文章《Qwen3.8-27B 发布日期》的标题卡片,显示日历将2026年8月10日那一周标记为承诺的发布窗口,并带有“状态:待定”徽章,副标题注明2026年8月3日的公告,以及堆叠的模型层图形。
Guides & Insights

Qwen3.8-27B 发布日期:权重于8月14日发布

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

阿里巴巴于2026年8月14日晚间发布了Qwen3.8-27B的开源权重,并以Apache 2.0许可证将仓库上线至Hugging Face和ModelScope。至此,本博客自8月3日公告以来一直在追踪的发布日期问题得以尘埃落定,同时也带来了首个API可用性数据点:该模型于同一天在一个商业API市场上架。Qwen3.8-27B是Qwen3.8系列中的密集、可自托管成员——是阿里巴巴定位为对标2.4万亿参数旗舰模型Qwen3.8-Max的兄弟模型,也是广泛使用的Qwen3.6-27B的继任者。

8月14日的下跌证实了什么

Qwen3.8 系列于 2026 年 8 月 3 日发布。当天,混合专家旗舰模型 Qwen3.8-Max 正式上线并提供付费 API,阿里巴巴承诺"大约一周内"开源 Max 和较小的 Qwen3.8-27B 的权重。这一期限随后被延长,直到 ModelScope 的预告页面开始倒计时至 8 月 15 日午夜(日本时间 00:00),才有了确切日期。发布如期而至:北京时间 8 月 14 日晚,模型同时上架 Hugging Face 和 ModelScope。

已确认的规格如下:Qwen3.8-27B 是一个稠密的 270 亿参数模型,原生支持多模态(文本、图像、视频、图表、文档),拥有原生 262,000 token 的上下文窗口,可通过 YaRN 扩展至 100 万 token,并具备可配置的 reasoning_effort 模式,用于调整思考深度以节省计算资源。这些是发布材料中厂商声明的规格——现在可以直接在公开权重中核查,而不必仅凭信任接受。

在阿里巴巴自己的评测中,27B 超越了其前代产品,甚至超过了更大的 Qwen3.7-Plus:SWE-bench Pro 61.7(对比 Qwen3.6-27B 的 53.5)、智能体终端编码 73.0(对比 63.4)以及 JobBench 33.4(对比 21.8)。这些都是厂商报告的数据——目前还没有独立基准为 27B 发布分数,因此应将其视为社区现在将尝试复现的说法。

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

一个版本中的哪些层已经落地

对于开放权重模型而言,“发布”是分层的,各层之间相隔数天相继落地。原始权重是第一层——已于8月14日落地。推理框架支持是第二层:vLLM和SGLang通常在权重发布后数天内就会添加支持,这是模型已准备好提供服务而不仅仅是可供下载的信号。社区量化是第三层——GGUF和AWQ构建版本,以及随之而来的Ollama、LM Studio和llama.cpp一键命令路径,通常要晚一到两周。

所以,“我什么时候能拉取权重”的答案是:现在。“我什么时候能用一条命令运行它”这个问题,则由框架和量化层来回答,而这些仍在陆续推出中。

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

许可证问题已解决。

许可证是比日期更重要的开放问题,而这次发布解决了它。Qwen3.8-27B 以 Apache 2.0 协议发布——这是一个宽松许可证,没有用户数量上限,也没有商业讨论触发条件。此前有人担心 Qwen 的开放发布将采用通义千问许可证,其中包含 1 亿月活跃用户的条款,但这种担忧并未在 27B 模型上成为现实。这消除了从第一天起就将模型接入产品和智能体的主要法律障碍。

第一个 API 可用性数据点

{{1}}此次发布还生成了27B的首个API可用性数据点:权重发布后数小时内,该模型便作为一个活跃的服务端点出现在商业API市场上。{{/1}}该列表可独立验证——是第三方目录条目,而非供应商声明——这是首个证据,表明该模型不仅可下载,还可通过托管API进行部署。

这就是 OrcaRouter 在成本计算中的用武之地。目前该系列中可路由的成员是 Qwen3.8-Max,通过 OrcaRouter 以供应商挂牌价提供服务——每百万输入 token 2.00 美元,每百万输出 token 6.00 美元,零加价,因此供应商自身的价格就是您支付的价格。一个 API 密钥即可覆盖它以及目录中的 200 多个模型,并具备自动故障转移功能。当 Qwen3.8-27B 在路由器上赢得一席之地时,同一个密钥将路由到它;在此之前,Apache 2.0 权重可免费自行托管以进行评估。

接下来要验证什么

这次发布回答了日期问题,但尚未回答质量问题。未来几周有三件事值得关注:

• 推理框架支持 — vLLM 和 SGLang 的拉取请求中命名了 Qwen3.8-27B,这一信号表明该模型已准备好进行大规模服务,而不仅仅是能直接从仓库运行。

• 社区量化与真实 VRAM 实测数据 —— Unsloth 等工具通常会在数天内发布 GGUF 构建及实测内存数据,将预发布预估转化为可直接用于部署的参考数字。

• 独立基准测试——当27B的Artificial Analysis和LMArena评分公布后,这些分数才应驱动生产决策,而不是阿里巴巴自己的评估。

你今天可以使用的内容

Qwen3.8-27B 现已开放下载——这正是 Apache 2.0 发布的意义所在。对于希望在托管 API 上基于该代模型进行构建的团队,Qwen3.8-Max 已在 OrcaRouter 上线,按供应商标价计费(每百万输入 token 2.00 美元,每百万输出 token 6.00 美元,零加价),支持自动故障转移,且整个目录只需一个密钥。在独立基准测试确认供应商评分之前,自行托管 27B 权重进行评估是低风险的切入方式。

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

发布日期的问题已经尘埃落定:Qwen3.8-27B 于 2026 年 8 月 14 日以 Apache 2.0 许可证发布,原生支持 262K 上下文窗口,并且同一天就有 API 可用性的数据点。剩下的问题是可衡量的——它的服务表现如何,量化效果如何,以及独立评测能否复现阿里的分数。在押注生产路径之前,先阅读许可证、拉取权重,并等待框架支持和社区构建。