文章《Qwen3.8-27B 发布日期》的标题卡片,显示日历将2026年8月10日那一周标记为承诺的发布窗口,并带有“状态:待定”徽章,副标题注明2026年8月3日的公告,以及堆叠的模型层图形。
Guides & Insights

Qwen3.8-27B 发布日期:目前我们所知的一切

作者

Jim Song

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

Alibaba承诺在2026年8月10日那一周发布Qwen3.8-27B的开放权重,但那个窗口期已过。如今,这次延期有了一个具体的目标:根据PC Watch 8月13日对预告的报道,ModelScope上的官方Qwe​n页面正在倒计时,指向2026年8月15日午夜——日本标准时间(JST)00:00。截至今天,Hugging Face上的官方Qwe​n组织下仍未出现这些权重,但自8月3日公告以来,发布日期的问题首次有了答案。以下是已确认的内容、仍未证实的内容,以及值得关注的要点。

什么是已确认的?

阿里巴巴于2026年8月3日发布了{{1}}Qwe​n3.8{{/1}}系列。当天发生了两件事:{{2}}Qwen3.8-Max{{/2}}——2.4万亿参数的混合专家旗舰模型——正式上线并提供付费API;同时,阿里巴巴承诺将在{{3}}“大约一周内”{{/3}}开源Max和较小的Qwen3.8-27B的权重。多家独立媒体(36Kr、TrendForce、C114)都报道了同样的承诺:{{4}}Hugging Face和ModelScope,8月10日那一周。{{/4}}

27B 是这一代中可自托管的成员——阿里巴巴将其定位为面向单 GPU 和本地部署工作的规模,是广泛使用的 Qwen3.6-27B 的直接继任者。这一血统很重要。Qwen3.6-27B 成为同代中最受欢迎的本地编码模型之一,3.8 版本继承了既有用户群的那些问题:运行成本多少?智能体能力更强吗?什么时候能拉取?

今天可以独立验证的是旗舰机型,而这现在包括了开放权重。Qwen3.8-Max 已在 API 上线,其代码仓库——Qwen3.8-2.4T-A95B(完整 BF16)和官方 FP8 量化版本——于 8 月 10 日那一周在 Hugging Face 上的官方 Qwe​n 组织下发布,这是阿里巴巴首次开源 Max 级旗舰机型。它也已被评分:Artificial Analysis 将其智能指数评为 58,这是中国实验室在该榜单上最接近榜首的一次;其编程指数为 71.8,价格则是每百万输入 token 2.00 美元,每百万输出 token 6.00 美元。

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

对于一个开放权重模型来说,"发布"实际上是什么样子

关于闭源模型的日期问题很简单——API 一上线就有了。对于开放权重模型,“发布”是有层次的,每个层次相隔数天落地:

原始权重以 Hugging Face 和 ModelScope 仓库的形式提供,其中包含模型卡和 LICENSE 文件。

推理框架也随之跟进——vLLM 和 SGLang 预计将在几天内添加支持,这表明一个模型已经准备好投入服务,而不仅仅是可供下载。

社区量化版本(GGUF、AWQ)通常会滞后一到两周,而正是在这个时候,Ollama、LM Studio 和 llama.cpp 的用户才能真正拉取并运行它。

所以,如果问题是“我什么时候能下载权重”,答案就是官方 Qwen 组织下出现一个仓库。如果问题是“我什么时候能用一条命令运行它”,那就要再加上一到两周。8月3日所作承诺针对的是前者,目标时间是8月10日那一周——而这一步现在已经落地到这一代中的一个成员:Qwen3.8-2.4T-A95B 在那一周上传到了 Hugging Face。至于 27B,它仍未出现在 Hugging Face 上——但 ModelScope 的倒计时现在已经给出了目标时间:2026年8月15日 00:00 JST。

什么仍然未经验证

在代码仓库发布之前,关于27B的其他一切都只是推测。不要因为有言之凿凿的报道,就把预测当作规格——以下内容在撰写本文时均未得到证实:

• 架构 — 密集或专家混合,以及MoE情况下的活跃参数数量。

• 上下文窗口、输出限制,以及它是仅支持文本还是多模态。据 PC Watch 报道,ModelScope 的预告中描述了面向图像和视频的原生多模态与多语言支持——这些是预告中的厂商声明,在权重发布之前仍未经证实。

• 许可证。Apache 2.0 并非安全假设;近期 Qwen 开源版本以 Tongyi Qianwen 许可证发布,该许可证包含一项每月活跃用户超过 1 亿的条款,超过该阈值将引发商业讨论。

• 任何基准测试分数。关于3.8代流传的每一个数字都是供应商为Max报告的;27B完全没有公开的评估。

• 精确的量化大小。流传的 VRAM 数值是从 Qwen3.6-27B 沿用的预估数据,而非 3.8 模型的实际测量值。

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

为什么许可证比日期更重要

发布日期决定你何时可以开始测试。许可证决定你是否可以发布。在 Tongyi Qianwen 许可证下的 Qwe​n 模型,在月活跃用户低于 1 亿时可免费使用——超过这个数字,你需要商讨商业条款。对于团队将集成到产品和智能体中的本地模型,这个门槛的到来可能比听起来更快。在仓库中,第一个要打开的文件是 LICENSE,然后才是模型卡和 README。

如何赶在博客文章之前捕捉到下降

Hugging Face 上的官方 Qwen 组织就是最可靠的依据——当名为 Qwen3.8-27B 的仓库出现在那里或 ModelScope 上时,就意味着发布已经发生。这一机制本周已得到验证:Qwen3.8-2.4T-A95B 及其 FP8 版本正是以这种方式出现在该组织下的,因此 27B 仓库的出现同样不会认错。在 ModelScope 上,Qwen3.8-27B 的倒计时页面已经上线,指向 8 月 15 日午夜——这是迄今为止最接近官方日期的信息。还有三个早期信号值得关注:

一个提及 Qwen3.8-27B 的 vLLM 或 SGLang 拉取请求。框架的拉取请求通常是权重发布的第一条公开痕迹,因为集成工作在仓库暂存的那一刻就开始了。

• Qwen团队自己的渠道(X、微信、qwen.ai博客),这些渠道往往会宣布发布本身。

• 社区量化工具 — Unsloth 等通常会在几天内发布量化文件和真实的 VRAM 测量结果,从而将上述预测转化为可测量的数字。

有一条警告始终适用:在官方组织发布之前,你能下载到的任何“Qwen3.8-27B”要么是占位符,要么是第三方上传。仅凭名称不足以保证真实性。

你今天可以使用的内容

27B 是值得等待的模型,但不是这一代唯一的选项。Qwen3.8-Max 现已上线——同样支持自行托管,因为其权重可下载——在 OrcaRouter 上按供应商列表价格计费:每百万输入 token 2.00 美元,每百万输出 token 6.00 美元,零加价,因此供应商自家定价页上的标价就是您实际支付的费用。一个密钥即可访问,待 27B 发布并在公开基准测试中赢得信任后,同一个密钥也会路由到该模型。对于希望在今天就基于这一代模型进行构建、同时保留日后自行托管 27B 选项的团队来说,这是锁定程度最低的路径。

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

简单总结:发布日期的答案比一周前更清晰了。阿里巴巴给出的窗口——2026年8月10日那一周——已经过去。它交付了旗舰模型的权重:Qwen3.8-2.4T-A95B 及其官方 FP8 量化现已上线 Hugging Face。它没有交付 27B 的权重——但如今这次延迟有了明确目标:ModelScope 的倒计时指向 2026年8月15日午夜(日本时间 00:00,据 PC Watch)。关注 Hugging Face 上的官方 Qwe​n 组织以及 ModelScope 上的 Qwe​n 页面,一旦 27B 仓库上线就立即阅读 LICENSE,在权重使其可测之前,将所有流传的规格和显存数字都视为预测。

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

联系我们

加入我们的社区

DiscordEmailXGitHubYouTube