
Qwen3.8-27B 发布日期:目前我们所知的一切
- deepseek新DeepSeek: DeepSeek V4 Pro 08132026-08-12$0.44 / $0.88 每百万 tokens · 72 tok/s
- grok新SpaceXAI: Grok 4.62026-08-1261智能77代码
- meta新Meta: Muse Spark 1.22026-08-0557智能72代码
- qwen新Qwen: Qwen3.8 Max2026-08-0358智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens · 2304 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- metaMeta: Muse Spark 1.12026-07-1653智能71代码
- kimiMoonshotAI: Kimi K32026-07-1560智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71代码
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77代码
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77代码
- grokxAI: Grok 4.52026-07-0856智能72代码
- tencentTencent: Hy32026-07-0642智能59代码
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42代码
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39代码
Alibaba承诺在2026年8月10日那一周发布Qwen3.8-27B的开放权重,但那个窗口期已过。如今,这次延期有了一个具体的目标:根据PC Watch 8月13日对预告的报道,ModelScope上的官方Qwen页面正在倒计时,指向2026年8月15日午夜——日本标准时间(JST)00:00。截至今天,Hugging Face上的官方Qwen组织下仍未出现这些权重,但自8月3日公告以来,发布日期的问题首次有了答案。以下是已确认的内容、仍未证实的内容,以及值得关注的要点。
什么是已确认的?
阿里巴巴于2026年8月3日发布了{{1}}Qwen3.8{{/1}}系列。当天发生了两件事:{{2}}Qwen3.8-Max{{/2}}——2.4万亿参数的混合专家旗舰模型——正式上线并提供付费API;同时,阿里巴巴承诺将在{{3}}“大约一周内”{{/3}}开源Max和较小的Qwen3.8-27B的权重。多家独立媒体(36Kr、TrendForce、C114)都报道了同样的承诺:{{4}}Hugging Face和ModelScope,8月10日那一周。{{/4}}
27B 是这一代中可自托管的成员——阿里巴巴将其定位为面向单 GPU 和本地部署工作的规模,是广泛使用的 Qwen3.6-27B 的直接继任者。这一血统很重要。Qwen3.6-27B 成为同代中最受欢迎的本地编码模型之一,3.8 版本继承了既有用户群的那些问题:运行成本多少?智能体能力更强吗?什么时候能拉取?
今天可以独立验证的是旗舰机型,而这现在包括了开放权重。Qwen3.8-Max 已在 API 上线,其代码仓库——Qwen3.8-2.4T-A95B(完整 BF16)和官方 FP8 量化版本——于 8 月 10 日那一周在 Hugging Face 上的官方 Qwen 组织下发布,这是阿里巴巴首次开源 Max 级旗舰机型。它也已被评分:Artificial Analysis 将其智能指数评为 58,这是中国实验室在该榜单上最接近榜首的一次;其编程指数为 71.8,价格则是每百万输入 token 2.00 美元,每百万输出 token 6.00 美元。

对于一个开放权重模型来说,"发布"实际上是什么样子
关于闭源模型的日期问题很简单——API 一上线就有了。对于开放权重模型,“发布”是有层次的,每个层次相隔数天落地:
原始权重以 Hugging Face 和 ModelScope 仓库的形式提供,其中包含模型卡和 LICENSE 文件。
推理框架也随之跟进——vLLM 和 SGLang 预计将在几天内添加支持,这表明一个模型已经准备好投入服务,而不仅仅是可供下载。
社区量化版本(GGUF、AWQ)通常会滞后一到两周,而正是在这个时候,Ollama、LM Studio 和 llama.cpp 的用户才能真正拉取并运行它。
所以,如果问题是“我什么时候能下载权重”,答案就是官方 Qwen 组织下出现一个仓库。如果问题是“我什么时候能用一条命令运行它”,那就要再加上一到两周。8月3日所作承诺针对的是前者,目标时间是8月10日那一周——而这一步现在已经落地到这一代中的一个成员:Qwen3.8-2.4T-A95B 在那一周上传到了 Hugging Face。至于 27B,它仍未出现在 Hugging Face 上——但 ModelScope 的倒计时现在已经给出了目标时间:2026年8月15日 00:00 JST。
什么仍然未经验证
在代码仓库发布之前,关于27B的其他一切都只是推测。不要因为有言之凿凿的报道,就把预测当作规格——以下内容在撰写本文时均未得到证实:
• 架构 — 密集或专家混合,以及MoE情况下的活跃参数数量。
• 上下文窗口、输出限制,以及它是仅支持文本还是多模态。据 PC Watch 报道,ModelScope 的预告中描述了面向图像和视频的原生多模态与多语言支持——这些是预告中的厂商声明,在权重发布之前仍未经证实。
• 许可证。Apache 2.0 并非安全假设;近期 Qwen 开源版本以 Tongyi Qianwen 许可证发布,该许可证包含一项每月活跃用户超过 1 亿的条款,超过该阈值将引发商业讨论。
• 任何基准测试分数。关于3.8代流传的每一个数字都是供应商为Max报告的;27B完全没有公开的评估。
• 精确的量化大小。流传的 VRAM 数值是从 Qwen3.6-27B 沿用的预估数据,而非 3.8 模型的实际测量值。

为什么许可证比日期更重要
发布日期决定你何时可以开始测试。许可证决定你是否可以发布。在 Tongyi Qianwen 许可证下的 Qwen 模型,在月活跃用户低于 1 亿时可免费使用——超过这个数字,你需要商讨商业条款。对于团队将集成到产品和智能体中的本地模型,这个门槛的到来可能比听起来更快。在仓库中,第一个要打开的文件是 LICENSE,然后才是模型卡和 README。
如何赶在博客文章之前捕捉到下降
Hugging Face 上的官方 Qwen 组织就是最可靠的依据——当名为 Qwen3.8-27B 的仓库出现在那里或 ModelScope 上时,就意味着发布已经发生。这一机制本周已得到验证:Qwen3.8-2.4T-A95B 及其 FP8 版本正是以这种方式出现在该组织下的,因此 27B 仓库的出现同样不会认错。在 ModelScope 上,Qwen3.8-27B 的倒计时页面已经上线,指向 8 月 15 日午夜——这是迄今为止最接近官方日期的信息。还有三个早期信号值得关注:
一个提及 Qwen3.8-27B 的 vLLM 或 SGLang 拉取请求。框架的拉取请求通常是权重发布的第一条公开痕迹,因为集成工作在仓库暂存的那一刻就开始了。
• Qwen团队自己的渠道(X、微信、qwen.ai博客),这些渠道往往会宣布发布本身。
• 社区量化工具 — Unsloth 等通常会在几天内发布量化文件和真实的 VRAM 测量结果,从而将上述预测转化为可测量的数字。
有一条警告始终适用:在官方组织发布之前,你能下载到的任何“Qwen3.8-27B”要么是占位符,要么是第三方上传。仅凭名称不足以保证真实性。
你今天可以使用的内容
27B 是值得等待的模型,但不是这一代唯一的选项。Qwen3.8-Max 现已上线——同样支持自行托管,因为其权重可下载——在 OrcaRouter 上按供应商列表价格计费:每百万输入 token 2.00 美元,每百万输出 token 6.00 美元,零加价,因此供应商自家定价页上的标价就是您实际支付的费用。一个密钥即可访问,待 27B 发布并在公开基准测试中赢得信任后,同一个密钥也会路由到该模型。对于希望在今天就基于这一代模型进行构建、同时保留日后自行托管 27B 选项的团队来说,这是锁定程度最低的路径。

简单总结:发布日期的答案比一周前更清晰了。阿里巴巴给出的窗口——2026年8月10日那一周——已经过去。它交付了旗舰模型的权重:Qwen3.8-2.4T-A95B 及其官方 FP8 量化现已上线 Hugging Face。它没有交付 27B 的权重——但如今这次延迟有了明确目标:ModelScope 的倒计时指向 2026年8月15日午夜(日本时间 00:00,据 PC Watch)。关注 Hugging Face 上的官方 Qwen 组织以及 ModelScope 上的 Qwen 页面,一旦 27B 仓库上线就立即阅读 LICENSE,在权重使其可测之前,将所有流传的规格和显存数字都视为预测。
