
GPT-6 Sol 与 Qwen 4 Max:输入价格持平,其他几乎所有方面都毫无可比性
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
下面这个数字,让GPT-6 Sol与Qwen 4 Max这一组合值得单独占一页:两者的标价都是每百万输入 token 2.00 美元。这也是这场对比中真正可用的部分的起点,而对 Qwen 4 Max 来说,几乎也就是终点。该公司于 2026 年 9 月 22 日在云栖大会上发布了 Qwen 4 Max 这一档位——与 GPT-6 Sol 发布是同一天——而截至本文撰写时,它还没有公开的模型卡:没有价格、没有上下文窗口、没有权重说明,也没有任何评测方给出的分数。真正有实测数据、并且今天就能调用的 Qwen 旗舰,是Qwen3.8 Max,于 2026 年 8 月 3 日发布,价格为 2.00 / 6.00 美元。所以,实际的问题并不是 Qwen 4 Max 相对 GPT-6 Sol 的表现如何,而是这个已公布的档位告诉你该公司旗舰正走向何方,以及你实际能路由调用的 Qwen 相对今天的 GPT-6 模型表现如何。
这个区别并非吹毛求疵。一个已经公布、但尚未明确规格的层级,可以容纳你想对它做出的任何假设;而一篇文章若悄悄假定 Qwen 4 Max 胜过 GPT-6 Sol——仅仅因为版本号更高——那它就是在提出一个厂商并未提出、证据也并不支持的论点。
目前可比较的三件事
• 输入价格 — GPT-6 Sol 每百万 $2.00,Qwen3.8 Max 每百万 $2.00,完全持平
• 输出价格 — GPT-6 Sol 每百万 $10.00,Qwen3.8 Max 每百万 $6.00
• 缓存输入 — GPT-6 Sol 每百万 $0.20,Qwen3.8 Max 每百万 $0.25
• 上下文窗口 — GPT-6 Sol 1,050,000 个 token,Qwen3.8 Max 1,000,000 个 token
• 输入模态 — 两者均支持文本、图像以及视频或文件;GPT-6 Sol 支持文本、图像和文件,Qwen3.8 Max 支持文本、图像和视频
• 长请求阶梯 — 当输入超过 272,000 个 token 时,GPT-6 Sol 会将整个请求重新定价为 $4.00 / $15.00,而 Qwen3.8 Max 的价目卡上没有阶梯价格
• 智能指数 — GPT-6 Sol 47.6,Qwen3.8 Max 45.4
• 编程指数 — GPT-6 Sol 在本修订版中未公布,Qwen3.8 Max 76.2
• GPQA Diamond — GPT-6 Sol 96.1,Qwen3.8 Max 92.8
• Terminal-Bench 4.0 — GPT-6 Sol 43.9,Qwen3.8 Max 38.9
其中有两行值得反复琢磨。缓存输入那一行与这一规律相悖——Qwen3.8 Max 每百万缓存读取的收费比 GPT-6 Sol 高五美分,而在缓存密集型的智能体循环中,这恰恰是最先变动的计价项。而长请求条款,正是输入价格上的平局被彻底打破的地方:在输入价恰好为 $2.00 时,两者看起来可以互换,直到提示词超过 272,000 个 token,此时 GPT-6 Sol 的整次请求会重新定价为 $4.00 / $15.00,而 Qwen3.8 Max 的价目表上则完全没有与之对应的阶梯。在满上下文提示词下,这家公司的模型不只是输出更便宜。它是两者中唯一一个,其公布费率仍能从标题价预测出来的模型。
两件不可相提并论的事,以及为什么这一区别很重要
首先是 Qwen 4 Max 的能力。公司把它呈现为产品线中的一个层级,而不是一款产品:没有基准测试表,没有上下文长度数据,没有关于权重的说明,没有费率。所有关于它将如何表现的内容,都是从 Qwen 系列的发展轨迹作出的推测,包括这句话。唯一清晰可辨的是目标——它所取代的层级,以及这个后继者被打造来超越的模型——而这告诉你的是行进方向,而不是终点。
第二个是开放权重的问题,也是最值得在你围绕 Qwen 4 Max 部署做规划之前提出来的一点。该公司只公开 Qwen 家族中部分模型的权重,另一些则不公开。旗舰模型 Qwen3.8 Max 被列为闭源 API 模型——没有许可证文件,也没有可下载的检查点——尽管同一代中较小的同门模型是公开的。4 系列旗舰究竟会跟随较小的同门模型,还是保持闭源,目前尚无答案;如果团队基于开放权重的预期来制定自托管方案,那就是在押注一个当前旗舰并未树立的先例。
真正跑起来的对比是 GPT-6 Sol 对阵 Qwen3.8 Max,而它比代际编号所暗示的要接近得多:在 Intelligence Index 上是 47.6 对 45.4,两个数字都是同一修订版上的第三方数据,GPQA Diamond 则是实打实的 96.1 对 92.8。在输出价格仅为四分之三的情况下,2.2 点的指数差距已是这场对决现有版本中最接近的一种,在公司为 4 系列发布任何东西之前,这正是应当作为推理依据的那一个。

该公告本身是什么的证据
一个已宣布但未说明具体规格的档位并不是空洞的信号。它告诉你,该公司打算让其下一款旗舰位居产品线顶端,并且愿意在它尚未准备好之前就公开命名;这是沟通习惯上的变化,而不是能力上的宣示。它还设定了倒计时:9月宣布的一个档位会让人预期出现一个出货窗口,而从宣布到规格公布之间的空档,通常正是竞争定位发生的地方。
对于任何目前正在使用 Qwen3.8 Max 的人来说,实际后果是:这次迁移将是一个能力问题,而不是成本问题。Qwen 4 Max 正在打造以取代的那一档,价格已经是 $2.00 / $6.00,而继任者必须击败一个得分为 45.4、同时输出成本比 GPT-6 Sol 低三分之一的模型。它是否也能缩小与 47.6 的差距——以及在什么日期——才是唯一值得关注的事,而公告中没有任何内容能回答这一点。

路由一个尚不存在的模型
这场对话中的两个 Qwen 模型中,只有一个在我们的目录里,而且它不是 4。Qwen3.8 Max 通过 OrcaRouter 路由,模型 id 为 qwen/qwen3.8-max,与 GPT-6 Sol 一样,位于 200+ 个模型之中,而它的价值恰恰就在于此:当公司发布时,这是一条路由,而不是一个集成项目。Qwen 4 Max 会在有东西可路由时——一张卡、一个费率、一个端点——才会被加入,而且不会提前,因为没有任何负责任的方式,能依据一份尚未写出的规范去卖一个席位。
与此同时,保留两列的理由在于,两个模型在“哪里便宜”上意见不一。Qwen3.8 Max 在输入价格上毫不让步,却把 GPT-6 Sol 的输出费率砍掉三分之一,而且没有长上下文断崖;GPT-6 Sol 则拥有略微更好的指数,以及丰厚得多的缓存输入折扣,代价是请求超过 272,000 个 token 后整单重新计价。耗时长、输出密集的工作负载与短小、对缓存友好的工作负载想要的是不同答案,而两者之间只差一条路由规则,而非两场采购谈判。
故障转移在这里之所以重要,原因与这组特定搭配有关。Qwen3.8 Max 在我们各条路由上是一款高流量模型——七天窗口内超过 1.1 亿个 token——而流量正是让端点差异暴露出来的东西。它后面再配置一条路由,意味着主路由性能下降时只需重试;而公司价目卡上的费率变动——恰恰是旗舰模型换代所引发的那类事件——当天就会在我们这边生效,因为我们的目录直接透传供应商的标价,不加任何加价。

这个月,拿这个怎么办
如果你现在就需要一款 Qwen 旗舰,那该找的就是 Qwen3.8 Max,而且在推理上它能与 GPT-6 Sol 一较高下,输出价格却明显更低——这就是当下这场对决的诚实状况。如果你想要的是这一对当中推理基准上已公布的最强成绩,那么 GPT-6 Sol 的 47.6 就是那个数字,而且它的缓存输入折扣是本次比较中最便宜的。如果你在等 Qwen 4 Max,那就等一张卡,而不是等一个日期,因为那次公告只给了你档位,别的什么都没给。
无论你选择哪一个,在最终决定之前都要先核查 GPT-6 那边的情况。GPT-6 Sol 已被 GPT-6.1 Sol 取代,价格同为 $2.00 / $10.00,缓存输入价格减半至 $0.10,而它自己的模型页面现在也会把读者重定向到后者。拿 GPT-6 Sol 做对比,就是拿一个后继者已在售的模型做对比;同样的告诫也适用于任何源自 4 Max 发布公告的 Qwen 数字:两者都只是新闻层面的说法,而目前其中只有一个是可购买的产品。
本文中的对比2
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
