
Qwen3.8-Max 评测:阿里巴巴以 2.4T 开源权重押注前沿编码
- meta新Meta: Muse Spark 1.12026-07-1651智能71代码
- kimi新MoonshotAI: Kimi K32026-07-1557智能76代码
- openai新OpenAI: GPT-5.6 Luna2026-07-0951智能71代码
- openai新OpenAI: GPT-5.6 Terra2026-07-0955智能77代码
- openai新OpenAI: GPT-5.6 Sol2026-07-0959智能77代码
- grok新xAI: Grok 4.52026-07-0854智能72代码
- tencentTencent: Hy32026-07-0641智能59代码
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42代码
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39代码
- anthropicAnthropic: Claude Sonnet 52026-06-3053智能72代码
- klingKling: Kling 3.0 Turbo2026-06-1757智能52代码57数学
- z-aiZ.ai: GLM 5.22026-06-1651智能69代码60数学
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242智能61代码61数学
- anthropicAnthropic: Claude Fable 52026-06-0960智能77代码
- qwenQwen: Qwen3.7 Plus2026-06-0139智能56代码59数学
- minimaxMiniMax: MiniMax M32026-05-3144智能59代码59数学
- AnthropicAnthropic: Claude Opus 4.82026-05-2856智能74代码68数学
- GoogleGemini 3.5 Flash2026-05-2350智能70代码51数学
- qwenQwen3.7 Max2026-05-2246智能66代码71数学
- qwenQwen3.7 Max (2026-05-20)2026-05-2046智能66代码73数学
阿里巴巴通义千问于2026年7月19日预览了Qwen3.8-Max,此次发布异常激进:一个2.4T参数的基座模型,率先通过Qwen和Qoder渠道上线,官方口径将其置于当前模型栈的顶端附近。
这篇评测回答了团队真正关心的问题:Qwen3.8-Max 是否准备好影响你今天的编码、代理和办公效率工作流,还是它仍然只是一个需要等到权重、公开API定价和独立基准测试发布后才能有定论的观望模型?

快速裁决
考虑一下Qwen3.8-Max,如果你...
已经使用Qoder或Qwen Chat,并希望首批获得阿里巴巴最新旗舰模型的使用权限。
构建编程智能体、全栈开发工作流、数据分析副驾驶,或者Qwen表示新模型改进最大的Office/Cowork自动化。
关注开源权重,但可以稍等片刻:{{1}}阿里巴巴推出的公告{{/1}}表示权重即将推出,并非今日便可获取。
想要测试阿里巴巴定位为接近前沿、仅次于Claude Fable 5的模型,同时将该说法视为供应商宣传,直至第三方基准测试结果出炉。
如果你……,就请推迟(或保持当前的生产默认设置)。
今天需要自托管。预览版已上线,但在撰写本文时,开放权重尚未发布。
需要一份清晰的公共API价格表。Qoder有一个启动积分活动;这与标准的按token计费的API定价不同。
运行高风险的生产代理,并在更改路由逻辑之前需要独立的基准测试复制。
今天需要确认的网关列表。Qwen3.8-Max 目前是预览通道;更广泛的提供商可用性可能滞后。
Qwen3.8-Max是什么?
Qwen3.8-Max-Preview 是阿里巴巴Qwen系列中最新款的旗舰模型。Qoder的官方发布页面将其描述为一个2.4T参数的基础模型,并表示它在编程和专业生产力方面相比Qwen3.7-Max有所提升,包括全栈开发、数据分析和Office工作流等复杂长周期任务。
重要的词是预览。Qwen3.8-Max在更广泛的发布故事完成之前,通过Qwen和Qoder访问路径即可看到。这使得它对于早期测试令人兴奋,但对于生产采购则危险在于过度强调。

Qwen3.8-Max 有什么新功能?
2.4T参数规模升级。主要规格就是规模。拥有2.4万亿参数,Qwen3.8-Max的定位远高于早期开源的Qwen3旗舰系列,明确属于超大规模前沿模型范畴。
一次关于编程和协同办公的推广。Qoder官方宣传强调编程和专业生产力,而非泛泛的聊天。这一框架很重要:阿里巴巴将Qwen3.8-Max定位为面向开发者工作流、数据处理和办公自动化的模型。
长周期任务定位。该模型的描述围绕复杂的全栈开发、数据分析和Office工作流——这些任务需要模型维持状态、使用工具、修订计划,并在多个步骤中保持输出结构化。
在权重之前进行预览访问。 发布模式是产品优先,权重其次。这使用户能够立即在Qwen和Qoder中测试行为,而开放权重的承诺仍然是尚未解决的主要发布里程碑。
一项奖励测试的发布活动。Qoder的活动将于2026年7月19日开始,其中Qwen3.8-Max-Preview可享受90%的Credits折扣,另有一项夜间优惠,广告宣传可低至98%的折扣。对于早期用户,其经济设计使得大量评估变得廉价。

定价与获取:实际费用
目前还没有公开的每 token 标准定价方案。具体的发布经济模型在 Qoder 中:符合条件的 Pro、Pro+、Ultra、Pro Trial、Teams 和 Enterprise 用户可使用 Qwen3.8-Max-Preview,享有 Credits 消耗降低 90% 的优惠,系数从 0.5x 降至 0.05x。Qoder 还宣传夜间费率最高可享 98% 折扣。
那是一个慷慨的预览活动,而非已确定的API价格表。如果你正在为产品做预算,请暂时将Qwen3.8-Max视为评估渠道。如果你是Qoder用户,现在正是在发布折扣期间进行昂贵编码和生产力测试的绝佳时机。

评分
下面的评分是我们基于阿里巴巴/Qoder发布的发布信息以及目前缺乏独立基准测试结果所做的编辑评估。请将其视为一份预览评分卡,而非最终的基准测试结论。
编码:9/10 - 该模型明确针对编码和全栈开发,但第三方复现仍在等待中。
自主/长期工作:8/10 - 定位很强;公开证据仍然薄弱。
专业生产力/协同工作:9/10 - 这是该产品发布中最清晰的目标方向之一。
推理:8/10 —— 鉴于 Max 的定位,很可能很强,但是还没有独立的数据表。
成本效益:在Qoder活动期间为8/10,长期API定价未知。
开放性:8/10——如果承诺的权重很快发布,则评分高;在可实际下载之前,评分较低。
总体评分:约8.4/10 - 一个严肃的预览模型,其上升潜力大于确定性。

优点
庞大的2.4T参数规模及明确的旗舰定位。
启动信息聚焦于实际工作——编码、数据分析、全栈开发和Office工作流——而不仅仅是聊天演示。
通过Qwen/Qoder渠道,立即可以预览访问。
Qoder的发布活动使得大量测试对符合条件的用户来说异常便宜。
开放权重的承诺使得该模型相比封闭的仅预览发布具有更大的战略优势。
缺点
权重很快会发布,但在撰写本文时尚未提供。
目前尚无独立的基准测试套件能定论其质量表现。
启动材料中未提供清晰的公共API价格表、速率限制说明或生产环境SLA。
与Claude Fable 5的供应商比较是有用的定位,而非证据。
通过Qoder的预览访问对开发者来说很棒,但这与广泛的生产可用性不是一回事。
Qwen3.8-Max 的比较
vs Qwen3.7-Max。这是预期的升级路径。Qoder 表示,Qwen3.8-Max 在编码和专业生产力方面相比 Qwen3.7-Max 有显著提升。如果您的工作流已经偏好 Qwen3.7-Max,那么该预览版值得立即测试。
vs GLM-5.2。GLM-5.2 如今拥有更清晰的生产故事:开放权重、已公布定价和基准测试表。Qwen3.8-Max 规模更大,发布声明也更具野心,但在它取代 GLM-5.2 成为明显的开放权重生产默认选择之前,还需要权重和独立评估。
vs DeepSeek V4。DeepSeek V4 仍然是价值的参考点:便宜、开放、易于评估。Qwen3.8-Max 的目标更高,侧重于编码和生产力质量,而不一定是原始单位成本。
与Claude Fable 5及封闭前沿模型相比,阿里巴巴的X消息将Qwen3.8描述为接近前沿水平,仅落后于Fable 5。如果这一说法成立,Qwen3.8-Max将成为2026年最重要的开放权重故事之一。在那之前,Fable 5和其他封闭旗舰模型仍是要求最高的付费生产工作中更安全的选择。

谁应该使用Qwen3.8-Max?
拥有编码密集型工作流程并能够利用发布时Credits折扣的Qoder用户。
开发工具团队在广泛发布前测试下一代开放权重代码模型。
AI生产力团队正在构建数据分析、办公流程和长文档自动化。
研究人员和模型评估者正在为即将发布的权重准备基准测试框架。
谁应该等待?
今天需要可下载权重的团队。
需要在评估之前获得稳定的公共API定价和企业级SLA的采购团队。
已经在GLM-5.2、DeepSeek V4、Claude或其他提供商上稳定运行的产品,缺乏进行预览迁移的带宽。
Qwen3.8-Max 值得吗?
是的,用于测试。对于Qoder用户来说,新的2.4T旗舰产品与大幅的Credits折扣相结合,正是你应该利用的机会窗口:运行你的真实代码库、真实文档、真实数据分析任务,并与你当前的默认设置进行比较。
用于生产替换,还不是时候。正确的态度是兴奋但克制:现在评估,之后谨慎路由,并等待权重和独立基准测试,然后再围绕它重写你的模型策略。
最终裁决
Qwen3.8-Max 是 2026 年最重要的预览版本之一:规模庞大、以编程/生产力为目标、提供折扣实操访问权限,并明确承诺开源权重。我们的预览评分约为 8.4/10。潜力巨大,但最终评判取决于接下来的发展——权重、基准测试、API 定价以及实际智能体表现。
使用 Qwen3.8-Max 通过 OrcaRouter
明智的生产策略不是在预览版发布当天就把所有筹码押在一个模型上。将稳定的流量保留在经证实的模型上,在活动期间在 Qoder 中测试 Qwen3.8-Max,并在更广泛的提供商访问或权重使路由变得可行后,将其添加为专用的编码/生产力通道。
这就是路由器发挥作用的地方。借助OrcaRouter,团队可以将GLM、DeepSeek、Claude、GPT、Gemini等模型统一放在一个兼容OpenAI的端点后面,然后在模型从预览版升级到正式版时灵活接入新通道。对于Qwen3.8-Max,应同样采取这种方式:尽早评估,审慎路由,并保留备用方案。

常见问题
Qwen3.8-Max现在可用了吗?
是的,处于预览状态。阿里巴巴Qwen的发布信息将用户引导至Qwen Chat、Qwen App和Qoder Token Plan。Qoder的活动页面将Qwen3.8-Max-Preview列为模型层级。
Qwen3.8-Max 有多少个参数?
Qoder的官方发布页面将Qwen3.8-Max-Preview描述为一个2.4T参数的基础模型。
Qwen3.8-Max的权重是否开源?
撰写时尚未发布。阿里巴巴的发布信息称权重即将推出,因此正确的表述是“开源权重承诺即将发布”,而非“今日可下载”。
Qwen3.8-Max 的价格是多少?
目前还没有标准的公开API价格表。具体的发布优惠是Qoder的积分活动:符合条件的用户使用Qwen3.8-Max-Preview可享受90%折扣,夜间优惠号称最高可达98%折扣。
Qwen3.8-Max 比 Qwen3.7-Max 更好吗?
阿里巴巴/Qoder声称,与Qwen3.7-Max相比,它显著提高了编码和专业生产力。在独立基准测试结果公布之前,将此视为供应商宣称。
Qwen3.8-Max比GLM-5.2更好吗?
现在说还为时过早。GLM-5.2今天已经公开了权重、定价和发布的基准测试。Qwen3.8-Max拥有更惊人的规模和预览势头,但仍需要公开权重和第三方测试。
我能自己托管 Qwen3.8-Max 吗?
尚未。权重文件已承诺很快提供,但即使到了,一个2.4T参数的模型也将是一个严重的基础设施项目,而不是一个随意的本地安装。
我可以通过OrcaRouter使用Qwen3.8-Max吗?
截至撰写本文时,尚未确认OrcaRouter Qwen3.8-Max的上市信息。请为当前生产模型组合使用OrcaRouter,并在网关访问或开放权重使其可行后尽快添加Qwen3.8-Max。
我今天应该切换生产工作负载吗?
不要全面铺开。如果你有Qoder的访问权限,就积极测试,但在权重、定价、基准测试和可靠性数据更加明确之前,请将生产流量保持在经过验证的路径上。
准备好保持你的模型堆栈灵活了吗?
将今天的生产流量通过OrcaRouter运行,在预览窗口处于活动状态时测试Qwen3.8-Max,并且仅在证据跟上炒作时才添加新通道。
