Solar Pro 4 与 Qwen 3.8 Max 的 Hero 卡片,将 Upstage 的 Solar Pro 4(2026年8月10日)与阿里巴巴的 Qwen 3.8 Max(2026年8月3日)进行对比,标题对比为每 1M 输入 $0.03 对 $2.00。
Guides & Insights

Solar Pro 4 对决 Qwen 3.8 Max:0.03美元的Agent 对阵 阿里的2.4T开源豪赌

作者

Jim Song

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

2026年8月3日当周,阿里巴巴发布了Qwen 3.8 Max,一个2.4万亿参数的稀疏MoE模型,在Arena排行榜上全球排名第二,在Artificial Analysis的编程指数上排名第12,输入每百万token收费2.00美元,输出每百万token收费6.00美元。七天后,Upstage发布了Solar Pro 4,一款闭源权重的智能体旗舰模型,定价为0.03美元和0.12美元。两者都作为面向长程、多步骤工作而构建的“智能体”模型进行营销。一个是2026年中国夏季最强的开源权重作品,另一个是2026年最便宜的商业“智能体模型”标签。它们实际上并不是在能力上竞争,而是在竞争开发者在花费第一个token之前可以对模型做出何种假设。

两次发射,两个假设

Qwen 3.8 Max 于8月3日走出阿里巴巴实验室,具备前沿发布的各种特征:2.4T总参数(每个token约95B激活参数)、1M token上下文、原生文本-图像-视频输入、Arena排名第二,以及经审计的 Artificial Analysis Intelligence Index 为58。从独立证据来看,它处于全球开源权重模型的顶级行列。阿里巴巴已表示将遵循 Qwen 的模式发布权重,这将使其成为首个开源的最大级(Max-class)Qwen。从前沿标准来看,这些都不便宜——$2/$6——但相对于专有前沿模型来说,它还算便宜。

Solar Pro 4 于8月10日发布,基于一组不同的假设。Upstage 的发布资料描述了其在长文档推理、多轮工具调用和终端任务性能上相对于 Solar Pro 3 的改进,但未披露参数数量,也没有独立基准测试。其全部差异化优势在于价格:$0.03/$0.12 的输入价格比 Qwen 3.8 Max 便宜约66倍,输出价格便宜约50倍。Qwen 3.8 Max 让你相信的是一个拥有审计分数的2.4T模型,而 Solar Pro 4 让你相信的只是一个价格。

Screenshot of the Upstage Console models page showing the banner 'Solar Pro 4 is live. Free through August 10'.

记分牌,如实解读。

• 智能指数 — Qwen 3.8 Max:58(AA,经审计);Solar Pro 4:无公开数据

• 编码指数 — Qwen 3.8 Max:71.8(126个中排名第12,AA);Solar Pro 4:尚未评测

• 上下文 — Qwen 3.8 Max:1M tokens;Solar Pro 4:524K

• 输入模态 — Qwen 3.8 Max:文本、图像、视频;Solar Pro 4:以文本为主

• 权重 — Qwen 3.8 Max:承诺开放发布;Solar Pro 4:闭源

• 价格 — Qwen 3.8 Max:$2.00/$6.00 每 1M;Solar Pro 4:$0.03/$0.12 每 1M

Comparison scoreboard for Solar Pro 4 and Qwen 3.8 Max: price $0.03/$0.12 vs $2.00/$6.00, context 524K vs 1M, parameters undisclosed vs 2.4T (~95B active), independent score none vs AA Index 58, coding not yet measured vs AA Coding 71.8 (#12), input modalities text vs text+image+video, with footer noting Solar Pro 4 figures are launch-listed and unaudited while Qwen 3.8 Max is per Artificial Analysis and Alibaba.

这种不对称性是显而易见的,而且这不是Solar Pro 4的错。Qwen 3.8 Max自8月3日起就可以被测量;Solar Pro 4自8月10日起才可以被测量。一个未经测量的模型并不是一个糟糕的模型——它只是一个未经测量的模型。但就目前这一具体比较而言,这是“经审计的证据”对阵“发布价格声明”,而诚实解读任何正面交锋的方式,就是明确说出这一点。

100倍的差距实际上买到了什么

这里值得关注的数据不是每token的价格,而是这个价格在架构层面解锁了什么。按照Solar Pro 4的定价,在代理循环的每一轮中把完整的50万token文档集留在上下文里,不再是一个成本决策。用三种不同的temperature运行同一个提示词并保留最佳结果——这是经典的廉价模型技巧——现在几乎等于免费。这是一种真正不同的开发姿态:你以计算资源近乎免费为前提来设计,就像当年团队对待第一批GPT-3.5级别的廉价模型那样。

代价在于,你是在把一个生产工作负载押注在一个未经证实的质量声明上。Qwen 3.8 Max 的 58 智能指数和 #2 Arena 排名并非全部真相——阿里巴巴自己的基准测试套件中包含的内部数据,应同样被视为供应商自报数据——但它们毕竟代表了一些东西。Solar Pro 4 目前还没有任何此类数据。如果它的质量与 Qwen 相近,那它就是市面上最划算的选择。如果不是,那么 0.03 美元的价格恰恰会说明它为什么只值 0.03 美元。

Screenshot of the OrcaRouter model page for Qwen 3.8 Max showing the $2.00/$6.00 per-1M zero-markup pricing and Artificial Analysis benchmark scores.

开放权重的分叉版本

这就是两款模型在结构上分道扬镳的地方,也是六个月后将决定这场对决胜负的关键。Qwen 3.8 Max 的开放发布一旦落地,它就成为一种可部署的资产:可以自行托管、微调、以边际成本提供服务,数据也留在自己的硬件上。Solar Pro 4 永远不会如此——闭源就是闭源。对于有数据驻留要求或长期成本曲线的企业来说,“Qwen 3.8 Max 最终可以部署在你自己集群里”是一种任何按 token 计价都无法匹敌的战略选项。

对于今天只是想调用一个模型的团队来说,这个开放性问题只是理论层面的。两者都位于兼容 OpenAI 的 API 之后,也都可通过厂商自有 API 及多个第三方平台获取。路由的答案——一个 API 覆盖 200 多个模型,提供商列表价格零加价直通,自动故障转移——让你可以将其视为成本图谱而非忠诚度决策:廉价的大批量流量导向 $0.03 模型,高风险的推理任务导向 Qwen 3.8 Max,再用路由 DSL 来规定哪些工作负载该去往何处。

底线

Qwen 3.8 Max 是更好的模型,证据更充分的模型,也是未来可为你所有的模型。Solar Pro 4 的价格则便宜两个数量级,但须诚实地标注星号:其质量声明截至本周尚未得到复现。如果你的工作负载需要经审计的前沿性能,那就为 Qwen 3.8 Max 付费。如果你的工作负载受容量限制且能容忍故障,0.03 美元的智能体才是理性之选——待首批独立的 Solar Pro 4 数据出炉时再复核,届时这场比较也将从苹果与橙子的对比变成真正的选择。

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

联系我们

加入我们的社区

DiscordEmailXGitHubYouTube