
Solar Pro 4 对决 Qwen 3.8 Max:0.03美元的Agent 对阵 阿里的2.4T开源豪赌
- meta新Meta: Muse Spark 1.22026-08-0557智能72代码
- qwen新Qwen: Qwen3.8 Max2026-08-0358智能72代码
- deepseek新DeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69代码
- minimax新MiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens · 2147 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- metaMeta: Muse Spark 1.12026-07-1653智能71代码
- kimiMoonshotAI: Kimi K32026-07-1560智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71代码
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77代码
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77代码
- grokxAI: Grok 4.52026-07-0856智能72代码
- tencentTencent: Hy32026-07-0642智能59代码
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42代码
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39代码
- anthropicAnthropic: Claude Sonnet 52026-06-3055智能72代码
- klingKling: Kling 3.0 Turbo2026-06-1757智能52代码57数学
2026年8月3日当周,阿里巴巴发布了Qwen 3.8 Max,一个2.4万亿参数的稀疏MoE模型,在Arena排行榜上全球排名第二,在Artificial Analysis的编程指数上排名第12,输入每百万token收费2.00美元,输出每百万token收费6.00美元。七天后,Upstage发布了Solar Pro 4,一款闭源权重的智能体旗舰模型,定价为0.03美元和0.12美元。两者都作为面向长程、多步骤工作而构建的“智能体”模型进行营销。一个是2026年中国夏季最强的开源权重作品,另一个是2026年最便宜的商业“智能体模型”标签。它们实际上并不是在能力上竞争,而是在竞争开发者在花费第一个token之前可以对模型做出何种假设。
两次发射,两个假设
Qwen 3.8 Max 于8月3日走出阿里巴巴实验室,具备前沿发布的各种特征:2.4T总参数(每个token约95B激活参数)、1M token上下文、原生文本-图像-视频输入、Arena排名第二,以及经审计的 Artificial Analysis Intelligence Index 为58。从独立证据来看,它处于全球开源权重模型的顶级行列。阿里巴巴已表示将遵循 Qwen 的模式发布权重,这将使其成为首个开源的最大级(Max-class)Qwen。从前沿标准来看,这些都不便宜——$2/$6——但相对于专有前沿模型来说,它还算便宜。
Solar Pro 4 于8月10日发布,基于一组不同的假设。Upstage 的发布资料描述了其在长文档推理、多轮工具调用和终端任务性能上相对于 Solar Pro 3 的改进,但未披露参数数量,也没有独立基准测试。其全部差异化优势在于价格:$0.03/$0.12 的输入价格比 Qwen 3.8 Max 便宜约66倍,输出价格便宜约50倍。Qwen 3.8 Max 让你相信的是一个拥有审计分数的2.4T模型,而 Solar Pro 4 让你相信的只是一个价格。

记分牌,如实解读。
• 智能指数 — Qwen 3.8 Max:58(AA,经审计);Solar Pro 4:无公开数据
• 编码指数 — Qwen 3.8 Max:71.8(126个中排名第12,AA);Solar Pro 4:尚未评测
• 上下文 — Qwen 3.8 Max:1M tokens;Solar Pro 4:524K
• 输入模态 — Qwen 3.8 Max:文本、图像、视频;Solar Pro 4:以文本为主
• 权重 — Qwen 3.8 Max:承诺开放发布;Solar Pro 4:闭源
• 价格 — Qwen 3.8 Max:$2.00/$6.00 每 1M;Solar Pro 4:$0.03/$0.12 每 1M

这种不对称性是显而易见的,而且这不是Solar Pro 4的错。Qwen 3.8 Max自8月3日起就可以被测量;Solar Pro 4自8月10日起才可以被测量。一个未经测量的模型并不是一个糟糕的模型——它只是一个未经测量的模型。但就目前这一具体比较而言,这是“经审计的证据”对阵“发布价格声明”,而诚实解读任何正面交锋的方式,就是明确说出这一点。
100倍的差距实际上买到了什么
这里值得关注的数据不是每token的价格,而是这个价格在架构层面解锁了什么。按照Solar Pro 4的定价,在代理循环的每一轮中把完整的50万token文档集留在上下文里,不再是一个成本决策。用三种不同的temperature运行同一个提示词并保留最佳结果——这是经典的廉价模型技巧——现在几乎等于免费。这是一种真正不同的开发姿态:你以计算资源近乎免费为前提来设计,就像当年团队对待第一批GPT-3.5级别的廉价模型那样。
代价在于,你是在把一个生产工作负载押注在一个未经证实的质量声明上。Qwen 3.8 Max 的 58 智能指数和 #2 Arena 排名并非全部真相——阿里巴巴自己的基准测试套件中包含的内部数据,应同样被视为供应商自报数据——但它们毕竟代表了一些东西。Solar Pro 4 目前还没有任何此类数据。如果它的质量与 Qwen 相近,那它就是市面上最划算的选择。如果不是,那么 0.03 美元的价格恰恰会说明它为什么只值 0.03 美元。

开放权重的分叉版本
这就是两款模型在结构上分道扬镳的地方,也是六个月后将决定这场对决胜负的关键。Qwen 3.8 Max 的开放发布一旦落地,它就成为一种可部署的资产:可以自行托管、微调、以边际成本提供服务,数据也留在自己的硬件上。Solar Pro 4 永远不会如此——闭源就是闭源。对于有数据驻留要求或长期成本曲线的企业来说,“Qwen 3.8 Max 最终可以部署在你自己集群里”是一种任何按 token 计价都无法匹敌的战略选项。
对于今天只是想调用一个模型的团队来说,这个开放性问题只是理论层面的。两者都位于兼容 OpenAI 的 API 之后,也都可通过厂商自有 API 及多个第三方平台获取。路由的答案——一个 API 覆盖 200 多个模型,提供商列表价格零加价直通,自动故障转移——让你可以将其视为成本图谱而非忠诚度决策:廉价的大批量流量导向 $0.03 模型,高风险的推理任务导向 Qwen 3.8 Max,再用路由 DSL 来规定哪些工作负载该去往何处。
底线
Qwen 3.8 Max 是更好的模型,证据更充分的模型,也是未来可为你所有的模型。Solar Pro 4 的价格则便宜两个数量级,但须诚实地标注星号:其质量声明截至本周尚未得到复现。如果你的工作负载需要经审计的前沿性能,那就为 Qwen 3.8 Max 付费。如果你的工作负载受容量限制且能容忍故障,0.03 美元的智能体才是理性之选——待首批独立的 Solar Pro 4 数据出炉时再复核,届时这场比较也将从苹果与橙子的对比变成真正的选择。
