
Sakana Namazu 对比 Qwen 3.8:一个已上线,另一个仅官宣
- meta新Meta: Muse Spark 1.22026-08-0557智能72代码
- qwen新Qwen: Qwen3.8 Max2026-08-0358智能72代码
- deepseek新DeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69代码
- minimax新MiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens · 2143 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- metaMeta: Muse Spark 1.12026-07-1653智能71代码
- kimiMoonshotAI: Kimi K32026-07-1560智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71代码
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77代码
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77代码
- grokxAI: Grok 4.52026-07-0856智能72代码
- tencentTencent: Hy32026-07-0642智能59代码
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42代码
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39代码
- anthropicAnthropic: Claude Sonnet 52026-06-3055智能72代码
- klingKling: Kling 3.0 Turbo2026-06-1757智能52代码57数学
Sakana Namazu 和 Qwen 3.8 在 2026 年的同一周内问世,两者都承载着各自国家对于国家大语言模型的期望。Sakana Namazu 是日本的:自 8 月 2 日起上线的商业 API,基于开放权重模型 Kimi K2.6 构建,并针对日语商务语言进行了调优,定价为每百万 token $0.95 / $4.00。Qwen 3.8 是中国的:阿里巴巴的下一代旗舰模型,于 7 月 19 日发布公告,预览版已在阿里巴巴自家平台上运行,而完整版本和开放权重仍待公布。目前两者中只有一款可以调用。
两款旗舰产品,相隔一周
时间线就是故事本身。7月19日:阿里巴巴发布Qwen 3.8,据称是一款2.4万亿参数的混合专家旗舰模型,承诺开放权重,但未提供许可证和日期。8月2日:Sakana开放Sakana Namazu API,这是一款功能完备的产品,包含定价、工具和企业控制台。8月3日:Qwen 3.8-Max-Preview出现在阿里巴巴的Token Plan、Qoder和QoderWork上,据称价格为每百万token 2美元/6美元——但全面开放、开放权重以及路由平台接入仍是后话。这是一场赛跑,一名选手已经冲过终点线,而另一名选手还在宣布阶段。
你今天实际能构建什么
使用 Sakana Namazu,答案就是一切:兼容 OpenAI 的端点、作为一等工具的网络搜索与代码执行、函数调用,以及 Sakana 展示过的智能体循环(规划→搜索→交叉核对→产出)。使用 Qwen 3.8,答案则是:等待。预览版运行在阿里巴巴自家产品上,模型 ID 已为路由而设——OrcaRouter 的目录中列出了 qwen/qwen3.8,注明发布前调用会返回 model_not_yet_available,发布后则按供应商成本自动路由——但“上线之日”并不是发货日期。对于本季度就要选定架构的团队来说,上线胜过官宣。

规格对比
• 状态 — Sakana Namazu 于 {{1}}2026年8月2日{{/1}} 上线,而 Qwen 3.8 于 {{2}}7月19日{{/2}} 发布,{{3}}仅限预览版{{/3}},{{4}}正式版待定{{/4}}。
• 价格 — Namazu 为每 100 万 tokens $0.95 / $4.00,而 Qwen 3.8 为每 100 万 tokens $2 / $6(据报告,未经证实)
• 规模 — Namazu 继承了 Kimi K2.6 的 1T 总参 / 32B 激活 MoE,对比之下 Qwen 3.8 据称为 2.4T 总参 / ~95B 激活
• 上下文 — Namazu 未披露 vs Qwen 3.8 ~1M tokens(据报道,未经证实)
• 开放权重 — Namazu 闭源,Qwen 3.8 承诺开放但尚未发布
• 验证 — 两者均仅为供应商报告;均无独立评分
主权问题
这两款模型的潜台词都带有国家属性。Sakana Namazu 的旗舰基准是 FairPoliticsQA,即其内部的政治中立性测试——相对于基础模型实现了 34.10% 至 56.30% 的提升,而该测试的核心诉求恰恰是避免像在别国互联网上训练的模型那样作答。它基于中国基座模型(Kimi K2.6)构建,但经过调优后以日本企业级同类产品的风格作答。与此同时,Qwen 3.8 是中国开放权重生态系统的旗舰产品,厂商声称其具备前沿级编码能力(GPQA Diamond 92.6、Terminal-Bench 2.1 86.6、SWE-bench Pro 67.7——均为自行报告),内容护栏则受到阿里巴巴所处监管环境的塑造。对于选择基础模型的企业而言,“这款模型承载着谁的框架?”如今已是一个采购问题,而非政治问题。

价格差异意味着什么
即使按 Qwen 3.8 公布的 $2 / $6 表面价值计算,Sakana Namazu 以 $0.95 / $4.00 的价格是更便宜的选择——而且它已经上线。有意思的转折点在于,Namazu 的价格恰好与基础模型 Kimi K2.6 的价格相同:Sakana 对其后训练不收取额外费用,这使得针对日语优化的版本成为默认选择,而不是直接调用原始基础模型。Qwen 3.8 的公布价格是预览期的数字;长期费率与开放权重许可一样,尚未公布。仅从成本确定性来看,Sakana Namazu 是更稳妥的预算项目。

决定
如果你本月就需要一个能用的日本商务模型,如果你的工作负载对敬语敏感,或者需要在日本语境下保持政治中立,又或者你认为带工具的托管API胜过一张路线图,那就选择Sakana Namazu。如果你正在为规模化而构建系统,而传闻中2.4万亿参数的前沿模型比可用性更重要;如果你想要可以自行托管的开放权重(等它们真正发布时);又或者你的技术栈面向中国市场,那就选择Qwen 3.8。而如果你在对冲——当一边已经上线、另一边还只是承诺时,这是明智的立场——请注意这种不对称性早已内置:Qwen 3.8上线当天就会通过OrcaRouter路由,按供应商成本价计费,无加价、无需改代码。所以你今天就可以采用Sakana Namazu,然后在Qwen 3.8落地的那天早上,用同一个密钥把它加上。
本文中的对比1
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
