
Sakana Namazu 對比 Qwen 3.8:一個已上線,另一個僅發布
- meta新Meta: Muse Spark 1.22026-08-0557智能72程式
- qwen新Qwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseek新DeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimax新MiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens · 2143 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- metaMeta: Muse Spark 1.12026-07-1653智能71程式
- kimiMoonshotAI: Kimi K32026-07-1560智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77程式
- grokxAI: Grok 4.52026-07-0856智能72程式
- tencentTencent: Hy32026-07-0642智能59程式
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42程式
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39程式
- anthropicAnthropic: Claude Sonnet 52026-06-3055智能72程式
- klingKling: Kling 3.0 Turbo2026-06-1757智能52程式57數學
Sakana Namazu 和 Qwen 3.8 在 2026 年的同一週內問世,兩者都承載著各自母國對國家級大型語言模型(LLM)的期望。Sakana Namazu 是日本的:自 8 月 2 日起上線的商業 API,基於開放權重的 Kimi K2.6,並針對日本商業語言調校,價格為每百萬個 token 0.95 美元 / 4.00 美元。Qwen 3.8 是中國的:阿里巴巴的下一款旗艦模型,於 7 月 19 日發布公告,預覽版已在阿里巴巴自家平台上運行,完整版與開放權重仍待推出。今日只有其中一款可以實際呼叫使用。
兩款旗艦,相隔一週
時間軸就是故事本身。7月19日:阿里巴巴發布Qwen 3.8,據報導是一款2.4兆參數的混合專家(MoE)旗艦模型,承諾開放權重,但未說明授權條款或日期。8月2日:Sakana開放Sakana Namazu API——這是一款具備定價、工具和企業控制台的成熟產品。8月3日:Qwen 3.8-Max-Preview出現在阿里巴巴的Token Plan、Qoder和QoderWork上,據報導價格為每百萬個token 2美元/6美元——但全面上市、開放權重以及路由平台接入仍尚未實現。這是一場競賽,一位跑者已經衝過終點線,另一位則還在發布階段。
你今天實際上可以構建什麼
對 Sakana Namazu 來說,答案是包羅萬象:一個與 OpenAI 相容的端點、將網路搜尋與程式碼執行視為一級工具、函式呼叫,以及 Sakana 已展示的代理迴圈(規劃 → 搜尋 → 交叉查證 → 產出)。對 Qwen 3.8 來說,答案是:再等等。預覽版運行於阿里巴巴自家的產品上,模型 ID 已為路由而配置——OrcaRouter 的目錄列出 qwen/qwen3.8,並註明在發布前呼叫會回傳 model_not_yet_available,發布後則會自動以供應商成本計價路由——但「上線之日」並非出貨日期。對本季就要選定架構的團隊而言,已上線的勝過已宣布的。

規格比較
• 狀態 — Sakana Namazu 已於 2026 年 8 月 2 日上線;Qwen 3.8 於 7 月 19 日發布,目前僅提供預覽版,正式發布(GA)待定
• 價格 — Namazu $0.95 / $4.00 每 1M tokens 對比 Qwen 3.8 $2 / $6 每 1M tokens(據報導,未經證實)
• 規模 — Namazu 沿用 Kimi K2.6 的 1T / 32B 啟用 MoE,而 Qwen 3.8 據報導為 2.4T 總參數 / ~95B 啟用參數
• 背景 — Namazu 未公開 vs Qwen 3.8 約100萬 tokens(據報導,未經證實)
• 開放權重 — Namazu 封閉,Qwen 3.8 承諾推出,尚未發布
• 驗證 — 兩者皆僅由供應商申報;兩者皆無獨立評分
主權問題
這兩個模型的潛臺詞都帶有國家色彩。Sakana Namazu 的旗艦基準是 FairPoliticsQA,這是一項政治中立的內部測試——相較於基礎模型提升了 34.10% 至 56.30%,而這項提升明確針對的是避免像一個在另一個國家網路上訓練的模型那樣作答。它建立在中國的基礎模型(Kimi K2.6)之上,但經過調校,使其回答風格如同日本的企業級對應產品。與此同時,Qwen 3.8 是中國開放權重生態系統的旗艦之作,供應商宣稱具備前沿等級的編碼能力(GPQA Diamond 92.6、Terminal-Bench 2.1 86.6、SWE-bench Pro 67.7——均為自行申報),其內容護欄也由阿里巴巴的監管背景所塑造。對於正在選擇基礎模型的企業來說,「這個模型承載的是誰的框架?」如今已是一個採購問題,而非政治問題。

價格差異的含義
即使以 Qwen 3.8 公布的 $2 / $6 為準,Sakana Namazu 以 $0.95 / $4.00 的價格仍是更划算的選擇——而且它已經正式上線。有趣的轉折點在於:Namazu 的定價恰好等於基礎模型 Kimi K2.6 的定價;Sakana 對其後訓練不加收任何溢價,使得這個日語調校版本成為相對於直接呼叫原始基礎模型的預設首選。Qwen 3.8 的公布價格屬於預覽階段的數字;其長期費率如同開放權重授權一樣,尚未公布。單就成本確定性而言,Sakana Namazu 是更穩妥的預算項目。

決定
如果你需要一個本月就能用的日本商業模型,如果你的工作負載對敬語敏感,或者需要在日本語境下政治中立,或者一個附帶工具的託管 API 勝過一張路線圖,那就選擇 Sakana Namazu。如果你正在為規模而建置,且一個據稱有 2.4T 參數的前沿模型比可用性更重要,如果你想要可以自行託管的開放權重(當它們真正釋出時),或者你的技術棧是面向中國市場的,那就選擇 Qwen 3.8。而如果你是在避險——當一邊已上線、另一邊只是承諾時,這是理智的姿態——請注意,這種不對稱性早已內建:Qwen 3.8 在推出當天就會以供應商成本、不另加價、也無需更動程式碼,經由 OrcaRouter 路由,所以你今天就可以採用 Sakana Namazu,並在 Qwen 3.8 上線的那天早上,用同一把金鑰再加上它。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
