Sakana Namazu 的主視覺標題卡——日本自有的 LLM API,副標題為「基於 Kimi K2.6,為日本商務調校——2026 年 8 月 2 日上線」,並附上每 100 萬 token 為 $0.95/$4.00、OpenAI 相容 API、內建網路搜尋與程式碼執行等統計標籤。OrcaRouter 標誌合成於右下角。
Engineering & Research

Sakana Namazu API:日本自己的 LLM,以基礎模型的價格提供

作者

Jim Song

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

Sakana Namazu 是 Sakana AI 以 Moonshot 開放權重的 Kimi K2.6 為基礎所打造、針對日本商業情境的 LLM API,已於 2026 年 8 月 2 日正式上線——而最關鍵的數字在於,它的價格與其基礎模型完全一致。Moonshot 在其自家 API 上對 Kimi K2.6 收取每百萬輸入 token 0.95 美元、每百萬輸出 token 4.00 美元。Sakana 對 Sakana Namazu 也收取相同的 0.95/4.00 美元,而這個模型是 Sakana 內部針對日語、敬語與商業情境所進行的後訓練成果。整個後訓練的溢價為零美元。

實際發佈的內容

{{1}}此 API 與 OpenAI 相容:保留您現有的用戶端,換掉 base_url,將模型設為 sakana-namazu,就能直接運作——包括函式呼叫。{{/1}}{{2}}它與普通的 Kimi K2.6 端點最顯著的差異在於,網路搜尋與程式碼執行被內建為一級工具,{{/2}}{{3}}且模型經過調校,能在自主迴圈中使用這些工具。{{/3}}{{4}}Sakana 展示了一個每週市場研究代理程式,{{/4}}{{5}}能在無人介入的情況下規劃、搜尋、交叉比對並撰寫報告;{{/5}}{{6}}一個客戶支援流程,{{/6}}{{7}}能在回覆客服單的同時彙整訂單資料;{{/7}}{{8}}以及一個魚群燈光秀,{{/8}}{{9}}能讀取水族箱截圖、決定下一個主題並加以執行。{{/9}}

發布的規格:

• 基礎模型 — Moonshot AI 的 Kimi K2.6,一款擁有 1T 參數 / 320億活躍參數的開放權重 MoE,由 Sakana 內部以自家日語資料進行後訓練

• 介面 — 與 OpenAI 相容;模型名稱 sakana-namazu;更改 base_url 與 API 金鑰,無需重寫程式碼

• 價格 — 每 1M 輸入符元 $0.95,每 1M 輸出符元 $4.00,每 1M 快取輸入 $0.15;思考符元按輸出費率計費。

• 工具 — 網路搜尋每 1,000 次呼叫 $7.00 美元,程式碼執行每小時 $0.12 美元(保留工作階段),按 token 用量另行計費

• 模態 — 文字與圖像輸入,文字輸出

• 上下文窗口 — 未由Sakana公開

• 可用性 — 透過 Sakana 的 API 控制台即時提供;在 GDPR 相關工作完成前,不適用於歐盟/歐洲經濟區、英國或瑞士

請注意這個誠實落差:此處每一項品質宣稱皆來自廠商自行報告。Sakana 尚未揭露其上下文視窗長度,也未發布延遲或吞吐量數據,且目前尚無任何獨立實驗室對 Sakana Namazu 進行評測。

A single-column scoreboard for Sakana Namazu listing the Kimi K2.6 base, $0.95/$4.00 per 1M tokens, an undisclosed context window, built-in web search and code execution, a vendor-reported FairPoliticsQA jump from 34.1% to 56.3%, and no independent scores, with a sourcing footer noting vendor-reported benchmarks. OrcaRouter logo composited bottom-right.

FairPoliticsQA 的躍升才是真正的新聞。

Sakana 主打的基準是 FairPoliticsQA,這是一項針對政治與歷史敏感問題的回答中立性內部評測——正是那些主要靠單一國家網路內容訓練而成的模型,往往會吸收該國思維框架的主題。Sakana 報告指出,Sakana Namazu 從基礎模型 Kimi K2.6 的 34.10% 躍升至 56.30%。這是個驚人的數字,也值得誠實檢視:這項評測出自 Sakana 自己,其建構方式並未完全公開,而中立性基準上的躍升,反映的既是基礎模型原本的偏見,也是修正的成效。不過,這個方向正是該產品的核心意義——一個日本主權的 LLM,不該像中國或美國的模型那樣回答問題。

在其他方面,情況是「守住優勢並略有進展」:JFBench(日語指令跟隨)相較基礎模型提升 1.5%,內部日譯英評估在敬語密集文本上有所改善,而 AIME26、MMLU-Pro 和 LiveCodeBench v6 大致不變。如果基礎模型本來就很強大,那麼調校後的模型在保持強勁表現的同時改善日語情境行為,正是你希望從後訓練工作中獲得的成果。

A pricing card for Sakana Namazu v1.0 showing $0.95 input, $4.00 output, and $0.15 cached input per 1M tokens, web search at $7.00 per 1,000 calls, code execution at $0.12 per hour, and a note that the model is not available in the EU/EEA, UK, or Switzerland and may train on inputs by default.

此價格為基本型的價格

Pricing is where Sakana Namazu is either shrewd or desperate, and it is worth taking both readings seriously. 定價正是 Sakana Namazu 精明或孤注一擲之處,而這兩種解讀都值得認真看待。Charging the base model's list price means a developer comparing "call Kimi K2.6 directly" against "call the Japanese-tuned Sakana Namazu" sees no premium for the tuning — which is the entire adoption strategy in one number. 收取基礎模型的定價,意味著開發者在比較「直接呼叫 Kimi K2.6」與「呼叫日本調校的 Sakana Namazu」時,看不到任何調校溢價——這正是用一個數字呈現的完整採用策略。It also makes the value obvious for Japanese-business workloads: the keigo, the jargon, the refusal-reduction, the built-in web search and code execution arrive without a per-token surcharge. 這也讓日本商業工作負載的價值一目了然:敬語、術語、降低拒絕率、內建網頁搜尋與程式碼執行,全都不需要額外的逐 token 加價。

工具費用是需要注意的部分,因為那是代理迴圈真正花錢的地方。網路搜尋每 1,000 次呼叫 7.00 美元,程式碼執行每小時 0.12 美元,聽起來很小,直到每週研究代理執行數百次搜尋——真正會擴增的是呼叫次數,而不是代幣價格。一個不加價、直接轉傳供應商價格的路由閘道,正好能讓這些數字保持誠實:沒有平台層級膨脹工具成本,廠商降價當天就能在你的端上生效。(Sakana Namazu 本身尚未出現在 OrcaRouter 的目錄中——它在 Sakana 自己的控制台上運行——但正是這種原價轉傳原則,讓與基礎模型的比較保持乾淨。)

The Artificial Analysis page for Kimi K2.6 in English, showing an Intelligence Index of 45, first-party pricing of $0.95/$4.00 per 1M tokens, and a note that Moonshot has since launched Kimi K3, captured August 11, 2026.

Sakana 沒有發布的事情

有三個差距比任何基準測試都更重要。首先,沒有上下文視窗——Sakana 的公告和產品頁面完全略過不提,這對一個以代理式用途行銷的 API 來說並不尋常。其次,沒有獨立評測;基礎模型 Kimi K2.6 是世界上評測最完善的開放權重模型之一——Artificial Analysis 將其名列開放權重領域之首——但 Sakana Namazu 的效能差異完全是自家宣稱的。第三,資料處理:預設情況下,你的輸入可能被用於訓練,可在控制台中選擇退出,且處理過程不保證留在日本境內——在將客戶資料傳送給它之前,這點值得留意。

誰該嘗試,誰該等待

{{1}}如果你正在推出日語產品或內部工具,而缺少的正是這樣一個模型——能以日本商務往來對象的口吻應答,敬語完整保留、減少拒答、內建代理工具——而且一段時間內你能接受沒有獨立基準評測,那就試試看。{{/1}} {{2}}如果你的部署位於歐盟、英國或瑞士(該服務不適用於當地),如果你的合規制度要求確保資料僅在日本境內處理,或者如果你需要可依據它來規劃檢索設計的上下文視窗,那就請再等等。{{/2}}

接下來幾週值得關注的是:{{1}}Sakana Namazu 在公開排行榜上的獨立評分、上下文窗口的揭露,以及歐盟限制是否解除{{/1}}。在這些結果出爐之前,{{2}}請認清 Sakana Namazu 的本質——一個嚴肅、定價合理、押注日本主權的賭注,目前僅與其製造者的說法一樣可靠{{/2}}。

© 2026 OrcaRouter

推理服務商

經營推理平台?讓您的模型上架 OrcaRouter。

聯絡我們

加入我們的社區

DiscordEmailXGitHubYouTube