
Sakana Namazu API: il LLM tutto giapponese al prezzo del modello base
- metaNUOVOMeta: Muse Spark 1.22026-08-0557Intelligenza72Codice
- qwenNUOVOQwen: Qwen3.8 Max2026-08-0358Intelligenza72Codice
- deepseekNUOVODeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenza69Codice
- minimaxNUOVOMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token · 2143 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenza69Codice
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenza49Codice
- metaMeta: Muse Spark 1.12026-07-1653Intelligenza71Codice
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenza76Codice
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenza71Codice
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenza77Codice
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenza77Codice
- grokxAI: Grok 4.52026-07-0856Intelligenza72Codice
- tencentTencent: Hy32026-07-0642Intelligenza59Codice
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligenza42Codice
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligenza39Codice
- anthropicAnthropic: Claude Sonnet 52026-06-3055Intelligenza72Codice
- klingKling: Kling 3.0 Turbo2026-06-1757Intelligenza52Codice57Matematica
Sakana Namazu, l'API LLM per il business giapponese di Sakana AI, basata sul modello open-weight Kimi K2.6 di Moonshot, è stata lanciata il 2 agosto 2026 — e il numero più importante è che costa esattamente quanto costa già il suo modello base. Moonshot addebita $0,95 per milione di token di input e $4,00 per milione di token di output per Kimi K2.6 sulla propria API. Sakana addebita gli stessi $0,95 / $4,00 per Sakana Namazu, un modello che ha post-addestrato internamente per la lingua giapponese, il keigo e il contesto business. L'intero premio per il post-addestramento è zero dollari.
Cosa è stato effettivamente spedito
L'API è compatibile con OpenAI: mantieni il client esistente, cambia il base_url, imposta il modello su sakana-namazu e funziona e basta — incluso il function calling. Ciò che più la distingue da un semplice endpoint Kimi K2.6 è che la ricerca web e l'esecuzione di codice sono integrate come strumenti di prima classe, e il modello è ottimizzato per usarli in un ciclo autonomo. Sakana ha dimostrato un agente di ricerca di mercato settimanale che pianifica, cerca, verifica in modo incrociato e scrive un report senza intervento umano; un flusso di lavoro per l'assistenza clienti che aggrega i dati degli ordini mentre risponde ai ticket; e uno spettacolo di luci per banchi di pesci che legge gli screenshot dell'acquario, decide il motivo successivo e lo esegue.
Specifiche come pubblicate:
• Modello base — Kimi K2.6 di Moonshot AI, un MoE open-weight con 1T di parametri / 32B attivi, post-addestrato internamente sui dati giapponesi di Sakana
• Interfaccia — compatibile con OpenAI; nome del modello sakana-namazu; cambia base_url e chiave API, nessuna riscrittura del codice
• Prezzo — $0.95 per 1M token di input, $4.00 per 1M token di output, $0.15 per 1M token in cache; i token di ragionamento vengono fatturati alla tariffa di output
• Strumenti — ricerca web a $7,00 per 1.000 chiamate, esecuzione di codice a $0,12 all'ora (sessione mantenuta), fatturati in aggiunta ai token
• Modalità — input di testo e immagini, output di testo
• Finestra di contesto — non resa nota da Sakana
• Disponibilità — disponibile tramite la console API di Sakana; non disponibile nell'UE/SEE, nel Regno Unito o in Svizzera mentre proseguono i lavori relativi al GDPR
Notate il divario di onestà: ogni affermazione di qualità qui è dichiarata dal fornitore. Sakana non ha rivelato una finestra di contesto, non ha pubblicato dati su latenza o throughput, e nessun laboratorio indipendente ha ancora valutato Sakana Namazu.

Il balzo di FairPoliticsQA è la vera storia.
Il benchmark con cui Sakana guida è FairPoliticsQA, una valutazione interna della neutralità delle risposte su questioni politicamente e storicamente cariche — precisamente gli argomenti in cui un modello addestrato in gran parte sull'internet di un singolo paese tende ad assorbire la prospettiva di quel paese. Sakana riporta che Sakana Namazu passa dal 34,10% al 56,30% rispetto alla base Kimi K2.6. È un numero sorprendente e onesto da interrogare: la valutazione è di Sakana stessa, la sua costruzione non è completamente pubblica, e un balzo in un benchmark di neutralità dice tanto sul bias iniziale del modello base quanto sulla correzione. La direzione, però, è il punto centrale del prodotto — un LLM sovrano giapponese che non risponde come uno cinese o americano.
Altrove il quadro è "tenere il servizio più un po'": JFBench (seguire istruzioni in giapponese) in aumento dell'1,5% rispetto alla base, una valutazione interna di traduzione dal giapponese all'inglese migliorata su testi ricchi di onorifici, e AIME26, MMLU-Pro e LiveCodeBench v6 sostanzialmente invariati. Se il modello base era già solido, il modello ottimizzato che si mantiene solido migliorando al contempo il comportamento nei contesti giapponesi è esattamente il compromesso che si vuole da uno sforzo di post-addestramento.

Il prezzo è il prezzo del modello base.
Il prezzo è il punto in cui Sakana Namazu si mostra o astuto o disperato, ed è giusto prendere sul serio entrambe le letture. Far pagare il prezzo di listino del modello base significa che uno sviluppatore che confronta "chiamare direttamente Kimi K2.6" con "chiamare Sakana Namazu ottimizzato per il giapponese" non vede alcun premio per l'ottimizzazione — che è l'intera strategia di adozione in un solo numero. Inoltre rende ovvio il valore per i carichi di lavoro aziendali giapponesi: il keigo, il gergo, la riduzione dei dinieghi, la ricerca web integrata e l'esecuzione del codice arrivano senza sovrapprezzo per token.
Le tariffe degli strumenti sono la parte a cui prestare attenzione, perché è lì che un loop agentico spende davvero denaro. La ricerca web a $7.00 per 1,000 chiamate e l'esecuzione di codice a $0.12 all'ora sembrano cifre piccole finché un agente di ricerca settimanale non esegue alcune centinaia di ricerche — è il numero di chiamate, non il prezzo dei token, a scalare. Un gateway di instradamento che trasmette i prezzi dei fornitori senza alcun ricarico mantiene onesti proprio questi numeri: nessun livello di piattaforma che gonfia il costo degli strumenti, e un taglio di prezzo del fornitore che diventa effettivo per te lo stesso giorno in cui viene pubblicato. (Sakana Namazu stesso non è ancora nel catalogo di OrcaRouter — gira sulla console proprietaria di Sakana — ma il principio del pass-through è il motivo per cui il confronto con il modello base rimane pulito.)

Le cose che Sakana non ha pubblicato
Tre lacune contano più di qualsiasi benchmark. In primo luogo, nessuna finestra di contesto: l'annuncio di Sakana e la pagina del prodotto la omettono del tutto, il che è insolito per un'API commercializzata per uso agentico. In secondo luogo, nessuna valutazione indipendente: Kimi K2.6, il modello base, è uno dei modelli open-weight più testati al mondo — Artificial Analysis lo colloca al vertice del campo open-weight — ma i delta di Sakana Namazu sono interamente auto-dichiarati. In terzo luogo, gestione dei dati: di default i tuoi input potrebbero essere usati per l'addestramento, con un'opzione di esclusione nella console, e l'elaborazione non è garantita che rimanga in Giappone — una cosa da sapere prima di inviare dati dei clienti attraverso di essa.
Chi dovrebbe provarlo, chi dovrebbe aspettare
Provatelo se distribuite prodotti o strumenti interni in lingua giapponese e il pezzo mancante è un modello che risponde come un interlocutore commerciale giapponese — keigo intatto, rifiuti ridotti, strumenti agentici integrati — e potete fare a meno di benchmark indipendenti per un po'. Aspettate se la vostra distribuzione è nell'UE, nel Regno Unito o in Svizzera (non è disponibile lì), se il vostro regime di conformità richiede una gestione dei dati garantita solo in Giappone, o se avete bisogno di una finestra di contesto attorno alla quale pianificare un sistema di retrieval.
Cosa osservare nelle prossime settimane: una scheda di valutazione indipendente per Sakana Namazu su una classifica pubblica, la divulgazione di una finestra di contesto e l'eventuale revoca della restrizione UE. Finché questi elementi non arriveranno, tratta Sakana Namazu per quello che è: una scommessa seria, ben prezzata, sul Giappone sovrano, che al momento vale solo quanto la parola di chi l'ha creata.
