
Boreal vs Kimi K3: Nessuno dei due gira sul tuo hardware
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiNUOVOOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleNUOVOGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenNUOVOQwen: Qwen3.8 Max (0902)2026-09-0240Intelligenza72Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligenza69Codice
Novantasei shard Safetensors. Ecco cosa ottieni scaricando Kimi K3 — un modello mixture-of-experts da 2.800 miliardi di parametri con 104 miliardi di parametri attivi per token, pubblicato con licenza MIT modificata il 27 luglio 2026, undici giorni dopo il rilascio da parte di Moonshot AI. Le indicazioni della stessa Moonshot AI per il serving raccomandano configurazioni supernode con almeno 64 acceleratori. Boreal non può essere scaricato in alcun modo: il modello video pubblicitario di Creatify, lanciato il 15 settembre 2026, è chiuso e in self-service, al prezzo di un centesimo al secondo di video finito di classe 720p. Uno di questi ti consegna i pesi e la bolletta dell'hardware. L'altro si tiene i pesi e ti addebita al secondo. Nessuno dei due gira sul tuo hardware, e le ragioni sono opposte — ed è esattamente per questo che vale la pena fare il confronto.
Cosa ti dà davvero l'"open weights"
L'etichetta open-weights fa un lavoro concreto in questo confronto, e ne fa meno di quanto sembri.
Quello che ottieni davvero con Kimi K3 è la durabilità. I pesi esistono come file. Se Moonshot AI cambiasse i suoi prezzi, mettesse in secondo piano il modello o sparisse, il checkpoint sarebbe ancora lì — e lo sarebbero anche gli stack di serving che lo supportano, con vLLM, SGLang e TokenSpeed tutti elencati tra i percorsi supportati. Non è un'affermazione di marketing; è una proprietà dell'artefatto. Per un'organizzazione il cui registro dei rischi include la concentrazione dei fornitori, è la cosa in assoluto più preziosa del rilascio.
Quello che non ottieni è un deployment che puoi eseguire. Un modello sparso da 2,8 trilioni di parametri con 896 esperti non è una proposta da quantizzare e via. La raccomandazione ufficiale di oltre 64 acceleratori non è una baseline conservativa che un team determinato possa limare di molto — è la descrizione della classe di macchina per cui il modello è stato progettato. I team che eseguono Kimi K3 a una scala che assomigli anche lontanamente a quella di produzione, in pratica, lo noleggiano da qualcuno che gestisce un supernodo. Il che significa che la questione pratica della disponibilità resta invariata dal fatto che i pesi siano pubblici: stai comunque acquistando inferenza da terzi, e la licenza è l'unica cosa che si è mossa.
C'è un dettaglio della licenza che vale la pena leggere attentamente, perché è la parte che la maggior parte dei riassunti salta. I termini MIT modificati subordinano gli obblighi di branding e attribuzione al superamento dei 100 milioni di utenti attivi mensili o dei 20 milioni di dollari di ricavi mensili, e richiedono alle aziende che offrono model-as-a-service i cui ricavi da licenziatari e affiliate superano i 20 milioni di dollari in un qualsiasi periodo di dodici mesi consecutivi di stipulare un accordo separato con Moonshot. L'uso interno e il fine-tuning sono ampiamente consentiti. La rivendita è subordinata a condizioni. Questa è una licenza ragionevole per un modello di frontiera, ed è una cosa sostanzialmente diversa dalla MIT — per una startup che pianifica di costruire un prodotto su di essa, la soglia è una futura negoziazione, non un diritto attuale.
Quello che Boreal ti spedisce invece
Boreal fa il compromesso opposto, ed è più deliberato di quanto sembri.
Creatify afferma di possedere i pesi e di servirli essa stessa, e che il modello di base su cui ha eseguito il post-training è open source e genera audio e video congiuntamente. Questi due fatti, insieme, costituiscono l'intera strategia di prodotto. La discendenza open source ti dice all'incirca quale classe di modello viene utilizzata e che l'audio non è aggiunto a posteriori. La proprietà ti dice che nessun altro può servirlo, ed è proprio questo che rende possibile, in primo luogo, un prezzo al secondo.
Quello che ottieni non è durabilità — è throughput. Creatify dichiara un rendering all’incirca 1:1 con il tempo reale: un secondo di video finito per ogni secondo di tempo effettivo. Questo è un risultato di ingegneria dell’inferenza, non di qualità del modello, ed è la cosa che sopravviverebbe se i pesi venissero pubblicati domani. Se il checkpoint comparisse su Hugging Face la prossima settimana, la capacità di renderizzare una clip di cinque secondi in circa cinque secondi per pochi centesimi apparterrebbe comunque a chi ha costruito lo stack di serving — e l’implementazione di riferimento, con un throughput già ottimizzato pari a quello di oltre 64 acceleratori, resterebbe comunque di Creatify.
Quindi la simmetria onesta è questa: Kimi K3 ti dà un checkpoint che non puoi permetterti di servire, e Boreal ti dà un servizio che non puoi sottrarre al suo fornitore. Nessuno dei due è auto-ospitabile. Solo uno dei due è una copertura contro il rischio del fornitore, ed è quello in cui la copertura costa più di ciò che viene coperto.

Il contrasto delle specifiche
• Output — Boreal: video renderizzato, classe 720p, da testo a video e da immagine a video. Kimi K3: solo testo.
• Pesi — Boreal: proprietari, di proprietà di Creatify e serviti da Creatify. Kimi K3: pubblicato il 27 luglio 2026, 96 shard Safetensors, MIT modificata con termini di rivendita subordinati ai ricavi.
• Self-hosting — Boreal: non possibile. Kimi K3: possibile in linea di principio, con Moonshot che raccomanda almeno 64 acceleratori.
• Prezzo — Boreal: 0,01 $ al secondo di video finale. Kimi K3: 3,00 $ per 1M di input / 15,00 $ per 1M di output, con letture dalla cache a 0,30 $ per 1M e una tariffa fissa su tutta la finestra di contesto.
• Contesto — Boreal: non pubblicato. Kimi K3: 1.048.576 token, senza sovrapprezzo per il contesto lungo.
• Latenza — Boreal: dichiarata in rapporto 1:1 con il tempo reale. Kimi K3: tempo p50 al primo token di 10,00 secondi sul nostro banco di prova — il limite massimo riportato dalla nostra strumentazione, quindi va letto come "lento" anziché come una misurazione precisa.
Evidenze — Boreal: solo dati forniti dal fornitore. Kimi K3: righe del fornitore che includono 93,5 su GPQA Diamond e 88,3 su Terminal-Bench 2.1, un primo posto nella Frontend Code Arena con 1679 Elo, e risultati indipendenti che includono un tasso di fallimento del 36% su problemi con invarianti nascosti.
La traccia che non puoi disattivare
Kimi K3 ha una proprietà di fatturazione insolita persino tra i modelli di ragionamento, ed è la differenza di costo più concreta in questo confronto.
La modalità di pensiero non può essere disattivata e il livello di impegno di ragionamento predefinito è impostato al massimo. Ogni richiesta produce una traccia di ragionamento completa, e ogni token di quella traccia viene fatturato a $15.00 per milione di output. Per un compito in cui la risposta è una sola parola, stai comunque pagando per una deliberazione. Le letture dalla cache a $0.30 per milione ammorbidiscono notevolmente il lato input, e il prezzo fisso su tutto il contesto da 1M è davvero più favorevole rispetto alle strutture a livelli usate dai suoi concorrenti — ma il lato output non ha una modalità economica.
Il costo di Boreal non ha una leva equivalente che si possa sbagliare. Una clip di cinque secondi costa cinque centesimi, che il modello abbia lavorato duramente o in modo banale, perché l'artefatto è l'unità e l'artefatto è fisso. Non è ovviamente meglio — è semplicemente immune a qualunque cosa il modello faccia al suo interno.
Kimi K3 è nel nostro catalogo, ed è di gran lunga il modello più trafficato sulla nostra board: 3.150,6 milioni di token negli ultimi sette giorni, più di diciassette volte il traffico di Grok 4.6 e tredici volte quello di GPT-5.6 Sol. Un volume così è l'aspetto che un modello di frontiera open-weight assume in produzione: molti chiamanti, sensibili al prezzo, pronti a dirottare verso chiunque li serva peggio. Sta dietro la stessa chiave del resto del catalogo a tariffa di listino del provider con 0% di markup, il che conta più per un modello open-weights che per uno chiuso: quando il checkpoint è pubblico, il prezzo lo stabilisce il provider che lo serve, quindi il prezzo è la variabile competitiva e si muove.
Boreal non è nel nostro catalogo. OrcaRouter non fornisce modelli di generazione video, e lo strato testuale di una pipeline pubblicitaria — i brief, le varianti di hook, il passaggio di conformità — è il punto in cui ci collochiamo rispetto a esso.

Quale, e cosa guardare
Se il tuo vincolo è la concentrazione dei fornitori e hai accesso a una potenza di calcolo seria, Kimi K3 è l'unico dei due a offrire una risposta reale, e il tasso di fallimento del 36% sui problemi a invarianza nascosta è il numero da soppesare rispetto a questo. È un modello di classe frontiera con annessa una vera via di fuga, e la via di fuga è così costosa che la maggior parte dei team non la userà mai.
Se il tuo vincolo è il costo per asset pubblicitario finito, Boreal è l'opzione più economica e di gran lunga più prevedibile, e il suo vincolo è la qualità su un formato specifico: una clip parlata con una sola persona ha ottenuto il 60% nel test di 40 casi del fornitore stesso, contro l'83% e l'85% su scene di prodotto e creator. Testa quel formato prima di dedicargli una campagna.
Una precisazione sulle prove, perché vale per entrambi. Le cifre di intelligenza pubblicate di Kimi K3 sono state riespresse almeno una volta, e i numeri più vecchi nell'intervallo 57-60 non dovrebbero essere citati insieme a quelli attuali dello stesso valutatore: un promemoria del fatto che un punteggio di benchmark è un'osservazione datata, non una proprietà del modello. E ogni cifra di qualità attribuita a Boreal proviene dal post di lancio di Creatify stesso. La prima valutazione indipendente di Boreal, quando arriverà, varrà più di tutto ciò che è attualmente pubblicato al riguardo.

