
Boreal vs Kimi K3: Geen van beide draait op jouw hardware
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiNIEUWOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleNIEUWGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenNIEUWQwen: Qwen3.8 Max (0902)2026-09-0240Intelligentie72Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligentie69Coderen
Zesenennegentig Safetensors-shards. Dat is wat het downloaden van Kimi K3 je oplevert — een mixture-of-experts-model met 2,8 biljoen parameters en 104 miljard actieve parameters per token, gepubliceerd onder een aangepaste MIT-licentie op 27 juli 2026, elf dagen nadat Moonshot AI het uitbracht. Moonshots eigen advies voor het serveren ervan beveelt supernode-configuraties van ten minste 64 accelerators aan. Boreal kan helemaal niet worden gedownload: het advertentievideomodel van Creatify, gelanceerd op 15 september 2026, is gesloten en selfservice, met een prijs van één cent per seconde voltooide 720p-klasse video. Een van deze geeft je de gewichten en de hardwarerekening. De andere houdt de gewichten en rekent je per seconde af. Geen van beide draait op jouw hardware, en de redenen zijn tegenpolen — precies daarom is de vergelijking de moeite waard.
Wat "open weights" je daadwerkelijk oplevert
Het open-weights-label doet echt werk in deze vergelijking, en het doet minder werk dan het klinkt.
Wat je met Kimi K3 echt krijgt, is duurzaamheid. De gewichten bestaan als bestanden. Als Moonshot AI zijn prijsstelling zou wijzigen, het model minder prioriteit zou geven of zou verdwijnen, dan zou het checkpoint er nog steeds zijn — en zo ook de servingstacks die het ondersteunen, waarbij vLLM, SGLang en TokenSpeed allemaal worden genoemd onder de ondersteunde paden. Dat is geen marketingclaim; het is een eigenschap van het artefact. Voor een organisatie wier risicoregister leveranciersconcentratie bevat, is het het meest waardevolle aspect van de release.
Wat je niet krijgt, is een implementatie die je kunt draaien. Een sparse model met 2,8 biljoen parameters en 896 experts is geen kwestie van kwantiseren en klaar. De officiële aanbeveling van 64-plus accelerators is geen conservatieve basislijn die een vastberaden team nog veel kan onderbieden — het is een beschrijving van de klasse van machine waarvoor het model is ontworpen. Teams die Kimi K3 draaien op iets dat op productieschaal lijkt, huren het in de praktijk van iemand die een supernode beheert. Dat betekent dat de praktische beschikbaarheidsvraag niet verandert doordat de gewichten openbaar zijn: je koopt nog steeds inferentie bij een derde partij, en de licentie is het enige dat is veranderd.
Er is een licentiedetail dat aandachtig lezen waard is, want het is het onderdeel dat de meeste samenvattingen overslaan. De aangepaste MIT-voorwaarden laten branding- en attributieverplichtingen pas ingaan boven 100 miljoen maandelijkse actieve gebruikers of $20 miljoen aan maandelijkse omzet, en verplichten model-as-a-service-bedrijven waarvan de omzet van licentienemers en gelieerde partijen over twaalf opeenvolgende maanden meer dan $20 miljoen bedraagt, een afzonderlijke overeenkomst met Moonshot te sluiten. Intern gebruik en fine-tuning zijn in ruime mate toegestaan. Doorverkoop is aan voorwaarden gebonden. Dat is een redelijke licentie voor een frontier-model, en het is wezenlijk iets anders dan MIT — voor een startup die van plan is er een product bovenop te bouwen, is de drempel een toekomstige onderhandeling, niet een huidig recht.
Wat Boreal je in plaats daarvan stuurt
Boreal doet de tegenovergestelde ruil, en dat is doelbewuster dan het lijkt.
Creatify stelt dat het eigenaar is van de gewichten en deze zelf serveert, en dat het basismodel waarop het heeft nagetraind een open-sourcemodel is dat audio en video gezamenlijk genereert. Die twee feiten samen vormen de volledige productstrategie. De open-sourceherkomst vertelt je ruwweg welke modelklasse wordt aangeroepen en dat de audio er niet achteraf aan vastgeschroefd is. Het eigenaarschap vertelt je dat niemand anders het kan serveren, en dat is wat een prijs per seconde überhaupt mogelijk maakt.
Wat je krijgt is geen duurzaamheid — het is doorvoer. Creatify geeft aan dat rendering ongeveer 1:1 met realtime verloopt: één seconde afgewerkte video per seconde kloktijd. Dat is een resultaat van inference-engineering, niet van modelkwaliteit, en het is wat zou standhouden als de gewichten morgen werden gepubliceerd. Als het checkpoint volgende week op Hugging Face zou verschijnen, dan zou het vermogen om een clip van vijf seconden in ongeveer vijf seconden voor een stuiver te renderen nog steeds toebehoren aan wie de servingstack heeft gebouwd — en de referentie-implementatie, met een al afgestemde doorvoer van meer dan 64 acceleratoren, zou nog steeds van Creatify zijn.
De eerlijke symmetrie is deze: Kimi K3 geeft je een checkpoint dat je je niet kunt veroorloven te serveren, en Boreal geeft je een dienst die je niet bij zijn leverancier weg kunt halen. Geen van beide is zelf te hosten. Slechts één van hen is een hedge tegen leveranciersrisico, en het is degene waarbij de hedge meer kost dan datgene wat wordt afgedekt.

Het specificatiecontrast
• Uitvoer — Boreal: gerenderde video, 720p-klasse, tekst-naar-video en afbeelding-naar-video. Kimi K3: alleen tekst.
• Gewichten — Boreal: propriëtair, eigendom van en aangeboden door Creatify. Kimi K3: gepubliceerd op 27 juli 2026, 96 Safetensors-shards, aangepaste MIT-licentie met omzetafhankelijke doorverkoopvoorwaarden.
• Zelfhosting — Boreal: niet mogelijk. Kimi K3: in principe mogelijk, waarbij Moonshot ten minste 64 acceleratoren aanbeveelt.
• Prijs — Boreal: $0,01 per seconde voltooide video. Kimi K3: $3,00 per 1 mln. input / $15,00 per 1 mln. output, met leesbewerkingen uit cache tegen $0,30 per 1 mln. en een vast tarief over het volledige contextvenster.
• Context — Boreal: niet gepubliceerd. Kimi K3: 1.048.576 tokens, zonder toeslag voor lange context.
• Latentie — Boreal: opgegeven als 1:1 met realtime. Kimi K3: p50 tijd tot eerste token van 10,00 seconden op ons board — het plafond dat onze instrumentatie rapporteert, dus lees het als "traag" in plaats van als een precieze meting.
• Bewijs — Boreal: alleen door de leverancier uitgevoerd. Kimi K3: leveranciersgegevens, waaronder 93,5 op GPQA Diamond en 88,3 op Terminal-Bench 2.1, een eerste plaats in de Frontend Code Arena met 1679 Elo, en onafhankelijke bevindingen waaronder een uitvalpercentage van 36% bij problemen met verborgen invarianten.
Het spoor dat je niet kunt uitschakelen
Kimi K3 heeft een afrekeningswijze die zelfs onder redeneermodellen ongewoon is, en dat is het meest concrete kostenverschil in deze vergelijking.
De denkmodus kan niet worden uitgeschakeld, en de standaard redeneerinspanning staat op maximaal. Elk verzoek produceert een volledige redeneertrace, en elk token van die trace wordt gefactureerd tegen $15,00 per miljoen output. Voor een taak waarbij het antwoord één woord is, betaal je nog steeds voor een beraadslaging. Cache-reads tegen $0,30 per miljoen verzachten de inputzijde aanzienlijk, en de vaste prijsstelling over de volledige 1M-context is echt vriendelijker dan de gelaagde structuren die zijn concurrenten gebruiken — maar de outputzijde heeft geen goedkope modus.
De kosten van Boreal hebben geen vergelijkbare hendel die je verkeerd kunt instellen. Een clip van vijf seconden kost vijf cent, of het model nu hard of triviaal werkte, omdat het artefact de eenheid is en het artefact vaststaat. Dat is niet duidelijk beter — het wordt simpelweg niet beïnvloed door wat het model intern ook doet.
Kimi K3 staat in onze catalogus, en het is met afstand het drukste model op onze lijst: 3.150,6 miljoen tokens in de afgelopen zeven dagen, meer dan zeventien keer het verkeer van Grok 4.6 en dertien keer dat van GPT-5.6 Sol. Dat volume is hoe een open-weight frontiermodel er in productie uitziet — veel aanroepers, prijsgevoelig, bereid om om te routeren rond wie het model het slechtst serveert. Het zit achter dezelfde sleutel als de rest van de catalogus tegen het lijsttarief van de provider met 0% markup, wat meer uitmaakt voor een open-weightmodel dan voor een gesloten model: wanneer de checkpoint openbaar is, wordt de prijs bepaald door de provider die het serveert, dus de prijs is de variabele waarop wordt geconcurreerd, en die beweegt.
Boreal staat niet in onze catalogus. OrcaRouter levert geen videogeneratiemodellen, en de tekstlaag van een advertentiepijplijn — de briefs, de hookvarianten, de compliancecontrole — is waar wij ons daartoe verhouden.

Welke, en waar je op moet letten
Als je beperking leveranciersconcentratie is en je hebt toegang tot serieuze rekenkracht, dan is Kimi K3 de enige van deze twee die een echt antwoord biedt, en het faalpercentage van 36% op problemen met verborgen invarianten is het getal dat je daartegen moet afwegen. Het is een model in de frontierklasse met een echte ontsnappingsroute eraan verbonden, en de ontsnappingsroute is duur genoeg dat de meeste teams die nooit zullen gebruiken.
Als je beperking de kosten per afgeronde advertentie-asset zijn, is Boreal de goedkopere en veel voorspelbaardere optie, en de beperking ervan is de kwaliteit bij één specifiek formaat: een clip met één pratend persoon scoorde 60% in de eigen test met 40 cases van de leverancier, tegenover 83% en 85% bij product- en creatorscènes. Test dat formaat voordat je er een campagne op inzet.
Eén voorbehoud bij het bewijsmateriaal, want het geldt voor beide. De gepubliceerde intelligentiecijfers van Kimi K3 zijn minstens één keer herzien, en oudere cijfers in de reeks 57 tot 60 mogen niet worden aangehaald naast de huidige cijfers van dezelfde evaluator — een herinnering eraan dat een benchmarkscore een observatie op een bepaald moment is, geen eigenschap van het model. En elk kwaliteitscijfer dat aan Boreal wordt gekoppeld, komt uit Creatify's eigen lanceringsbericht. De eerste onafhankelijke evaluatie van Boreal, wanneer die ook komt, zal meer waard zijn dan alles wat er momenteel over gepubliceerd is.

