Une carte de titre générée indiquant « Boreal vs Kimi K3 », avec le sous-titre « Aucun des deux ne tourne sur votre matériel », des icônes plates au trait représentant un cadre de lecture vidéo, une pile de lames de serveur et un cadenas, avec le logo OrcaRouter incrusté en bas à droite.
Guides & Insights

Boreal vs Kimi K3 : Aucun des deux ne tourne sur votre matériel

Auteur

Magnus Corvin

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Quatre-vingt-seize fragments Safetensors. Voilà ce que vous rapporte le téléchargement de Kimi K3 — un modèle à mélange d'experts de 2,8 billions de paramètres, dont 104 milliards de paramètres actifs par token, publié sous licence MIT modifiée le 27 juillet 2026, onze jours après sa sortie par Moonshot AI. Les propres recommandations de Moonshot pour le servir préconisent des configurations en supernœuds d'au moins 64 accélérateurs. Borealne peut pas être téléchargé du tout : le modèle de vidéo publicitaire de Creatify, lancé le 15 septembre 2026, est fermé et en libre-service, facturé un centime par seconde de vidéo finie de classe 720p. L'un vous remet les poids et la facture matérielle. L'autre garde les poids et vous facture à la seconde. Aucun des deux ne tourne sur votre matériel, et les raisons sont opposées — c'est précisément pourquoi la comparaison vaut la peine d'être faite.

Ce que les « poids ouverts » vous livrent réellement

L’étiquette open-weights compte vraiment dans cette comparaison, et elle compte moins qu’elle n’en a l’air.

Ce que vous obtenez réellement avec Kimi K3, c’est la pérennité. Les poids existent sous forme de fichiers. Si Moonshot AI modifiait sa politique tarifaire, reléguait le modèle au second plan ou disparaissait, le checkpoint serait toujours là — et les piles de service qui le prennent en charge aussi, vLLM, SGLang et TokenSpeed figurant tous parmi les chemins pris en charge. Ce n’est pas une affirmation marketing ; c’est une propriété de l’artefact. Pour une organisation dont le registre des risques inclut la concentration des fournisseurs, c’est l’élément le plus précieux de cette version.

Ce que vous n'obtenez pas, c'est un déploiement que vous pouvez exécuter. Un modèle parcimonieux de 2,8 billions de paramètres comptant 896 experts n'est pas une proposition du type « on quantifie et on lance ». La recommandation officielle de plus de 64 accélérateurs n'est pas une base conservatrice qu'une équipe déterminée peut réduire de beaucoup — c'est une description de la catégorie de machine pour laquelle le modèle a été conçu. Les équipes qui font tourner Kimi K3 à une échelle ressemblant peu ou prou à la production le louent, en pratique, auprès de quelqu'un qui exploite un supernœud. Ce qui signifie que la question de la disponibilité pratique reste inchangée du fait que les poids sont publics : vous achetez toujours de l'inférence à un tiers, et la licence est la seule chose qui a changé.

Il y a un détail de licence qui mérite une lecture attentive, car c’est la partie que la plupart des résumés omettent. Les termes MIT modifiés conditionnent les obligations de branding et d’attribution au-delà de 100 millions d’utilisateurs actifs mensuels ou de 20 millions de dollars de revenus mensuels, et exigent des entreprises de modèle-as-a-service dont les revenus du licencié et de ses affiliés dépassent 20 millions de dollars sur douze mois consécutifs qu’elles concluent un accord distinct avec Moonshot. L’usage interne et le fine-tuning sont largement autorisés. La revente est conditionnée. C’est une licence raisonnable pour un modèle de pointe, et c’est une chose matériellement différente de MIT — pour une startup qui prévoit de bâtir un produit par-dessus, le seuil relève d’une négociation future, non d’un droit présent.

Ce que Boreal vous livre à la place

Boreal fait le pari inverse, et c'est plus délibéré qu'il n'y paraît.

Creatify déclare qu’elle possède les poids et qu’elle les sert elle-même, et que le modèle de base à partir duquel elle a réalisé son post-entraînement est un modèle open source qui génère conjointement l’audio et la vidéo. Ces deux faits réunis constituent toute la stratégie produit. La filiation open source vous indique à peu près à quelle classe de modèle on fait appel et que l’audio n’est pas greffé après coup. La possession vous indique que personne d’autre ne peut le servir, ce qui rend justement possible un prix à la seconde.

Ce que vous obtenez n’est pas de la pérennité — c’est du débit. Creatify annonce un rendu à peu près à 1:1 avec le temps réel : une seconde de vidéo finale par seconde de temps réel. C’est un résultat d’ingénierie d’inférence plutôt qu’un résultat de qualité du modèle, et c’est ce qui survivrait à la publication des poids demain. Si le checkpoint apparaissait sur Hugging Face la semaine prochaine, la capacité de rendre un clip de cinq secondes en environ cinq secondes pour cinq cents appartiendrait encore à celui qui a construit la pile de service — et l’implémentation de référence, avec un débit déjà optimisé équivalent à plus de 64 accélérateurs, resterait encore celle de Creatify.

Donc, la symétrie honnête est celle-ci : Kimi K3 vous donne un checkpoint que vous n’avez pas les moyens de servir, et Boreal vous donne un service que vous ne pouvez pas retirer à son fournisseur. Les deux sont non auto-hébergeables. Un seul des deux constitue une couverture contre le risque fournisseur, et c’est celui dont la couverture coûte plus cher que ce qu’elle couvre.

A generated two-column scoreboard for Boreal vs Kimi K3 sharing six dimension labels. Boreal reads output rendered video, weights closed and vendor-served, self-hosting not possible, meter $0.01 per second, context not published, independent score none yet. Kimi K3 reads output text only, weights open with 96 shards, self-hosting 64+ accelerators, meter $3 / $15 per 1M, context 1M at a flat rate, independent score 1679 Elo front-end. Footer reads "Boreal figures vendor-run and unreproduced; Kimi K3 per our catalogue and third-party evaluators."

Le contraste de spécification

• Sortie — Boreal : vidéo rendue, classe 720p, texte-vers-vidéo et image-vers-vidéo. Kimi K3 : texte uniquement.

• Poids — Boreal : propriétaires, détenus et servis par Creatify. Kimi K3 : publié le 27 juillet 2026, 96 fragments Safetensors, MIT modifiée avec des conditions de revente subordonnées aux revenus.

• Auto-hébergement — Boreal : impossible. Kimi K3 : possible en principe, Moonshot recommandant au moins 64 accélérateurs.

• Prix — Boreal : 0,01 $ par seconde de vidéo terminée. Kimi K3 : 3,00 $ par million de tokens d'entrée / 15,00 $ par million de tokens de sortie, avec des lectures en cache à 0,30 $ par million et un tarif forfaitaire sur toute la fenêtre de contexte.

• Contexte — Boreal : non publié. Kimi K3 : 1 048 576 tokens, sans surcoût pour le contexte long.

• Latence — Boreal : annoncée à 1:1 avec le temps réel. Kimi K3 : p50 du temps jusqu’au premier token de 10,00 secondes sur notre tableau de bord — le plafond que rapporte notre instrumentation, donc à interpréter comme « lent » plutôt que comme une mesure précise.

• Preuves — Boreal : uniquement des exécutions réalisées par le fournisseur. Kimi K3 : des données du fournisseur incluant 93,5 sur GPQA Diamond et 88,3 sur Terminal-Bench 2.1, une première place dans le Frontend Code Arena à 1679 Elo, et des résultats indépendants qui incluent un taux d’échec de 36 % sur des problèmes à invariants cachés.

La trace que vous ne pouvez pas désactiver

Kimi K3 possède une particularité de facturation inhabituelle, même parmi les modèles de raisonnement, et c'est la différence de coût la plus concrète dans cette comparaison.

Le mode de réflexion ne peut pas être désactivé, et l’effort de raisonnement par défaut est réglé au maximum. Chaque requête produit une trace de raisonnement complète, et chaque jeton de cette trace est facturé à 15,00 $ par million de jetons en sortie. Pour une tâche dont la réponse tient en un seul mot, vous payez quand même pour une délibération. Les lectures de cache à 0,30 $ par million allègent considérablement le côté entrée, et la tarification uniforme sur l’ensemble du contexte de 1M est réellement plus favorable que les structures par paliers qu’utilisent ses concurrents — mais le côté sortie n’a pas de mode économique.

Le coût de Boreal ne comporte aucun levier équivalent qu’on puisse mal régler. Un clip de cinq secondes coûte cinq cents, que le modèle ait travaillé dur ou de façon triviale, car l’artefact est l’unité et l’artefact est fixe. Ce n’est pas manifestement mieux — c’est simplement insensible à tout ce que le modèle fait en interne.

Kimi K3 figure dans notre catalogue, et c'est, de loin, le modèle le plus sollicité de notre tableau : 3 150,6 millions de tokens sur les sept derniers jours, plus de dix-sept fois le trafic de Grok 4.6 et treize fois celui de GPT-5.6 Sol. Un tel volume, c'est à quoi ressemble un modèle de frontière à poids ouverts en production — beaucoup d'appelants, sensibles au prix, prêts à contourner celui qui le sert le plus mal. Il se trouve derrière la même clé que le reste du catalogue, au tarif catalogue du fournisseur, avec 0 % de marge, ce qui compte davantage pour un modèle à poids ouverts que pour un modèle fermé : quand le checkpoint est public, le prix est fixé par le fournisseur qui le sert, si bien que le prix devient la variable concurrentielle, et il bouge.

Boreal ne figure pas dans notre catalogue. OrcaRouter ne propose pas de modèles de génération vidéo, et c'est dans la couche textuelle d'un pipeline publicitaire — les briefs, les variantes d'accroche, la passe de conformité — que nous nous situons par rapport à lui.

A screenshot of Creatify's own launch post for Boreal, dated September 15 2026 and headed "Introducing Boreal: frontier-quality AI video at a cent a second", showing the Boreal by Creatify Labs logo card and the opening paragraph stating that Boreal generates text-to-video and image-to-video at one cent per second, about $0.05 for a five-second clip, and renders in realtime.

Lequel, et quoi regarder

Si votre contrainte est la concentration des fournisseurs et que vous disposez d'une puissance de calcul sérieuse, Kimi K3 est le seul de ces deux modèles à offrir une véritable réponse, et le taux d'échec de 36 % sur les problèmes à invariant caché est le chiffre à mettre en balance. C'est un modèle de classe frontière auquel est attachée une véritable porte de sortie, et cette porte de sortie est suffisamment coûteuse pour que la plupart des équipes ne l'utilisent jamais.

Si votre contrainte est le coût par création publicitaire finie, Boreal est l’option la moins chère et de loin la plus prévisible, et sa limite réside dans la qualité sur un format précis : un clip d’une personne qui parle a obtenu 60 % dans le test interne de 40 cas du fournisseur, contre 83 % et 85 % pour les scènes de produit et de créateur. Testez ce format avant d’y engager une campagne.

Une mise en garde concernant les données probantes, car elle s’applique aux deux. Les chiffres d’intelligence publiés de Kimi K3 ont été révisés au moins une fois, et les chiffres plus anciens de la plage 57 à 60 ne devraient pas être cités aux côtés des chiffres actuels du même évaluateur — un rappel qu’un score de benchmark est une observation datée, et non une propriété du modèle. Et chaque chiffre de qualité associé à Boreal provient de la propre publication de lancement de Creatify. La première évaluation indépendante de Boreal, quand elle arrivera, vaudra plus que tout ce qui est actuellement publié à son sujet.

A screenshot of the OrcaRouter model page for kimi/kimi-k3, showing Kimi K3 by MoonshotAI dated 2026-07-15 marked Featured, a 1M-token context, text + image input with text output, a p50 time to first token of 10.00 seconds, input $3.00 and output $15.00 per 1M tokens, and 3150.6M tokens of traffic in the last 7 days.