
GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed : deux niveaux de vitesse, un prix manquant
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 610 tok/s
- openaiNOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- anthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- grokNOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 189 tok/s
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
Deux fournisseurs ont livré la même idée de produit à trois semaines d'intervalle, et la différence entre eux est la meilleure façon de voir ce que chacun vend réellement. Le camp Xiaomi est arrivé le 22 septembre 2026 : Xiaomi MiMo v2.6 Pro Ultraspeed est le même point de contrôle de 1,02 billion de paramètres que MiMo-V2.6-Pro, servi plus rapidement, à 4,35 $ par million de jetons d'entrée et 8,70 $ par million de jetons de sortie, contre 0,44 $ et 0,87 $ pour la voie Pro standard. Le GPT-5.6 Sol Ultrafast du fournisseur est la même manœuvre appliquée à GPT-5.6 Sol : des poids identiques, jusqu'à 750 jetons de sortie par seconde, jusqu'à 14× le niveau standard, fonctionnant sur du matériel à l'échelle de la plaquette de Cerebras — et aucun prix publié, six semaines après l'annonce du mode le 13 août.
Mettez les deux côte à côte et l’anomalie saute aux yeux. Xiaomi a publié une grille tarifaire avant de publier la plupart des benchmarks. OpenAI a publié les benchmarks, le partenaire matériel et les noms des clients — et n’a toujours pas publié de chiffre sur lequel bâtir un budget. L’un de ces paliers peut être acheté aujourd’hui. L’autre est une valeur dans un schéma d’API. Les comparer consiste donc moins à déterminer lequel est le plus rapide qu’à déterminer ce que vaut un palier de vitesse quand un fournisseur vous a communiqué le prix et que l’autre ne l’a pas fait.
Ce que chacun est réellement
Ni l’un ni l’autre n’est un nouveau modèle. C’est là la prémisse commune, et il vaut la peine de l’affirmer sans détour, car les deux lancements ont attiré une couverture qui traitait un changement de service comme une mise à disposition de nouvelles capacités.
MiMo v2.6 Pro Ultraspeed est une configuration de service du modèle phare de Xiaomi : même point de contrôle à mélange d'experts creux de 1,02 T de paramètres, avec 42 B activés par token, même contexte de 1 M de tokens, même multimodalité native pour le texte, l'image, la vidéo et l'audio, mêmes poids sous licence MIT sur les dépôts publics. La documentation de Xiaomi elle-même annonce jusqu'à 20 fois la vitesse de sortie du service Pro standard, à qualité égale ; des fiches de catalogue tierces décrivant le même modèle le même jour indiquent environ 10 fois. Personne n'a publié de mesure permettant de concilier les deux.
GPT-5.6 Sol Ultrafast est une configuration de service du produit phare d'OpenAI : même point de contrôle, même comportement de raisonnement, même fenêtre de contexte de 1 050 000 jetons, même sortie maximale de 128K, mêmes réponses. L'accélération est matérielle plutôt que liée à l'ordonnancement — les poids du modèle résident dans la SRAM sur puce du silicium à l'échelle du wafer de Cerebras au lieu de faire la navette entre la mémoire et les unités de calcul du GPU — et il s'agit du premier produit du partenariat de calcul OpenAI–Cerebras de janvier 2026, d'un montant estimé à environ 10 milliards de dollars sur trois ans.
Donc, l’axe honnête de comparaison n’est pas l’intelligence. C’est ce que le fournisseur a choisi de modifier, ce qu’il a facturé pour cette modification, et quelle part de la modification il vous a laissé vérifier.

Les grilles tarifaires, y compris celle qui est vierge
• MiMo v2.6 Pro Ultraspeed — 4,35 $ en entrée / 8,70 $ en sortie par million de tokens, publié par Xiaomi.
• MiMo-V2.6-Pro standard — 0,44 $ / 0,87 $, publiés par les catalogues commerciaux de Xiaomi. Environ 9,9× en entrée et exactement 10× en sortie.
• GPT-5.6 Sol Ultrafast — aucune grille tarifaire publiée au 27 septembre 2026. La page de tarification d'OpenAI comporte toujours quatre onglets — Standard, Batch, Flex, Fast — et ce niveau de service n'y figure pas.
• GPT-5.6 Sol standard — 4,00 $ / 20,00 $ par million, tarif promotionnel actuel d’OpenAI, avec entrée en cache à 0,40 $ et un palier de contexte long à 8,00 $ / 30,00 $ au-delà d’environ 272 K tokens d’entrée.
• La seule offre premium comparable qu'OpenAI ait jamais tarifée — Fast mode, à 8,00 $ / 40,00 $, soit exactement le double du tarif standard pour une vitesse de sortie jusqu'à environ 2,5×.
C'est cette dernière ligne qui explique tout l'intérêt de la case vide. Le palier de vitesse de Xiaomi coûte dix fois le prix de la voie standard et promet dix à vingt fois la vitesse, ce qui, comme échange, est au moins cohérent : on paie proportionnellement plus pour proportionnellement moins d'attente, et le pari est que le temps réel est le produit. Le palier de vitesse d'OpenAI représente une ponction plus lourde sur un silicium plus rare que le mode Fast, donc quel que soit son coût final, le précédent laisse présager un supplément plutôt qu'une remise. Mais « le précédent laisse présager un supplément » n'est pas un chiffre, et tant qu'il n'en existe pas, ce palier ne peut pas du tout être comparé à UltraSpeed sur le prix — seulement sur le fait que Xiaomi a bien voulu annoncer son chiffre, et OpenAI non.
D'où viennent les chiffres
Les deux niveaux ont des problèmes de preuve opposés, et il vaut la peine de nommer les deux plutôt que de couper la poire en deux.
L'affirmation de Xiaomi sur la vitesse est vague quant à son ampleur, mais elle s'ancre à un prix publié. Le facteur 20× est un plafond annoncé par le fournisseur, dans des conditions que Xiaomi n'a pas précisées ; le 10× est ce qu'une fiche de catalogue a bien voulu présenter comme typique ; et le multiplicateur réel se situe quelque part dans une large fourchette que personne n'a mesurée publiquement à un niveau de concurrence déclaré. En regard de cela, le prix est exact, les pondérations sont téléchargeables sous licence MIT, et le rapport technique ainsi que l'environnement d'entraînement par apprentissage par renforcement sont publics — vous pouvez examiner ce que Xiaomi a fait, mais vous ne pouvez pas encore vérifier à quelle vitesse cela tourne.
L’affirmation de vitesse d’OpenAI est précise en amplitude, mais sans ancrage dans un produit achetable. Jusqu’à 750 jetons de sortie par seconde, jusqu’à 14× la norme, énoncé sans détour. C’est aussi un chiffre de débit pour les jetons de sortie, et non un multiplicateur homogène de bout en bout : le traitement des entrées et le raisonnement propre du modèle ne se compressent pas selon ce rapport, d’où la mention d’un maximum par l’entreprise. Les benchmarks à l’appui sont rapportés par le fournisseur et, dans un cas, croisés entre fournisseurs — une exécution de Humanity's Last Exam de 2 500 questions donnée comme terminée en 11 heures 11 minutes, contre 78 heures 27 minutes pour Claude Fable 5, avec une précision comparable. La couverture indépendante du lancement a cité une comparaison plus resserrée, d’environ 11×, de la vitesse de génération sur la même exécution, tandis que les propres chiffres de Cerebras impliquent environ 7× pour le temps de test total. Trois parties, trois fractions d’une même charge de travail, aucune reproduction par un tiers de l’une d’entre elles. Cerebras rapporte séparément 5,6× de bout en bout sur GDP-Val, sans perte de qualité mesurable, également non reproduit.
Les deux séries de chiffres sont avancées par les fournisseurs. La différence, c’est que l’imprécision de Xiaomi concerne la vitesse, tandis que celle d’OpenAI concerne le coût, et pour quiconque établit un budget, le coût est plus difficile à estimer.

Ce qui s'est passé cette semaine, et pourquoi cela ne comble pas l'écart
Si cette comparaison a la moindre accroche d'actualité, c'est grâce à un commit plutôt qu'à une annonce. La valeur ultrafast figure dans le schéma openai-openapi public d'OpenAI depuis le 13 août 2026 — le jour même où le mode a été annoncé —, avec la description qui la réserve à gpt-5.6-sol et la qualifie de soumise à un contrôle d'accès. Le commit qui a fait l'actualité cette semaine est plus tardif et plus modeste : le 25 septembre 2026, fe4f7a1 a ajouté ultrafast à deux autres énumérations, le paramètre service-tier au niveau de la requête et le champ de politique service-tier rattaché aux agents. Avant ce commit, ces deux listes affichaient auto, default, flex, priority, fast. Après, on y trouve une entrée décrite comme « Utilise le niveau de service ultrafast. »ultrafast aux énumérations service_tier de sa spécification publique openai-openapi — le champ que le schéma décrit comme « le niveau de service utilisé pour les requêtes de modèle », et le champ de politique rattaché aux agents. Avant ce changement, cette liste indiquait default, flex, priority, fast. Après, on y trouve une entrée décrite comme « Utilise le niveau de service ultrafast. »
La distinction compte pour quiconque lit la couverture. Il ne s'agit pas du palier en cours de création ; il s'agit du palier que l'on raccorde au champ avec lequel un agent est configuré, ce qui signifie qu'un client peut éventuellement être écrit contre lui sans aucun nouvel endpoint. Un article publié le lendemain décrit un sélecteur Fast / Standard / Ultrafast qui arrive dans le Responses API Playground, avec un accès plus large attendu après la conférence DevDay d'OpenAI. Nous n'avons pas vu le sélecteur et OpenAI n'a pas publié de note de déploiement, donc cette partie repose sur une source unique. Ce qui est vérifiable, ce sont les entrées de schéma ajoutées et l'absence persistante d'une grille tarifaire six semaines après l'annonce.
Pendant ce temps, l'offre de Xiaomi est achetable depuis cinq jours et reste la seule des deux que l'on puisse mettre sur une facture. Sa propre question ouverte est différente : de savoir si une prime de 10× se maintient, ou si elle se comporte comme la plupart des tarifs de lancement d'un nouveau palier premium et dérive vers la voie standard une fois que la couverture de lancement s'arrête. Standard Pro à 0,44 $ / 0,87 $ est la référence, et un palier qui s'ouvre à dix fois sa référence finit rarement à ce niveau.
Choisir entre eux, étant donné que vous ne le pouvez probablement pas.
Le fait pratique et inconfortable est que, pour la plupart des lecteurs, il s’agit d’une comparaison entre un palier que vous ne pouvez pas acheter et un autre que vous ne devriez probablement pas acheter au prix catalogue. GPT-5.6 Sol Ultrafast est un aperçu sur liste d’attente pour certains clients sélectionnés, qui s’étend à mesure que la capacité augmente, sans date de disponibilité générale ni prix ; MiMo v2.6 Pro Ultraspeed est disponible, coûteux et conçu pour un type d’acheteur bien précis.
Le test de charge de travail est le même pour les deux, et il porte sur la forme de votre graphe de requêtes plutôt que sur la taille de votre prompt. Une seule génération longue y gagne bien moins que le multiplicateur annoncé, car le traitement des entrées et le raisonnement ne s'accélèrent pas dans le même rapport. Une boucle d'agent en quarante étapes derrière une seule action visible par l'utilisateur y gagne quelque chose de bien plus proche du chiffre complet, car chaque aller-retour représente une latence qu'une personne subit en attendant. Si votre trafic ressemble à la deuxième forme, les deux niveaux vous sont destinés ; s'il ressemble à la première, la voie standard sur l'un ou l'autre modèle a toujours été le bon choix, et la voie standard de MiMo-V2.6-Pro à $0.44 / $0.87 est l'un des moyens les moins chers d'appeler un modèle de la classe des mille milliards de paramètres, où que ce soit.
Ce que ni l’un ni l’autre des niveaux ne change, c’est que vous achetez de la latence, pas de la qualité. Si vous évaluez les performances d’UltraSpeed ou d’Ultrafast par rapport à sa propre voie standard sur des invites identiques et que vous obtenez des réponses différentes, c’est un résultat qui mérite d’être signalé, pas une fonctionnalité — rien dans la description de l’un ou l’autre fournisseur ne prétend que les poids ont changé.
C'est aussi le cas où un routeur justifie sa place, et précisément pour le palier que vous ne pouvez pas obtenir. GPT-5.6 Sol est disponible sur OrcaRouter en tant que openai/gpt-5.6-sol au tarif propre du fournisseur, avec zero markup on tokens sur le point de terminaison compatible OpenAI à api.orcarouter.ai/v1, de sorte que la voie standard vers laquelle vous vous rabattriez n'est qu'à un changement d'URL de base près, et la même clé donne accès à plus de 200 modèles. C'est important, car la réponse honnête à « dois-je utiliser Ultrafast » aujourd'hui est « vous ne pouvez pas, alors décidez ce qui portera le trafic interactif en attendant » — et le moyen d'acheter de la latence sans liste d'attente est d'acheminer les appels interactifs vers le modèle du catalogue qui franchit votre seuil de qualité avec le temps d'horloge le plus faible, et de laisser le travail nocturne sur la voie la moins chère qui passe le seuil. Quand le palier s'ouvrira, c'est le commutateur que vous actionnerez. Notez clairement ce que nous n'hébergeons pas : aucun modèle Xiaomi n'est sur OrcaRouter, donc MiMo v2.6 Pro Ultraspeed provient de l'API propre de Xiaomi et de plusieurs plateformes tierces, et cette page n'est pas une voie d'accès à celui-ci.

Qu'est-ce qui réglerait ça ?
Trois mesures, dont aucune n’existe encore. Une grille tarifaire Ultrafast publiée ferait de ceci la comparaison qu’elle mérite d’être, plutôt qu’une comparaison avec un trou dedans. Une distribution de latence indépendante à un niveau de concurrence déclaré vous dirait si le véritable multiplicateur de Xiaomi se rapproche plutôt de 10× ou de 20×, et s’il tient sous charge plutôt que dans une démonstration en flux unique. Et une reproduction indépendante de la suite de benchmarks de l’un ou l’autre fournisseur ferait sortir les deux ensembles de chiffres de la colonne des revendications.
D’ici là, la lecture défendable est étroite. Xiaomi a commercialisé un palier de vitesse avec un prix et une vitesse vague ; OpenAI a commercialisé un palier de vitesse avec une vitesse précise et aucun prix ; les deux sont le même modèle que l’offre par rapport à laquelle leur prix est établi, et aucun n’a fait l’objet de mesures indépendantes. Si vous avez besoin de cette latence maintenant et que la charge de travail est interactive, UltraSpeed est bien réel, disponible à l’achat et tarifé pour exactement l’acheteur qu’il vise. Si vous en avez besoin maintenant et que la charge de travail n’est pas interactive, les voies standard des deux modèles sont moins chères, éprouvées et disponibles aujourd’hui — et le palier dont tout le monde débat sera encore là quand quelqu’un publiera un chiffre.
