
GPT-6.1 Ultrafast vs Xiaomi Mi v2.6 Pro Ultraspeed : Deux voies rapides, l'une dit ce qu'elle coûte
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Les deux moyens les plus rapides d'acheter un modèle de frontière ont été mis en vente à seize jours d'intervalle, et un seul d'entre eux vous a dit comment la vitesse était produite. GPT-6.1 Ultrafast — le palier de service au-dessus de GPT-6.1 Sol, qu'OpenAI a publié le 29 septembre 2026 et qui a obtenu ce palier le 8 octobre 2026 — est un modèle phare fermé auquel vous accédez via une API, facturé six fois le prix de Standard, sans aucune description publiée de ce qui se passe entre les poids et votre requête. Xiaomi MiMo v2.6 Pro Ultraspeed, publié le 22 septembre 2026, est un palier de vitesse au-dessus de MiMo-V2.6-Pro, un checkpoint sous licence MIT dont Xiaomi a également publié l'environnement d'apprentissage par renforcement. Les deux vendent de la latence à un multiple. Seul le multiple de Xiaomi repose sur quelque chose qu'un client peut inspecter, et cette différence compte davantage dans la décision que l'une ou l'autre des affirmations de vitesse.
Le prix des deux voies est la partie facile, et il est couvert ci-dessous. La partie difficile, c’est qu’un palier de vitesse est une promesse de service, et les deux fournisseurs ont fait cette promesse à des niveaux de divulgation très différents — l’un a emprunté son chiffre phare à un modèle frère, l’autre a livré la recette d’entraînement en même temps que la liste de prix. Si vous êtes sur le point de confier une charge de travail de production à une voie rapide, l’écart de divulgation est le risque que vous assumez réellement.
Les prix, avec les deux côtés sur la même ligne
Les deux niveaux sont vendus par multiples d’une voie standard, et les multiples sont suffisamment proches pour que le prix ne soit pas ce qui les distingue.
• Voie standard — GPT-6.1 Sol à 2,00 $ en entrée / 10,00 $ en sortie par million de tokens, contre MiMo-V2.6-Pro à 0,44 $ / 0,87 $.
• Voie rapide — GPT-6.1 Ultrafast à 12,00 $ / 60,00 $, face à MiMo-V2.6-Pro-UltraSpeed à 4,35 $ / 8,70 $.
• Le multiple — exactement 6x sur chaque ligne pour le palier OpenAI, environ 9,9x en entrée et exactement 10x en sortie pour celui de Xiaomi.
• Entrée mise en cache — GPT-6.1 Sol est facturé 0,10 $ par million sur Standard et 0,60 $ sur Ultrafast ; la grille tarifaire MiMo que nous pouvons consulter ne publie pas de ligne distincte pour l’entrée mise en cache, pour aucune des deux voies.
• Contexte long — GPT-6.1 Sol refacture l'ensemble de la requête à 2x les tarifs d'entrée et de cache et à 1,5x en sortie au-delà de 272 000 jetons d'entrée, ce qui place Ultrafast à $24.00 / $1.20 / $30.00 / $90.00. MiMo-V2.6-Pro offre une fenêtre de contexte de 1 M de jetons, sans seuil de facturation équivalent publié.
• Écart absolu — les deux voies rapides sont séparées d'un facteur 2,8 en entrée et d'un facteur 6,9 en sortie, ce qui correspond à l'écart entre un modèle fermé de pointe et un modèle à poids ouverts qui apparaît au sein du palier de vitesse plutôt qu'au tarif standard.
Le résumé en une ligne de ce bloc : Xiaomi facture un multiple plus élevé sur un modèle bien moins cher, et OpenAI facture un multiple plus faible sur un modèle bien plus cher. Sur les jetons de sortie, vous payez 60,00 $ par million pour la voie OpenAI et 8,70 $ pour celle de Xiaomi. Aucun des deux fournisseurs n'offre de réduction pour la vitesse ; tous deux la facturent comme un produit distinct, ce qui est le premier signe que, dans les deux cas, la voie standard reste la valeur par défaut et que la voie rapide est une exception que l'on justifie en fonction de la charge de travail.
Ce que chaque fournisseur vous dira au sujet de la vitesse
C'est ici que les deux déploiements cessent d'être symétriques, et c'est l'élément le plus utile de la page.
Le chiffre publié par OpenAI pour Ultrafast est que GPT-6 Astra Ultrafast génère des tokens jusqu’à 8 fois plus vite que GPT-6 Astra en mode Standard dans Codex. Il s’agit d’une mesure d’un autre modèle, dans un autre client, formulée comme un plafond. La documentation qui couvre Ultrafast pour GPT-6.1 Sol indique que ce niveau réduit le temps entre les tokens de sortie générés et renvoie à une grille tarifaire ; elle ne donne aucun chiffre pour le niveau Sol. Ainsi, le chiffre phare associé à ce déploiement est emprunté au modèle frère qui bénéficie d’Ultrafast depuis le 29 septembre, et aucun tiers indépendant n’a publié de mesure en tokens par seconde pour l’un ou l’autre. Il pourrait bien se vérifier — même pile de service, même mécanisme — mais il s’agit d’un plafond fourni par le fournisseur que OpenAI n’a pas mesuré lui-même pour ce modèle.
La divulgation de Xiaomi est d'une autre nature, et la différence n'est pas qu'elle soit plus précise. Ses propres documents affirment qu'UltraSpeed atteint jusqu'à 20 fois la vitesse de sortie du service Pro standard à qualité égale. Des fiches de catalogue tierces décrivant le même modèle le même jour indiquent environ 10 fois. Les deux chiffres circulent, ce ne sont pas les mêmes, et personne n'a publié de mesure permettant de les concilier. Si l'on lit cela honnêtement : « jusqu'à 20x » est un plafond annoncé par le fournisseur dans des conditions que Xiaomi n'a pas précisées, « environ 10x » est ce qu'un catalogue a bien voulu présenter comme typique, et le multiplicateur réel se situe quelque part dans une large fourchette tant que personne ne publie des distributions de latence par requête à un niveau de concurrence déclaré.
Donc Xiaomi vous donne deux chiffres qui ne concordent pas, et OpenAI vous donne un chiffre qui appartient à un autre modèle. Ni l'un ni l'autre n'est un fait sur lequel vous pouvez baser un budget, et la conséquence pratique est la même dans les deux cas : mesurez le niveau sur vos propres prompts avant d'y engager un chemin de production.
L’asymétrie qui compte vraiment : ce que les chiffres supplémentaires apportent
Les promesses de vitesse mises à part, les deux voies relèvent de types de type très différents, et c'est là que le choix cesse d'être une comparaison de prix.
MiMo-V2.6-Pro est une conception creuse de mélange d'experts que Xiaomi a décrite publiquement : 1,02 billion de paramètres au total, dont 42 milliards activés par token, une fenêtre de contexte de 1 M de tokens, une multimodalité native sur le texte, l'image, la vidéo et l'audio, et une étiquette de licence MIT sur les checkpoints publiés. Le lot de publication comprend un rapport technique et des notes de déploiement, et Xiaomi indique qu'elle ouvre le code source de l'environnement d'entraînement par apprentissage par renforcement ainsi que son code, afin que le post-entraînement puisse être examiné et reproduit. La session de RL est également documentée — 30 étapes et environ 750 000 trajectoires par modèle, en moins de six jours, pour une dépense publiée combinée d'environ 3 474 715 $ sur les sessions Pro et Flash. Sur DeepSWE v1.1, le propre harnais de Xiaomi avec mini-swe-agent à avg@3, l'entreprise rapporte que MiMo-V2.6-Flash passe de 48,8 à 65,68 et MiMo-V2.6-Pro de 58,4 à 72,57 au cours de cette session. Ce sont des chiffres rapportés par le fournisseur et non reproduits ; la distinction entre « le harnais de Xiaomi dit 72,57 » et « 72,57 est le score » est la différence entre une affirmation et un fait.
GPT-6.1 Sol ne publie rien de tout cela. Aucun nombre de paramètres, aucune note d’architecture, aucun chiffre sur les dépenses d’entraînement, aucun checkpoint, et aucune licence à lire — il y a une fiche de modèle, une fenêtre de contexte, une date de coupure des connaissances au 30 avril 2026, et une API. C’est l’arrangement normal pour un laboratoire de pointe et ce n’est pas une critique. Mais cela a une conséquence pour une décision d’achat que la couverture du lancement tend à omettre : avec la voie des modèles à poids ouverts, un palier rapide décevant est récupérable. Si UltraSpeed s’avère ne pas valoir 10x votre trafic, le même checkpoint est téléchargeable et vous pouvez le servir vous-même ou via un autre fournisseur, ce qui plafonne votre risque au coût de la migration. Avec la voie fermée, un palier rapide décevant se traduit par une facture et un budget de limites de débit que vous ajustez à la baisse ; vous ne pouvez pas contourner cela en exécutant les poids, car il n’y a pas de poids à exécuter.
Une mise en garde au sujet de cette étiquette MIT, car elle est réduite à sa plus simple expression dans la couverture du lancement. La licence s'applique aux checkpoints publiés par Xiaomi. UltraSpeed est un service hébergé, et les services hébergés sont régis par des conditions d'utilisation plutôt que par une licence sur les poids. Le droit d'exécuter le checkpoint sur votre propre matériel et le droit de revendre le service accéléré qu'un tiers en propose sont deux droits différents, et seul le premier découle du fichier de licence.


Deux pièges de nommage avant de copier l’un ou l’autre identifiant
Aucun des deux noms dans le titre de cette page n’est un point de contrôle, et la documentation des deux fournisseurs rend cette erreur facile à répéter.
• GPT-6.1 Ultrafast — pas un modèle. L'identifiant dans la requête reste identique à celui du modèle standard ; le palier est défini par un champ de la requête, et le résultat est le même checkpoint, planifié différemment.
• MiMo v2.6 Pro Ultraspeed — ce n’est pas non plus un ensemble de poids distinct. Il s’agit du checkpoint MiMo-V2.6-Pro servi sur un chemin plus rapide et facturé comme une ligne à part entière.
• Ce que cela signifie pour l'évaluation comparative — si vous comparez les deux voies de l'un ou l'autre modèle sur des invites identiques, le résultat attendu est les mêmes réponses à des rythmes différents. Un contenu divergent sur la même entrée est un défaut à signaler, et non une capacité que vous avez achetée.
• Ce que cela signifie pour la vérification de la licence — pour Xiaomi, lisez la fiche du modèle. Pour OpenAI, il n’y a rien à lire, car les poids ne sont pas distribués.
Il existe aussi une asymétrie plus subtile qui se manifeste dans la manière dont chaque niveau est vendu. GPT-6.1 Sol prend en charge la résidence des données aux États-Unis et dans l’UE ainsi que le traitement mondial, y compris avec Ultrafast, de sorte qu’une charge de travail fixée sur un traitement européen dispose d’une réponse documentée. La grille tarifaire MiMo que nous pouvons consulter ne mentionne pas du tout la résidence des données — Xiaomi vend un modèle et un chemin de service, pas une posture de conformité. Pour un acheteur soumis à réglementation, cette seule ligne peut décider de la comparaison avant même que le prix ne soit pris en compte.
Où chaque voie est réellement appelable
Les deux voies rapides sont accessibles via l'API propre à leur fournisseur, et toutes deux apparaissent sur des plateformes tierces. Ni l'une ni l'autre n'est sur OrcaRouter, et il vaut la peine de le dire clairement plutôt que de laisser une page de comparaison sous-entendre le contraire.
Ce qui est disponible sur OrcaRouter, c'est la voie standard du modèle OpenAI : openai/gpt-6.1-sol aux tarifs propres à OpenAI, soit 2,00 $ par million de jetons d'entrée et 10,00 $ par million de jetons de sortie, avec 0 % de marge et le prix du fournisseur répercuté tel quel, de sorte qu'un changement de tarif du fournisseur est appliqué de notre côté le jour même. Ultrafast est un indicateur de niveau de service facturé sur votre propre compte OpenAI, et aucun modèle Xiaomi n'est hébergé ici. Ce qu'une seule clé permet d'obtenir, c'est la voie standard aux côtés de plus de 200 autres modèles derrière un seul point de terminaison compatible OpenAI, avec basculement automatique entre fournisseurs — ce qui est la posture utile lorsque la charge de travail que vous protégez est celle qui remarquerait un plafond de limitation de débit à trois heures du matin.

Quelle voie tester, dans l'ordre
Si votre charge de travail est interactive et que le temps de génération se mesure à l’aune d’une personne, les deux niveaux méritent un essai, et le facteur décisif ne sera pas le prix — ce sera la date d’expiration de votre confiance. La voie des poids ouverts vous permet de vérifier, puis de partir ; la voie fermée vous demande de vérifier auprès du seul fournisseur capable de le servir et de rester. Cette asymétrie est réelle, mais elle n’est pas gratuite non plus : MiMo-V2.6-Pro-UltraSpeed est un service hébergé, donc la sortie est une migration plutôt qu’un changement de configuration, et le checkpoint vers lequel vous migreriez pourrait ne pas correspondre aux optimisations de service de ce niveau.
Si votre charge de travail est par lots ou planifiée, les deux sont un mauvais achat, à 6x et à 10x, et le choix honnête est de l’exécuter sur la voie standard et de consacrer plutôt la différence à l’évaluation.
Ce qui changerait cette page : une mesure indépendante de la vitesse de sortie de l’un ou l’autre des paliers à un niveau de concurrence déclaré, une déclaration de résidence des données publiée par Xiaomi, ou une valeur de limite de débit d’OpenAI pour le palier Sol sur laquelle un acheteur peut s’appuyer pour planifier au lieu de la demander. Tant que ces éléments n’existent pas, la comparaison oppose une liste de prix à une liste de prix, l’un des deux fournisseurs ayant publié bien plus d’informations sur l’objet dont le prix est établi.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
