
GPT-6.1 Ultrafast vs. Xiaomi MiMo v2.6 Pro Ultraspeed: Zwei schnelle Spuren, eine sagt, was sie gekostet hat
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAIGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
Die zwei schnellsten Wege, ein Frontier-Modell zu kaufen, kamen mit sechzehn Tagen Abstand in den Verkauf, und nur einer von ihnen verriet, wie die Geschwindigkeit zustande kam. GPT-6.1 Ultrafast — die Serving-Stufe über GPT-6.1 Sol, das OpenAI am 29. September 2026 veröffentlichte und das diese Stufe am 8. Oktober 2026 erhielt — ist ein geschlossenes Flaggschiff, das man über eine API erreicht, bepreist zum Sechsfachen von Standard, ohne veröffentlichte Darstellung dessen, was zwischen den Gewichten und Ihrer Anfrage passiert. Xiaomi MiMo v2.6 Pro Ultraspeed, veröffentlicht am 22. September 2026, ist eine Speed-Stufe über MiMo-V2.6-Pro, einem MIT-lizenzierten Checkpoint, dessen Reinforcement-Learning-Umgebung Xiaomi ebenfalls veröffentlicht hat. Beide verkaufen Latenz zu einem Vielfachen. Nur Xiaomis Vielfaches steht auf etwas, das ein Kunde inspizieren kann, und dieser Unterschied wiegt für die Entscheidung mehr als jede der beiden Geschwindigkeitsangaben.
Der Preis der beiden Lanes ist der einfache Teil und wird unten behandelt. Der schwierige Teil ist, dass eine Geschwindigkeitsstufe ein Versprechen über die Bereitstellung ist, und die beiden Anbieter haben dieses Versprechen auf sehr unterschiedlichen Offenlegungsniveaus abgegeben – der eine hat seine Schlagzeilenzahl von einem Schwestermodell übernommen, der andere hat das Trainingsrezept zusammen mit der Preisliste geliefert. Wenn Sie im Begriff sind, eine Produktionsworkload einer schnellen Lane anzuvertrauen, ist die Offenlegungslücke das Risiko, das Sie tatsächlich eingehen.
Die Preise, mit beiden Seiten auf derselben Zeile
Beide Stufen werden als Vielfaches einer Standard-Lane verkauft, und die Vielfachen liegen so dicht beieinander, dass der Preis nicht das ist, was sie voneinander trennt.
• Standard-Tarif — GPT-6.1 Sol bei 2,00 $ Eingabe / 10,00 $ Ausgabe pro Million Tokens, gegenüber MiMo-V2.6-Pro bei 0,44 $ / 0,87 $.
• Schnellspur — GPT-6.1 Ultrafast zu $12.00 / $60.00, gegenüber MiMo-V2.6-Pro-UltraSpeed zu $4.35 / $8.70.
• Der Multiplikator — genau 6x in jeder Zeile für die OpenAI-Stufe, ungefähr 9,9x bei der Eingabe und genau 10x bei der Ausgabe für Xiaomis.
• Zwischengespeicherte Eingabe — GPT-6.1 Sol kostet 0,10 $ pro Million im Standard-Tarif und 0,60 $ bei Ultrafast; die MiMo-Preisliste, die wir einsehen können, führt für keinen der beiden Kanäle eine separate Position für zwischengespeicherte Eingaben auf.
• Langkontext — GPT-6.1 Sol berechnet die gesamte Anfrage oberhalb von 272.000 Eingabe-Tokens mit 2x Eingabe- und Cache-Tarifen sowie 1,5x Ausgabe neu, wodurch Ultrafast auf $24,00 / $1,20 / $30,00 / $90,00 kommt. MiMo-V2.6-Pro verfügt über ein Kontextfenster von 1 Mio. Tokens ohne entsprechende veröffentlichte Preisschwelle.
• Absolute Spanne – die beiden Fast Lanes liegen beim Input um den Faktor 2,8 und beim Output um den Faktor 6,9 auseinander; das ist die Lücke zwischen einem geschlossenen Frontier-Modell und einem Open-Weight-Modell, die sich innerhalb der Speed-Stufe statt beim Standardtarif zeigt.
Die einzeilige Zusammenfassung dieses Blocks: Xiaomi verlangt einen höheren Multiplikator für ein viel günstigeres Modell, und OpenAI verlangt einen niedrigeren Multiplikator für ein viel teureres. Bei Output-Tokens zahlen Sie 60,00 $ pro Million für die OpenAI-Spur und 8,70 $ für die von Xiaomi. Keiner der Anbieter bietet einen Rabatt für Geschwindigkeit; beide bepreisen sie als separates Produkt, was das erste Anzeichen dafür ist, dass in beiden Fällen die Standard-Spur weiterhin der Standard ist und die schnelle Spur eine Ausnahme darstellt, die Sie je Workload rechtfertigen.
Was jeder Anbieter Ihnen über die Geschwindigkeit sagen wird
An diesem Punkt sind die beiden Rollouts nicht mehr symmetrisch, und das ist das Nützlichste auf dieser Seite.
Die von OpenAI veröffentlichte Zahl für Ultrafast besagt, dass GPT-6 Astra Ultrafast in Codex Token bis zu 8-mal schneller generiert als GPT-6 Astra im Standardmodus. Das ist eine Messung eines anderen Modells in einem anderen Client, als Obergrenze formuliert. Die Dokumentation, die Ultrafast für GPT-6.1 Sol behandelt, besagt, dass die Stufe die Zeit zwischen generierten Ausgabe-Tokens verringert, und verweist auf eine Preisliste; sie beziffert die Sol-Stufe überhaupt nicht. Die Schlagzeilen-Zahl, die diesem Rollout zugeschrieben wird, ist also vom Schwestermodell übernommen, das seit dem 29. September auf Ultrafast läuft, und keine unabhängige Stelle hat für eines von beiden eine Token-pro-Sekunde-Messung veröffentlicht. Das mag durchaus zutreffen – gleicher Serving-Stack, gleicher Mechanismus –, aber es ist eine Hersteller-Obergrenze, die OpenAI selbst für dieses Modell nicht gemessen hat.
Xiaomis Offenlegung ist anderer Art, und der Unterschied besteht nicht darin, dass sie präziser ist. Das eigene Material des Unternehmens behauptet, UltraSpeed erreiche bei gleicher Qualität bis zu 20-mal die Ausgabegeschwindigkeit des Standard-Pro-Dienstes. Drittanbieter-Katalogeinträge, die dasselbe Modell am selben Tag beschreiben, nennen ungefähr das 10-Fache. Beide Zahlen sind im Umlauf, sie sind nicht dieselbe Zahl, und niemand hat eine Messung veröffentlicht, die sie miteinander in Einklang bringt. Ehrlich gelesen: „bis zu 20x“ ist eine Hersteller-Obergrenze unter Bedingungen, die Xiaomi nicht spezifiziert hat, „ungefähr 10x“ ist das, was ein Katalog als typisch zu behaupten bereit war, und der tatsächliche Multiplikator liegt irgendwo in einem breiten Bereich, bis jemand Latenzverteilungen pro Anfrage bei angegebenem Parallelitätsgrad veröffentlicht.
Also liefert Xiaomi dir zwei nicht miteinander vereinbare Zahlen, und OpenAI liefert dir eine Zahl, die zu einem anderen Modell gehört. Keine von beiden ist eine Tatsache, auf die du ein Budget stützen kannst, und die praktische Konsequenz ist für beide dieselbe: Miss die Stufe anhand deiner eigenen Prompts, bevor du einen Produktionspfad darauf festlegst.
Die Asymmetrie, auf die es wirklich ankommt: Was die zusätzlichen Ziffern bringen
Mal abgesehen von den Geschwindigkeitsversprechen: Die beiden Spuren sind an ganz unterschiedliche Arten von Produkten geknüpft, und an diesem Punkt ist die Wahl kein Preisvergleich mehr.
MiMo-V2.6-Pro ist ein Sparse-Mixture-of-Experts-Design, das Xiaomi öffentlich beschrieben hat: 1,02 Billionen Gesamtparameter, von denen 42 Milliarden pro Token aktiviert werden, ein Kontextfenster von 1 Mio. Token, native Multimodalität über Text, Bild, Video und Audio sowie ein MIT-Lizenz-Tag auf den veröffentlichten Checkpoints. Das Release-Bundle enthält einen technischen Bericht und Deployment-Notizen, und Xiaomi sagt, dass es die Trainingsumgebung für das Reinforcement Learning und seinen Code als Open Source freigibt, damit das Post-Training untersucht und reproduziert werden kann. Der RL-Lauf ist ebenfalls dokumentiert — 30 Schritte und rund 750.000 Trajektorien pro Modell, in weniger als sechs Tagen, bei kombinierten veröffentlichten Ausgaben von etwa 3.474.715 US-Dollar für die Pro- und Flash-Läufe. Auf DeepSWE v1.1, dem eigenen Harness von Xiaomi mit mini-swe-agent bei avg@3, berichtet das Unternehmen, dass MiMo-V2.6-Flash von 48,8 auf 65,68 und MiMo-V2.6-Pro von 58,4 auf 72,57 in diesem Lauf gestiegen sind. Diese Angaben stammen vom Anbieter und sind nicht reproduziert; der Unterschied zwischen „Xiaomis Harness sagt 72,57“ und „72,57 ist der Wert“ ist der Unterschied zwischen einer Behauptung und einer Tatsache.
GPT-6.1 Sol veröffentlicht nichts davon. Es gibt keine Parameteranzahl, keine Angaben zur Architektur, keine Angabe zu den Trainingsausgaben, keinen Checkpoint und keine Lizenz zum Lesen – es gibt eine Modellkarte, ein Kontextfenster, einen Wissens-Cutoff vom 30. April 2026 und eine API. Das ist die übliche Handhabung für ein Frontier-Labor, und das ist keine Kritik. Aber das hat eine Konsequenz für eine Kaufentscheidung, die die Launch-Berichterstattung gern überspringt: Auf der Open-Weight-Schiene ist eine enttäuschende schnelle Stufe noch korrigierbar. Wenn sich UltraSpeed als nicht das 10-Fache Ihres Traffics wert erweist, ist derselbe Checkpoint herunterladbar, und Sie können ihn selbst oder über einen anderen Anbieter hosten, was Ihr Verlustrisiko auf Kosten der Migration begrenzt. Auf der Closed-Schiene ist eine enttäuschende schnelle Stufe eine Rechnung und ein Rate-Limit-Budget, das Sie wieder nach unten anpassen; Sie können es nicht umgehen, indem Sie die Gewichte laufen lassen, denn es gibt keine Gewichte, die man laufen lassen könnte.
Ein Hinweis zu diesem MIT-Label: In der Launch-Berichterstattung wird es zu stark vereinfacht. Die Lizenz gilt für die Checkpoints, die Xiaomi veröffentlicht hat. UltraSpeed ist ein gehosteter Dienst, und für gehostete Dienste gelten Nutzungsbedingungen statt einer Lizenz für die Modellgewichte. Das Recht, den Checkpoint auf eigener Hardware auszuführen, und das Recht, den beschleunigten Serving-Betrieb, den jemand dafür anbietet, weiterzuverkaufen, sind zwei verschiedene Rechte – und nur das erste stammt aus der Lizenzdatei.


Zwei Namensfallen, bevor Sie einen der beiden Bezeichner kopieren
Keiner der beiden Namen im Titel dieser Seite ist ein Checkpoint, und die Dokumentation beider Anbieter macht es leicht, den Fehler zu wiederholen.
• GPT-6.1 Ultrafast — kein Modell. Die Kennung in der Anfrage bleibt dieselbe wie die des Standardmodells; die Stufe wird durch ein Feld in der Anfrage festgelegt, und das Ergebnis ist derselbe Checkpoint, nur anders geplant.
• MiMo v2.6 Pro Ultraspeed — ebenfalls kein eigenständiger Satz von Gewichten. Es ist der MiMo-V2.6-Pro-Checkpoint, der über einen schnelleren Pfad bereitgestellt und als eigener Posten abgerechnet wird.
• Was das für das Benchmarking bedeutet – wenn Sie die beiden Lanes eines der beiden Modelle mit identischen Prompts vergleichen, besteht das erwartete Ergebnis aus denselben Antworten mit unterschiedlichen Raten. Abweichender Inhalt bei derselben Eingabe ist ein zu meldender Defekt, keine Fähigkeit, die Sie gekauft haben.
• Was das für die Lizenzprüfung bedeutet — für Xiaomi lesen Sie die Modellkarte. Für OpenAI gibt es nichts zu lesen, weil die Gewichte nicht verteilt werden.
Es gibt außerdem eine weichere Asymmetrie, die sich darin zeigt, wie die einzelnen Stufen verkauft werden. GPT-6.1 Sol unterstützt US- und EU-Datenresidenz sowie globale Verarbeitung, auch unter Ultrafast, sodass eine auf europäische Verarbeitung festgelegte Workload eine dokumentierte Antwort hat. Die MiMo-Preisliste, die wir lesen können, nennt keine Residenz – Xiaomi verkauft ein Modell und einen Serving-Pfad, keine Compliance-Haltung. Für einen regulierten Käufer kann diese eine Zeile den Vergleich entscheiden, bevor der Preis überhaupt berücksichtigt wird.
Wo jede Lane tatsächlich aufrufbar ist
Beide Fast Lanes sind über die eigene API ihres jeweiligen Anbieters erreichbar, und beide erscheinen auf Drittanbieter-Plattformen. Keine von beiden ist auf OrcaRouter vertreten, und es ist wichtig, das unmissverständlich zu sagen, anstatt eine Vergleichsseite etwas anderes nahelegen zu lassen.
Was auf OrcaRouter angeboten wird, ist die Standard-Lane des OpenAI-Modells: openai/gpt-6.1-sol zu OpenAIs eigenen Listenpreisen von 2,00 $ pro Million Eingabe-Token und 10,00 $ pro Million Ausgabe-Token, mit 0 % Aufschlag und direkt durchgereichtem Anbieterpreis, sodass eine Preisänderung des Anbieters noch am selben Tag bei uns ankommt. Ultrafast ist ein Service-Tier-Flag, das über Ihr eigenes OpenAI-Konto abgerechnet wird, und hier wird überhaupt kein Xiaomi-Modell gehostet. Was ein Schlüssel bietet, ist die Standard-Lane neben mehr als 200 anderen Modellen hinter einem einzigen OpenAI-kompatiblen Endpunkt, mit automatischem Failover über Anbieter hinweg – was die nützliche Haltung ist, wenn die Workload, die Sie schützen, diejenige ist, die um drei Uhr morgens eine Rate-Limit-Obergrenze bemerken würde.

Welche Spur in welcher Reihenfolge zu testen ist
Wenn Ihre Workload interaktiv ist und die Generierungszeit an der Uhr eines Menschen hängt, sind beide Stufen einen Versuch wert, und der entscheidende Faktor wird nicht der Preis sein — es wird das Ablaufdatum Ihres Vertrauens sein. Die Open-Weight-Spur lässt Sie verifizieren und dann gehen; die geschlossene Spur verlangt von Ihnen, mit dem einen Anbieter zu verifizieren, der sie bereitstellen kann, und zu bleiben. Diese Asymmetrie ist real, aber sie ist auch nicht kostenlos: MiMo-V2.6-Pro-UltraSpeed ist ein gehosteter Dienst, daher ist der Ausstieg eine Migration statt einer Konfigurationsänderung, und der Checkpoint, zu dem Sie migrieren würden, entspricht möglicherweise nicht den Serving-Optimierungen der Stufe.
Wenn Ihre Workload Batch- oder geplant ist, sind beide der falsche Kauf – bei 6x und bei 10x – und der ehrliche Zug ist, sie auf der Standard-Spur laufen zu lassen und die Differenz stattdessen in Evaluation zu investieren.
Was diese Seite ändern würde: eine unabhängige Messung der Ausgabegeschwindigkeit beider Stufen bei einem angegebenen Parallelitätsgrad, eine veröffentlichte Erklärung zum Datenstandort von Xiaomi oder eine Rate-Limit-Angabe von OpenAI für die Sol-Stufe, mit der ein Käufer planen kann, statt sie anfordern zu müssen. Solange es diese nicht gibt, ist der Vergleich eine Preisliste gegen eine Preisliste, wobei einer der beiden Anbieter deutlich mehr über den bepreisten Gegenstand veröffentlicht hat.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
