Eine generierte Hero-Titelkarte für „GPT-5.6 Sol Ultrafast vs. Xiaomi MiMo v2.6 Pro Ultraspeed" mit der Überzeile „Two speed tiers. One missing price." und zwei Karten: links „GPT-5.6 Sol Ultrafast" mit Gewichte: wie bei Sol, Geschwindigkeitsangabe: bis zu 14x, Preis: noch nicht veröffentlicht; rechts „MiMo v2.6 Pro Ultraspeed" mit Gewichte: wie bei Pro, Geschwindigkeitsangabe: 10x bis 20x, Preis: 4,35 $ / 8,70 $; Fußzeile „Keines von beiden wurde unabhängig gemessen." OrcaRouter-Logo unten rechts.
Guides & Insights

GPT-5.6 Sol Ultrafast vs. Xiaomi MiMo v2.6 Pro Ultraspeed: Zwei Geschwindigkeitsstufen, ein fehlender Preis

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Zwei Anbieter brachten dieselbe Produktidee mit drei Wochen Abstand auf den Markt, und der Unterschied zwischen ihnen ist der beste Weg zu sehen, was jeder wirklich verkauft. Die Xiaomi-Seite erschien am 22. September 2026: Xiaomi MiMo v2.6 Pro Ultraspeed ist derselbe 1,02-Billionen-Parameter-Checkpoint wie MiMo-V2.6-Pro, schneller bereitgestellt, zu 4,35 $ pro Million Input-Tokens und 8,70 $ pro Million Output gegenüber den 0,44 $ und 0,87 $ des Standard-Pro-Tarifs. Das GPT-5.6 Sol Ultrafast des Anbieters ist dasselbe Manöver, angewendet auf GPT-5.6 Sol: identische Gewichte, bis zu 750 Ausgabe-Tokens pro Sekunde, bis zum 14-Fachen der Standard-Stufe, läuft auf Cerebras-Wafer-Scale-Hardware — und überhaupt kein veröffentlichter Preis, sechs Wochen nachdem der Modus am 13. August angekündigt wurde.

Stellt man die beiden nebeneinander, springt die Anomalie sofort ins Auge. Xiaomi veröffentlichte eine Preisliste, bevor es die meisten Benchmarks veröffentlichte. OpenAI veröffentlichte die Benchmarks, den Hardwarepartner und die Kundennamen – und hat bis heute keine Zahl veröffentlicht, auf die sich ein Budget stützen ließe. Eine dieser Stufen kann heute gekauft werden. Die andere ist ein Wert in einem API-Schema. Ein Vergleich der beiden dreht sich daher weniger darum, welche schneller ist, sondern vielmehr darum, was eine Geschwindigkeitsstufe wert ist, wenn ein Anbieter Ihnen den Preis genannt hat und der andere nicht.

Was jedes einzelne tatsächlich ist

Weder das eine noch das andere ist ein neues Modell. Das ist die gemeinsame Prämisse, und es lohnt sich, sie unverblümt auszusprechen, denn beide Starts zogen Berichterstattung auf sich, die eine Serving-Änderung als Veröffentlichung neuer Fähigkeiten behandelte.

MiMo v2.6 Pro Ultraspeed ist eine Serving-Konfiguration von Xiaomis Flaggschiff: derselbe Sparse-Mixture-of-Experts-Checkpoint mit 1,02T Parametern, bei dem pro Token 42B aktiviert werden, derselbe 1M-Token-Kontext, dieselbe native Multimodalität über Text, Bild, Video und Audio hinweg, dieselben unter MIT-Lizenz stehenden Gewichte in den öffentlichen Repositories. Xiaomis eigene Unterlagen beanspruchen bei gleicher Qualität bis zur 20-fachen Ausgabegeschwindigkeit des Standard-Pro-Dienstes; Katalogeinträge von Drittanbietern, die dasselbe Modell am selben Tag beschreiben, nennen ungefähr das 10-Fache. Niemand hat eine Messung veröffentlicht, die beide Zahlen in Einklang bringt.

GPT-5.6 Sol Ultrafast ist eine Serving-Konfiguration von OpenAIs Flaggschiff: derselbe Checkpoint, dasselbe Reasoning-Verhalten, dasselbe Kontextfenster von 1.050.000 Tokens, dieselbe maximale Ausgabe von 128K, dieselben Antworten. Die Beschleunigung ist hardware- und nicht schedulingbedingt – die Gewichte des Modells liegen im On-Chip-SRAM auf Cerebras' Wafer-Scale-Silizium, statt zwischen GPU-Speicher und Recheneinheit hin- und hergeschoben zu werden – und es ist das erste Produkt der im Januar 2026 geschlossenen OpenAI–Cerebras-Compute-Partnerschaft, die mit rund 10 Milliarden US-Dollar über drei Jahre beziffert wird.

Die ehrliche Vergleichsachse ist also nicht die Intelligenz. Sie ist, was der Anbieter zu ändern beschloss, was er für die Änderung berechnete und wie viel von der Änderung er Sie überprüfen ließ.

A screenshot of the Hugging Face model card for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the TextGeneration / Transformers / Safetensors / English / Chinese / mimo_v2 / multimodal / conversational / custom_code / 3-bit precision fp8 tags, a License: mit badge, 53 likes, and the card opening 'MiMo-V2.6-Pro-RL — Scaling Reinforcement Learning Toward Self-Improvement' with the Technical Report link and the introduction describing native omnimodal input and a 1M-token context window.

Die Tarifkarten, einschließlich der leeren

• MiMo v2.6 Pro Ultraspeed — 4,35 $ Eingabe / 8,70 $ Ausgabe pro Million Tokens, veröffentlicht von Xiaomi.

• MiMo-V2.6-Pro Standard — 0,44 $ / 0,87 $, veröffentlicht in Xiaomis kommerziellen Katalogen. Ungefähr 9,9× bei der Eingabe und genau 10× bei der Ausgabe.

• GPT-5.6 Sol Ultrafast — Stand 27. September 2026 liegt keine veröffentlichte Preisliste vor. Die Preisseite von OpenAI enthält weiterhin vier Tabs — Standard, Batch, Flex, Fast — und diese Tarifstufe ist nicht darunter.

• GPT-5.6 Sol Standard — 4,00 $ / 20,00 $ pro Million, OpenAIs aktueller Aktionspreis, mit gecachtem Input zu 0,40 $ und einem Sprung auf 8,00 $ / 30,00 $ bei langem Kontext ab etwa 272K Tokens Eingabe.

• Das einzige vergleichbare Premium-Angebot, das OpenAI je bepreist hat — Fast mode, bei 8,00 $ / 40,00 $, genau das Doppelte des Standardtarifs für bis zu etwa 2,5-fache Ausgabegeschwindigkeit.

Diese letzte Zeile ist der ganze Grund, warum das leere Feld wichtig ist. Xiaomis Geschwindigkeitsstufe kostet zehnmal so viel wie die Standardspur und beansprucht die zehn- bis zwanzigfache Geschwindigkeit, was als Tausch zumindest in sich schlüssig ist: Man zahlt proportional mehr für proportional weniger Wartezeit, und die Wette ist, dass die tatsächlich verstreichende Zeit das Produkt ist. OpenAIs Geschwindigkeitsstufe ist ein größerer Anspruch auf knapperes Silizium als Fast mode, also spricht der Präzedenzfall unabhängig davon, was sie letztlich kostet, für einen Aufpreis statt für einen Rabatt. Aber „der Präzedenzfall spricht für einen Aufpreis“ ist keine Zahl, und solange es keine gibt, lässt sich die Stufe preislich überhaupt nicht mit UltraSpeed vergleichen – nur anhand der Tatsache, dass Xiaomi bereit war, seine Zahl zu nennen, und OpenAI nicht.

Woher die Zahlen stammen

Die beiden Ebenen haben entgegengesetzte Beweisprobleme, und es lohnt sich, beide zu benennen, statt einen Mittelweg zu suchen.

Xiaomis Geschwindigkeitsversprechen ist in seiner Größenordnung vage, aber an einen veröffentlichten Preis gekoppelt. Die 20× sind eine Hersteller-Obergrenze unter Bedingungen, die Xiaomi nicht spezifiziert hat, die 10× sind das, was ein Katalogeintrag als typisch zu behaupten bereit war, und der tatsächliche Multiplikator liegt irgendwo in einem breiten Bereich, den niemand öffentlich bei einem angegebenen Parallelitätsniveau gemessen hat. Demgegenüber ist der Preis exakt, die Gewichte sind unter MIT herunterladbar, und der technische Bericht sowie die Trainingsumgebung für bestärkendes Lernen sind öffentlich – man kann nachvollziehen, was Xiaomi getan hat, man kann derzeit einfach nicht überprüfen, wie schnell es läuft.

OpenAIs Geschwindigkeitsversprechen ist in seiner Größenordnung konkret, aber an nichts Kaufbares geknüpft. Bis zu 750 Ausgabe-Token pro Sekunde, bis zu 14× Standard, schlicht angegeben. Es handelt sich zudem um eine Durchsatzangabe für Ausgabe-Token, nicht um einen pauschalen End-to-End-Multiplikator: Die Eingabeverarbeitung und die eigene Schlussfolgerung des Modells werden nicht in diesem Verhältnis komprimiert, weshalb das Unternehmen sie als Maximum bezeichnet. Die unterstützenden Benchmarks stammen vom Anbieter selbst und in einem Fall anbieterübergreifend – ein Durchlauf von Humanity's Last Exam mit 2.500 Fragen, der mit 11 Stunden 11 Minuten gegenüber 78 Stunden 27 Minuten für Claude Fable 5 bei vergleichbarer Genauigkeit abgeschlossen wurde. Unabhängige Berichte über den Start zitierten einen engeren Vergleich der Generierungsgeschwindigkeit von etwa 11× beim selben Durchlauf, während Cerebras' eigene Zahlen für die gesamte Testzeit auf etwa 7× hindeuten. Drei Parteien, drei Bruchteile einer Arbeitslast, keine unabhängige Reproduktion einer davon. Cerebras berichtet separat von 5,6× End-to-End bei GDP-Val ohne messbaren Qualitätsverlust, ebenfalls nicht reproduziert.

Beide Zahlenreihen sind Anbieterangaben. Der Unterschied ist, dass Xiaomis Unklarheit die Geschwindigkeit betrifft und die von OpenAI die Kosten, und für jeden, der ein Budget aufstellt, sind die Kosten die schwerer zu schätzende Größe.

A generated two-column scoreboard titled 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed — the scoreboard'. Left column 'GPT-5.6 Sol Ultrafast': Checkpoint same as Sol, Speed claim up to 14x, Output speed up to 750 tok/s, Price not published, Context 1.05M tokens, Access waitlisted preview. Right column 'MiMo v2.6 Pro Ultraspeed': Checkpoint same as Pro, Speed claim 10x to 20x, Output speed not published, Price $4.35 / $8.70, Context 1M tokens, Access purchasable today. Footer sourcing line noting neither speed claim is independently measured; OrcaRouter logo bottom-right.

Was diese Woche passiert ist und warum es die Lücke nicht schließt

Der Grund, warum dieser Vergleich überhaupt einen Nachrichtenaufhänger hat, ist ein Commit und keine Ankündigung. Der Wert ultrafast steht seit dem 13. August 2026 in OpenAIs öffentlichem openai-openapi-Schema — am selben Tag, an dem der Modus angekündigt wurde — und trägt die Beschreibung, die ihn auf gpt-5.6-sol beschränkt und als zugriffskontrolliert kennzeichnet. Der Commit, der diese Woche Bewegung brachte, ist später und kleiner: Am 25. September 2026 fügte fe4f7a1 ultrafast zu zwei weiteren Enumerationen hinzu, dem Service-Tier-Parameter auf Anfrageebene und dem Service-Tier-Richtlinienfeld für Agenten. Vor diesem Commit lauteten diese beiden Listen auto, default, flex, priority, fast. Danach gibt es einen Eintrag, der als „Verwendet das ultrafast-Service-Tier." beschrieben wird.ultrafast zu den service_tier Enumerationen in seiner öffentlichen openai-openapi Spezifikation — das Feld, das das Schema als „das für Modellanfragen verwendete Service-Tier" beschreibt, und das den Agenten zugeordnete Richtlinienfeld. Vor der Änderung lautete diese Liste default, flex, priority, fast. Danach gibt es einen Eintrag, der als „Verwendet das ultrafast-Service-Tier." beschrieben wird.

Die Unterscheidung ist für jeden relevant, der die Berichterstattung liest. Dies ist nicht die Stufe, die erstellt wird; es ist die Stufe, die in das Feld eingebunden wird, mit dem ein Agent konfiguriert wird, was bedeutet, dass schließlich ein Client dafür geschrieben werden kann, ohne dass ein neuer Endpoint erforderlich ist. Ein Bericht vom folgenden Tag beschreibt einen Fast-/Standard-/Ultrafast-Selektor, der in den Responses API Playground kommt, wobei ein breiterer Zugriff nach der DevDay-Konferenz von OpenAI erwartet wird. Wir haben den Selektor nicht gesehen, und OpenAI hat keine Rollout-Notiz veröffentlicht, daher beruht dieser Teil auf einer einzigen Quelle. Überprüfbar sind die hinzugefügten Schema-Einträge und das anhaltende Fehlen einer Preisliste sechs Wochen nach der Ankündigung.

Unterdessen ist Xiaomis Tarif seit fünf Tagen erhältlich und nach wie vor der einzige der beiden, den man in Rechnung stellen kann. Seine eigene offene Frage ist eine andere: ob ein 10-facher Aufpreis Bestand hat oder ob er sich wie die meisten Einführungspreise für einen neuen Premium-Tarif verhält und in die Standard-Spur abdriftet, sobald die Launch-Berichterstattung endet. Standard Pro mit 0,44 $ / 0,87 $ ist der Anker, und ein Tarif, der mit dem Zehnfachen seines Ankers startet, endet selten dort.

Zwischen ihnen zu wählen, da du es wahrscheinlich nicht kannst

Die unbequeme praktische Tatsache ist, dass dies für die meisten Leser ein Vergleich zwischen einer Stufe ist, die Sie nicht kaufen können, und einer, die Sie zum Listenpreis wahrscheinlich nicht kaufen sollten. GPT-5.6 Sol Ultrafast ist eine Preview mit Warteliste für ausgewählte Kunden, die mit wachsender Kapazität ausgeweitet wird, ohne Termin für die allgemeine Verfügbarkeit und ohne Preis; MiMo v2.6 Pro Ultraspeed ist verfügbar, teuer und für eine bestimmte Art von Käufer gemacht.

Der Workload-Test ist für beide derselbe, und es geht dabei um die Form Ihres Anfragegraphen, nicht um die Größe Ihres Prompts. Eine einzelne lange Generierung erzielt eine weit geringere Beschleunigung als der plakative Multiplikator, weil Eingabeverarbeitung und Reasoning nicht im selben Verhältnis schneller werden. Eine vierzigstufige Agentenschleife hinter einer für den Nutzer sichtbaren Aktion erzielt etwas, das viel näher an der vollen Zahl liegt, weil jeder Roundtrip Latenz bedeutet, die ein Mensch aussitzt. Wenn Ihr Traffic wie die zweite Form aussieht, sind beide Stufen auf Sie ausgelegt; wenn er wie die erste aussieht, war die Standard-Spur bei beiden Modellen immer die richtige Wahl, und die Standard-Spur von MiMo-V2.6-Pro zu $0,44 / $0,87 ist eine der günstigsten Möglichkeiten, irgendwo ein Modell der Billionen-Parameter-Klasse aufzurufen.

Was keine der beiden Stufen ändert, ist, dass Sie Latenz kaufen, nicht Qualität. Wenn Sie UltraSpeed oder Ultrafast mit identischen Prompts gegen ihre jeweilige Standard-Spur benchmarken und unterschiedliche Antworten erhalten, ist das ein berichtenswerter Befund, kein Feature – nichts in der Beschreibung des einen oder anderen Anbieters behauptet, dass sich die Gewichte geändert hätten.

Dies ist ebenfalls der Fall, in dem ein Router seinen Platz verdient, und zwar speziell für die Stufe, die du nicht bekommen kannst. GPT-5.6 Sol ist auf OrcaRouter live als openai/gpt-5.6-sol zum eigenen Tarif des Anbieters mit ohne Aufschlag auf Tokens über den OpenAI-kompatiblen Endpunkt unter api.orcarouter.ai/v1, sodass die Standard-Spur, auf die du zurückfallen würdest, nur eine Basis-URL-Änderung entfernt ist und derselbe Key 200+ Modelle trägt. Das ist wichtig, denn die ehrliche Antwort auf die Frage „Sollte ich Ultrafast nutzen?“ lautet heute: „Du kannst nicht, also entscheide, was in der Zwischenzeit den interaktiven Verkehr trägt“ — und Latenz ohne Warteliste kaufst du, indem du die interaktiven Aufrufe an dasjenige Modell im Katalog leitest, das deine Qualitätshürde besteht und dabei die kürzeste Wall-Clock-Zeit hat, und die Nachtarbeit auf der günstigsten Spur lässt, die besteht. Wenn die Stufe öffnet, ist das der Schalter, den du umlegst. Halte ausdrücklich fest, was wir nicht hosten: Kein Xiaomi-Modell ist auf OrcaRouter, daher kommt MiMo v2.6 Pro Ultraspeed von Xiaomis eigener API und mehreren Drittanbieter-Plattformen, und diese Seite ist kein Weg dorthin.

A screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, labelled 'Openweights model, Released September 2026', showing the Intelligence, Performance & Price Analysis headings with an Intelligence Index figure, a Speed figure, a Cost figure of In $0.435 / Out $0.87 with a 99% cache discount, a $0.13 blended figure, a Verbosity rank of 20/115, and a Comparison Summary describing the model as among the leading open-weight models in intelligence and notably fast but somewhat verbose, with text, image, speech and video input and a 1M-token context window.

Was würde es klären

Drei Messungen, von denen noch keine existiert. Eine veröffentlichte Ultrafast-Preisliste würde daraus den Vergleich machen, der er verdient, und nicht einen Vergleich mit einem Loch. Eine unabhängige Latenzverteilung bei einem angegebenen Nebenläufigkeitsgrad würde Ihnen zeigen, ob Xiaomis tatsächlicher Multiplikator näher bei 10× oder 20× liegt und ob er unter Last hält statt nur in einer Single-Stream-Demonstration. Und eine unabhängige Reproduktion der Benchmark-Suite eines der beiden Anbieter würde beide Zahlenreihen aus der Spalte der Behauptungen herausnehmen.

Bis dahin ist die vertretbare Lesart eng. Xiaomi hat eine Geschwindigkeitsstufe eingeführt – mit einem Preis und vager Geschwindigkeit; OpenAI hat eine Geschwindigkeitsstufe eingeführt – mit konkreter Geschwindigkeit und ohne Preis; beide sind dasselbe Modell wie das, gegen das sie preislich antreten, und keine von beiden wurde unabhängig gemessen. Wenn Sie die Latenz jetzt brauchen und die Arbeitslast interaktiv ist, ist UltraSpeed real, kaufbar und preislich genau auf den Käufer zugeschnitten, den sie will. Wenn Sie sie jetzt brauchen, die Arbeitslast aber nicht, sind die Standard-Lanes bei beiden Modellen günstiger, bewährt und heute verfügbar – und die Stufe, über die alle streiten, wird auch dann noch da sein, wenn jemand eine Zahl veröffentlicht.