Eine Titelkarte für den Vergleich Xiaomi MiMo-V2.6-Pro gegen MiniMax M3, die zwei einander gegenüberliegende Spezifikationskarten zeigt: Xiaomi MiMo-V2.6-Pro mit Intelligence Index v4.3.2 46, Ausgabegeschwindigkeit 134,3 Tokens/Sekunde, gemischt 0,18 $ pro 1 Mio. und 1 API-Anbieter, gegenüber MiniMax M3 mit Index 29, 168,9 Tokens/Sekunde, 0,22 $ und 15 API-Anbietern.
Guides & Insights

Xiaomi MiMo-V2.6-Pro vs. MiniMax M3: Der bessere Score hat die dünnere Route

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Xiaomi MiMo-V2.6-Pro wurde am 22. September 2026 allgemein verfügbar und belegte mit 46 auf v4.3.2 den Spitzenplatz unter den Open-Weights-Modellen im Artificial Analysis Intelligence Index. MiniMax M3 hält seit seiner Veröffentlichung am 31. Mai 2026 eine Version dieses Titels, und im selben Index erzielt es heute 29 Punkte – siebzehn Punkte dahinter. Der Score ist das am wenigsten Interessante an dem Paar. MiniMax M3 liefert 168,9 Ausgabe-Token pro Sekunde gegenüber 134,3, antwortet in 0,92 Sekunden gegenüber 2,15, ist günstiger pro Eingabe-Token und ist über fünfzehn API-Anbieter erreichbar, gegenüber nur einem bei Xiaomi. Das neuere, höher bewertete Modell ist dasjenige, das sich tatsächlich schwerer aufrufen lässt, und genau um diese Umkehrung geht es in diesem Vergleich.

Beide mit offenen Gewichten, beide multimodal, vierzehn Wochen auseinander.

Die beiden Modelle sind enge Verwandte in ihrer Design-Ausrichtung. Beide sind sparse Mixture-of-Experts-Modelle aus chinesischen Laboren, beide bieten ein Kontextfenster von 1 Mio. Token, beide verarbeiten Bilder und Video nativ statt über einen nachträglich angebauten Adapter, und beide veröffentlichen ihre Gewichte. Vierzehn Wochen liegen zwischen ihren Veröffentlichungen, und die Indexlücke zwischen ihnen ist die Strecke, die die Open-Weights-Frontier in diesem Zeitraum zurückgelegt hat.

• Gesamtparameter — Xiaomi MiMo-V2.6-Pro 1,02T; MiniMax M3 etwa 427B, beide sparse MoE

• Aktiv pro Token — Xiaomi MiMo-V2.6-Pro 42B; MiniMax M3 etwa 23–25B

• Kontext — jeweils 1 Mio. Token, wobei MiniMax M3 ein Minimum von 512K garantiert

• Eingabemodalitäten – Text, Bild und Video für beide; Xiaomi fügt Audioeingabe hinzu

• Gewichte — MIT-Lizenz für Xiaomi MiMo-V2.6-Pro; MiniMax M3 wird unter der MiniMax Community Licence vertrieben, die nicht permissiv ist und eine separate Vereinbarung für die kommerzielle Nutzung erfordert

• Veröffentlicht — Xiaomi MiMo-V2.6-Pro 21.–22. September 2026; MiniMax M3 31. Mai 2026

• Erreichbarkeit — ein API-Anbieter wurde für Xiaomi MiMo-V2.6-Pro bei Artificial Analysis gezählt; fünfzehn für MiniMax M3

Diese letzte Zeile ist die, die man im Blick behalten sollte. Alles andere auf dem Blatt spricht für das neuere Modell. Diese Zeile nicht, und sie ist die Zeile, die entscheidet, ob ein Modell in einem Produktionspfad Platz finden kann.

Was der Index misst, und wer ihn gemessen hat

Artificial Analysis hat beide Modelle selbst auf v4.3.2 getestet – ein aus zehn Evaluierungen zusammengesetztes Komposit, das logisches Denken, Wissen, Mathematik und Programmierung abdeckt, darunter AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience und AA-LCR v1.1. Weder die 46 noch die 29 ist eine Anbieterzahl, was hier wichtig ist, weil beide Labore auch eigene Benchmark-Zahlen veröffentlicht haben, die Anbieterzahlen sind, und die beiden Arten dürfen nicht vermischt werden.

Die 46 bringt Xiaomi MiMo-V2.6-Pro in diesem Composite an die Spitze des Open-Weights-Felds. Sie bringt es jedoch nicht an die Spitze des Index: Claude Fable 5.1 und GPT-6 Astra stehen beide bei 53, Claude Opus 5 bei 51. Die 29 von MiniMax M3 platzieren es auf Rang sechzehn von 114 gemessenen Modellen – deutlich über dem Median seiner Größenklasse, aber weit entfernt von der Frontier, mit der es im Juni verglichen wurde.

MiniMax M3 hat die Belege, die Xiaomi nicht hat

Dies ist der Teil des Vergleichs, der übersprungen wird, und es ist der Teil, dem ein Käufer das größte Gewicht beimessen sollte. MiniMax M3 steht mit einem offiziellen Eintrag auf dem öffentlichen Leaderboard von DeepSWE v1.1: 20,4 % Pass@1 und 48,7 % Pass@4, veröffentlicht am 8. Juni 2026, nachdem ein MiniMax-Inferenz-Upgrade die abnormale Token-Generierung behoben und das Long-Context-Cache-Verhalten verbessert hatte. Diesem Eintrag war eine Effizienzabrechnung beigefügt, und die Abrechnung ist nicht schmeichelhaft: ein Median von 311 Agent-Schritten, rund 91.000 Ausgabe-Tokens und etwa 5,04 US-Dollar pro Aufgabe. Es besteht Engineering-Aufgaben mit langem Horizont – und das zu hohen Kosten.

Xiaomis Schlagzeilen-Benchmarkwert für sein neues Modell beträgt 72,57 auf DeepSWE v1.1, ein Anstieg gegenüber einem Ausgangswert von 58,4, gemessen mit mini-swe-agent als Durchschnitt aus drei Durchläufen auf Xiaomis eigenem Harness. Es ist kein Leaderboard-Eintrag und wurde auch nicht als solcher eingereicht. 72,57 neben MiniMax' 20,4 zu stellen und daraus einen 52-Punkte-Sieg abzulesen, ist Arithmetik über zwei verschiedene Messungen hinweg: Das Board veröffentlicht Pass@1 für eine bestimmte Konfiguration, mit einem Konfidenzintervall und durchschnittlichen Kosten pro Aufgabe, die ein Dritter erneut ausführen kann, und dem Herstellerwert ist nichts davon beigefügt. Die 72,57 mögen durchaus ehrlich sein. Es ist einfach nicht dieselbe Art von Objekt.

MiniMax hat auch eigene Launch-Zahlen veröffentlicht, und derselbe Vorbehalt gilt für jede einzelne davon: SWE-Bench Pro bei 59.0, BrowseComp bei 83.5, SVG-Bench bei 63.7 und Terminal-Bench 2.1 bei 66.0, ausgeführt auf der eigenen Infrastruktur von MiniMax mit eigenem Scaffolding. Betrachten Sie sie als Behauptungen über das Modell, nicht als Messungen desselben.

Geschwindigkeit, Latenz und die zwei Zahlen, die über eine Rechnung entscheiden

Die Durchsatzlücke verläuft entgegengesetzt zur Qualitätslücke, und sie ist groß genug, um von Bedeutung zu sein. MiniMax M3 erzeugt 168,9 Ausgabe-Tokens pro Sekunde gegenüber 134,3 bei Xiaomi MiMo-V2.6-Pro, und seine 0,92 Sekunden bis zum ersten Token sind etwa zweieinhalbmal schneller als Xiaomis 2,15. Für ein interaktives Produkt ist die Latenz bis zum ersten Token die Zahl, die ein Nutzer spürt; für eine Batch-Pipeline ist der Durchsatz die Zahl, die die Wanduhrzeit bestimmt.

Bei den Kosten liegen die beiden näher beieinander, als die Listenpreise vermuten lassen, und die Richtung hängt von Ihrem Traffic ab. MiniMax M3 wird mit 0,30 $ pro Million Input-Tokens und 1,20 $ pro Million Output angegeben; Xiaomi MiMo-V2.6-Pro mit 0,43 $ und 0,87 $. M3 ist günstiger beim Input, Xiaomi günstiger bei der Generierung. Sobald Cache-Rabatte angewendet werden – 80 % für M3, 99 % für Xiaomi –, liegen die gemischten Sätze bei einem 7:2:1-Mix aus Cache-Treffern/Input/Output bei 0,22 $ und 0,18 $ pro Million. Artificial Analysis verzeichnet außerdem für Xiaomi MiMo-V2.6-Pro Kosten von 0,13 $ pro Aufgabe des Intelligence Index, gemessen auf dieselbe Weise über alle Modelle auf dem Board hinweg; dies ist die vergleichbarste einzelne Kostenkennzahl, die für die beiden verfügbar ist.

A two-column comparison scoreboard for Xiaomi MiMo-V2.6-Pro and MiniMax M3 covering Intelligence Index v4.3.2 (46 vs 29), output speed (134.3 vs 168.9 tokens/second), time to first token (2.15s vs 0.92s), blended rate ($0.18 vs $0.22 per 1M), API providers (1 vs 15) and long-horizon evidence (vendor harness only vs public Pass@1 entry).

Fünfzehn Routen gegen eine, und was Failover wert ist

Ein Vorsprung von siebzehn Indexpunkten nützt Ihnen nichts, wenn der Endpunkt ausgefallen ist. Artificial Analysis zählte zum Zeitpunkt des Verfassens einen einzigen API-Anbieter für Xiaomi MiMo-V2.6-Pro, und diese Zahl sagt etwas über die Veröffentlichung aus, nicht über das Modell: Ein vor drei Tagen veröffentlichter Checkpoint hatte keine Zeit, sich zu verbreiten. MiniMax M3, vier Monate alt, wird von fünfzehn Anbietern bereitgestellt.

Diese Differenz ist genau das, wofür ein Router da ist, und hier gehen die beiden Modelle kommerziell auseinander. MiniMax M3 ist auf OrcaRouter als minimax/minimax-m3 verfügbar: ein einziger OpenAI-kompatibler Endpunkt, der Listenpreis des Anbieters wird mit 0 % Aufschlag durchgereicht, sodass die oben genannten $0,30 und $1,20 MiniMax' eigene Zahlen sind und nicht unsere, und eine Preisänderung von MiniMax ist am selben Tag auf unserer Seite live. Seine fünfzehn Upstreams sind das, was eine automatische Failover-Kette überhaupt sinnvoll macht – eine Anfrage, die bei einem Anbieter hängen bleibt, wird bei einem anderen erneut versucht, bevor die Antwort beginnt, was eine andere Garantie ist als bei einem Modell, das nur eine einzige Anlaufstelle hat. Xiaomi MiMo-V2.6-Pro ist nicht auf OrcaRouter; kein Xiaomi-Modell ist das, und um es heute zu erreichen, braucht man Xiaomis eigene Plattform und die Kataloge von Drittanbietern, die es auflisten.

Wenn Sie beides in derselben Anwendung wollen, ist die praktische Form ein Schlüssel, der die Modelle hält, für die Sie sich bereits entschieden haben, wobei der Neueinsteiger gegen sie bewertet wird, statt aufgrund einer drei Tage alten Bewertung übernommen zu werden. Das ist eine Routing-Entscheidung, und die nützliche Eigenschaft ist, dass eine Fallback-Spur nichts kostet, bis zu dem Tag, an dem sie Sie rettet.

The OrcaRouter model page for minimax/minimax-m3, showing MiniMax as the vendor, the 2026-05-31 release date, Vision, Tools, JSON and Reasoning capability tags, a 1M-token context window, 512K maximum output, $0.30 per 1M input and $1.20 per 1M output, and a p50 time to first token of 8.49 seconds.

Welches soll man wählen?

Wenn Sie diese Woche ein multimodales Open-Weight-Modell mit Millionen-Token in Produktion benötigen, lautet die Antwort MiniMax M3, und zwar mit großem Abstand — fünfzehn Anbieter, First Token in unter einer Sekunde, ein ausreichend permissiver kommerzieller Weg nur, wenn Sie die Community-Lizenz gelesen haben, und ein offizieller Eintrag für Long-Horizon-Benchmarks, den Sie einsehen können. Die Effizienzwarnung ist real: Kalkulieren Sie die 91.000 Output-Tokens pro Aufgabe ein, nicht nur den Preis pro Token.

Wenn Sie ein Modell für eine Arbeit auswählen, die Sie nächsten Monat beginnen, ist Xiaomi MiMo-V2.6-Pro das leistungsfähigere Modell mit einem großen gemessenen Vorsprung, zu einem niedrigeren Mischpreis und mit einer MIT-Lizenz, die die Lizenzdiskussion vollständig überflüssig macht. Was ihm noch fehlt, ist ein zweiter Ort, an dem es laufen kann. Worauf man achten sollte, ist die Anbieterzahl: Sobald sie über eins hinausgeht, hört die Siebzehn-Punkte-Lücke auf, ein Forschungsergebnis zu sein, und wird zu einer Bereitstellungsentscheidung.

Bis dahin lautet die ehrliche Zusammenfassung, dass das bessere Modell dasjenige ist, von dem aus man nicht auf ein anderes umschalten kann, und das schwächere Modell dasjenige, das man heute Abend den Kunden vorsetzen kann.

The Artificial Analysis model page showing the Intelligence Index v4.3.2 scores, output speed, latency and per-task cost that both models in this comparison are measured on.

Woher die Zahlen in diesem Beitrag stammen

Index-Werte, Durchsatz, Latenz, Cache-Rabatte und Anbieterzahlen für beide Modelle sind Messungen von Artificial Analysis auf dem Intelligence Index v4.3.2, abgelesen am 22. September 2026, und die 29 für MiniMax M3 basiert auf derselben Version des Composite wie die 46 für Xiaomi MiMo-V2.6-Pro. Die DeepSWE-v1.1-Werte für MiniMax M3 stammen aus dem öffentlichen Leaderboard-Eintrag vom 8. Juni 2026. Die DeepSWE-Veränderung von 58,4 auf 72,57, die Reinforcement-Learning-Ausgaben von rund 2,62 Millionen US-Dollar für den Pro-Lauf über dreißig Schritte sowie die SWE-Bench-Pro-, BrowseComp-, SVG-Bench- und Terminal-Bench-Zahlen für MiniMax M3 werden alle von den Anbietern angegeben, basieren auf den eigenen Testumgebungen der jeweiligen Labore und wurden nicht unabhängig reproduziert. Die Preise pro Token sind die Listenpreise der Anbieter selbst.