
Xiaomi MiMo-V3-Flash: Läuft das unveröffentlichte schnelle Modell in OpenCodes Omen Alpha?
- googleNEUGoogle: Gemini 3.8 Flash2026-09-0259Intelligenz76Coding
- qwenNEUQwen: Qwen3.8 Max (0902)2026-09-0258Intelligenz72Coding
- anthropicNEUAnthropic: Claude Fable 5.12026-09-0166Intelligenz82Coding
- AlibabaNEUQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiNEUZ.ai: GLM 5.3 Flash2026-08-2658Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1860Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1552Intelligenz68Coding
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1261Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0557Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenz69Coding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenz49Coding
Xiaomi MiMo-V3-Flash wurde von Xiaomi nicht angekündigt. Es gibt keine Modellkarte, keine Hugging-Face-Gewichte, keine Preisseite und keinen Startbeitrag – der Name kursiert nur aus einem einzigen Grund: Am 4. September 2026 sagte teortaxesTex, ein prominenter unabhängiger KI-Analyst, öffentlich, dass er glaubt, Omen Alpha, das anonyme „Stealth-Modell“, das OpenCode am selben Morgen seinen Go-Abonnenten anzubieten begann, sei Xiaomi MiMo-V3-Flash. Seine Identifizierung stützt sich hauptsächlich auf das, was er als Chain-of-Thought eines Modells aus der DeepSeek-V4-GA-Ära in der sichtbaren Reasoning-Spur von Omen Alpha liest – was, falls es zutrifft, Xiaomi MiMo-V3-Flash zu einer von Xiaomi gebauten schnellen Stufe machen würde, die auf DeepSeeks offenen V4-Gewichten trainiert wurde. Nichts an dieser Identifizierung ist bestätigt, und dieser Artikel behandelt sie genau als das, was sie ist: eine gut begründete Hypothese in einem aktiven Ratespiel.
Die Grundregeln für das Folgende: Der Start von Omen Alpha ist bestätigte Tatsache, und die Behauptung des Analysten ist eine gekennzeichnete Behauptung. Die Existenz der V3-Generation wird durch eine Konferenzvorschau und einen durchgesickerten Benchmark gestützt, die beide von Xiaomi eindeutig als unbestätigt markiert wurden. Die Behauptung, dass überhaupt ein Modell namens Xiaomi MiMo-V3-Flash existiert, ist eine Schlussfolgerung aus dem Verhalten, keine Xiaomi-Aussage – und da Xiaomi keine gemacht hat, wird hier keine als Tatsache wiederholt.
Die Behauptung und die vier Gründe dahinter
Der Auslöser war ein Entwicklerbericht. Ein Entwickler, der Omen Alpha in OpenCode testete und als @SPAC89 postete, schrieb, dass „Omen Alpha High“ – das Modell mit seiner hohen Reasoning-Einstellung – eine umfangreiche Programmieraufgabe in weniger als zehn Minuten abgeschlossen hatte und dass ein deutlich längerer Lauf von mehreren Stunden im Gange war. teortaxesTex zitierte diesen Bericht und sagte, er glaube, dass das Modell Xiaomi MiMo-V3-Flash sei, und nannte vier Gründe, die alle verhaltensbasiert und nicht dokumentarisch seien:
Der Reasoning-Trace. Das sichtbare Chain-of-Thought liest sich wie DeepSeek V4 GA CoT – seine Tells sind „hmm“, „fine“ und Checklistenpunkte mit vorangestelltem ✓. Der Screenshot, den er angehängt hat, zeigt Omen Alpha mitten im Build bei der Einstellung „high“ mit einem Trace, der dem Muster entspricht.
• Die Geschwindigkeit. Das Modell ist schnell — das ist die Beobachtung, auf die er reagierte — und Xiaomis schnelle Stufe trug historisch den Namen „Flash".
• Der Betreiber. DeepSeek führt keine verdeckten Werbeaktionen durch. Selbst wenn die Überlegungen ursprünglich von DeepSeek V4 GA stammen, ist derjenige, der hinter Omen Alpha steckt, ein Dritter, der auf DeepSeek aufbaut, und nicht DeepSeek selbst.
• Die Clusterbildung. Die Ausgabetexte der Xiaomi-MiMo-Modelle clustern mit denen von DeepSeek – seine Kurzform für zwei Generationen, deren Texte in der Verteilung nahe beieinanderliegen, was genau dem entspricht, was ein mit DeepSeek trainiertes Modell hervorbringen würde. Er nennt mit StepFuns Step-4 eine Alternative, die ebenfalls mit DeepSeek clustert, und sagt, er sei sich bei StepFuns aktueller Generation nicht sicher.
Der Bote ist einen Satz wert, denn dieselbe Tatsache schneidet in beide Richtungen. teortaxesTex ist ein selbsternannter DeepSeek-Anhänger – sein X-Profil nennt ihn seit 2023 einen DeepSeek-Fan. Das ist das Profil von jemandem, der einen DeepSeek-V4-Denkstil auf Anhieb erkennen kann, und auch das Profil von jemandem, der geneigt ist, einen solchen zu sehen.
Wo ein MiMo-V3-Flash in Xiaomis Produktpalette einzuordnen wäre
Die offiziell von Xiaomi bestätigten MiMo-Modelle sind heute MiMo-V2.5 und MiMo-V2.5-Pro, die beide Ende April 2026 unter der MIT-Lizenz als Open Source veröffentlicht werden. MiMo-V2.5-Pro ist ein Mixture-of-Experts-Modell mit 1,02 Billionen Parametern, 42 Milliarden aktiven Parametern und einem Kontextfenster von 1 Million Token; MiMo-V2.5 ist das kleinere General-Purpose-Geschwistermodell mit 310 Milliarden Parametern. Dahinter in der Modellfamilie stehen MiMo-V2-Flash (Dezember 2025, ein offenes MoE mit 309 Milliarden Parametern) und MiMo-V2-Pro (März 2026) – und MiMo-V2-Pro ist für diese Geschichte von Bedeutung, weil es zunächst unter einem anonymen Codenamen, Hunter Alpha, an die Öffentlichkeit gelangte, bevor Xiaomi es für sich beanspruchte. Anonyme Feldtests sind für Xiaomi keine Ausnahme; sie sind Teil der Art und Weise, wie Xiaomi Produkte auf den Markt bringt.
Die V3-Generation ist der Punkt, an dem sich die Bilanz vom ausgelieferten Produkt zum Bericht verschiebt. Auf der ICML im Juli 2026 gab Luo Fuli, die Forscherin, die das MiMo-Team leitet, einen Ausblick auf die Architektur von V3. Im Zentrum steht ein Design, das Xiaomi High Sparse nennt: Eine kleine Anzahl von Full-Attention-Schichten fungiert als „Orakel“, das die Token auswählt, auf die sich die umgebenden Sparse-Schichten konzentrieren sollen, und diese Sparse-Schichten teilen sich den KV-Cache der Full-Attention-Schichten, anstatt einen eigenen zu führen. Xiaomi zufolge reduziert das den Speicherbedarf des KV-Cache um etwa das Zehnfache; zudem habe das Team ein Verhältnis von 11:1 zwischen Sparse- und Full-Attention an einem Modell im 80-Milliarden-Parameter-Maßstab validiert, das die Qualität der Full-Attention erreichte, während eine hybride Sliding-Window-Baseline bei gleicher Sparsity etwa sieben MMLU-Punkte verlor. Dabei handelt es sich um die eigenen Angaben des Teams aus einem Konferenzvortrag, nicht um unabhängige Ergebnisse. Am 21. August kursierte dann ein angeblicher Benchmark-Screenshot für ein MiMo-V3-Pro, den Max For AI geteilt hatte: SWE-Bench Pro 72,8; zum Vergleich: GLM 5.3 67,9, Kimi K3 65,8, Claude Opus 5 74,6 und GPT-5.6 Sol Max 75,4; dazu Terminal-Bench 2.0 70,6 und τ3-bench 76,4. Xiaomi hat nichts bestätigt, und weder die Existenz von V3 noch der Zeitpunkt einer Veröffentlichung wurden angekündigt. Das Fazit für diesen Artikel ist jedoch enger gefasst: Die V3-Generation ist nachweislich im Gange, aber kein V3-Modell wurde ausgeliefert – genau deshalb wäre ein unangekündigtes Xiaomi MiMo-V3-Flash, das im Stillen auftaucht, eine echte Neuigkeit und keine Routineangelegenheit.
Warum ein Flash — und warum OpenCode Go — passen würden.
Mit der Flash-Stufe stellt Xiaomi schnelle, günstige Kapazität bereit; dasselbe tat es im Dezember mit MiMo-V2-Flash. Und OpenCode Go ist ein plausibles Erprobungsfeld, weil es bereits Xiaomis aktuelles offenes Modell anbietet: Dieselbe Go-Reihe, die Omen Alpha mit 11.600 Anfragen pro fünf Stunden aufführt, listet auch MiMo-V2.5 mit 30.100 Anfragen auf – eines der großzügigsten Kontingente auf der Seite. Ein Xiaomi-Team, das ein V3-Flash-Modell neben seinem eigenen MiMo-V2.5 auf einer Plattform testen würde, erhielte ohne Marketingkosten einen direkten Vergleich mit der Vorgängergeneration – auf einer Plattform, die in diesem Monat bereits eine anonyme Enthüllung verzeichnet hat. Das ist ein Argument für Plausibilität, kein Beweis für die Identität.

Die Produktform weist in dieselbe Richtung. Omen Alpha, das mit der Reasoning-Einstellung „high" in unter zehn Minuten abschließt, entspricht dem Verhalten, das man von einer schnellen Reasoning-Stufe erwarten würde, und die kursierenden Zahlen von dritter Seite für Omen Alpha – rund 0,20 US-Dollar pro Million Input-Tokens und 0,66 US-Dollar pro Million Output-Tokens, nach Presseberichten statt einer offiziellen Preisliste – ordnen es neben DeepSeek V4 Flash am günstigen Ende des Marktes ein. Genau so sähe eine auf DeepSeek V4 basierende „Flash"-Stufe aus: ein Modell, das sich wie ein schnelles, günstiges Reasoning-Modell der DeepSeek-Generation verhält. Wieder einmal gilt: berichtet und abgeleitet, nicht bestätigt.
Die DeepSeek-Verbindung ist der springende Punkt — und das schwächste Beweisstück.
Warum DeepSeek V4 GA überhaupt eine Rolle spielt: DeepSeeks V4-Reihe wechselte im August 2026 von der Vorschauphase zur allgemeinen Verfügbarkeit, als DeepSeek V4 Pro am 13. August seinen GA-Build 0813 mit MIT-lizenzierten offenen Gewichten auslieferte, zusammen mit dem günstigeren Schwestermodell DeepSeek V4 Flash. Offene Gewichte unter der MIT-Lizenz bedeuten, dass Dritte legal darauf aufbauen können, und die Community erkennt ein solches Modell gewöhnlich an dem Reasoning-Stil, den es erbt: DeepSeeks Chain-of-Thought aus der GA-Ära hat wiedererkennbare sprachliche Eigenheiten, und genau diese Eigenheiten sind es, die teortaxesTex laut eigenen Angaben im Trace von Omen Alpha sieht. Wenn er damit richtigliegt, dass der Trace von DeepSeek V4 GA stammt, und auch damit, dass der Betreiber Xiaomi ist, dann wäre Xiaomi MiMo-V3-Flash die schnelle Variante von Xiaomi, die auf DeepSeeks offenen Reasoning-Gewichten basiert – eine legale, aber strategisch bemerkenswerte Wahl, und eine, die schlüssig erklären würde, warum ein Modell, das dem Anschein nach von Xiaomi stammt, wie ein DeepSeek denkt.
Jetzt kommt der schwierige Teil. Eine Chain-of-Thought-Ähnlichkeit ist die schwächste Klasse von Modell-Fingerabdrücken, weil sie eher Stil als Struktur betrifft. Die Identifizierung des anonymen Modells, die diesen Monat tatsächlich Bestand hatte — Ox Alpha als GLM-5.3-Flash — stützte sich auf weitaus belastbarere Beweise: Tokenizer-Abgleich und Video-Encoding-Forensik. Es wurde kein vergleichbarer harter Fingerabdruck veröffentlicht, der Omen Alpha mit Xiaomi in Verbindung bringt. Die vorherrschende Lesart der Community weist zudem woandershin: Entwickler berichten, dass die Backend-Anfragen von Omen Alpha unter einem „zhipu“-Namespace aufgelöst werden; einige Tester beschreiben, dass sich das Modell selbst als GLM-basiert identifiziert; und die Presselesart des Starts besagt, dass Omen Alpha die zweite anonyme Veröffentlichung von Zhipu AI innerhalb von neun Tagen ist, nach dem Ox-Alpha-Lauf, der als GLM-5.3-Flash gelesen wurde. Wenn diese Lesart richtig ist, ist das DeepSeek-gefärbte Reasoning entweder ein stilistischer Zufall oder ein Zeichen dafür, dass das Zhipu-Modell selbst mit DeepSeek-Spuren trainiert wurde — aber es ist kein Xiaomi-Produkt. Die beiden Lager können nicht beide recht haben, und keines der beiden Lager hat eine Stellungnahme des Labors, das es nennt.

Was würde es klären
• Eine Xiaomi-Ankündigung – oder Gewichte. Xiaomi hat seine MiMo-Modelle seit MiMo-V2-Flash als Open Source veröffentlicht, wobei MiMo-V2.5 und MiMo-V2.5-Pro unter MIT veröffentlicht wurden; ein echtes Xiaomi MiMo-V3-Flash würde höchstwahrscheinlich so bestätigt werden, wie GLM-5.3-Flash es wurde, mit Gewichten und einer Modellkarte auf Hugging Face.
• Ein eindeutiger Fingerabdruck. Die Übereinstimmung der Tokenizer war der Beweis für die Identifizierung von Ox Alpha; ein Tokenizer-Test, der Omen Alpha Xiaomi zuordnet, wurde nicht veröffentlicht.
• Die eigene Aussage des Modells. Einige Tester berichten, dass Omen Alpha sich selbst als GLM-basiert beschreibt. Die Selbstauskunft eines Modells zählt als Daten, aber nicht als Provenienz.
• Unabhängige Benchmarks von Omen Alpha. Neutrale Bewertungen des anonymen Modells würden es der Community ermöglichen, es mit den MiMo-V3-Pro-Zahlen zu vergleichen, die im August durchgesickert sind.
• Die Enthüllung nach dem Go-Zeitfenster. Frühere anonyme Modelle wurden Tage bis Wochen nach der Veröffentlichung beansprucht; wer auch immer Omen Alpha beansprucht, wird das Modell exakt benennen.
Was tun, während das Raten weitergeht
Die praktische Position hängt nicht davon ab, wer recht hat. Omen Alpha ist ein anonymes Modell hinter einem Abonnement für 10 Dollar pro Monat, und Xiaomi MiMo-V3-Flash ist ein unbestätigter Name, der daran hängt; keines von beiden ist etwas, auf das man heute eine Produktionspipeline setzen sollte. Wenn ein Hersteller sich jedoch meldet und das zugrunde liegende Modell gewöhnliche APIs erreicht, ist das der Moment, in dem eine Routing-Schicht ihre Daseinsberechtigung beweist: OrcaRouter gibt die Listenpreise der Anbieter mit 0 % Aufschlag weiter, sodass ein neu veröffentlichter Tarif am selben Tag, an dem der Anbieter ihn veröffentlicht, auf derselben API live ist, und automatisches Failover ermöglicht es Ihnen, einen Teil des echten Datenverkehrs an einen unbewiesenen Neuling zu senden, mit einem Fallback auf ein Modell, dem Sie bereits vertrauen. In der Zwischenzeit ist die Sache, auf die man achten sollte, einfach: Beansprucht jemand Omen Alpha, und erscheint Xiaomi MiMo-V3-Flash jemals auf einer Modellkarte? Eines dieser beiden wird passieren.

{{1}}Stand 4. September 2026 ist Xiaomi MiMo-V3-Flash ein Name, eine plausible Produktform und die Hypothese eines prominenten Analysten – kein veröffentlichtes Modell. {{2}}Die V3-Generation ist real genug, um im Juli vorab vorgestellt und im August geleakt zu werden.{{/2}} {{3}}Ob ihre erste öffentliche Sichtung gerade jetzt unter dem Codenamen Omen Alpha stattfindet, ist eine Frage, die nur Xiaomi beantworten kann – und es hat sie nicht beantwortet.{{/3}}{{/1}}
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
