
Union Alpha vs. DeepSeek V4.1 Flash: Ein einwöchiges Gratisangebot gegen offene Gewichte
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiNEUOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenz76Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Union Alpha ist heute kostenlos. DeepSeek V4.1 Flash kostet 0,15 US-Dollar pro Million Eingabe-Tokens – und im Dezember wird es noch verfügbar sein. Diese Asymmetrie macht den gesamten Vergleich aus: Eines dieser beiden Modelle ist eine anonyme Vorschau mit einem angegebenen Zeitfenster von einer Woche und ohne veröffentlichte Gewichte, und das andere ist ein MIT-lizenzierter Mixture-of-Experts-Checkpoint, den man herunterladen, prüfen und selbst hosten kann. Wenn du ein Modell auswählst, auf dem du aufbauen willst, statt nur damit zu spielen, ist das kostenlose Modell nicht die sicherere Wahl.
Was Union Alpha tatsächlich ist
Union Alpha tauchte am 16. September 2026 in Modellkatalogen von Drittanbietern auf und wird jetzt auf OrcaRouters kostenlosem Tarif. Sein Betreiber ist anonym – das Anbieterfeld lautet buchstäblich "Stealth" – und kein Labor hat es für sich beansprucht. Das ist keine Kritik am Modell; es ist die mit Abstand wichtigste Tatsache daran, denn alles andere, was man darüber sagen kann, ergibt sich daraus.
Verifizierbar ist die Form des Endpunkts, denn man kann ihn aufrufen und die Metadaten lesen:
• Kontextfenster — 262.144 Tokens (256K), mit einer maximalen Ausgabe von 131.072 Tokens.
• Ein- und Ausgaben — akzeptiert Text und Bilder, gibt nur Text aus. Keine Videoeingabe, kein Audio.
• API-Oberfläche — tools, tool_choice, response_format, temperature, top_p und max_tokens. Strukturierte JSON-Ausgabe funktioniert; strikte JSON-Schema-Durchsetzung nicht. In der Praxis berücksichtigt tool_choice nur „auto“.
• Reasoning-Steuerung — keine offengelegt. Es gibt keinen Aufwandsregler, kein Denkbudget, keinen sichtbaren Reasoning-Kanal.
• Herkunft — keine Gewichte, keine Lizenz, keine Parameteranzahl, keine Architekturanmerkung, kein angegebener Wissensstichtag. Der Tokenizer ist als „Sonstiges“ eingetragen.
• Preis — 0 $ pro Million Input- und Output-Tokens während der Preview-Phase, rate-limitiert, mit HTTP 429, sobald Sie das Limit Ihres Tarifs erreichen.
Die einzige damit verbundene Leistungsbehauptung – „Frontier-Level-Leistung über ein breites Spektrum allgemeiner Aufgaben“ – stammt vom Betreiber und wurde nie unabhängig reproduziert. Dahinter stehen weder ein Leaderboard-Eintrag noch eine Benchmark-Tabelle des Anbieters noch eine Model Card.
Was DeepSeek V4.1 Flash wirklich ist
DeepSeek V4.1 Flash wurde am 10. September 2026 veröffentlicht, sechs Tage bevor Union Alpha erschien, und es ist ein Objekt der entgegengesetzten Art. Es ist ein Sparse-Mixture-of-Experts-Modell, das auf einer neuen Causal-Encoder-Decoder-Architektur basiert, mit einem 552B-Parameter-Backbone (16B aktiv bei der Ausgabe, 8B bei der Eingabe) plus 196B Engram-Parameter für das konditionale Gedächtnis – insgesamt rund 763B – trainiert auf 45T Tokens und unter der MIT-Lizenz veröffentlicht.
Zwei technische Details sind wichtiger als die Parameterzahl. Compressed Sparse Attention 2 in Kombination mit FP4-KV-Caching bringt den Cache auf rund 890 Bytes pro Token – etwa ein Viertel dessen, was DeepSeek V4 Flash benötigte –, und genau das macht einen Kontext von 1 Mio. Token wirtschaftlich vertretbar. Und DeepSeek fasst seine eigene Produktlinie darin zusammen: Legacy-Anfragen an V4 Flash und V4 Pro werden zu Flash-Preisen an V4.1 Flash weitergeleitet.
• Kontextfenster — 1.000.000 Token, gegenüber den 262.144 von Union Alpha.
• Maximale Ausgabe — 384.000 Token pro Antwort, gegenüber 131.072.
• Eingaben — Text und Bild (native Vision); Ausgabe nur Text.
• Preis — 0,15 $/Mio. Eingabe, 0,60 $/Mio. Ausgabe, 0,003 $/Mio. gecachte Eingabe außerhalb der Spitzenzeiten; verdoppelt auf 0,30 $/1,20 $/0,006 $ während der Spitzenzeiten (Mo.–Fr., 01:00–04:00 und 06:00–10:00 UTC). An Wochenenden gilt immer der Off-Peak-Tarif.
• Gewichte — MIT, herunterladbar, selbst hostbar.
• Beobachtete Geschwindigkeit — 215 Ausgabe-Token pro Sekunde, mit einer p50-Zeit bis zum ersten Token von 842 ms, einer p95 von 2,40 s und einer Fehlerrate von 1,2 %
Das Benchmark-Bild ist schief – und nicht so, wie man vermuten würde
DeepSeek veröffentlicht. Union Alpha nicht. Das ist alles.
V4.1 Flash kommt mit einer vollständigen Tabelle, obwohl diese größtenteils aus DeepSeeks eigener Berichterstattung plus Aggregator-Einträgen besteht und nicht aus einem einzigen unabhängigen Audit: GPQA Diamond 90,9, HLE 63,9 mit Tools und 36,8 ohne, Terminal-Bench 2.1 bei 90,6, DeepSWE v1.1 bei 74,2, CyberGym 88,1, MathArena Apex 65,6 und einen Artificial Analysis Intelligence Index von 40. Beachten Sie die Lücken in dieser Tabelle – Terminal-Bench 4.0 kommt auf 31,2, drastisch unter dem Wert von 2.1, was daran erinnert, dass die Schlagzeilen-Zahlen der Anbieter sich um diejenige Suite gruppieren, die das Modell am besten dastehen lässt.
Für Union Alpha existiert genau eine unabhängige Messung. Das SMF Clearinghouse ließ es mit deaktiviertem Reasoning durch 157 Tests der Official-A-Suite laufen und bewertete es mit 136/157 — 86,6 %, null Fehler, Rang zehn von sechsundzwanzig Einträgen. Reasoning 30/30, Tools 2/2, Coding 26/30, Mathematik 24/30 und eine auffallend schwache Writing-Suite mit 2/5. Das ist ein echter Datenpunkt, und es ist der einzige.
Die ehrliche Zusammenfassung lautet also: V4.1 Flash hat viele Zahlen, die meisten davon herstellergefärbt, aber wenigstens sichtbar und datiert. Union Alpha hat eine Zahl, und die ist ganz ordentlich.

Der Preis ist die einzige Achse, auf der Union Alpha gewinnt – und das gewinnt sie uneingeschränkt.
Kostenlos schlägt $0,15/$0,60. Es gibt keine clevere Formulierung, die daran etwas ändert. Für eine Woche Evaluierungsarbeit, Batch-Experimente oder einen Wegwerf-Agent-Loop, den man hundertmal laufen lassen möchte, kostet Union Alpha gar nichts und V4.1 Flash kostet im großen Maßstab echtes Geld.
Doch das Wort „free“ wiegt hier ungewöhnlich schwer. Die Vorschau ist ratenbegrenzt, sodass der Durchsatz vom jeweiligen Tarif gedeckelt wird und nicht vom Modell. Dahinter steht ein einziger Endpoint – also kein Anbieter-Fallback, falls dieser Endpoint ins Wanken gerät. Und das kostenlose Fenster kann der Anbieter jederzeit schließen – ein Preis nach der Vorschau wurde nicht angekündigt.
Hier verändert das Routing ebenfalls die Rechnung. OrcaRouter gibt die Listenpreise der Anbieter mit 0 % Aufschlag weiter, sodass die Änderung, wenn DeepSeek seine Off-Peak-Tarife anpasst, noch am selben Tag auf unserer Seite live ist, statt auf einen Repricing-Zyklus zu warten. Beide Modelle laufen über denselben Schlüssel, was bedeutet, dass Sie den obigen Vergleich als Konfigurationsänderung statt als zwei Integrationen durchführen können – und Union Alpha für $0 im kostenlosen Tarif sowie V4.1 Flash auf dem kostenpflichtigen Pfad ohne einen zweiten Vertrag erhalten.
Welche sollte man eigentlich anrufen?
Die entscheidende Frage ist nicht die Leistungsfähigkeit. Sie lautet, ob die Antwort den nächsten Monat überleben muss.

Setze DeepSeek V4.1 Flash ein, wenn die Arbeit in die Produktion geht. Der 1M-Token-Kontext, die 384K-Ausgabe-Obergrenze, die MIT-Gewichte, die datierte Benchmark-Tabelle und die Tatsache, dass DeepSeek seinen eigenen Legacy-Traffic darauf konsolidiert, deuten alle in dieselbe Richtung: Dies ist ein Modell mit Zukunft und einer Papierspur. Bei 0,003 US-Dollar pro Million gecachter Eingabe-Tokens ist eine stark gecachte Long-Context-Workload ohnehin nahezu kostenlos.
Nutze Union Alpha, wenn du ein Modell erkundest, dich damit vergleichst oder einfach neugierig auf ein Modell bist, das eine schnelle Stufe von etwas viel Größerem sein könnte. Sein Vision-Input und das 256K-Fenster sind wirklich nützlich für Dokument- und Screenshot-Arbeit, und das Official-A-Ergebnis legt nahe, dass es kompetent und nicht peinlich ist. Halte es einfach von jedem Pfad fern, auf dem dich ein plötzlicher 429 oder ein unangekündigtes Herunterfahren etwas kostet.
Und wenn Sie beides tun möchten, ohne irgendetwas umzubauen, dann spricht das für eine Routing-Schicht statt für eine direkte Integration.
Was würde dieses Urteil ändern?
Drei Dinge, nach Wahrscheinlichkeit geordnet.
Ein namentlich genanntes Labor erhebt Anspruch auf Union Alpha. Der Präzedenzfall spricht dafür, dass dies plausibel ist: Der vorherige anonyme Eintrag in dieser Serie, Ox Alpha, wurde sechs Tage nach seinem Erscheinen als GLM-5.3-Flash von Zhipu enthüllt. Die Enthüllung bringt eine Lizenz, eine Parameteranzahl und mit ziemlicher Sicherheit einen Preis.
Ein unabhängiges Leaderboard bewertet es. Derzeit ist eine einzige Testsuite mit 157 Tests der gesamte öffentliche Datensatz. Ein Artificial-Analysis-Eintrag mit datierter Methodik würde Union Alpha von der Anekdote zu Daten machen.
Das kostenlose Fenster schließt sich leise. Das ist das Standardergebnis bei Stealth-Previews – Ox Alpha wurde nach dem Ende seiner Preview aus dem Katalog entfernt. Wenn Union Alpha ohne einen Preis nach der Preview verschwindet, wird „kostenlos“ genau eine Woche Integrationsarbeit gekostet haben, weshalb die Kombination mit automatischem Failover die umsichtige Art ist, es heute zu nutzen.

Der kostenpflichtige Pfad ist nur einen Schlüssel entfernt: DeepSeek V4.1 Flash Modellseite listet die Off-Peak-Tarife von 0,15 $/0,60 $ ohne zusätzliche Pro-Token-Marge auf, und die Verdopplung während der Spitzenzeiten ist auf derselben Seite aufgeschlüsselt.
