
Step 5 Preview vs. MiniMax M3: Günstiger pro Token, teurer pro Punkt
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens
- deepseekNEUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0540Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenz76Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Der Stückpreis spricht deutlich für MiniMax M3. Bei 0,30 $ pro Million Eingabe und 1,20 $ pro Million Ausgabe unterbietet das 428B-Sparse-Modell des Anbieters die 1,00 $ und 2,70 $ von Step 5 Preview auf beiden Seiten um mehr als das Zweifache. Doch der Stückpreis ist der falsche Nenner für ein Modell, das man zum Beantworten von Fragen verwendet, und sobald man durch das teilt, was jedes Modell tatsächlich liefert, kehrt sich das Ranking um. Step 5 Preview kostet 0,71 $ pro Intelligence-Index-Aufgabe bei einer Punktzahl von 44. MiniMax M3 kostet 0,51 $ pro Index-Aufgabe bei einer Punktzahl von 29. Pro Punkt gemessener Leistungsfähigkeit ist das Modell mit dem höheren Listenpreis das günstigere – und der Grund dafür ist eine Lücke von fünfzehn Punkten im Index, die kein noch so großer Rabatt schließen kann.
Zwei sehr unterschiedliche Arten von „verfügbar“
MiniMax M3 ist allgemein verfügbar seit 1. Juni 2026, als MiniMax es über MiniMax Code, seinen Token Plan und die API öffnete — kein Preview-Label an keiner Stelle des Launches. Die Gewichte folgten am 12. Juni, elf Tage später, wie versprochen. Das Repository MiniMaxAI/MiniMax-M3 umfasst ungefähr 428 Milliarden Gesamtparameter mit etwa 23 Milliarden aktiven pro Token, basierend auf MiniMax Sparse Attention, zusammen mit einer separaten MXFP8-quantisierten Veröffentlichung.
Step 5 Preview hat seine API am 20. September 2026 geöffnet. Seine Gewichte wurden nicht veröffentlicht — das Hugging-Face-Repository stepfun-ai/Step-5-Preview-BF16 ist eine leere Hülle — und StepFun hat sich auf den 15. Oktober 2026 festgelegt. Der praktische Unterschied ist also, dass M3 ein Modell ist, das man herunterladen, selbst hosten und inspizieren kann, während Step 5 Preview ein gehosteter Endpunkt mit einer veröffentlichten Absicht ist.
Erwähnenswert: MiniMax’ eigene Modellseite behauptet weiterhin, M3 werde „bald vollständig als Open Source veröffentlicht“, was dem Repository widerspricht, das im Juni veröffentlicht wurde. Betrachten Sie das als veraltete Anbieterseite und nicht als Beleg dafür, dass die Gewichte fehlen.
Die Preisgeschichte ist nicht die Kostengeschichte
Artificial Analysis berechnet eine Kennzahl für die Kosten pro Index-Aufgabe, indem es denselben Evaluationssatz durch jedes Modell laufen lässt und die Tokenkosten addiert. Es ist das, was in der Branche einer Gesamtbetriebskosten-Kennzahl für eine feste Arbeitsmenge am nächsten kommt, und es bezieht die beiden Effekte ein, die Tokenpreise verbergen: wie ausführlich ein Modell ist und wie viel es nachdenkt.
Schritt 5 Preview liegt bei 0,71 $ pro Index-Aufgabe, mit Gesamtkosten für den Index-Lauf von 922,84 $. MiniMax M3 liegt bei 0,51 $, mit Gesamtkosten für den Lauf von 537,98 $. Beim reinen Durchsatz an Aufgaben ist M3 rund 28 % günstiger. Teilt man durch den Index-Score – 44 gegen 29 –, kommt Schritt 5 Preview auf etwa 1,6 Cent pro Indexpunkt gegenüber 1,8 Cent bei M3.
Ein Vorbehalt gehört genau hierhin: Das ist ein Index-Durchlauf pro Modell, und ein Index-Durchlauf ist eine kleine Stichprobe. Die Arithmetik pro Punkt ist eine Plausibilitätsprüfung der Zahl pro Aufgabe, kein eigenständiger Benchmark. Doch die Richtung deckt sich mit den Zahlen pro Aufgabe, und genau diese Werte können die eigenen Preislisten der beiden Anbieter nicht zeigen.
• Intelligenz-Index — Step 5 Preview 44 (#24 von 200) vs. MiniMax M3 29 (#15 von 113), beide auf der aktuellen Indexversion
• Eingabepreis — 1,00 $ pro Million vs. 0,30 $ pro Million
• Output-Preis — 2,70 $ pro Million gegenüber 1,20 $ pro Million
• Kosten pro Indexierungsaufgabe — 0,71 $ vs. 0,51 $
• Aktive Parameter — 27B vs. 23B
• Kontextfenster — 1 Mio. Tokens vs. 1 Mio. Tokens
• Ausgabegeschwindigkeit — 99,8 Tokens/s vs. 210,4 Tokens/s
• Gewichte – versprochen am 15. Oktober 2026 vs. verfügbar seit 12. Juni 2026

Die Indexversions-Falle, die dies verwirrend macht
Es besteht eine echte Gefahr beim Lesen der M3-Zahlen, und sie ist einen Absatz wert, denn sie bringt fast jede Drittanbieter-Vergleichsseite ins Stolpern. Artificial Analysis hat seinen Intelligence Index am 7. September 2026 neu kalibriert, und die Neukalibrierung hat die Werte durchweg komprimiert. Auf der aktuellen Skala misst M3 29. Auf der Skala vor September maß es 44 bis 45 — und eine Reihe von Trackern veröffentlicht dafür noch immer 44,4 oder 45,4.
Diese Kollision ist hier wichtiger als sonst, weil der aktuelle Score von Step 5 Preview ebenfalls 44 beträgt. Eine Seite, auf der ein veralteter M3-Wert neben einem aktuellen Step 5 Preview-Wert steht, lässt zwei Modelle als gleichauf erscheinen, während der aktuelle Abstand fünfzehn Punkte beträgt. Beide Werte in diesem Artikel stammen aus der aktuellen Indexversion und sind miteinander vergleichbar; alles, was vor dem 7. September veröffentlicht wurde, ist es nicht.
Wo MiniMax M3 wirklich kaum zu schlagen ist
Zwei Dinge bei M3 liegen nicht dicht beieinander. Das erste ist die Geschwindigkeit: 210,4 Ausgabe-Tokens pro Sekunde, womit M3 das viertschnellste der 113 Modelle ist, die Artificial Analysis verfolgt – gegenüber einem Median von 76,3. Die 99,8 Tokens pro Sekunde von Step 5 Preview sind beachtlich und weniger als die Hälfte davon. M3s Zeit bis zum ersten Token von 1,01 Sekunden ist ebenfalls der schnellere Wert gegenüber 2,96 Sekunden.
Die zweite ist die Eingabemodalität. M3 akzeptiert Text, Bild und Video und gibt Text zurück, und MiniMax dokumentiert den Desktop- und Computer-Use-Betrieb. Step 5 Preview nimmt Text und Bilder entgegen. Wenn Ihre Pipeline Bildschirmaufzeichnungen oder Videoframes in ein Modell einspeist, ist das keine Präferenz — es ist ein Unterschied in der Leistungsfähigkeit.
Die Preisdifferenz verstärkt beides. Bei 0,30 $ und 1,20 $ mit einem dauerhaften Rabatt von 50 %, angewendet auf einen Listenpreis von 0,60 $ und 2,40 $, und einem Cache-Rabatt von 80 %, der die Cache-Lesevorgänge auf 0,06 $ pro Million senkt, ist M3 einer der günstigsten Wege, ein großes Token-Volumen durch ein leistungsfähiges Modell zu bewegen. Beachten Sie die Staffelung: Eingaben über 512K Token verdoppeln die gesamte Anfrage, und die Priority-Service-Stufe kostet das 1,5-Fache.
Wo es auseinanderfällt
MiniMax' eigener Evaluationsdatensatz für M3 ist stark und sollte als vom Anbieter gemeldet betrachtet werden: SWE-bench Verified bei 80,5 %, SWE-bench Pro bei 59,0 %, Terminal-Bench 2.1 bei 66,0 %, MCP Atlas bei 74,2 %, BrowseComp bei 83,5 und OSWorld-Verified bei 70,06 %. MiniMax führte diese auf der eigenen Infrastruktur mit Claude Code als Scaffolding durch, gemittelt über vier Durchläufe, und das Bewertungs-Setup ist nicht öffentlich – daher sind sie nach derzeitiger Lage nicht durch Dritte reproduzierbar.
Das unabhängig gemessene Bild fällt für agentische Arbeit deutlich härter aus. Artificial Analysis verzeichnete Terminal-Bench 4.0 bei 2 % für M3 – eine andere Version des Benchmarks als die Terminal-Bench-2.1-Angabe des Anbieters und nicht damit vergleichbar, aber dennoch deutlich. SciCode kam auf 47 %, AutomationBench-AA auf 21 % und CritPt auf 4 %. M3s stärkste unabhängige Ergebnisse liegen bei Langkontext- und Wissensarbeit: AA-LCR v1.1 bei 83 %, Humanity's Last Exam bei 39 %.
Step 5 Preview kehrt dieses Profil um. Terminal-Bench 4.0 erreicht 33,3 % auf demselben Harness wie M3 mit 2 %, SciCode erreicht 59 % gegenüber 47 %. Wenn die Arbeit agentisch oder codeförmig ist, ist das kein knapper Vergleich, und der Preisvorteil gleicht das nicht aus.

Die Lizenzklausel, die die meisten Vergleiche überspringen
MiniMax M3 ist Open-Weight, aber es ist nicht Open Source im OSI-Sinne, und die Bedingungen sind strenger, als die Formulierung „offene Gewichte“ vermuten lässt. Das Repository enthält die MiniMax Community License: kostenlos für nichtkommerzielle Nutzung, wobei die kommerzielle Nutzung daran geknüpft ist, dass „Built with MiniMax M3“ prominent angezeigt wird – und jedes Produkt mit mehr als 20 Millionen USD Jahresumsatz erfordert eine vorherige schriftliche Genehmigung von MiniMax. Es ist nicht MIT, nicht Apache und nicht die Art von Lizenz, die eine Rechtsabteilung durchwinkt.
Step 5 Preview lässt sich auf dieser Achse noch überhaupt nicht bewerten, da es keine Lizenz zum Lesen gibt. StepFun hat eine Veröffentlichung der Gewichte am 15. Oktober zugesagt und die Bedingungen, die dafür gelten werden, noch nicht veröffentlicht. Wer darauf aufbauen möchte, sollte die Lizenz als offene Frage behandeln, statt anzunehmen, dass sie der von Moonshot oder DeepSeek ähneln wird.
Das ist die ehrliche Asymmetrie zwischen den beiden: Die Bedingungen von M3 sind restriktiv, aber bekannt; die von Step 5 Preview sind unbekannt. Eine restriktive Lizenz, mit der man planen kann, ist besser als eine unangekündigte, mit der man es nicht kann.
Einen von beiden anrufen
MiniMax M3 ist in unserem Katalog unter /models/minimax/minimax-m3 verfügbar, erreichbar über denselben Schlüssel und dasselbe Anfrageformat wie die übrigen über 200 Modelle, die wir routen, wobei der Anbieter-Listenpreis mit 0 % Aufschlag weitergegeben wird — der dauerhafte Rabatt von 50 %, den MiniMax gewährt, ist also der Preis, den Sie sehen, und er ändert sich an dem Tag, an dem MiniMax ihn ändert. Automatisches Failover ist die andere Hälfte davon: M3 mit 210 Tokens pro Sekunde ist attraktiv für Arbeiten mit hohem Volumen, und Arbeiten mit hohem Volumen sind genau der Bereich, in dem ein einzelner beeinträchtigter Endpunkt am meisten schadet.
Step 5 Preview ist nicht in unserem Katalog. StepFuns Textmodelle gehören nicht zu denen, die wir anbieten, daher ist es über StepFuns eigene API und mehrere Drittanbieter-Plattformen verfügbar – und es ist nicht über den Schlüssel erreichbar, den Sie für M3 verwenden würden.

Das Urteil
Greifen Sie zu MiniMax M3, wenn Volumen, Latenz oder Videoeingabe die einschränkenden Faktoren sind, wenn Sie ein Modell wollen, das Sie heute herunterladen können, und wenn Sie mit der Community-Lizenz leben können – einschließlich der Umsatzschwelle von 20 Millionen Dollar. Akzeptieren Sie, dass unabhängige Agentic-Scores es weit abgeschlagen zurücklassen und dass seine Anbieter-Benchmarks außerhalb von MiniMax' eigener Infrastruktur nicht reproduziert wurden.
Nehmen Sie Step 5 Preview, wenn die Arbeit agentisch oder code-lastig ist, wenn Sie die Fähigkeit pro Dollar statt den Token pro Dollar wollen und wenn es Ihnen nichts ausmacht, ein früher Kunde eines gehosteten Endpoints zu sein, dessen Gewichte nächsten Monat eintreffen. Akzeptieren Sie, dass Sie die Lizenz nicht prüfen können, bevor Sie bauen, und dass eine Spanne von 2 % gegenüber 33,3 % bei Terminal-Bench 4.0 die Art von Lücke ist, die ein Projekt entscheidet.
Der Rabatt ist echt. Er ist nur nicht das, was gekauft wird.
MiniMax M3 ist eines der Modelle, die wir mit 0 % Aufschlag und automatischem Failover routen, sodass eine Preisänderung des Anbieters noch am selben Tag über denselben Schlüssel aktiv ist.
