Hero-Karte für den Vergleich Ideogram 4.5 vs. MAI Image 2.6 Preview. Eine Überschrift lautet „Ideogram 4.5 vs. MAI Image 2.6 Preview“ über der Zeile „Ein Spezialist gegen eine Plattform“. Die linke Karte mit der Überschrift „Ideogram 4.5“ listet „Öffentliche API seit 30. Sep. 2026“, „Elo 1.013, 2.278 Stichproben“ und „0,03 $ bis 0,22 $ pro Bild“ auf; die rechte Karte mit der Überschrift „MAI Image 2.6 Preview“ listet „Öffentliche Vorschau in Microsoft Foundry“, „Elo 1.161, 9.410 Stichproben“ und „Bis zu 1,5K Ausgabe“ auf. Eine Fußzeile lautet „Dasselbe Board, dasselbe Panel – Artificial Analysis“.
Guides & Insights

Ideogram 4.5 vs. MAI Image 2.6 Preview: Ein Spezialist gegen eine Plattform

Autor

Magnus Corvin

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Ideogram 4.5 wurde für eine einzige Sache entwickelt: ein Bild immer wieder zu bearbeiten, ohne dass es an Qualität verliert. MAI Image 2.6 Preview, das Flaggschiff-Bildmodell von Microsoft AI, wurde dagegen entwickelt, alles auf einmal zu können – generieren, mit mehreren Referenzen bearbeiten, einen Prompt in Live-Webinhalten verankern und sein Seitenverhältnis selbst wählen – und es ist seit dem 4. September 2026 über Microsoft Foundry öffentlich als Vorschau aufrufbar. Stellt man sie nebeneinander, zeigen die Zahlen in die eine Richtung und die Produktprofile in die andere. Ideogram gewinnt bei dem, wofür es gebaut wurde; Microsoft gewinnt fast alle anderen Achsen, einschließlich derer, die darüber entscheiden, ob ein Team es tatsächlich einsetzen kann.

Was jedes einzelne ist

Ideogram 4.5 ist am 30. September 2026 live gegangen – in Ideograms App, der eigenen API, der MCP-Integration und der Apps-Sammlung sowie auf Partnerplattformen. Es generiert und bearbeitet mit vier Rendering-Geschwindigkeiten, gibt nativ in 2K aus und demonstriert lokalisierte Bearbeitungen an einer Quelle von 4.016 × 6.016 Pixeln – 24,2 Megapixel – ohne Downscaling. Der Hersteller behauptet, dass wiederholte Durchläufe nicht mehr abdriften: Kanten bleiben an Ort und Stelle, Textur bleibt erhalten, ein bearbeiteter Ausschnitt fügt sich wieder ins Original ein. Die Modellgewichte werden nicht veröffentlicht.

MAI Image 2.6 ist das stärkste Bildmodell von Microsoft AI und die Spitze einer Modellreihe, die MAI-Image-1, MAI-Image-2 im März 2026, MAI-Image-2.5 im Juni, MAI-Image-2.5-Pro im Juli und unterwegs MAI-Image-2-Efficient umfasst. Es debütierte im August 2026 auf Arenas Ranglisten mit Platz 2, und am 4. September 2026 überführte Microsoft es in Microsoft Foundry und MAI Playground in die öffentliche Vorschau, zusammen mit einem neuen MAI-Image-2.6-Flash für Workloads mit hohem Durchsatz. Die Funktionen auf der Modellkarte sind umfangreich: Multi-Referenz-Bearbeitung, die Personen, Produkte, Stile und Szenen aus mehreren Bildern kombiniert, Web-Grounding, dynamische Seitenverhältnisse und Ausgabe bis zu 1,5K-Auflösung. Es ist außerdem proprietär und läuft nur in Microsofts Cloud.

A generated two-column comparison scoreboard for Ideogram 4.5 and MAI Image 2.6 Preview. The Ideogram column reads 'Access: public API', 'Price: $0.03 to $0.22', 'Text-to-image: Elo 1,013', 'Editing: rank 23', 'Output: native 2K' and 'Announced: Sep 30, 2026'; the MAI column reads 'Access: invite-gated', 'Price: none published', 'Text-to-image: Elo 1,161', 'Editing: No. 3 on Arena', 'Output: not specified' and 'Announced: Aug 19, 2026'. The footer reads 'Elo figures per Artificial Analysis; access per Microsoft.'

Die Aufstellung

• Zugang — öffentliche App, API- und MCP-Integration seit 30. September 2026 vs. öffentliche Vorschau in Microsoft Foundry und MAI Playground seit 4. September 2026.

• Preis — 0,03 $ pro Bild bei Low, 0,06 $ bei Medium und 0,22 $ bei High auf einer Preisliste des Anbieters vs. keiner veröffentlichten Preisliste im News-Post von Microsoft; die Preisgestaltung steckt hinter der Foundry-Modellkarte, und die unabhängigen Vergleichsseiten führen das Modell mit 38,90 $ pro 1.000 Bilder.

• Text-zu-Bild-Wertung — Rang 34 mit 1.013 Elo aus 2.278 vs. 1.161 Elo aus 9.410 Stichproben, veröffentlicht im August 2026.

• Bearbeitungsbewertung — Rang 23 bei 1.064 Elo aus 2.459 Stichproben bei 220,00 $ pro 1.000 Bilder vs. Rang 3 bei 1.137 Elo aus 15.684 Stichproben bei 38,90 $ pro 1.000.

• Ausgabe — native 2K mit Bearbeitungen, demonstriert bei 4.016 × 6.016, gegenüber bis zu 1,5K Auflösung laut Microsofts Datenblatt.

• Fähigkeitsprofil — eine einzige scharfe Kante (Multi-Turn-Bearbeitungstreue) gegenüber einem breiten Set: Multi-Referenz-Bearbeitung, Web-Grounding, dynamische Seitenverhältnisse und ein schnellerer Flash-Ableger.

A screenshot of the MAI-Image-2.6 model card in Microsoft Foundry, captured in English with a throwaway browser profile, showing the model's publisher, its Preview lifecycle stage, a context window of 32,000 and token limits of 4,096 output, and the pay-as-you-go pricing link. The card does not display a per-image rate.

Gleiches Board, gleiches Panel, und es ist nicht knapp

Dies ist das seltene Aufeinandertreffen, bei dem ein sauberer Vergleich existiert, weil beide Modelle auf Artificial Analysis vertreten sind, mit Zeilen, die vom selben Panel und aus demselben Stimmenpool gemessen wurden.

Text-zu-Bild: MAI-Image-2.6 mit 1.161 Elo aus 9.410 Stichproben gegen Ideogram 4.5 (High) mit 1.013 Elo aus 2.278 Stichproben. Das sind 148 Elo bei der vierfachen Stichprobenmenge, und in der Preisspalte stehen 38,90 $ gegenüber 100,00 $ pro tausend Bilder.

Bildbearbeitung: MAI-Image-2.6 bei 1.137 Elo aus 15.684 Stichproben gegen Ideogram 4.5 (High) bei 1.064 Elo aus 2.168 Stichproben, bei einer unabhängigen Umrechnung von 38,90 $ gegenüber 220,00 $ pro Tausend.

Microsofts eigener Beitrag vom 4. September reklamierte Platz 2 im Bereich Text-zu-Bild und Platz 1 bei der Bildbearbeitung auf dieser Rangliste, beide mit dem Vermerk „Stand: 4. Sep. 2026“. Liest man ihn einen Monat später, hat die Text-zu-Bild-Platzierung weiterhin Bestand, die Behauptung zur Bildbearbeitung dagegen nicht mehr: GPT Image 2.5 Sunburst kam im September auf den Markt und steht mit 1.182 Elo auf Platz eins dieser Rangliste, während MAI-Image-2.6 mit 1.137 Elo auf Platz drei liegt. Das ist kein Seitenhieb gegen das Modell – es ist das, was mit jeder Behauptung „Nr. 1 heute“ in einem Markt geschieht, in dem wöchentlich ausgeliefert wird, und es ist der Grund, warum dieser Artikel bei jedem Rang ein Datum nennt.

A screenshot of the Artificial Analysis text-to-image leaderboard, captured in English, showing MAI-Image-2.6 at 1,161 Elo, Ideogram 4.5 (High) at rank 34 with 1,013 Elo from 2,278 samples at $100.0 per 1,000 images, and GPT Image 2.5 Sunburst (max) first at 1,197 Elo.

Der Unterschied, der zählt, ist nicht die Punktzahl.

Wenn die Gremien das entschieden, wäre es vorbei. Tun sie nicht, aus zwei Gründen.

Der erste Punkt ist, dass keines der Boards Ideograms eigentliche Behauptung misst. Editing-Arenen zeigen einer abstimmenden Person ein Quellbild und zwei Ergebnisse aus jeweils einer Einzelanweisung; sie zeigen ihr nie die zehnte Bearbeitung einer Sequenz im Vergleich zur ersten – genau die Drift, die Ideogram 4.5 verhindern sollte. Ein Bearbeitungsabstand von 73 Punkten sagt dir, dass MAI Image 2.6 bei Einzelbearbeitungen bevorzugt wird. Er sagt nichts über die zehnte Runde bei einer großen Datei aus, und die zehnte Runde ist genau das, wovon ein Katalogteam, ein Schilderwechsel oder eine Fotorestaurierung tatsächlich abhängt.

Der zweite Punkt ist die Verfügbarkeitsform. Eine Vorschau ist nicht dasselbe wie ein Produkt. Foundry public preview ist der richtige Ort für Evaluierung und interne Tools, und Microsoft hat keine General-Availability-Bedingungen daran geknüpft – keine Verfügbarkeitszusage, keine Abkündigungsmitteilung, keine Durchsatzgarantie. Microsofts Modell ist außerdem nur über Microsofts Cloud und Playground erreichbar, sodass es keinen zweiten Anbieter gibt, auf den man zurückgreifen kann, wenn ein Vorschau-Endpunkt gedrosselt wird. Ideogram 4.5 wird auf einer veröffentlichten Stufenleiter mit einer Preisliste ausgeliefert, die man in ein Budget aufnehmen kann, und Ideograms eigene API ist eine Zusage statt einer Vorschau.

Dann ist da noch die Preisrichtung, die für das neuere Modell wirklich unangenehm ist. In Ermangelung einer veröffentlichten Microsoft-Preisliste sind die einzigen Zahlen die Umrechnungen der Ranglisten: M-Image-2.6 mit 38,00 $ pro Tausend gegenüber M 4.5 mit 100,00 $ für Text-zu-Bild und 220,00 $ für Bearbeitung. Ein Modell mit besseren Ergebnissen auf beiden Ranglisten und einem niedrigeren umgerechneten Preis ist nicht schwer zu verkaufen – es ist die Standardwahl.

Wo jedes Einzelne tatsächlich seinen Platz verdient

Wählen Sie Ideogram 4.5, wenn der teure Teil Ihres Workflows die Reparatur bereits freigegebener Arbeit und nicht die Produktion neuer Arbeit ist: Farbvarianten für einen Katalog, Beschilderung, die über eine Kampagne hinweg übersetzt wird, ein beschädigtes Foto, das restauriert wird, ohne das zu übermalen, was erhalten geblieben ist. Die 24,2-Megapixel-Demonstration und die Behauptung zur Kantenerhaltung zielen genau darauf ab, und kein konkurrierendes Modell erhebt diese Behauptung mit vergleichbaren Belegen. Testen Sie es an Ihrer Worst-Case-Sequenz, bevor Sie sich festlegen; die Behauptung wurde von niemandem außerhalb des Anbieters reproduziert.

Wählen Sie MAI Image 2.6, wenn Sie Breite und Geschwindigkeit der Integration benötigen. Multi-Referenz-Bearbeitung mit mehreren Quellbildern, Web-Grounding und dynamischen Seitenverhältnissen decken die meisten Produktionsaufträge ab, ohne dass ein zweites Modell in der Pipeline benötigt wird, und MAI-Image-2.6-Flash existiert für das Volumen — laut Microsofts eigener Angabe ist es 2,8× schneller als GPT-Image-2-Medium, gemessen in einem internen Lasttest bei 100 Anfragen pro Minute bei 1024 × 1024, was vom Anbieter angegeben und nicht reproduziert wurde. Wenn Ihr Team bereits in Azure zu Hause ist, sind die Integrationskosten nahezu null, und das kann 24 Megapixel an Bearbeitungstreue aufwiegen.

Nimm beide, wenn du einen echten Content-Betrieb betreibst. Ein Plattformmodell für Generierung und Volumen, einen Spezialisten für die Durchgänge, die pixeltreu sein müssen, und eine Regel dazu, wer welchen Schritt verantwortet. Der Fehler ist, dies als einen einzigen Kauf zu behandeln.

Routing, wenn die beiden Endpunkte unterschiedliche Garantien haben

Nichts in diesem Duell steht in OrcaRouters Katalog. Ideogram 4.5 ist über die eigene API des Anbieters und mehrere Drittanbieter-Plattformen verfügbar; MAI Image 2.6 Preview ist nur über Microsoft Foundry und MAI Playground erreichbar. Unsere Bild-Sparte liegt woanders — G​oogles Gemini 3.1 Flash Image- und Imagen 4-Identifikatoren, O​penAIs GPT-Image-Modelle — und zu behaupten, wir würden eines davon routen, würde nicht eine einzige Überprüfung überstehen.

Wofür eine Routing-Schicht hier wirklich gut ist, ist die Asymmetrie zwischen diesen beiden Verfügbarkeitsgeschichten. Ein Preview-Endpunkt ohne SLA ist genau der Fall, in dem automatisches Failover seinen Nutzen beweist: Der Aufruf landet auf einer bedienten Alternative, statt um 2 Uhr nachts einen Fehler zu werfen, und man erfährt es aus den Logs statt aus einem Support-Ticket. Preis pro Aufruf zum Listenpreis des Anbieters, ohne dass etwas aufgeschlagen wird, bedeutet, dass eine Preissenkung eines Anbieters oder der erste veröffentlichte Tarif einer Preview am Tag seines Erscheinens auf Ihrer Rechnung auftaucht — was zählt, wenn der Vergleich, den Sie durchführen, bei der Editing-Position das 2,6-Fache beträgt. Und wenn Sie eine Preview gegen einen Spezialisten A/B-testen möchten, ohne zwei Verträge abzuschließen, ist ein einziger Schlüssel der günstigste Weg.

Was jetzt tun?

Wenn Sie heute ein Modell auswählen, lautet die ehrliche Antwort, dass das bessere Modell zugleich das günstigere ist – und dasjenige, das Sie nur in der Vorschau bekommen können. Wählen Sie MAI Image 2.6, wenn Sie innerhalb von Microsofts Cloud und unter Vorschau-Bedingungen leben können; wählen Sie Ideogram 4.5, wenn Sie eine Preisliste benötigen, die Sie planen können, eine First-Party-API oder das spezifische Verhalten bei der Bearbeitungstreue – und akzeptieren Sie, dass Sie dafür etwa das Zweieinhalbfache des umgerechneten Bearbeitungstarifs zahlen.

Zwei Dinge würden die Sache klären. Das erste ist ein Multi-Turn-Treue-Benchmark: dasselbe Bild, zehn aufeinanderfolgende Bearbeitungen, gemessene Divergenz. Solange niemand einen durchführt, ist die Eigenschaft, die Ideogram 4.5 interessant macht, ungemessen, und die Eigenschaft, die MAI Image 2.6 interessant macht, ist gemessen. Das zweite ist, dass Microsoft MAI Image 2.6 mit einer veröffentlichten Preisliste von der Vorschau in die allgemeine Verfügbarkeit überführt; das beseitigt den letzten praktischen Einwand gegen die Plattformstrategie und lässt das Spezialistenargument vollständig auf Drift beruhen.