Hero-titelkaart voor GPT-Image-2 vs Flux 3, met kop 'GPT-Image-2 vs Flux 3' en ondertitel 'Eén live model, één routekaart', twee kaarten waarop GPT-Image-2 wordt getoond met een badge 'Openbare API sinds mei 2026' en Flux 3 met een badge 'Image-tier: binnenkort beschikbaar', met het OrcaRouter-logo in de rechterbenedenhoek.
Guides & Insights

GPT-Image-2 vs Flux 3: Een live model vergelijken met een routekaart

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Dit is geen normale model-tegen-model-post, omdat GPT-Image-2 en Flux 3 niet in dezelfde staat van bestaan verkeren. GPT-Image-2 werd uitgebracht op 21 april 2026, is sinds begin mei aanroepbaar via de API van OpenAI en heeft deze week een nieuwe mogelijkheid gekregen — beeldgeneratie met transparante achtergrond in de API, aangekondigd op 20 augustus en nu beschikbaar. Flux 3 is het multimodale basismodel van Black Forest Labs, aangekondigd op 23 juli 2026, en de beeldlaag heeft nog steeds geen openbaar endpoint, geen model-ID en geen prijslijst op het moment van schrijven. De ene kun je om 3 uur 's nachts aanroepen met een geldige sleutel; voor de andere kun je je aanmelden voor een wachtlijst. De nuttige vergelijking is dus niet "welke beter is" — het is wat het uitgebrachte model vandaag daadwerkelijk doet, wat de routekaart claimt voor het niet-uitgebrachte model, en hoe een ontwikkelaar een beloofd model moet behandelen dat steeds blijft schuiven terwijl een live model steeds beter wordt.

Een van deze heeft een eindpunt.

Begin met beschikbaarheid, want die bepaalt al het andere. Black Forest Labs onthulde op 23 juli Flux 3 als één model dat gezamenlijk is getraind op het voorspellen van beeld, video, audio en robotacties, gebaseerd op een flow-matching-aanpak die het lab Self-Flow noemt. Naar verluidt ging meer dan 95% van de rekenkracht voor training naar videovoorspelling, wat te zien is aan wat er daadwerkelijk is uitgebracht: alleen Flux 3 Video werd algemeen beschikbaar, op 4 augustus, met een betaalde API. De modelpagina van de image-tier bevat nog steeds een label 'binnenkort beschikbaar' met een aanvraagformulier, geen get-started-knop — geen endpoint, geen gedocumenteerde parameters, geen kosten per afbeelding en geen benchmark die iemand kan draaien.

GPT-Image-2 daarentegen is al vier maanden in productie. OpenAI opende begin mei de API-toegang, en de identifier van het model, gpt-image-2, is stabiel genoeg dat een vastgepinde snapshot, gpt-image-2-2026-04-21, ernaast bestaat. Het is momenteel het nummer één tekst-naar-afbeelding-model op beide grote onafhankelijke leaderboards — 1.381 Elo op Arena's tekst-naar-afbeelding-leaderboard (de medium build) en 1.369 Elo voor de high build op Artificial Analysis — en het rendert meertalige tekst, waaronder CJK, baseert de generatie op webzoekopdrachten en produceert output tot 4K. Vier maanden productieverkeer is het verschil tussen een bewering en een staat van dienst.

De recente wijziging aan de kant van GPT-Image-2

De gebeurtenis die deze krachtmeting actueel maakt, heeft niets met Flux 3 te maken. Op 20 augustus maakte Ope​nAI een preview met transparante achtergrond beschikbaar voor GPT-Image-2 in de Images API: stel de achtergrond in op "transparent" en het endpoint retourneert een PNG of WebP met een echt alfakanaal, uitgesneden en klaar voor compositie. Dat is een functie die precies is gericht op het productiewerk dat de roadmap van Flux 3 image ook aanprijst — productfoto's, iconen, marketingmaterialen — en het werd toegevoegd als een parameter op een al live endpoint in plaats van als een nieuw model. Dus terwijl de wereld wacht op een Flux 3 image endpoint dat nog steeds "coming soon" zegt, heeft de gevestigde speler net een van de hiaten gedicht die het buiten de compositiepijplijnen hield.

De functionaliteit is uitsluitend via de API beschikbaar — er is geen ChatGPT-schakelaar — en het is een parameter, geen nieuw product. Beide Images API-endpoints, generatie en bewerking, accepteren een achtergrondveld met de waarden "transparent", "opaque" en "auto" (de standaardwaarde, waarbij het model beslist). Het alfakanaal blijft alleen behouden in PNG- of WebP-uitvoer, dus het verzoek legt het uitvoerformaat expliciet vast. Ope​nAI's eigen API-referentie vermeldt transparante ondersteuning voor gpt-image-2 en de snapshot gpt-image-2-2026-04-21 nog steeds als "in preview" — dat is het label van de leverancier, geen aankondiging van algemene beschikbaarheid — en het advies is om de prompt vrij te houden van elke beschreven achtergrond, zodat het model het transparantieverzoek daadwerkelijk honoreert. Geen nieuw endpoint, geen nieuw model-ID, geen aparte prijskaart: dezelfde gpt-image-2-aanroep die eerder een ondoorzichtige PNG opleverde, levert nu een uitgesneden afbeelding op.

Comparison scoreboard titled 'GPT-Image-2 vs Flux 3 - the scoreboard'. GPT-Image-2 column: Released Apr 21, 2026; Availability Public API since May; Arena T2I Elo 1,381 (#1); Text rendering multilingual incl. CJK; Transparent bg preview Aug 20; Max resolution 4K. Flux 3 column: Released announced Jul 23, 2026; Availability image tier coming soon; Arena T2I Elo none yet; Text rendering promised; Transparent bg not stated; Max resolution not specified. Footer: GPT-Image-2 figures per Arena and OpenAI list pricing; Flux 3 image claims are a vendor roadmap. OrcaRouter logo bottom-right.

Wat Flux 3-image belooft, en wat er daadwerkelijk wordt geleverd

Het specificatieblad van de Flux 3-beeldlaag is een leveranciersroadmap, dus behandel het als zodanig. Black Forest Labs heeft beeldgeneratie en -bewerking in diverse stijlen en resoluties beloofd, verbeterde verwerking van complexe prompts, zeer nauwkeurige meertalige tekstweergave, zero-shot-stijloverdracht van referentieafbeeldingen, personage- en merkenconsistentie zonder fine-tuning, en niet-destructieve bewerking die textuur en belichting behoudt. Dat zijn de juiste dingen om te beloven — het zijn precies de functies waar de huidige marktleiders op concurreren — maar geen ervan is vandaag testbaar, omdat geen ervan een endpoint heeft.

Wat daadwerkelijk via BFL aanroepbaar is, zijn de videotier en de oudere FLUX-beeldlijn. Flux 3 Video kost $0,17 per seconde op HD en $0,29 per seconde op FHD voor volledige renders, met een draftmodus van $0,06 per seconde. De door BFL zelf gerapporteerde cijfers zijn een Elo van 1.135 voor tekst-naar-video en 1.051 voor beeld-naar-video, evenals voorkeurswinsten ten opzichte van Luma Ray 3.2, Runway Gen-4.5, Gr​ok Imagine Video en Kling v3 Pro — allemaal door de leverancier gerapporteerd en niet onafhankelijk gereproduceerd, en niets daarvan draagt over naar de beeldtier. Voor stilstaande beelden blijft het huidige BFL-aanbod de FLUX.2-lijn, die op 1.226 Elo staat op hetzelfde Artificial Analysis-bord waar GPT-Image-2 leidt met 1.369. Die kloof is de praktische context voor 'Flux 3 image is coming': de huidige BFL-beeld-API ligt ruwweg 140 Elo achter op die van Ope​nAI, en het beloofde model is wat BFL nodig heeft om die kloof te dichten.

Screenshot of the Artificial Analysis Text-to-Image leaderboard (captured August 20, 2026) showing GPT Image 2 (high) in first place at 1,369 Elo and Black Forest Labs' current image entry FLUX.2 (max) at 1,226 Elo, with no Flux 3 image entry present, in English.

Prijsstelling: er bestaat slechts één echte prijskaart

Er is geen Flux 3 image-prijs, omdat er geen Flux 3 image-product is. De enige gepubliceerde cijfers zijn de tokenprijzen van GPT-Image-2: $5 per miljoen tekst-invoertokens, $8 per miljoen afbeeldingsinvoertokens en $30 per miljoen afbeeldingsuitvoertokens, waarbij de Batch-API voor een doorlooptijd van maximaal 24 uur op ongeveer de helft uitkomt. Ope​nAI publiceert geen tokens-per-afbeelding, dus bedragen per afbeelding zijn omrekeningen, geen prijsopgaven: ruwweg $0,006 voor een lage kwaliteit van 1024×1024, rond $0,05 voor een middelmatige, rond $0,21 bij hoge kwaliteit, en tot ongeveer $0,41 voor een 4K-render in hoge kwaliteit. Ter vergelijking: dat is de enige kant van de balans die echt is; de Flux 3 image-kolom is een lege cel.

Screenshot of the OrcaRouter model page for openai/gpt-image-2 (captured August 20, 2026), showing the model description, input rate of $8.00 and output rate of $30.00 per million tokens, median latency, and community usage, in English.

Wat een bouwer met een beloofd model zou moeten doen

De verstandige houding wanneer het model van een concurrent steeds weer wordt uitgesteld, is om voort te bouwen op wat er is en de toekomst een configuratiewijziging te laten zijn in plaats van een herontwerp. GPT-Image-2 is vandaag al routeerbaar via OrcaRouter — één API-sleutel, OpenAI's lijstprijs doorberekend tegen 0% opslag, automatische failover tussen providers — dus een pijplijn die er assets mee genereert, kan later hetzelfde endpoint naar de API van Flux 3 image wijzen op de dag dat er daadwerkelijk een endpoint bestaat, en een deel van het verkeer ernaartoe routeren met de routing-DSL zonder de aanroepende code aan te raken. Je hebt nu het daadwerkelijk uitgebrachte model, en wanneer het beloofde model arriveert, beoordeel je het tegen een werkende referentie in plaats van tegen een persbericht. Het wachten kost je niets; bouwen op niets terwijl je wacht kost je alles.

De conclusie is bewust eenzijdig. Als je dit kwartaal beeldgeneratie nodig hebt, is GPT-Image-2 de aangewezen keuze en daar is geen twijfel over mogelijk — het is de onafhankelijke nummer één, het heeft net uitvoer met transparante achtergrond aan de API toegevoegd, en het heeft een openbare API en een stabiele prijs. Flux 3 image is een reden om Black Forest Labs in de gaten te houden, geen reden om een project uit te stellen. Volg de opening van de early access en de eerste onafhankelijke benchmarks; op het moment dat er een endpoint bestaat, wordt de vergelijking in dit bericht een test die je daadwerkelijk kunt uitvoeren.