
FLUX 3 Image vs Bernini-Diffusers-v2: Een betaald endpoint tegenover een downloadbare repo
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 223 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
FLUX 3 Image en Bernini-Diffusers-v2 zijn beide beeldmodellen die je vandaag volledig kunt verkrijgen, en geen van beide is een product dat je kunt huren. FLUX 3 Image ging live op 1 oktober 2026 op api.bfl.ai/v1/flux-3-image met een gepubliceerde tariefkaart en geen gepubliceerde score. Bernini-Diffusers-v2 verscheen op 13 augustus 2026 op Hugging Face onder Apache-2.0 met gepubliceerde scores en geen andere manier om het aan te roepen dan je eigen GPU's. De een komt met een factuur. De ander komt met een Python-versiepin.
Die tweedeling is de hele vergelijking, en het loont om daar precies over te zijn, want de gebruikelijke framing 'hosted vs open weights' past hier niet. Bernini is geen open-weightsmodel dat je in een bestaande inferentiestack kunt droppen. Het is een tweefasensysteem — een Qwen2.5-VL-7B planner vóór een Wan2.2-T2V-A14B diffusiedecoder — en de v2-release is een fix voor het trainingsschema, niet een nieuw capaciteitsniveau. FLUX 3 Image is één endpoint met een ongewoon grote hoeveelheid controlemogelijkheden eraan vastgeschroefd: ruimtelijke grounding, een coördinatenraster van 0–1000, en box-scoped bewerking waarbij je aangeeft welke regio's behouden blijven. Verschillende soorten dingen.
Wat elk ervan eigenlijk is
• FLUX 3 Image — Black Forest Labs' image tier of its unified FLUX 3 family, released October 1, 2026. One HTTP POST to https://api.bfl.ai/v1/flux-3-image with an x-key header; only prompt is required. The call returns a polling URL, and a finished 4K render can take several minutes. Generated samples are downloadable for one hour.
• Bernini-Diffusers-v2 — de planner-plus-renderer-stack van ByteDance, op 13 augustus 2026 naar Hugging Face gepusht zonder begeleidende aankondiging. De repository is getagd als image-text-to-video en is afhankelijk van diffusers. Taken die worden vermeld: tekst-naar-afbeelding, afbeelding-naar-afbeelding, tekst-naar-video, video-naar-video, referentie-naar-video en referentie-naar-afbeelding. Er is geen gehoste inferentie en geen prijslijst — het getting-started-pad is hf download en een Gradio-app.
• De distributiekloof — FLUX 3 Image is een service met verbruiksmeter die je aanroept. Bernini is een repository die je uitrolt. Voordat het de moeite loont om welke kwaliteitsvraag dan ook te stellen, vereist de een een GPU uit de Hopper-klasse en de ander een creditcard.
Licentiëring is het punt waarop deze twee het sterkst uiteenlopen
Bernini-Diffusers-v2 is Apache-2.0 op repositoryniveau. Voor een zelfgehoste pipeline maakt dat enorm veel uit: geen meter per afbeelding, geen onderhandelde commerciële overeenkomst, geen gebruiksrapportage. Je betaalt voor elektriciteit en schedulertijd, en de marginale kosten van de tienduizendste afbeelding zijn hetzelfde als die van de eerste.
FLUX 3 Image is geen open weights, en Black Forest Labs is er expliciet over dat dit tijdelijk is. Commerciële weights zijn vandaag beschikbaar onder een onderhandelde BFL-licentie, en de openbare open-weights-release wordt beschreven als komende in de volgende weken. Dat is een belofte met een vorm maar geen datum, en het is het allerbelangrijkste op deze pagina om opnieuw te controleren in plaats van aan te nemen. Als je een image stack kiest voor de komende twee jaar, weegt de licentiekwestie waarschijnlijk zwaarder dan de Elo-kwestie — maar alleen als je bereid bent om zelf een tweedelige video-native diffusiestack te draaien.
Bedieningsoppervlak: bounding boxes versus promptverbetering
Dit is het deel van de matchup dat echt interessant is, omdat de twee modellen "het precies daarheen laten gaan" op volledig verschillende manieren oplossen.
FLUX 3 Image neemt een JSON-array die aan de prompt wordt toegevoegd. Coördinaten lopen op beide assen over een raster van 0–1000, en elk vak wordt geschreven als [top, left, bottom, right]. Je levert een tabel met elementen aan, elk met een id, een bbox en een desc, plus een globale caption die die id's bij naam noemt. In BFL's eigen voorbeeld luiden de id's zoiets als animal_1 en silhouette_1; de caption verwijst er rechtstreeks naar. Boven de generatieaanroep is er grounding, standaard ingeschakeld, die een web- en afbeeldingszoekopdracht uitvoert voordat er wordt gegenereerd.
FLUX 3 Image breidt vervolgens hetzelfde coördinatensysteem uit naar bewerken. In plaats van een masker te sturen, stuur je een reeks bewerkingen die per box gelden: Behoud (bronbox naar dezelfde box, met als bron ref_image_0), Verplaats (bronbox naar een nieuwe doelbox), Nieuw (geen bron, doelbox gegenereerd op basis van een beschrijving — toevoegen, vervangen of herkleuren) en Verwijder (bronbox naar een null-doel). Meerdere bewerkingen gaan in één aanvraag.
Het voorbehoud is belangrijk. BFL's documentatie zegt dat pixels buiten de bewerkte vakken "meestal identiek blijven." Meestal. Het is een behoudsclaim met een slag om de arm in de formulering, wat de eerlijke manier is om er een te lanceren en ook de reden dat je op je eigen frames moet testen in plaats van een demo te vertrouwen.
Bernini heeft geen equivalent van een gebruikersgerichte coördinatietaal. De referentiegeleide bewerking ervan verbeterde in v2 door een trainingswijziging — de connectormodule wordt gedurende duizenden stappen opgewarmd voordat de co-training begint — en ByteDance meldt dat die wijziging zich uit in betere referentiegeleide bewerking en OpenS2V-prestaties. Het is een kwaliteitsfix binnen een bestaande architectuur, niet een nieuwe besturingsinterface. Als je workflow ervan afhangt dat je het model vertelt welke rechthoek het met rust moet laten, beantwoordt slechts één van deze twee de vraag.

Wat de cijfers wel en niet ondersteunen
De pagina van Bernini-Diffusers-v2 bevat een tabel met zeven metrieken waarin v2 met v1 wordt vergeleken, en elk cijfer daarin is door de leverancier gerapporteerd. De richting is gemengd, wat het waard is om hardop te zeggen:
• Omhoog — OpenS2V 63,83 (van 62,30), VBench 84,46 (van 84,37), Bernini-rv2v 3,55 (van 3,48).
• Vlak — EditVerse 8.02, ongewijzigd, en Bernini-v2v 3.49, ongewijzigd.
• Downgrade — OpenVE 3.96, vanaf 4.03.
De pagina stelt ook dat v2 in de eerste categorie valt onder toonaangevende closed-source commerciële modellen in een interne, blinde, menselijke paarsgewijze arena. Dat is van buiten ByteDance niet te verifiëren en moet worden opgevat als een marketingclaim, niet als een meting. De drie echte ontwikkelingen zijn de hierboven genoemde, en ze zijn zelfgerapporteerd ten opzichte van de eigen v1 van hetzelfde lab.
FLUX 3 Image heeft nog helemaal geen cijfers. De tekst-naar-afbeelding-ranglijst van Artificial Analysis en de bijbehorende bewerkingsranglijst zijn beide gecontroleerd op 1 oktober en 2026-10-02 en bevatten geen rij voor FLUX 3 Image — de BFL-vermeldingen op die ranglijsten stoppen bij de FLUX.2-lijn, waar FLUX.2 [max] op 1021 Elo staat op de generatieranglijst en op 996 op de bewerkingsranglijst. FLUX.2 [dev] verankert beide ranglijsten op precies 1000. De eerlijke uitspraak over de kwaliteit van FLUX 3 Image is op dit moment dan ook dat niemand buiten Black Forest Labs er een score voor heeft gepubliceerd, en dat het dichtstbijzijnde beschikbare referentiepunt de generatie ervoor is.
Die asymmetrie is de praktische valkuil in deze vergelijking. Bernini's cijfers zijn door de leverancier geproduceerd, maar ze bestaan en ze geven een richting aan. Die van FLUX 3 Image ontbreken. Afwezigheid is geen falen — het model is een dag oud — maar het betekent wel dat het enige bewijs voor de bewerkingsclaim van FLUX 3 Image momenteel afkomstig is van het bedrijf dat het verkoopt.
De prijskant, die helemaal niet symmetrisch is
FLUX 3 Image wordt per afbeelding geprijsd op basis van resolutieniveau, en op de tariefkaart van de leverancier staan er vijf:
• 768sq — $0,041 lijstprijs, $0,0205 tijdens de lanceringsperiode.
• 1K (de standaard) — $0,048 lijstprijs, $0,024 in de aanbieding.
• 1.5K — $0,07 lijstprijs, $0,035 in de aanbieding.
• 2K — $0,10 lijstprijs, $0,05 in de aanbieding.
• 4K — $0.607 adviesprijs, $0.3035 in de aanbieding.

Referentieafbeeldingen en promptlengte zijn inbegrepen zonder extra kosten, en afgewezen, mislukte of gemodereerde verzoeken worden niet gefactureerd — wat hier meer dan gebruikelijk van belang is, want een 4K-aanroep is traag en de verleiding om een verzoek te laten vallen is reëel. De introductieprijs loopt van 15:00 UTC op 1 oktober tot 15:00 UTC op 8 oktober. De sprong in de lijstprijs van 2K naar 4K is een factor 6,07, veel steiler dan de verhouding in pixelaantal, dus het resolutieniveau dat je kiest is de belangrijkste kostenbeslissing in de hele API.
De niveaus volgen een pixelbudget in plaats van een vast frame. De voorbeelduitvoer van BFL is 5456 × 3072, ongeveer 16,8 megapixels, tegenover UHD 2160p met 8,3 megapixels — dus "4K" verwijst hier naar een budget, en uitvoerafmetingen worden afgerond op veelvouden van 16, waarbij de werkelijke waarde wordt teruggegeven als output_mp.
De prijs van Bernini is nul per afbeelding en niet-nul per uur. Acht GPU's voor sequence-parallelle inferentie, silicium van Hopper-klasse aanbevolen, Python 3.11.2 met PyTorch 2.7.1 en CUDA 12.6. Het break-evenpunt ten opzichte van $0,048 per afbeelding bij 1K ligt ergens in de duizenden afbeeldingen per maand, volledig afhankelijk van wat je voor compute betaalt — en het is een echt getal, geen retorisch getal. Als je al inferentie-infrastructuur draait, is de marginale afbeelding van Bernini bijna gratis. Doe je dat niet, dan is het FLUX 3 Image-endpoint dramatisch goedkoper dan een tweefasige diffusiestack opzetten.
Routing: geen van beide staat in onze catalogus
Het loont de moeite om dit ronduit te zeggen, want het is het soort bewering dat snel achterhaald raakt. OrcaRouter routeert FLUX 3 Image niet, en ook Bernini-Diffusers-v2 niet. FLUX 3 Image aanroepen betekent Black Forest Labs rechtstreeks via hun eigen endpoint aanroepen. Bernini aanroepen betekent dat je het zelf moet deployen.
Waar een OpenAI-compatibele router in een pipeline als deze eigenlijk voor dient, is alles aan weerszijden van de image-call. Een stap voor captioning of het herschrijven van prompts, een visionmodel dat de render tegen de briefing controleert, een videomodel dat de goedgekeurde still animeert, een klein tekstmodel dat de output classificeert — dat zijn de stappen waar het kunnen wisselen van provider met één string, op één key, en het automatisch laten failoveren van verzoeken wanneer een provider hapert, een flinke hoeveelheid onderhoud wegneemt. OrcaRouter geeft de lijstprijs van de provider door zonder markup, dus wanneer een leverancier een tarief verlaagt, is die wijziging dezelfde dag live in plaats van te moeten wachten tot een reseller de prijs aanpast, en met de routing-DSL kun je een specifiek model vastpinnen of een fallback-volgorde definiëren zonder applicatiecode aan te raken. Niets daarvan maakt FLUX 3 Image routeerbaar. Het betekent alleen dat de rest van de pipeline er niet om hoeft te geven welk model de still heeft geproduceerd.
![Screenshot of the Artificial Analysis text-to-image leaderboard, showing FLUX.2 [max] at 1021 Elo and FLUX.2 [dev] fixed as the 1000 anchor, with no FLUX 3 Image entry anywhere on the board](https://cms.orcarouter.ai/api/media/file/4-1497.png)
Op welke bouwen we voort?
Drie vragen scheiden deze netjes, en ze hebben geen gemeenschappelijk antwoord.
Moet u kunnen bepalen waar dingen terechtkomen? FLUX 3 Image is de enige van de twee met een coördinaattaal, en de bewerkingen binnen een box — behouden, verplaatsen, toevoegen, verwijderen — vormen een wezenlijk andere interface dan tekstinstructiebewerking. Als uw werk compositing, lay-out of productbeelden betreft waarbij regio's intact moeten blijven, is dat doorslaggevend, en de slag om de arm in "blijven meestal identiek" is iets wat u test in plaats van aanneemt.
Moet je weten hoe goed het is voordat je je vastlegt? Bernini heeft cijfers, allemaal door de leverancier gerapporteerd, en een gemengde koers. FLUX 3 Image heeft er geen. Als je je eigen evaluatie niet kunt uitvoeren, kies je tussen een gemeten model en een ongemeten model, en het gemeten model is de oudere architectuur.
Kun je een tweetraps-diffusiestack draaien? Dat is de echte drempel voor Bernini. Een Qwen2.5-VL-7B-planner die een Wan2.2-T2V-A14B-decoder voedt, op Hopper-GPU's, met een prompt-enhancer-hook die naar een OpenAI-compatibel endpoint wijst. De licentie is permissief en de rekening voor compute niet. Als je dat niet kunt, is de vraag niet meer relevant en is $0,048 per afbeelding het antwoord.
Het enige dat deze pagina het snelst zou veranderen, is dat BFL de FLUX 3 Image-gewichten vrijgeeft, wat volgens het bedrijf nog weken duurt. Dat verandert de licentiescheefheid van beslissend in mild en laat het verschil in controlemogelijkheden als de eigenlijke vergelijking overblijven. Tot dan is de accurate samenvatting dat dit twee goede modellen zijn met tegengestelde distributiemodellen, en de keuze wordt op basis van licenties en controle gemaakt lang voordat die op basis van kwaliteit wordt gemaakt.
