
Qwen 4 Max vs Gemini 3.1 Pro: het niet-aangekondigde vlaggenschip tegen de preview die nooit eindigde
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
De meeste vergelijkingen zetten een uitgebracht product tegenover een uitgebracht product. Deze is ongebruikelijk: Qwen 4 Max werd op 22 september 2026 in preview getoond tijdens de Yunqi-conferentie in Hangzhou, zonder releasedatum, zonder prijs en zonder modelgewichten, en Gemini 3.1 Pro is sinds 19 februari 2026 in preview en is zeven maanden later nog steeds in preview — zonder aangekondigde datum voor algemene beschikbaarheid en zonder afsluitdatum in zijn deprecatietabel. Geen van beide modellen in deze confrontatie is een uitgekristalliseerd product. Dat is geen reden om de vergelijking over te slaan. Het ís de vergelijking, en het is het enige eraan dat echt informatief is.
Zeven maanden preview
Een preview-label hoort een kortstondige status te zijn. Gemini 3.1 Pro heeft die status nu behouden door drie Flash-releases van hetzelfde lab heen, waaronder Gemini 3.8 Flash op 2 september 2026, dat Google beschrijft als zijn intelligentste Flash-model. Op de onafhankelijke composiet-benchmarks scoort dat model nu hoger dan 3.1 Pro. De Pro-lijn van Google heeft geen nieuwer model: er is geen Gemini 3.8 Pro, en de 3.5 Pro-generatie werd uitgesteld en naar verluidt opzijgeschoven. Het praktische effect is dat het model dat de naam Pro draagt niet langer het model met de hoogste score van zijn eigen leverancier is.
De eigen beperkingstekst van Google bij de catalogusvermelding adviseert om te anticiperen op deprecatie van de preview; dat is de eerlijke manier om de status te interpreteren. Een preview zonder GA-datum en zonder beëindigingsdatum is een model waarop je kunt bouwen, maar dat je niet kunt inplannen.
De Qwen-kant is een spiegelbeeld met omgekeerd teken. Qwen 4 Max zit niet in een lange preview; het is pre-preview, met helemaal niets gepubliceerd. De twee faalmodi zijn tegengesteld: Gemini 3.1 Pro is een echt eindpunt waarvan het voortbestaan op lange termijn ongespecificeerd is, en Qwen 4 Max is een gespecificeerd roadmap-item zonder eindpunt.

De vergelijking, en de lange-contextfiguur die daarover beslist
De specificatie van Gemini 3.1 Pro is openbaar en specifiek. Die van Qwen 4 Max is leeg. Wat de moeite waard is om bij stil te staan, is één rij van de Gemini-kolom, want het is het soort getal dat wordt geciteerd en dat niet zou moeten worden:
• Status — Gemini 3.1 Pro in preview sinds 19 februari 2026, versus Qwen 4 Max aangekondigd op 22 september 2026 zonder datum
• Prijs voor invoer — Gemini 3.1 Pro $2,00 per 1 miljoen tokens tot een prompt van 200K en $4,00 daarboven, terwijl die van Qwen 4 Max niet is gepubliceerd
• Outputprijs — Gemini 3.1 Pro $12,00 per 1 miljoen tot 200K en $18,00 daarboven, tegenover Qwen 4 Max, waarvoor geen prijs is gepubliceerd
• Gecachte invoer — Gemini 3.1 Pro $0,20 per 1M bij een cacheread, tegenover Qwen 4 Max dat niet gepubliceerd is
• Context — Gemini 3.1 Pro 1.048.576 tokens, versus Qwen 4 Max niet gepubliceerd
• Uitvoerplafond — Gemini 3.1 Pro 65.536 tokens, tegenover Qwen 4 Max: niet gepubliceerd
• Modaliteit — Gemini 3.1 Pro tekst-, afbeeldings-, video-, audio- en PDF-invoer met tekstuitvoer, versus Qwen 4 Max: niet gepubliceerd
• Redeneerbesturing — Gemini 3.1 Pro lage, gemiddelde en hoge denkniveaus, versus Qwen 4 Max niet gepubliceerd
• Retrieval over lange context — door de leverancier gerapporteerde MRCR v2 van 84,9 procent gemiddeld over acht needles bij 128K, maar 26,3 procent bij de puntsgewijze instelling van één miljoen tokens, tegenover Qwen 4 Max, waarvoor niets is gerapporteerd
• Door de leverancier gerapporteerde scores — Gemini 3.1 Pro SWE-bench Verified 80,6 procent, GPQA Diamond 94,3 procent, ARC-AGI-2 77,1 procent, Humanity's Last Exam 44,4 procent zonder hulpmiddelen, tegenover Qwen 4 Max: niets gerapporteerd
• Onafhankelijke score — Gemini 3.1 Pro 30 op de Artificial Analysis Intelligence Index v4.3.2, tegenover Qwen 4 Max, waarvoor geen onafhankelijke evaluatie bestaat.
Die langecontextrij is degene om mee te nemen. Een contextvenster van 1.048.576 tokens is een marketingcijfer; 26,3 procent retrieval bij de instelling van één miljoen tokens is wat dezelfde leverancier rapporteert wanneer hij het verre einde van dat venster meet. Beide cijfers komen van Google, waardoor de kloof een uitspraak is over het model en niet over de evaluator. Als je workload afhangt van het vinden van een feit dat begraven ligt nabij het einde van een prompt van een miljoen tokens, zegt het contextcijfer uit de kop niets nuttigs en zegt deze rij bijna alles.
De index bewoog, het model niet
Gemini 3.1 Pro werd gelanceerd op 19 februari 2026 met 57 op de Artificial Analysis Intelligence Index, als eerste in het veld. Onder indexrevisie v4.3.2, gepubliceerd op 19 september 2026, staat er 30. Aan het model is tussen die twee datums niets veranderd. De meetlat werd herbouwd, en hij werd herbouwd vier dagen vóór Alibaba's aankondiging van Qwen 4.
Dat toeval is meer waard dan de cijfers zelf. Drie van de vier modellen in deze reeks vergelijkingen — Gemini 3.1 Pro, Claude Opus 5 en het Qwen 3.8-vlaggenschip — hebben onafhankelijke scores die onder dezelfde revisie zijn verschoven, en in elk geval was de verschuiving groot genoeg om een rangorde om te keren. Elke vergelijking die deze maand is geschreven en die één enkele indexwaarde citeert zonder de revisie te noemen, vergelijkt scores die met verschillende linialen zijn verkregen, en de fout zal voor een lezer niet zichtbaar zijn.
Voor Qwen 4 Max is het gevolg dat het doel blijft bewegen. Wanneer Alibaba uiteindelijk publiceert, is de score die verslagen moet worden op deze index wat de huidige revisie op die dag zegt, en de revisie is minstens één keer in de afgelopen week gewijzigd.

Wat de operationele cijfers zeggen, inclusief het ongemakkelijke cijfer
Gemini 3.1 Pro is routeerbaar op OrcaRouter als google/gemini-3.1-pro-preview, met de Flagship- en Featured-badges, zonder pre-releasebanner, tegen de lijstprijs van Google van $2,00 en $12,00 per miljoen tokens met 0% opslag. De routing zelf is eerlijk — het tarief op de pagina is het tarief dat Google publiceert. De operationele cijfers over de zeven dagen tot 22 september zijn ook het vermelden waard in plaats van over te slaan: een p50 time-to-first-token van 10,00 seconden, een outputsnelheid van ongeveer 632 tokens per seconde, en een foutpercentage van 77,5 procent over het venster. Dat foutpercentage is geen voetnoot. Voor een model in de previewfase zonder GA-datum is het het allerbelangrijkste cijfer voor besluitvorming op de pagina, en een vergelijking die de prijs noemt zonder dat cijfer verkoopt in plaats van informeert.
Dezelfde catalogus bevat bijna 200 modellen op één OpenAI-compatibel endpoint met automatische failover en een routing-DSL, het mechanisme dat een foutpercentage als dat overleefbaar maakt in plaats van fataal: een gedegradeerd providerpad kan worden overgeschakeld (failover) in plaats van uitgeschakeld. De Qwen 3.8-familie — Qwen3.8-Max, Qwen3.8-Flash en Qwen3.8-27B — staat op hetzelfde endpoint als Gemini 3.1 Pro Preview, dus de vervanging waar dit artikel echt over gaat, degene die je vandaag kunt maken, is een wijziging van het routeringsbeleid in plaats van een migratieproject. Qwen 4 Max staat niet in de catalogus, en geen enkele Qwen 4-tier staat erin; wanneer die wordt uitgebracht, is dat waar hij zou verschijnen.
Het besluit, als je het zo kunt noemen
Geen van beide modellen hier is een product waar je je aan kunt committeren, en het eerlijke advies is om beide dienovereenkomstig te behandelen. Gemini 3.1 Pro is vandaag aanroepbaar tegen een gepubliceerde prijs, met een gepubliceerd contextvenster en een openbaar evaluatiespoor, inclusief de retrieval-zwakte aan het uiterste eind van dat venster; het is ook een preview waarvan de leverancier zegt dat je moet plannen voor deprecatie, met een foutpercentage dat onaanvaardbaar zou zijn voor een productie-afhankelijkheid. Qwen 4 Max heeft geen van die problemen, omdat het geen van die eigenschappen heeft.
Als je nu een model nodig hebt, is de keuze niet tussen deze twee. Het is tussen Gemini 3.1 Pro en het nu leverbare Qwen-vlaggenschip, en op basis van het beschikbare bewijs is dat een beslissing over de kwaliteit van long-context retrieval versus een inputtarief van $2,00 met gepubliceerde gewichten. Als je kunt wachten, let dan op twee dingen in plaats van één: een modelkaart voor Qwen 4 Max, en een datum voor algemene beschikbaarheid van Gemini 3.1 Pro. Wat het eerst verschijnt, vertelt je welke van deze twee roadmaps Alibaba en Google feitelijk prioriteit geven.

