Een gegenereerde herokaart met de titel 'Dots vs Qwen 3.8 Max', ondertitel 'Het verschil zit in waar je het mag verplaatsen'. Een verticale lijn splitst de kaart: het linkerpaneel, gelabeld 'Dots', vermeldt 'één plek waar het kan draaien'; het rechterpaneel, gelabeld 'Qwen 3.8 Max', vermeldt 'drie wire-formaten - vijf regio's - $2.00 / $6.00'. Het OrcaRouter-logo is gecomponeerd in de rechteronderhoek.
Guides & Insights

Dots vs Qwen 3.8 Max: het verschil zit in waar je het mag verplaatsen

Auteur

Elias Hawthorne

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Qwen 3.8 Max werd op 3 augustus 2026 uitgebracht en is Alibaba's meest capabele tier tot nu toe: native multimodaal, accepteert tekst, afbeeldingen en video en retourneert tekst, over een contextvenster van 1.000.000 tokens, aangeboden via drie wire-formats — OpenAI-compatibel, Anthropic-compatibel en native DashScope — vanuit Peking, Singapore, Tokio, Frankfurt en Virginia, voor $2,00 per miljoen inputtokens en $6,00 per miljoen outputtokens, met cached reads voor $0,25. Dots is de altijd-actieve agent van het bedrijf, aangekondigd tijdens DevDay op 29 september 2026: hij krijgt zijn eigen cloudcomputer en browser, bereikt meer dan 4.000 apps, draait op GPT-6 Astra en is inbegrepen bij Pro en Business Premium. Naast elkaar gezet is de interessante vraag niet welke capabeler is. Het gaat erom hoeveel plekken elk ervan mag innemen, en wie dat bepaalt.

Dat is geen abstract onderscheid. Het is juist het onderscheid dat bepaalt of een tool überhaupt beschikbaar is in je markt, of die door je compliance-team kan worden geauditeerd, en of het werk dat je erop bouwt een wijziging van de voorwaarden overleeft. Functionaliteit is het makkelijke deel van deze vergelijking; overdraagbaarheid is het deel dat pas laat en tegen hoge kosten wordt beslecht.

Drie manieren om één model aan te roepen

Een wire-formaat klinkt als een klein technisch detail, totdat je een applicatie tussen leveranciers moet verplaatsen. Het OpenAI-compatibele oppervlak betekent dat bestaande clientbibliotheken werken zonder vertaallaag. Het Anthropic-compatibele oppervlak betekent dat een codebase die is geschreven tegen de berichtvorm van een andere leverancier niet hoeft te worden herschreven. De native DashScope-interface biedt de volledige functieset, inclusief de schakelaar voor denkmodus. Drie oppervlakken voor één model betekenen dat de kosten van overstappen een basis-URL en een sleutel zijn, geen refactor.

Dat is het belangrijkst wanneer het ontbreekt. Niets aan een dot biedt een formaat, een URL of een sleutel, want een dot is niet iets dat je aanroept — het is iets waarmee je praat in andermans interface. Je agentlogica ergens anders onderbrengen betekent dat je die opnieuw moet opbouwen, dan de vierduizend connectors opnieuw moet verbinden waarvan die afhankelijk was, en dan moet ontdekken welke daarvan zich gedroegen op manieren die je niet had opgeschreven.

• Wat je koopt — een gehoste worker in ChatGPT, Slack en Teams (Dots) tegenover een model-endpoint dat je overal vandaan kunt aanroepen (Qwen 3.8 Max)

• Interfaces — geen enkele gepubliceerd voor een punt, tegenover OpenAI-compatibele, Anthropic-compatibele en native DashScope-oppervlakken (Qwen 3.8 Max)

• Waar het draait — de cloudcomputer van OpenAI met zijn eigen browser (Dots) tegen vijf bediende regio's verspreid over Azië, Europa en Noord-Amerika (Qwen 3.8 Max)

• Redeneerbesturing — niet beschikbaar voor een punt, tegenover een enable_thinking-schakelaar, of reasoning.effort op de Responses API (Qwen 3.8 Max)

• Kosten per eenheid — de eerste dot is inbegrepen bij Pro of Business Premium, tegoed niet gepubliceerd (Dots) tegen $2,00 per miljoen input en $6,00 per miljoen output, lezen uit cache $0,25 (Qwen 3.8 Max)

• Onafhankelijk bewijs — demo's van leveranciers en capaciteitsverklaringen, geen benchmark voor een punt, afgezet tegen een Artificial Analysis Intelligence Index van 45,4 op de vijftiende plaats van 145 gemeten modellen en 92,8 op GPQA Diamond (Qwen 3.8 Max)

Waar het model uitkomt, in cijfers die je kunt controleren

Het gepubliceerde profiel van Qwen 3.8 Max is een mid-frontierprofiel, en het is de moeite waard om het precies te lezen in plaats van impressionistisch. Een AA Intelligence Index van 45,4, waarmee het op de vijftiende plaats van de 145 gemeten modellen staat, plaatst het in de top tien procent zonder het aan de top te zetten. Een AA Coding Index van 76,2 op de negende plaats van 138 is sterker, en 88,8 op Terminal-Bench 2.1 is een werkelijk hoge score voor agentische uitvoering — hoger dan de 88,0 van GPT-5.6 Sol op dezelfde benchmark. Waar het relatief zwakker is, is recall bij lange context met 80,3, dat onder de 88,7 van Kimi K3 en de 83 van MiniMax M3 ligt ondanks een vergelijkbare contextvenstergrootte, en SciCode met 52,1.

Alibaba's eigen positionering, in zijn migratiegids, plaatst het model direct tegenover GPT-5.5, Claude Opus 4.7 en Gemini 3.1 Pro, en de eerlijke lezing van de cijfers is dat dit een model is waar je naar grijpt wanneer een mix van sterke agentische uitvoering en multimodale input belangrijker is dan als eerste op het intelligentiebord staan. Al die cijfers zijn metingen van derden, met hun bronnen opgenomen in onze catalogus, in plaats van leveranciersclaims — wat de reden is dat ze meer waard zijn dan een lanceringspresentatie.

Eén getal ontbreekt en moet hardop worden gezegd in plaats van ingevuld: onze catalogus vermeldt geen maximale uitvoerlengte voor dit model. Een context van een miljoen tokens is gedocumenteerd; een uitvoerplafond per antwoord niet.

A screenshot of the OrcaRouter model page for Qwen3.8 Max, showing the identifier 'qwen/qwen3.8-max' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-08-03, a description of it as Alibaba's newest flagship with a 1M-token context window served through OpenAI-compatible, Anthropic-compatible and native DashScope interfaces across multiple regions, a side panel reading 1M tokens of context over text, image and video input, and a price strip reading $2.00 and $6.00 with a p50 time to first token of 2.44 seconds.

Wat Dots je niet vertelt, en waarom dat een ontwerpkeuze is

OpenAI heeft één zin gepubliceerd over wat een dot kost, en die bevat geen getal: de eerste dot is inbegrepen bij Pro en Business Premium, met uitgebreidere limieten in de eerste maand en zonder dat gesprekken ermee ten koste gaan van de ChatGPT-gebruikslimieten. Daarbuiten is er geen opgegeven limiet, geen prijs voor een tweede dot, geen tarief voor extra capaciteit en geen kosten per taak. Het Pro 500-niveau van $500 per maand is een gebruikslimiet plus de Ultrafast-modus, in plaats van een tarief per dot, dus zelfs het duurste abonnement laat zich niet omrekenen naar een kostenpost per eenheid agentwerk.

Het is verleidelijk om dat te lezen als een gat in de documentatie. Het is nauwkeuriger om het als de categorie te lezen: een product met een prijs per seat kan geen prijs per eenheid hebben, want het hele punt van een seat is dat de marginale kosten van het gebruik ervan onzichtbaar zijn. Dat is echt handig voor verkennend werk en echt onhandig voor alles wat je moet toewijzen aan een project, een klant of een budgetpost.

Let op waar de twee producten op zijn geoptimaliseerd. Qwen 3.8 Max is geoptimaliseerd om overal vandaan te worden aangeroepen, door van alles, in welk formaat de aanroeper al spreekt dan ook. Een dot is geoptimaliseerd om op één plek te worden gebruikt, door één interface, met de onderliggende werking verborgen. Beide zijn coherente ontwerpen; ze beantwoorden alleen andere vragen, en een van de twee antwoordt met nee op "kan ik dit later verplaatsen".

A generated scoreboard titled 'Dots vs Qwen 3.8 Max - reach and reversibility', with two columns. The left column, 'Dots', lists: price included with Pro or Business Premium; allowance not published; interfaces none published; regions OpenAI's cloud computer; connectors 4,000+ apps; independent benchmark none. The right column, 'Qwen 3.8 Max', lists: context 1,000,000 tokens; input text, image, video; interfaces OpenAI-compatible, Anthropic-compatible, DashScope; regions five; price $2.00 in / $6.00 out per 1M; AA Intelligence Index 45.4, 15th of 145. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; Qwen 3.8 Max figures from independent listings as carried in the OrcaRouter catalogue.'

Twee antwoorden op "wat als deze leverancier verandert"

De vraag naar portabiliteit wordt concreet op het moment dat een leverancier een prijs verandert, een identificator als verouderd markeert of wijzigt wat een abonnement omvat. Voor een verbruiksgebaseerd model met drie wire-formats is het antwoord mechanisch: wijs de client naar een andere basis-URL, of verander één model-string, en de applicatie blijft werken. Er is niets anders over te zetten, want het model was nooit iets anders dan een aanroep.

Voor een dot is de reactie op een wijziging van de voorwaarden stoppen. De computer, de browser, de connectors en de limiet behoren allemaal toe aan OpenAI, en geen ervan kan worden geëxporteerd. Dat is geen kritiek op het product; het is de eerlijke beschrijving van het huren. Maar het betekent wel dat werk dat je volledig binnen een dot bouwt, een migratiepad heeft dat via een herschrijving loopt, en dat is een feit dat je moet inprijzen voordat je iets bouwt waarop je een jaar lang afhankelijk wilt zijn.

OrcaRouter is gebouwd voor het eerste geval. Qwen 3.8 Max wordt gerouteerd als qwen/qwen3.8-max tegen de lijstprijs van Alibaba's provider, doorgegeven met 0% markup, in dezelfde catalogus als 200-plus andere modellen achter één sleutel, met automatische failover tussen upstreamproviders en een routing-DSL om meerdere modellen in één verzoek samen te stellen. Dat is wat de vraag over de drie regio's aan jouw kant beantwoordbaar maakt in plaats van aan de kant van de leverancier: dezelfde identifier bereikt het model waar het ook wordt geserveerd, en een tariefwijziging van Alibaba komt dezelfde dag op je factuur terecht in plaats van bij de volgende verlenging. Wat het niet bereikt, is alles binnen een punt — er is geen endpoint voor, geen identifier, en geen vervangende intelligentie om in te schakelen.

De vraag die je moet stellen voordat je je vastlegt

Vraag wat er met je werk gebeurt op de dag dat de leverancier iets verandert waar je geen controle over hebt. Als het antwoord is "we veranderen een string en gaan verder", dan koop je een model, en het model met verbruiksmeting is de betere aankoop. Als het antwoord is "we zouden het opnieuw moeten bouwen", dan koop je een product, en je moet het bewust kopen — wetende dat het gemak waarvoor je betaalt, met omkeerbaarheid wordt betaald.

Geen van beide antwoorden is fout. Draagbaarheid kopen die je nooit zult gebruiken is net zo verspillend als gemak kopen waar je aan zult moeten ontsnappen. De fout is niet weten welke van de twee je hebt gekocht.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with a grid of model cards and credit top-up offers visible beneath.

Vergeleken in dit artikel2

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt