
GPT-6 vs Claude Opus 5: Beide partijen in deze confrontatie zijn al vervangen
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 60 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 356 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
The most useful thing to know about GPT-6 versus Claude Opus 5 is that both halves of the matchup are one generation behind their own vendors. Claude Opus 5 shipped on 24 July 2026 and was replaced by Claude Opus 5.5 on 22 September. GPT-6 Sol shipped on 22 September and was replaced by GPT-6.1 Sol on 29 September. If you searched for this comparison because you are choosing between them for new work, you are choosing between two models that each vendor has already moved past — and the honest version of this article is about when the older pair is still the right call, not about who wins.
Wat de twee modellen eigenlijk zijn
Claude Opus 5 was het vlaggenschip van Anthropic: een contextvenster van 1.000.000 tokens, een maximale uitvoer van 128.000 tokens, tekst-, afbeeldings- en bestandsinvoer, met een prijs van $5,00 per miljoen invoertokens en $25,00 per miljoen uitvoertokens, met een tarief van $0,50 voor gecachte invoer en $10,00 voor cache-schrijven. Het is één enkel model met één enkele id, anthropic/claude-opus-5.
GPT-6 Sol is de middelste tier van een generatie van drie modellen — GPT-6 Astra erboven en GPT-6 Luna eronder — met dezelfde context van meer dan 1.000.000 tokens (de catalogus vermeldt 1.050.000 voor de OpenAI-kant tegenover 1.000.000 voor Opus 5), hetzelfde uitvoerplafond van 128.000 tokens en dezelfde tekst-, afbeeldings- en bestandsinvoer. De prijs bedraagt $2,00 / $10,00, met een tarief van $0,20 voor gecachte invoer en $2,50 voor het schrijven naar cache. De prijskaart bevat een stap die de kaart van Anthropic niet heeft: elke aanvraag boven 272.000 invoertokens herprijst de hele aanvraag naar $4,00 / $15,00.
Dat is een prijsverschil van 2,5x per token in het voordeel van Sol aan de korte kant, en het verschil blijft ook bij cache bestaan — een korting van 90% op gecachte invoer bij Sol tegenover een korting van 98% bij Opus 5, waardoor het verschil krimpt tot $0,20 versus $0,50 per miljoen in plaats van te verdwijnen. Bij een workload met een lange context halveert het verschil in plaats van dicht te lopen.
• Invoer — GPT-6 Sol $2,00 per miljoen vs Claude Opus 5 $5,00
• Uitvoer — GPT-6 Sol $10,00 per miljoen vs Claude Opus 5 $25,00
• In cache opgeslagen invoer — GPT-6 Sol $0,20 per miljoen vs Claude Opus 5 $0,50
• Cache-schrijfacties — GPT-6 Sol $2,50 per miljoen vs Claude Opus 5 $10,00
• Boven 272K invoer — GPT-6 Sol herprijst het hele verzoek naar $4,00 / $15,00; geen equivalente stap op de Opus 5-kaart
• Context en uitvoer — 1.050.000 in en 128.000 uit vs 1.000.000 in en 128.000 uit
Het onafhankelijke bestuur, waar de kloof groter is dan de prijs
De prijs is 2,5 keer in het voordeel van GPT-6 Sol. Het scorebord begunstigt Claude Opus 5 meer dan het prijsverschil zou doen vermoeden, wat het tegenovergestelde is van het gebruikelijke verhaal over goedkopere modellen.
• AA Intelligence Index — Claude Opus 5 50,8, op de 11e plaats; GPT-6 Sol 47,6, op de 14e plaats
• AA Coding Index — Claude Opus 5 78,0, als tweede op die ranglijst; GPT-6 Sol 60,0
• GPQA Diamond — Claude Opus 5 93,2
• Humanity's Last Exam — Claude Opus 5 54,9 tegen GPT-6 Sol 47,9
• Terminal-Bench 2.1 — Claude Opus 5 89,1
• Terminal-Bench 4.0 — Claude Opus 5 49,0 tegen GPT-6 Sol 43,9
• τ-bench banking — Claude Opus 5 42,1
• SciCode — Claude Opus 5 56,4 tegen GPT-6 Sol 57,6
• Herinnering bij lange context — Claude Opus 5 79,3 tegen GPT-6 Sol 83,7
Twee rijen wijzen de andere kant op, en ze zijn het vermelden waard, want het geaggregeerde cijfer verbergt ze. GPT-6 Sol verslaat Opus 5 op recall bij lange context met 4,4 punten en is op SciCode met 1,2 punt beter. Dus het eerlijke beeld is niet "Opus 5 is overal beter" — het is dat Opus 5 duidelijk voorloopt op de coderings- en agentische ranglijsten (een voorsprong van 24 punten op de Coding Index is een resultaat van een andere orde), terwijl Sol de rij voor retrieval over een lang venster vasthoudt en gelijk scoort op een van de twee maatstaven voor wetenschappelijke code.
Eén methodologische kanttekening voordat een van beide cijfers ergens anders wordt aangehaald: Artificial Analysis garandeert niet dat twee modelpagina's op dezelfde dag tegen dezelfde indexrevisie worden gerenderd, en het splitst zijn peergroepen — open-weights-modellen worden gerangschikt tegen andere open-weights-modellen van dezelfde grootteklasse, propriëtaire modellen over een propriëtaire prijsband. Beide modellen hier zijn propriëtair, dus de twee cijfers komen van dezelfde kant van die lijn, maar behandel de verschillen van minder dan een punt als richting, niet als een gecontroleerde meting. Elk leverancierscijfer in dit stuk betreft de leverancier die zijn eigen model benchmarkt tegen zijn eigen voorganger, en is als zodanig gelabeld.
Wat de twee vervangingen hebben veranderd
Claude Opus 5.5 verscheen op 22 september voor $4,00 / $20,00 — goedkoper dan Opus 5 op beide tarieven, met een tarief van $0,20 voor gecachte input dat overeenkomt met dat van Sol — en scoort 57,6 op dezelfde Intelligence Index. Dat is 6,8 punten boven Opus 5 voor 20% minder geld. Elk argument om Opus 5 in een nieuwe build te houden, moet uitleggen waarom het 6,8 indexpunten en $1,00/$5,00 per miljoen waard is om op het oudere checkpoint te blijven.
GPT-6.1 Sol arriveerde op 29 september tegen dezelfde $2,00 / $10,00 als GPT-6 Sol, met een score van 51,8 op de index tegenover Sol's 47,6, en met een tarief van $0,10 voor gecachte input dat de gecachte lezing halveert. Het is dezelfde prijs met een betere score en betere cache-economie. Het enige argument voor specifiek GPT-6 Sol is hetzelfde dat geldt voor Opus 5: een regressiesuite die erop is gebaseerd, waarbij het wijzigen van het model de vergelijkingen die je al vertrouwt ongeldig maakt.
Er is een tweede, stillere reden waarom een team bij het oudere paar blijft, en die gaat niet over benchmarks. Deze beide zijn de checkpoints met de langste productiegeschiedenis achter zich. Opus 5 is aanroepbaar sinds 24 juli en GPT-6 Sol sinds 22 september, en de metingen van de onafhankelijke evaluator aan beide worden al lang genoeg uitgevoerd om een patroon te laten zien in plaats van één enkele aflezing. Het verkeer van Sol gedurende de laatste zeven dagen in onze eigen routeringsgegevens komt neer op ongeveer 2,1 miljoen tokens; dat van Opus 5 op ongeveer 23,0 miljoen. Het gaat om een rollend venster, niet om een totaal over de hele levensduur, en het verschuift tussen aflezingen — maar het herinnert eraan dat Opus 5 nog steeds echt werk doet in productie, zelfs nadat de vervanger is uitgebracht.
De vorm van latentie en kosten, dat is waar Sol zijn geld waard is.
• Mediane tijd tot eerste token — GPT-6 Sol 6,785 ms vs Claude Opus 5 4,652 ms
• Mediane outputsnelheid — GPT-6 Sol 179.6 tokens/s vs Claude Opus 5 82.2 tokens/s
• Zevendaags verkeer waargenomen aan onze kant — GPT-6 Sol ~2.1M tokens, Claude Opus 5 ~23.0M tokens
Sol levert zijn eerste token na ongeveer 2,1 seconden, maar streamt daarna meer dan twee keer zo snel als Opus 5. Bij een lange generatie — het soort run waarbij de uitvoer duizenden tokens omvat in plaats van tientallen — domineert dat tweede getal, en een goedkoop model dat eerder klaar is, is meer waard dan zijn tariefkaart doet vermoeden. Bij een korte, latentiegevoelige aanroep is het eerste-tokengetal het getal dat de gebruiker merkt.
Beide zijn servingmetingen van onze eigen routing, gemeten over een voortschrijdend venster van zeven dagen, en ze variëren tussen uitlezingen. Ze zijn nuttig om de vorm van de twee modellen te vergelijken, en niet om als servicelevelverwachting te worden aangehaald.

Het paar draaien zolang de migratie nog niet is besloten
De reden dat deze vergelijking überhaupt het beantwoorden waard is, is dat geen van beide vervangingen een kwestie van simpelweg omwisselen is. Als je evaluaties zijn opgezet rond Claude Opus 5, is overstappen naar Opus 5.5 een nieuwe baseline, geen upgrade; hetzelfde geldt voor GPT-6 Sol tegenover GPT-6.1 Sol. Het nuttige om in dat venster te doen, is beide generaties naast elkaar draaien op je eigen verkeer in plaats van te kiezen op basis van het scorebord van iemand anders.
Alle vier de modellen staan in dezelfde catalogus op OrcaRouter — Claude Opus 5, Claude Opus 5.5, GPT-6 Sol en GPT-6.1 Sol, aangeroepen via één API tegenover meer dan 200 modellen, met de lijstprijs van de provider doorgegeven tegen 0% opslag, zodat een prijsverlaging van een leverancier hier dezelfde dag landt in plaats van bij je volgende reconciliatie — waardoor de vergelijking een routeringsvraagstuk wordt in plaats van een inkoopvraagstuk. De routerings-DSL laat je splitsen op verzoekgrootte of op aandeel: stuur een deel van het productieverkeer naar het nieuwere checkpoint, vergelijk het met de baseline op je eigen evaluaties, verbreed het aandeel wanneer de cijfers standhouden, en houd het oudere model als fallback totdat ze dat doen. Automatische failover tussen providers dekt het geval waarin een route midden in een migratie verslechtert, het faalpatroon waardoor mensen een migratie halverwege opgeven.


Wie zou welke moeten kiezen, aangezien beide achterhaald zijn?
Als je iets nieuws begint: geen van beide. Claude Opus 5.5 is goedkoper dan Claude Opus 5 en scoort 6,8 punten hoger, en GPT-6.1 Sol kost hetzelfde als GPT-6 Sol, met een betere index en een gehalveerde cached read. De enige reden om met het oudere tweetal te beginnen, is een harde afhankelijkheid van een checkpoint waar je niets aan kunt veranderen.
Als je al een van beide draait: de beslissing gaat over je regressiesuite, niet over de boards. Claude Opus 5 blijft met een ruime marge het sterkere coding- en agentische model van de twee, dus een codingpipeline die daarop stabiel is, zou moeten vergelijken met Opus 5.5 in plaats van zijwaarts te migreren naar een GPT-6-tier. Een high-volume, kostenbewuste pipeline op GPT-6 Sol heeft de eenvoudigere upgrade — dezelfde prijs, betere score, betere cache — en de eerlijke reden om te wachten is alleen dat je je evaluaties nog niet opnieuw hebt uitgevoerd.
En als het antwoord dat je wilde simpelweg was welke van de twee wint: Claude Opus 5 doet dat, op vrijwel elk leaderboard, voor 2,5x de prijs. Het pleidooi voor GPT-6 Sol was nooit dat het beter was. Het was dat het goedkoop genoeg was om het prijsverschil waard te zijn — en dat pleidooi geldt nu voor GPT-6.1 Sol, voor dezelfde prijs en met een betere score.
Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
