Genererat titelkort med texten "GPT-6 vs Claude Opus 5", med en chip som lyder "Opus 5 ersatt av Claude Opus 5.5, 22 sep 2026" och en chip som lyder "GPT-6 Sol ersatt av GPT-6.1 Sol, 29 sep 2026", och en sidfot som lyder "Båda modellerna är fortfarande routade; indexsiffror enligt Artificial Analysis." OrcaRouter-logotypen är komponerad i nedre högra hörnet.
Guides & Insights

GPT-6 vs Claude Opus 5: Båda sidorna i den här matchen har redan ersatts

Författare

Magnus Corvin

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

The most useful thing to know about GPT-6 versus Claude Opus 5 is that both halves of the matchup are one generation behind their own vendors. Claude Opus 5 shipped on 24 July 2026 and was replaced by Claude Opus 5.5 on 22 September. GPT-6 Sol shipped on 22 September and was replaced by GPT-6.1 Sol on 29 September. If you searched for this comparison because you are choosing between them for new work, you are choosing between two models that each vendor has already moved past — and the honest version of this article is about when the older pair is still the right call, not about who wins.

Vad de två modellerna egentligen är

Claude Opus 5 var Anthropics flaggskepp: ett kontextfönster på 1 000 000 tokens, maximal utdata på 128 000 tokens, text-, bild- och filindata, listad till 5,00 USD per miljon indatatokens och 25,00 USD per miljon utdatatokens, med en cachad indataavgift på 0,50 USD och en cache-skrivavgift på 10,00 USD. Det är en enda modell med ett enda id, anthropic/claude-opus-5.

GPT-6 Sol är den mellersta nivån i en generation med tre modeller – GPT-6 Astra ovanför den och GPT-6 Luna under den – med samma kontextfönster på över 1 000 000 token (katalogen anger 1 050 000 för OpenAI-sidan mot Opus 5:s 1 000 000), samma utdatatak på 128 000 token och samma indata för text/bild/fil. Den listas till $2.00 / $10.00, med en avgift på $0.20 för cachad indata och en avgift på $2.50 för cacheskrivning. Dess prislista har ett steg som Anthropic-kortet inte har: varje begäran över 272 000 indata-token omprissätter hela begäran till $4.00 / $15.00.

Det är ett prisgap på 2,5x per token till Sols fördel i den korta änden, och gapet består även för cache – en rabatt på 90 % för cachad indata hos Sol mot en rabatt på 98 % hos Opus 5, vilket minskar skillnaden till $0,20 mot $0,50 per miljon i stället för att eliminera den. Vid en arbetsbelastning med lång kontext halveras gapet i stället för att stängas.

• Indata — GPT-6 Sol $2.00 per miljon mot Claude Opus 5 $5.00
• Utdata — GPT-6 Sol $10.00 per miljon mot Claude Opus 5 $25.00
• Cachad indata — GPT-6 Sol $0.20 per miljon mot Claude Opus 5 $0.50
• Cacheskrivningar — GPT-6 Sol $2.50 per miljon mot Claude Opus 5 $10.00
• Över 272K indata — GPT-6 Sol omprissätter hela begäran till $4.00 / $15.00; inget motsvarande steg på Opus 5-kortet
• Kontext och utdata — 1 050 000 in och 128 000 ut mot 1 000 000 in och 128 000 ut

Den oberoende styrelsen, där gapet är större än priset

Priset gynnar GPT-6 Sol 2,5 gånger. Tavlan gynnar Claude Opus 5 mer än vad prisskillnaden skulle antyda, vilket är motsatsen till den vanliga berättelsen om billiga modeller.

• AA Intelligence Index — Claude Opus 5 50,8, rankad 11:e; GPT-6 Sol 47,6, rankad 14:e
• AA Coding Index — Claude Opus 5 78,0, rankad 2:a på den listan; GPT-6 Sol 60,0
• GPQA Diamond — Claude Opus 5 93,2
• Humanity's Last Exam — Claude Opus 5 54,9 mot GPT-6 Sol 47,9
• Terminal-Bench 2.1 — Claude Opus 5 89,1
• Terminal-Bench 4.0 — Claude Opus 5 49,0 mot GPT-6 Sol 43,9
• τ-bench bank — Claude Opus 5 42,1
• SciCode — Claude Opus 5 56,4 mot GPT-6 Sol 57,6
• Återkallning i lång kontext — Claude Opus 5 79,3 mot GPT-6 Sol 83,7

Två rader går i motsatt riktning och de är värda att nämna, eftersom aggregeringen döljer dem. GPT-6 Sol slår Opus 5 på långkontextigenkänning med 4,4 punkter och är snäppet vassare på SciCode med 1,2. Så den ärliga bilden är inte "Opus 5 är bättre på allt" — det är att Opus 5 ligger avgjort före på resultattavlorna för kodning och agentbeteende (ett försprång på 24 punkter i Coding Index är en annan klass av resultat) medan Sol håller raden för hämtning över ett långt fönster och står lika på ett av de två måtten för vetenskapskod.

Ett metodologiskt förbehåll innan någon av siffrorna citeras någon annanstans: Artificial Analysis garanterar inte att två modellsidor renderas mot samma indexrevision samma dag, och man delar upp sina jämförelsegrupper — modeller med öppna vikter rangordnas mot andra modeller med öppna vikter i samma storleksklass, proprietära modeller inom ett proprietärt prisband. Båda modellerna här är proprietära, så de två siffrorna kommer från samma sida av den gränsen, men betrakta skillnaderna på under en punkt som en riktning snarare än som en kontrollerad mätning. Varje leverantörssiffra i den här artikeln är leverantören som benchmarkar sin egen modell mot sin egen föregångare och är märkt som sådan.

Vad de två ersättningarna ändrade

Claude Opus 5.5 lanserades den 22 september för $4,00 / $20,00 – billigare än Opus 5 på båda mätarna, med ett cachat indatapris på $0,20 som matchar Sols – och får 57,6 på samma Intelligence Index. Det är 6,8 punkter över Opus 5 för 20 % lägre kostnad. Alla argument för att behålla Opus 5 i ett nytt bygge måste förklara varför det är värt 6,8 indexpunkter och $1,00/$5,00 per miljon att stanna kvar på den äldre checkpointen.

GPT-6.1 Sol lanserades den 29 september till samma $2,00 / $10,00 som GPT-6 Sol, och fick 51,8 på indexet mot Sols 47,6, med en taxa på $0,10 för cachad inmatning som halverar kostnaden för cachad läsning. Det är samma pris med bättre poäng och bättre cacheekonomi. Det enda argumentet för just GPT-6 Sol är det som gäller för Opus 5: en regressionssvit som baslinjades mot den, där ett byte av modell ogiltigförklarar de jämförelser du redan litar på.

Det finns ett andra, tystare skäl till att ett team håller sig kvar vid det äldre paret, och det handlar inte om benchmarks. Båda dessa är de checkpoints som har den längsta produktionshistoriken bakom sig. Opus 5 har kunnat anropas sedan den 24 juli och GPT-6 Sol sedan den 22 september, och den oberoende utvärderarens mätningar på båda har pågått tillräckligt länge för att visa ett mönster snarare än en enskild avläsning. Sol:s trafik de senaste sju dagarna i våra egna routingdata uppgår till ungefär 2,1 miljoner tokens; Opus 5:s uppgår till ungefär 23,0 miljoner. Det är ett rullande fönster, inte en totalsumma över hela livstiden, och de förändras mellan avläsningar — men de är en påminnelse om att Opus 5 fortfarande utför verkligt arbete i produktion även efter att dess ersättare har släppts.

Latens- och kostnadsprofilen – det är där Sol gör nytta

• Median tid till första token — GPT-6 Sol 6 785 ms mot Claude Opus 5 4 652 ms
• Median utdatahastighet — GPT-6 Sol 179,6 tokens/s mot Claude Opus 5 82,2 tokens/s
• Sjudagarstrafik observerad på vår sida — GPT-6 Sol ~2,1M tokens, Claude Opus 5 ~23,0M tokens

Sol svarar med sin första token efter ungefär 2,1 sekunder men strömmar sedan med mer än dubbelt så hög hastighet som Opus 5. Vid en lång generering – den typ av körning där utdata är tusentals tokens i stället för dussintals – dominerar det andra talet, och en billig modell som blir klar tidigare är värd mer än vad dess prislista antyder. Vid ett kort, latenskänsligt anrop är det siffran för första token som användaren känner.

Båda dessa är serveringsmätningar från vår egen routning, tagna över ett rullande fönster på sju dagar, och de varierar mellan avläsningarna. De är användbara för att jämföra formen hos de två modellerna, inte för att citeras som en förväntan på servicenivå.

A generated two-column comparison scoreboard titled "GPT-6 Sol vs Claude Opus 5 — the scoreboard". The left column, GPT-6 Sol, reads Input $2.00, Output $10.00, AA Intelligence 47.6, AA Coding 60.0, Long-context recall 83.7, Output speed 180 tok/s. The right column, Claude Opus 5, reads Input $5.00, Output $25.00, AA Intelligence 50.8, AA Coding 78.0, Long-context recall 79.3, Output speed 82 tok/s. A footer line reads "Index figures per Artificial Analysis; serving figures are a rolling seven-day window from OrcaRouter." The OrcaRouter logo is composited in the bottom-right corner.

Kör paret medan migreringen är oavgjord

Anledningen till att den här jämförelsen alls är värd att besvara är att ingen av ersättningarna kan väljas rakt av. Om dina utvärderingar byggdes mot Claude Opus 5 är ett byte till Opus 5.5 en ny baslinje, inte en uppgradering; detsamma gäller GPT-6 Sol mot GPT-6.1 Sol. Det användbara att göra i det fönstret är att köra båda generationerna sida vid sida på din egen trafik i stället för att välja utifrån någon annans resultattavla.

Alla fyra modellerna finns i samma katalog på OrcaRouter – Claude Opus 5, Claude Opus 5.5, GPT-6 Sol och GPT-6.1 Sol, som anropas via ett enda API framför 200+ modeller, med leverantörens listpris vidarebefordrat med 0 % påslag, så att en leverantörs prissänkning slår igenom här samma dag i stället för vid din nästa avstämning – vilket gör jämförelsen till en routingfråga snarare än en inköpsfråga. Routing-DSL:en låter dig dela upp efter förfrågningsstorlek eller andel: skicka en del av produktionstrafiken till den nyare checkpunkten, jämför den mot baslinjen i dina egna utvärderingar, öka andelen när siffrorna håller, och behåll den äldre modellen som reserv tills de gör det. Automatisk failover mellan leverantörer täcker fallet där en rutt försämras mitt under en migrering, vilket är det felscenario som får folk att överge en migrering halvvägs.

Screenshot of the OrcaRouter model page for anthropic/claude-opus-5, showing the Anthropic vendor label, a 2026-07-24 catalogue release date, a 1M-token context window, a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, and a rate strip reading $5.00 per million input, $25.00 per million output, a 4.65 s median time to first token, a 10.00 s p95, and 23.0M tokens routed in seven days.Screenshot of the OrcaRouter model page for openai/gpt-6-sol, showing the OpenAI vendor label, a 2026-09-22 catalogue release date, a 1,050,000-token context window (shown as 1.05M-token context in the model blurb), a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, and a rate strip reading $2.00 per million input, $10.00 per million output, a 6.79 s median time to first token, a 10.00 s p95, and 2.1M tokens routed in seven days.

Vem bör välja vilken, med tanke på att båda är ersatta

Om du startar något nytt: ingen av dem. Claude Opus 5.5 är billigare än Claude Opus 5 och presterar 6,8 poäng högre, och GPT-6.1 Sol har samma pris som GPT-6 Sol med ett bättre index och en halverad cachad läsning. Det enda skälet att börja med det äldre paret är ett hårt beroende av en checkpoint som du inte kan ändra.

Om du redan kör en av dem: beslutet handlar om din regressionssvit, inte om ledartavlorna. Claude Opus 5 är fortfarande den starkare kodnings- och agentiska modellen av de två med stor marginal, så en kodningspipeline som är stabil på den bör jämföras mot Opus 5.5 i stället för att sidledes migrera till en GPT-6-nivå. En högvolym- och kostnadskänslig pipeline på GPT-6 Sol har den enklare uppgraderingen – samma pris, bättre poäng, bättre cache – och det ärliga skälet att skjuta upp är bara att du ännu inte har kört om dina utvärderingar.

Och om svaret du ville ha helt enkelt var vilken av de två som vinner: Claude Opus 5 gör det, på nästan varje resultattavla, för 2,5 gånger priset. Argumentet för GPT-6 Sol var aldrig att den var bättre. Det var att den var tillräckligt billig för att vara värd prisskillnaden — och det argumentet tillhör nu GPT-6.1 Sol till samma pris med en bättre poäng.

Jämförda i den här artikeln3

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen