
Claude Opus 5.5 vs GPT-6 Sol: metà prezzo, finché il contesto non si allunga
- openaiNUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- openaiNUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- anthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- grokNUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 177 tok/s
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1323 tok/s
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenza76Codice
Anthropic e OpenAI hanno lanciato modelli di punta concorrenti lo stesso pomeriggio. Claude Opus 5.5 è uscito il 22 settembre 2026 a $4 per milione di token di input e $20 per milione di token di output, un taglio del 20% su entrambe le tariffe rispetto a Claude Opus 5. GPT-6 Sol è uscito lo stesso giorno a $2 in input e $10 in output, un taglio netto del 50% rispetto a GPT-5.6 Sol, che OpenAI ha descritto come permanente anziché promozionale. Leggi solo quelle due frasi e il confronto sembra già deciso prima di iniziare: il modello OpenAI costa la metà, e metà prezzo è metà prezzo. Leggi il resto di entrambe le schede tariffarie e il divario per lo più si chiude — non perché uno dei due fornitori abbia cambiato qualcosa, ma perché entrambi i modelli applicano un sovrapprezzo allo stesso tipo di richiesta, e costa a Sol molto più del suo vantaggio di quanto costi ad Anthropic.
Due schede tariffarie, entrambe con uno scatto.
Al di sotto di 272.000 token di input, questo è il confronto più semplice nell'attuale frontiera:
• Input — GPT-6 Sol $2,00 per milione vs Claude Opus 5.5 $4,00
• Output — GPT-6 Sol 10,00 $ per milione vs Claude Opus 5.5 20,00 $
• Input in cache — GPT-6 Sol circa 90% di sconto sulla porzione in cache rispetto a Claude Opus 5.5 a $0.20 per milione, un moltiplicatore del 5% sull'input di base
• Contesto e output — GPT-6 Sol 872K secondo le misurazioni di Artificial Analysis, 1M dichiarati altrove, output massimo di 128K rispetto a Claude Opus 5.5 1M e 128K
• Data limite delle conoscenze — Claude Opus 5.5 giugno 2026 vs GPT-6 Sol non indicato negli stessi termini
Oltre 272.000 token di input, l'aritmetica cambia su entrambi i fronti, e non nella stessa misura. GPT-6 Sol ricalcola il prezzo dell'intera richiesta — non dell'eccedenza, dell'intera chiamata — a circa il doppio della tariffa di input e una volta e mezza quella di output, arrivando vicino a 4,00 $ in input e 15,00 $ in output. Il listino di Claude Opus 5.5 non prevede scaglioni per il contesto lungo: Anthropic fattura 4,00 $ e 20,00 $ sull'intera finestra da 1 milione di token e dichiara che una richiesta da 900.000 token costa, per token, quanto una da 9.000 token.
Mettili insieme e l'ordinamento si ribalta in un punto inatteso. In una chiamata a contesto lungo, le tariffe di input convergono a circa 4 $ su entrambi i modelli — il vantaggio di metà prezzo di Sol sull'input svanisce del tutto — mentre l'output si restringe da un divario di 2x a circa 15 $ contro 20 $, un vantaggio del 25% invece che del 50%. Sol è ancora più economico. Non è più abbastanza economico da essere l'unico numero nella decisione, e il motivo è che i due sovrapprezzi hanno forme diverse: il modello di Anthropic applica una tariffa fissa che risulta più alta, quello di OpenAI applica una penalità che colpisce più duramente proprio i carichi di lavoro agentici, di lettura di repository e su insiemi di documenti per cui entrambe le aziende vendono questi modelli.

Il punteggio indipendente, che è l'unico confronto a parità di condizioni

Nessuna delle due tabelle di lancio contiene il nuovo modello dell'altra — entrambe sono state scritte prima che arrivassero le uscite dello stesso giorno — quindi il materiale del fornitore non può minimamente classificare questi due. Artificial Analysis può farlo, perché esegue ogni modello in un'unica configurazione pubblicata:
• Indice di Intelligenza — Claude Opus 5.5 58, classificato #1 su 210 vs GPT-6 Sol 48, classificato #18
• Etichetta di configurazione — entrambi valutati al massimo sforzo; Claude Opus 5.5 etichettato inoltre come "Default Fallback"
• Velocità di output — GPT-6 Sol 113,3 token/sec, classificato 38° rispetto a Claude Opus 5.5, non ancora pubblicato
• Tempo al primo token — GPT-6 Sol 142,74 s rispetto a una mediana della classifica di 3,83 s; Claude Opus 5.5 non ancora pubblicato
• Prezzo — GPT-6 Sol 2,00 $ / 10,00 $ per milione vs Claude Opus 5.5 4,00 $ / 20,00 $
Dieci punti indice e diciassette posizioni rappresentano la separazione più ampia in qualsiasi abbinamento attuale Claude contro OpenAI, e va a sfavore del modello più economico per la seconda volta questo mese — lo stesso schema si è presentato quando GPT-6 Sol ha incontrato Claude Opus 5 in un confronto precedente e ha perso di tre punti a un costo inferiore del 60%. La riga della velocità taglia nella direzione opposta e conta più di quanto sembri: 113,3 token al secondo è circa il doppio di quanto riesca a fare il flagship GPT-6 Astra, ed è il dato più rapido di questo gruppo. Combinato con un primo token da 142 secondi, il profilo è quello di un modello che pensa a lungo e poi scrive in fretta, il che lo rende poco adatto a qualsiasi uso interattivo e una scelta ragionevole per lunghe esecuzioni non supervisionate.
Entrambe le cifre presentano la stessa avvertenza di quelle dei fornitori: sono misurazioni effettuate al massimo sforzo e la configurazione predefinita di nessuno dei due modelli è il massimo sforzo. Claude Opus 5.5 usa per default medio su una scala di impegno che va da basso a massimo; GPT-6 Sol espone una scala che va da nessuno a massimo. Un indice al massimo sforzo è un modo equo per confrontare i limiti massimi e un modo fuorviante per prevedere la vostra fattura.
Cosa si rompe quando si cambia, in entrambe le direzioni
L'attrito migratorio qui è asimmetrico e vale la pena saperlo prima di entrambe le mosse.
Claude Opus 5.5 non è un sostituto diretto di Claude Opus 5. La modalità thinking non può più essere disabilitata, quindi il codice che impostava un percorso non-thinking genererà un errore o cambierà comportamento in modo silenzioso. L'uso forzato degli strumenti restituisce un errore. I blocchi di thinking sono vincolati al modello e alla conversazione che li hanno prodotti, quindi non possono essere riprodotti tra modelli diversi. Il vecchio computer_20251124 strumento di uso del computer non è accettato sull'API di Claude o su Google Cloud. Separatamente, il testo tra le chiamate agli strumenti ora viene restituito all'interno di blocchi di thinking che risultano vuoti con l'impostazione di visualizzazione predefinita, quindi un'applicazione che esegue lo streaming di quel testo come stato di avanzamento rimarrà semplicemente silenziosa tra una chiamata e l'altra senza lanciare nulla.
La scala di effort di GPT-6 Sol è la più flessibile delle due: può essere modificata a metà conversazione senza invalidare la prompt cache, il che significa che un primo passaggio economico e un tentativo successivo costoso sullo stesso contesto sono un pattern supportato anziché uno che invalida la cache. Questo è un vero vantaggio ingegneristico per chiunque esegua ragionamento a livelli all'interno di una singola sessione, ed è l'argomento più forte a favore di Sol che non compare in alcuna tabella dei prezzi.
Eseguire entrambi e decidere con i tuoi numeri
La posizione onesta su questo confronto è che le tabelle dei fornitori non possono risolverlo e l'indice indipendente stabilisce solo il tetto massimo. Ciò che resta è la questione del carico di lavoro — quanto durano realmente i tuoi contesti e quanto costa un tentativo fallito — ed è misurabile sul tuo traffico, non discutibile da un comunicato stampa.
Entrambi i modelli sono instradabili da OrcaRouter al prezzo di listino del provider con markup dello 0%: GPT-6 Sol a 2,00 $ / 10,00 $ di OpenAI e Claude Opus 5.5 a 4,00 $ / 20,00 $ di Anthropic. Poiché il pass-through è esatto e i prezzi cambiano il giorno stesso in cui li cambiano i fornitori, il rapporto che misuri in staging è il rapporto che paghi in produzione, senza alcun livello di markup da ricalcolare. Una sola chiave copre entrambi, quindi la regola di instradamento che manda le chiamate sotto i 272K a Sol e le chiamate a contesto lungo al modello che vince nei tuoi eval è un cambio di configurazione anziché una seconda integrazione — e il failover automatico significa che un lancio nello stesso giorno da una delle due parti è qualcosa su cui puoi mettere una fetta di traffico anziché una scommessa che fai con un'intera pipeline.

La versione di questo che sopravvive al contatto con un disegno di legge
GPT-6 Sol è il modello più economico su ogni voce, in ogni configurazione, e questo non è in discussione. Ciò che non regge è il presupposto che «metà prezzo» sia il numero su cui pianificare: in una chiamata a contesto lungo le tariffe di input si incontrano a circa 4 $ e il divario sull'output si restringe a un quarto, il che è una decisione diversa da quella descritta dalle pagine di lancio. Metti questo a confronto con un divario di dieci punti nell'indice, diciassette posizioni in classifica e un primo token misurato di 142 secondi, e la suddivisione si scrive da sola per la maggior parte dei carichi di lavoro: Sol come predefinito per grandi volumi su contesti brevi e medi, Claude Opus 5.5 dove il contesto si allunga o il compito è abbastanza difficile che un nuovo tentativo costa più della differenza di token. L'errore da evitare è scegliere uno di questi solo in base alla tariffa principale, perché è il secondo numero su ciascun listino a decidere il caso per cui entrambi i modelli sono stati costruiti.
Confrontati in questo articolo2
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
