Une carte de titre pour 'Claude Fable 5.1 vs GPT-5.6 Sol', sous-titre 'Le nouveau n°1 face à la casse des prix', avec deux cartes arrondies — à gauche 'Claude Fable 5.1' (sorti le 1er septembre 2026, 10,00 $ / 50,00 $ par 1M, indice AA 66) et à droite 'GPT-5.6 Sol' (sorti le 9 juillet 2026, 4,00 $ / 20,00 $ par 1M, indice AA 61) — une bulle VS entre les deux, et le logo OrcaRouter en bas à droite.
Guides & Insights

Claude Fable 5.1 vs GPT-5.6 Sol : Le nouveau n°1 face à la sous-enchère tarifaire

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Prenez n'importe quelle couverture de Claude Fable 5.1 et de GPT-5.6 Sol de la première semaine de septembre et vous rencontrerez la même phrase : le nouveau modèle phare d'Anthropic, sorti le 1er septembre 2026, a battu le GPT-5.6 Sol d'OpenAI sur pratiquement tous les benchmarks qu'Anthropic a exécutés. Cette phrase est vraie, et c'est aussi la partie la moins importante de l'histoire. La partie la plus importante est que GPT-5.6 Sol, le modèle phare d'OpenAI qui est en production depuis le 9 juillet 2026, est environ 2,5 fois moins cher au prix catalogue, utilise, selon les mesures, environ un tiers de tokens en moins pour le même travail, et — selon une analyse de réévaluation d'Epoch AI du 8 septembre — ne paraît que plus attrayant à mesure que vos prompts sont courts. Claude Fable 5.1 est le nouveau n°1 de l'indice indépendant, avec 66 contre 61 pour GPT-5.6 Sol. Que cette avance de cinq points vaille ce qu'elle coûte est tout l'argument de cette page.

Le tableau des scores, et qui a rapporté chaque numéro.

Commençons par le seul chiffre qu'aucun des deux fournisseurs ne contrôle. Sur l'Artificial Analysis Intelligence Index en effort maximal, Claude Fable 5.1 obtient 66 — le score le plus élevé jamais enregistré par AA — contre 61 pour GPT-5.6 Sol, bien que la page du modèle d'AA pour la configuration de repli par défaut qu'Anthropic sert réellement affiche 53, toujours n°1 sur 201. C'est la déclaration indépendante la plus nette de l'affrontement : le fleuron d'Anthropic est le plafond actuel, et l'écart avec celui d'OpenAI est réel mais pas énorme.

En dessous, les benchmarks de composants sont répartis selon qui les a exécutés, et il vaut la peine de garder cela à l'esprit. Anthropic rapporte que Claude Fable 5.1 obtient 52,6 % sur Terminal-Bench-Science 0.1 contre 22,4 % pour GPT-5.6 Sol, 55,8 % sur Terminal-Bench 4.0 contre 37,3 %, 73,4 % sur CursorBench 3.2.0 contre 67,2 %, et 1 853 sur GDPval-AA v2 contre 1 711. OpenAI, de son côté, rapporte que GPT-5.6 Sol atteint environ 96 % sur SWE-bench Verified — un chiffre en ingénierie logicielle supérieur à tout ce qu'Anthropic publie pour Fable 5.1, car Anthropic ne publie pas du tout ce benchmark. Lisez honnêtement la tendance : chaque fournisseur est en tête sur les métriques qu'il choisit de publier, les deux entreprises partagent à peine un benchmark, et les chiffres des composants doivent être considérés comme des indications déclarées par le fournisseur, et non comme des faits comparatifs entre fournisseurs. L'indice et vos propres évaluations sont les seuls signaux comparables.

La fiche technique, côte à côte

• Prix — Claude Fable 5.1 : 10,00 $ / 50,00 $ par 1M, fixe quelle que soit la longueur, vs GPT-5.6 Sol : 4,00 $ / 20,00 $ par 1M pour une entrée jusqu'à 272K, puis l'ensemble de la requête est facturé à 8,00 $ / 30,00 $ (selon l'analyse d'Epoch AI du 8 septembre). Lecture du cache : 0,25 $ vs 0,40 $.

• Contexte / sortie max — Claude Fable 5.1 : 1M en entrée / 128K en sortie. GPT-5.6 Sol : ~1,05M en entrée / 128K en sortie.

• Entrées — les deux acceptent du texte et des images.

• Score indépendant — Claude Fable 5.1 à 66 sur l'AA Intelligence Index (max) vs GPT-5.6 Sol à 61.

• Tokenizer — OpenAI indique que le tokenizer de GPT-5.6 Sol utilise environ 34 % de tokens en moins sur un texte typique, soit une réduction de prix qui n'apparaît jamais sur la grille tarifaire.

• Statut — Claude Fable 5.1 GA 2026-09-01 ; GPT-5.6 Sol GA 2026-07-09 avec un tarif promotionnel d'entrée/sortie en vigueur jusqu'à fin 2026.

A two-column scoreboard titled 'Claude Fable 5.1 vs GPT-5.6 Sol — the scoreboard'. Left column 'Claude Fable 5.1': 'Price $10.00 / $50.00 per 1M flat', 'AA Intelligence Index 66 (max)', 'Terminal-Bench-Science 52.6% (vendor)', 'Terminal-Bench 4.0 55.8% (vendor)', 'Cache read $0.25', 'Released Sep 1, 2026'. Right column 'GPT-5.6 Sol': 'Price $4.00 / $20.00 per 1M (≤272K)', 'AA Intelligence Index 61', 'SWE-bench Verified ~96% (vendor)', 'Tokenizer ~34% fewer tokens', 'Cache read $0.40', 'Released Jul 9, 2026'. Footer: 'AA per Artificial Analysis; component benchmarks vendor-reported, unreproduced. Epoch AI, Sep 8 2026: Sol input reprices past 272K.'Screenshot of the Artificial Analysis model page for Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback), captured September 10, 2026, showing a #1-of-201 ranking, an Intelligence Index of 53 for the default-fallback configuration, pricing of $10.00 per 1M input and $50.00 per 1M output with a 98% cache discount, a cost of $7.63 per Intelligence Index task, and 190M output tokens against a 92M median.

L'écart de prix, l'écart de jetons et la falaise.

L'arithmétique commence au prix catalogue et devient plus intéressante à partir de là. À 4 $ / 20 $ contre 10 $ / 50 $, GPT-5.6 Sol est 2,5 fois moins cher par jeton. Ajoutez l'efficacité de tokenizer rapportée par OpenAI — environ 34 % de jetons en moins sur le même texte — et la même tâche logique coûte nettement moins sur Sol que ce que suggère même le ratio de la grille tarifaire. C'est pourquoi la couverture du lancement d'Anthropic a mis en avant les lectures de cache : le taux de lecture du cache de Claude Fable 5.1, à 0,25 $, est réellement bon marché, et c'est ce qui sauve les longues sessions d'agent en relecture du titre de 10 $ / 50 $. Un contexte de 100 000 jetons relu cinquante fois coûte 1,25 $ sur Claude Fable 5.1 contre 2,00 $ sur GPT-5.6 Sol à son taux de cache de 0,40 $.

Ensuite, il y a le précipice, qui tranche dans l'autre sens. Le palier à 4 $ / 20 $ de GPT-5.6 Sol ne s'applique que jusqu'à 272K jetons d'entrée ; au-delà, l'analyse du 8 septembre d'Epoch AI montre que la requête entière est re-tarifée à 8 $ en entrée / 30 $ en sortie. Claude Fable 5.1 ne présente pas un tel précipice — son tarif de 10 $ / 50 $ est uniforme quelle que soit la longueur, et pour des entrées très longues, ce tarif fixe peut carrément se révéler inférieur au palier re-tarifé de Sol. Pour les équipes dont les invites dépassent régulièrement un quart de million de jetons, l'argument du « modèle OpenAI bon marché » s'effondre ; pour tous les autres, ce sont les avantages de prix et de tokenizer de Sol qui priment.

Ce que les cinq points d'indice achètent

L'écart de cinq points sur l'indice se concentre précisément sur le travail où un modèle qui abandonne tôt coûte toute l'exécution. Les marges annoncées par Anthropic sur Terminal-Bench-Science (52,6 % contre 22,4 %) et AutomationBench sont les plus grandes entre deux modèles phares actuels, et la page des modèles d'Artificial Analysis montre ce que cela coûte en pratique : 7,63 $ de dépenses en modèles et 190 M de jetons de sortie pour exécuter l'indice, contre une médiane de 92 M, parce que le modèle le plus puissant écrit beaucoup plus avant de s'arrêter. Si votre travail est la recherche autonome, les agents à long horizon ou les tâches où une mauvaise décision précoce se cumule, ce surcoût achète le plafond actuel. Si votre travail est l'ingénierie logicielle où GPT-5.6 Sol réussit déjà vos évaluations, les cinq points sont une taxe.

La façon honnête de choisir

Il n'y a pas de vainqueur stable ici, et c'est en prétendant le contraire que les équipes surpayent. La position défendable consiste à traiter Claude Fable 5.1 comme le plafond de capacité et GPT-5.6 Sol comme la référence en matière de valeur, puis à mesurer votre propre charge de travail par rapport aux deux — ce qui est peu coûteux à faire car Claude Fable 5.1 et GPT-5.6 Sol sont tous deux sur OrcaRouter aux prix catalogue de leurs fournisseurs sans aucune marge, derrière un endpoint compatible OpenAI. Acheminez le trafic à long horizon et agentique vers Claude Fable 5.1, conservez le trafic de génie logiciel à fort volume sur GPT-5.6 Sol, et laissez le DSL de routage faire monter ou descendre un modèle dès que vos évaluations — ou les grilles tarifaires — changent. Le tarif promotionnel d'OpenAI expire, les versions mineures d'Anthropic arrivent, et l'avantage du tokenizer se manifeste différemment sur chaque corpus ; les modèles continueront d'échanger leurs places, et la configuration qui sait échanger avec eux vaut plus que l'un ou l'autre fleuron seul.

Screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol), showing $4.00 per 1M input and $20.00 per 1M output, a 1M-token context window (1.05M per the page description) with 128K max output, release date 2026-07-09, and Vision/Tools/JSON/Reasoning capability chips.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement