
GPT-6.1 Sol vs Gemini 3.1 Pro : sept mois d’aperçu contre huit jours de livraison
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Gemini 3.1 Pro figure sur la liste de prix du fournisseur depuis sept mois et demi et n'a jamais quitté l'aperçu. Annoncé le 19 février 2026, documenté aujourd'hui sur un point de terminaison se terminant par -preview, sans engagement de disponibilité générale et — plus révélateur encore — sans date de mise hors service non plus. GPT-6.1 Sol a huit jours, livré le 29 septembre 2026 à 2,00 $ par million de tokens d'entrée et 10,00 $ par million de tokens de sortie. Placez-les côte à côte sur l'Artificial Analysis Intelligence Index et l'aperçu vieux de sept mois n'est pas simplement compétitif : il se situe à moins de 22 points du modèle plus récent sur la révision la plus récente de l'indice — 29,7 contre 51,8 sur la v4.3.2 — tout en coûtant 1,8× plus par tâche d'indice, 1,30 $ contre 0,72 $. C'est cette combinaison qui rend cette comparaison intéressante et non formelle : sur ce tableau, le modèle plus ancien est à la fois en retrait sur la capacité et en avance sur le coût, ce qui va dans le mauvais sens pour un aperçu censé passer en version définitive. Mais la mise en garde sur la révision de l'indice compte ici plus que partout ailleurs dans cet ensemble, car un 29,7 et un 53 sont tous deux cités sur le même site et ce ne sont pas les mêmes mesures.
Les deux sont de grands modèles multimodaux dotés de fenêtres de contexte de classe 1 M. Gemini 3.1 Pro accepte le texte, les images, la vidéo, l'audio et les PDF, avec un plafond de sortie de 65 536 tokens et un palier tarifaire de 200 000 tokens au-delà duquel le tarif double. GPT-6.1 Sol accepte le texte, les images et les fichiers avec une fenêtre de 1 050 000 tokens, un plafond de sortie de 128 000 tokens, cinq niveaux d'effort de raisonnement et un palier de contexte long au-delà de 272 000 tokens de prompt. L'un est un produit commercialisé assorti d'un engagement d'assistance. L'autre est une préversion au cycle de vie indéterminé, et cette différence s'avère valoir plus que l'écart d'indice.
Le numéro d’index doit être accompagné de sa révision.
Artificial Analysis relance sa suite et republie les scores selon la révision actuelle de l’indice, ce qui signifie qu’un même modèle peut porter deux nombres différents selon le moment où on le consulte. Pour Gemini 3.1 Pro, cet écart est inhabituellement large : la précédente couverture de ce modèle par la rédaction indiquait 57 sur une ancienne révision, tandis que la page telle qu’elle est aujourd’hui indique 29,7 sur la v4.3.2, la version à dix évaluations qui affiche aussi le 51,8 de GPT-6.1 Sol. Les deux chiffres sont réels et figurent tous deux sur le même site web.
Ce que cela implique pour une comparaison est limité et important. Seuls des chiffres issus de la même révision peuvent être soustraits. Un 29,7 et un 51,8 issus de la v4.3.2 produisent un écart de 22 points ; un 57 et un 51,8 produisent un écart de cinq points dans l'autre sens. C'est le chiffre de 22 points qu'il faut utiliser ici, car c'est celui pour lequel les deux modèles ont été mesurés par la même suite sur la même échelle — et parce que les chiffres de coût par tâche, 1,30 $ contre 0,72 $, proviennent de cette même exécution.
• Indice d’intelligence, v4.3.2 — GPT-6.1 Sol 51,8 contre Gemini 3.1 Pro 29,7
• Coût par tâche d'indexation — GPT-6.1 Sol 0,72 $ vs Gemini 3.1 Pro 1,30 $
• Coût d'exécution de la suite complète — GPT-6.1 Sol 1 082 $ vs Gemini 3.1 Pro 1 935 $
• Fenêtre de contexte — GPT-6.1 Sol 1 050 000 jetons vs Gemini 3.1 Pro 1 000 000 jetons
• Sortie maximale — GPT-6.1 Sol 128 000 jetons contre Gemini 3.1 Pro 65 536 jetons
• Modalités d’entrée — texte, image et fichier sur les deux, ainsi que vidéo, audio et PDF sur Gemini 3.1 Pro
Deux de ces lignes favorisent la preview et méritent d’être énoncées sans détour. Gemini 3.1 Pro accepte la vidéo et l’audio, ce que GPT-6.1 Sol ne fait pas ; si votre pipeline ingère un enregistrement d’écran ou un appel, c’est un écart de capacités qu’aucun score ne comble. Et son plafond de sortie de 65 536 tokens est la moitié de celui de GPT-6.1 Sol, ce qui compte pour la génération de contenu long, mais contraint rarement le travail agentique, où les sorties sont courtes et les tours nombreux.
Pourquoi c'est le nombre le plus récent qui devrait faire pencher votre décision
La question du prix est plus intéressante que la question de l’indice.
La grille tarifaire de Gemini 3.1 Pro est de 2,00 $ en entrée et 12,00 $ en sortie par million de tokens, avec l'entrée mise en cache à 0,20 $ et les écritures dans le cache à 0,375 $, et un seuil de palier à 200 000 tokens de prompt au-delà duquel les tarifs passent à 4,00 $ et 18,00 $. GPT-6.1 Sol est à 2,00 $ en entrée et 10,00 $ en sortie, avec l'entrée mise en cache à 0,10 $, les écritures dans le cache à 2,50 $, et un seuil à 272 000 tokens au-delà duquel ses tarifs passent à 4,00 $ et 15,00 $. Le prix d'entrée affiché est identique. Le prix de sortie est inférieur de 20 % sur GPT-6.1 Sol, et le palier de contexte long est plus bas sur les deux axes. Là où les deux grilles se distinguent, c'est sur la mise en cache : 0,10 $ contre 0,20 $ par million de tokens d'entrée mis en cache, avec l'écriture du cache moins chère pour le modèle preview, à 0,375 $ contre 2,50 $.

Cette dernière paire inverse la lecture naïve. Si votre charge de travail est gourmande en cache — un long prompt système fixe renvoyé à chaque tour, ou un document relu tout au long d'une session — la ligne d'écriture de cache de Gemini 3.1 Pro est nettement moins chère et sa ligne de lecture de cache est deux fois plus élevée. Quel modèle gagne dépend du nombre de fois que vous relisez ce que vous avez écrit, et c'est un chiffre que vos propres journaux contiennent et qu'aucun benchmark ne publie. Ce qui n'est pas ambigu, c'est le coût de l'indice : sur un travail d'évaluation identique, le modèle vieux de huit jours a coûté 33 % de moins, et l'aperçu vieux de sept mois a coûté 79 % de plus que le modèle plus récent dans l'ensemble.
Le badge d'aperçu est le fait opérationnel
Voici la partie de la comparaison qu'un tableau de scores ne peut pas restituer et qui, pour un déploiement en production, prime sur tout ce qui précède.
Gemini 3.1 Pro est en aperçu depuis février, sans annonce de disponibilité générale ni date d'arrêt. Ces deux absences comptent et elles tirent dans des directions opposées. L'absence de disponibilité générale signifie qu'il n'y a aucun engagement de cycle de vie : les points de terminaison en aperçu ne sont pas couverts par les mêmes conditions de préavis de dépréciation que ceux en disponibilité générale, et peuvent être révisés sans prévenir l'appelant et sans changement de version, ce qui constitue la raison standard d'épingler un identifiant de modèle exact en production plutôt qu'un alias. L'absence de date d'arrêt signifie que vous ne pouvez pas non plus planifier de fenêtre de migration — le modèle a déjà dépassé le trimestre au cours duquel tout le monde s'attendait à ce qu'il passe en disponibilité générale, et cette famille a déjà mis hors service un modèle Pro par le passé.
La position de GPT-6.1 Sol est l’image miroir. Il n’a que huit jours, ce qui signifie que son bilan d’évaluation indépendante ne porte que sur une seule configuration et que ses modes de défaillance ne sont pas documentés ; il n’existe aucun corpus de praticiens à consulter lorsqu’il dysfonctionne. Sa sortie était en soi l’événement, et il est livré avec une structure de support dont ne dispose pas la version d’aperçu.
Ce sont des risques différents, pas des degrés de risque différents. Choisissez l'aperçu et vous pariez que le fournisseur continuera de servir un point de terminaison sans aucune obligation contractuelle de le faire. Choisissez le modèle vieux de huit jours et vous pariez qu'une seule exécution de benchmark et huit jours de disponibilité suffisent comme preuve pour votre charge de travail. L'index ne vous aidera dans aucun des deux cas.
La seule chose qui rendrait cela facile
Une annonce de disponibilité générale pour Gemini 3.1 Pro, avec un identifiant de modèle hors de l’espace de noms -preview et un engagement de cycle de vie publié, résoudrait la majeure partie de ce problème. Cela ne comblerait pas l’écart de 22 points d’indice ni l’écart de coût par tâche de 1,8×, mais cela supprimerait le risque de dépréciation qui rend actuellement la comparaison déséquilibrée, et cela permettrait à une équipe d’adopter le modèle sans épingler un identifiant de préversion et en espérant.
L'absence de cette annonce, au bout de sept mois et demi, est en soi une information. Une préversion censée valider les mises à jour avant le passage en GA « bientôt », selon la formulation du fournisseur en février, a disposé de deux trimestres pleins pour ce faire. Soit la validation est en cours, soit la préversion est le produit — et un appelant ne peut pas savoir de l'extérieur laquelle des deux. Ce qu'un appelant peut faire, c'est chiffrer l'incertitude et router en conséquence.
Les deux sur une même clé, de sorte que la réponse peut être par charge de travail.

Gemini 3.1 Pro est disponible sur OrcaRouter à ses tarifs affichés — 2,00 $ / 12,00 $, passant à 4,00 $ / 18,00 $ au-delà de 200 000 jetons de prompt, avec lectures de cache à 0,20 $. GPT-6.1 Sol est sur OrcaRouter à 2,00 $ / 10,00 $, passant à 4,00 $ / 15,00 $ au-delà de 272 000 jetons de prompt, avec lectures de cache à 0,10 $. Au prix catalogue du fournisseur dans les deux cas, rien ajouté, une seule clé et une seule facture.
Cela rend peu coûteuse la résolution des aspects délicats de cette comparaison. L’ingestion vidéo et audio reste sur la preview parce que rien d’autre dans la paire ne l’accepte ; le travail de texte et de codage à fort volume va au modèle plus récent, qui est moins cher par tâche et 33 % moins cher sur un travail d’évaluation identique. Si le point de terminaison de la preview est révisé ou retiré, le basculement automatique déplace ces appels vers une autre route plutôt que de les laisser échouer — ce qui est la couverture spécifique qu’appelle le risque de cycle de vie d’une preview. Et comme les deux se trouvent derrière un seul point de terminaison compatible OpenAI, la comparaison de prix qui compte vraiment peut être réalisée sur votre propre trafic en un après-midi au lieu d’être débattue à partir d’une grille tarifaire.

La lecture défendable, dès lors, n’est pas de savoir quel modèle est meilleur. Elle est que ces deux modèles sont facturés comme quasi équivalents alors qu’ils sont séparés par sept mois de maturité de cycle de vie et par 22 points d’écart sur le classement indépendant actuel, et que les avantages réels du modèle en preview — entrée vidéo et audio, écritures de cache bon marché — sont étroits et spécifiques. Si votre charge de travail nécessite ces modalités, Gemini 3.1 Pro est la seule option des deux et l’écart d’indice est le prix d’entrée. Si ce n’est pas le cas, on vous propose un endpoint en preview à l’avenir ouvert, à un coût par tâche supérieur de 80 % à celui d’un modèle sorti la semaine dernière, et la charge de la preuve s’inverse.
