Carte de titre principale portant « GPT-6 Sol Pro vs Gemini 3.1 Pro Preview » avec le sous-titre « Sept mois d’aperçu, et ce que cela coûte », avec le véritable logo OrcaRouter en bas à droite.
Guides & Insights

GPT-6 Sol Pro vs Gemini 3.1 Pro Preview : sept mois de preview, et ce que cela vous coûte

Auteur

Alistair Wren

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Gemini 3.1 Pro Preview est en préversion depuis sept mois. L'éditeur l'a publié le 19 février 2026 à 2,00 $ par million de jetons d'entrée et 12,00 $ par million de jetons de sortie, et depuis cette semaine, la fiche du modèle le décrit toujours comme « proposé sous forme de préversion », avertit qu'il « peut présenter des limitations de stabilité ou de disponibilité par rapport aux versions stables » et indique qu'il « pourrait faire l'objet de modifications ou d'un retrait sans préavis ». Il n'y a ni date de disponibilité générale ni date d'arrêt dans le tableau des dépréciations. GPT-6 Sol Pro — la configuration de GPT-6 Sol, le modèle devenu généralement disponible le 22 septembre 2026 à 2,00 $ en entrée et 10,00 $ en sortie — est la configuration inverse : une API de production avec une tarification publiée, un curseur d'effort documenté et un éditeur qui s'est engagé sur le chiffre.

La comparaison intéressante entre ces deux modèles n'est pas le tableau de benchmarks. C'est ce que chaque fournisseur vous a promis pour le prochain trimestre.

Deux lignes de prix, dont l'une est un aperçu

Les deux sont des listes de fournisseurs. Les propres chiffres de Google et d’OpenAI, transmis sans modification par les plateformes qui les hébergent.

• Entrée — GPT-6 Sol 2,00 $ par million de tokens vs Gemini 3.1 Pro Preview 2,00 $ par million de tokens

• Sortie — GPT-6 Sol 10,00 $ par million de tokens vs Gemini 3.1 Pro Preview 12,00 $ par million de tokens

• Contexte long — Gemini 3.1 Pro Preview facture l'entrée à 4,00 $ et la sortie à 18,00 $ par million de tokens au-delà d'un seuil de 200 000 tokens ; GPT-6 Sol applique son propre ajustement tarifaire pour contexte long au-delà d'un seuil d'entrée plus élevé

• Lecture du cache — GPT-6 Sol 0,20 $ par million de jetons vs Gemini 3.1 Pro Preview 0,20 $ par million de jetons

• Fenêtre de contexte — GPT-6 Sol 1 050 000 jetons vs Gemini 3.1 Pro Preview 1 000 000 jetons

• Sortie maximale — GPT-6 Sol 128 000 tokens vs Gemini 3.1 Pro Preview 65 000 tokens

• Modalités d’entrée — texte et image de GPT-6 Sol vs texte, image, audio, vidéo et fichier de Gemini 3.1 Pro Preview

• Statut de disponibilité — GPT-6 Sol en disponibilité générale depuis le 22 septembre 2026, tandis que Gemini 3.1 Pro Preview est en aperçu depuis le 19 février 2026, sans date de disponibilité générale annoncée

Les tarifs affichés sont suffisamment proches pour ne pas être le critère de décision. L’entrée est identique. La sortie diffère de 20 %. Les vraies différences sont celles des deux dernières lignes : Gemini prend en charge quatre modalités d’entrée de plus, et, dans l’autre sens, le plafond de sortie est deux fois plus élevé — 65 000 jetons contre 128 000 —, et Gemini est proposé en version préliminaire depuis bientôt un an.

A two-column scoreboard card titled 'GPT-6 Sol vs Gemini 3.1 Pro Preview - the scoreboard'. Left column 'GPT-6 Sol': AA Index, current 48; index at Feb 2026 not scored; price in/out $2 / $10; cost per index task $1.06; max output 128K; input modalities text + image. Right column 'Gemini 3.1 Pro Preview': AA Index, current 30; index at Feb 2026 57, retired index; price in/out $2 / $12; cost per index task $0.67; max output 65K; input modalities text, image, audio, video. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

Le statut d'aperçu est une véritable propriété opérationnelle

Le texte du catalogue de Google lui-même invite les développeurs à anticiper la dépréciation des previews. Cette phrase porte beaucoup de poids, et il vaut la peine de la lire comme une contrainte d'ingénierie plutôt que comme un simple avertissement.

Un modèle d’aperçu est un modèle sur lequel vous pouvez vous appuyer, mais autour duquel vous ne pouvez pas planifier. Trois conséquences en découlent, et aucune n’apparaît dans un tableau de prix.

• Aucun engagement de stabilité. La fiche indique clairement que le modèle peut présenter des limitations de stabilité par rapport aux versions stables, et que OrcaRouter ne fournit aucune garantie de latence spécifique pour ce modèle en aperçu. Nos propres données de télémétrie sur la page du modèle indiquent un temps jusqu'au premier token p50 et p95 tous deux à 10,00 secondes sur la semaine écoulée, ce qui correspond au haut de la plage affichée plutôt qu'à une médiane mesurée.

• Aucune date de dépréciation. Un modèle avec une date d’arrêt peut être planifié pour sortir d’une feuille de route. Un modèle sans date de disponibilité générale ni date d’arrêt ne peut pas être planifié du tout, dans un sens comme dans l’autre — vous ne savez pas quand il deviendra sûr d’en dépendre, et vous ne savez pas quand il cessera de fonctionner.

• Aucune position sur la feuille de route. Google a livré de nouveaux modèles Flash de la même famille qui surpassent désormais Gemini 3.1 Pro sur des composites indépendants, notamment Gemini 3.8 Flash le 2 septembre 2026. La génération 3.5 Pro a été retardée et aurait été mise de côté. Il n'existe pas de Gemini 3.8 Pro. Le modèle qui porte le nom Pro n'est plus le modèle affichant le meilleur score de son fournisseur, et il s'agit toujours d'une version préliminaire.

Voilà la formulation honnête pour quiconque doit choisir entre ces deux. GPT-6 Sol a six jours et un prix fixe, publié et permanent. Gemini 3.1 Pro Preview a sept mois et dispose d’une ligne de statut au lieu d’une feuille de route.

Ce que montre le dossier indépendant, et pourquoi l’étiquette de version constitue tout l’argument

Artificial Analysis publie une page de comparaison directe pour exactement ce couple sur l’indice actuel, ce qui en fait l’une des rares confrontations de cette série où les chiffres neutres sont véritablement comparables à périmètre constant. GPT-6 Sol à effort maximal obtient un score de 48 à 1,06 $ par tâche d’indice. Gemini 3.1 Pro Preview obtient un score de 30 à 0,67 $ par tâche d’indice.

Un écart de dix-huit points est considérable, et ce n'est pas l'écart que le modèle présentait en février. Lors de son lancement, Artificial Analysis a placé Gemini 3.1 Pro Preview en tête de son Intelligence Index avec 57. Le modèle n'a pas changé depuis. L'indice, lui, a changé — il a été réévalué le 19 septembre 2026, et le même modèle inchangé affiche désormais 30. Les deux chiffres proviennent d'Artificial Analysis ; ni l'un ni l'autre n'est faux ; les mettre côte à côte sans la version est l'erreur la plus courante dans la couverture de ce modèle, et c'est pourquoi tant de pages de comparaison décrivent un leader de février comme un égal de septembre.

Le coût par tâche raconte une autre histoire qui mérite qu’on fasse le calcul. Gemini est moins cher par tâche — 0,67 $ contre 1,06 $ — mais il obtient un score inférieur. Le coût par point d’indice ressort à 0,022 $ pour GPT-6 Sol et à 0,022 $ pour Gemini. Sur ce critère, les deux sont à égalité parfaite, ce qui est la façon la plus limpide de dire ce qui se passe réellement ici : Gemini n’est pas un moyen moins cher d’acheter la même intelligence, c’est un moyen moins cher d’en acheter moins.

Deux autres chiffres indépendants doivent figurer à côté de ceux-là, tous deux étiquetés. Sur OSWorld-Verified, le benchmark d'utilisation d'ordinateur, la propre page d'évaluation de Google annonce 76,2 % pour Gemini 3.1 Pro. Ce chiffre apparaît dans les supports de Google et dans des résumés tiers de ceux-ci, et il ne figure pas sur le tableau OSWorld vérifié de manière indépendante, lequel recense d'autres modèles Gemini — 3.6 Flash à 83 %, 3.5 Flash à 78,4 % — et aucune ligne 3.1 Pro. Sur le tableau OSWorld 2.0, plus difficile, le modèle obtient 30,6 %. Et sur GDPval-AA, le modèle se situe à environ 1 316 Elo, derrière Claude Sonnet 4.6 et Claude Opus 4.6.

Ce n'est pas une accusation de mauvaise foi ; les chiffres autodéclarés sont normaux et les deux fournisseurs les publient. C'est une observation sur ce que vous apporte réellement un aperçu vieux de sept mois : assez de temps pour qu'un chiffre rapporté par un fournisseur circule largement, et pas assez de réplications indépendantes pour que ce chiffre soit vérifié. Le bilan neutre de GPT-6 Sol, en revanche, est court, sans ambiguïté et vieux de six jours.

Une lacune de connaissances de quinze mois dont personne ne parle

La date d'arrêt des connaissances de Gemini 3.1 Pro Preview est janvier 2025. Celle de GPT-6 Sol est le 20 avril 2026 — quinze mois plus tard.

Cette lacune est absente de toutes les pages de comparaison de ce face-à-face, et elle compte davantage que l’écart de prix de sortie pour une catégorie de tâches précise : tout ce qui implique des API récentes, des versions récentes de bibliothèques, des événements récents ou des faits organisationnels récents. Un modèle dont la date de coupure est janvier 2025 répondra avec assurance au sujet d’un monde qui a évolué d’un an et un trimestre, et le mode de défaillance n’est pas un message d’erreur — c’est une mauvaise réponse plausible. Pour les travaux assistés par récupération, la date de coupure est presque sans importance, car le contexte porte les faits. Pour tout ce qui s’appuie sur des connaissances paramétriques, c’est la première contrainte à vérifier et la dernière que quiconque vérifie.

Screenshot of the Artificial Analysis model page for GPT-6 Sol, captured 23 September 2026, showing an Artificial Analysis Intelligence Index of 48 at maximum reasoning effort and 43 at high effort, a cost per index task of $1.06 and $0.37, a 1.05M-token context window, a 128k-token maximum output, and blended list pricing of $2.00 per million input tokens and $10.00 per million output tokens.

L'écart de modalité est l'argument le plus fort en faveur de Gemini, et il est bien réel.

Il serait facile de présenter cette confrontation comme une victoire sans appel du modèle le plus récent. Ce n’est pas le cas, et la raison en est la ligne d’entrée.

Gemini 3.1 Pro Preview accepte nativement les entrées texte, image, audio, vidéo et fichier sur le même point de terminaison. GPT-6 Sol accepte le texte et l'image. Pour une charge de travail construite autour de la compréhension vidéo, de la transcription de réunions ou du traitement de documents qui couvrent plusieurs formats, ce n'est pas une différence de fonctionnalité — c'est la différence entre un seul appel API et un pipeline de trois, avec les étapes intermédiaires facturées séparément et les modes de défaillance multipliés.

La réserve honnête qui y est attachée : un modèle en préversion affichant un taux d’erreur de 77,6 % sur sa page de modèle hébergé est un modèle en préversion dont l’avantage multimodal doit être mis en balance avec le fait qu’il répondra ou non. Ce chiffre est tel qu’affiché sur la page, et il est suffisamment élevé pour justifier une vérification avant que quiconque ne s’appuie dessus — ce qui est précisément le propos. Au bout de sept mois, le conseil honnête concernant ce modèle reste « mesurez-le vous-même », et c’est une phrase que personne n’écrit à propos d’une version GA.

Là où une couche de routage change l'arithmétique

Gemini 3.1 Pro Preview figure au catalogue d'OrcaRouter à 2,00 $ en entrée, 12,00 $ en sortie et 0,20 $ pour la lecture de cache par million de jetons, avec une fenêtre de contexte de 1 000 000 de jetons, un plafond de sortie de 65 000 jetons, les points de terminaison /v1/chat/completions et /v1beta/models/{model}:generateContent, et un temps jusqu'au premier jeton (p50) de 10,00 secondes, tel que mesuré sur notre propre page de modèle au cours de la semaine écoulée. Les tarifs catalogue du fournisseur sont répercutés sans marge ajoutée.

GPT-6 Sol ne fait pas partie de nos itinéraires, donc rien ici ne constitue une affirmation sur son prix via nous.

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview), captured 23 September 2026, showing Vision, Audio, Tools, JSON and Reasoning header badges, 'by Google — 2026-02-19', a 65K-token maximum output, an input price of $2.00 and an output price of $12.00 per million tokens, a p50 time to first token of 10.00 seconds, and both the /v1/chat/completions and /v1beta/models/{model}:generateContent endpoints.

Un modèle en preview est le cas d'école du routage plutôt que de l'engagement ferme. La raison d'essayer Gemini 3.1 Pro Preview et la raison de ne pas bâtir un chemin de production dessus sont une seule et même propriété — il peut changer sans préavis — et un point de terminaison unique doté du basculement automatique est le moyen de saisir la première sans accepter la seconde. La forme de la requête ne change pas lorsque le modèle qui la sous-tend change, de sorte que le chemin de repli est une entrée de configuration plutôt qu'une migration. Cela compte davantage ici que dans la plupart des confrontations, car le modèle le plus susceptible de remplacer celui-ci dans une chaîne de repli est un Flash plus récent du même fournisseur, sur la même clé, pour une fraction du tarif de sortie.

La règle de décision

• Entrée vidéo, audio ou en format mixte en un seul appel — Gemini 3.1 Pro Preview. Rien dans la colonne GPT-6 Sol n'accepte un fichier vidéo, et aucune différence de prix ne compense un pipeline d'ingestion que vous devez construire.

• Tout ce qui est assorti d’un engagement de disponibilité — GPT-6 Sol. Six jours d’existence, en disponibilité générale, un prix publié décrit comme permanent et un curseur d’effort documenté. Voilà à quoi ressemble « planifiable ».

• Générations longues — GPT-6 Sol, sur le plafond de sortie plutôt que sur le tarif. 128 000 tokens contre 65 000, c’est la contrainte qui se fait sentir en premier dans le travail de synthèse, et elle se fait sentir avant la différence de 20 % sur le prix de sortie.

• Évaluer Gemini 3.1 Pro Preview — faites-le derrière un chemin de basculement, et mesurez vous-même le taux d’erreur avant de dimensionner la charge de travail. Sept mois d’aperçu avec un taux d’erreur affiché de 77,6 % sur la page hébergée ne constituent pas un instrument stabilisé.

• Si votre plan repose sur le fait que ce modèle sera bon marché au prochain trimestre — ni l’un ni l’autre. L’aperçu de Gemini peut voir son prix modifié ou être retiré sans préavis, et le prix de GPT-6 Sol n’est permanent que dans la mesure où OpenAI l’a affirmé cette semaine. Un tarif forfaitaire est un engagement, pas une garantie ; c’est simplement un engagement plus fort que celui d’un encart d’aperçu.

Comparés dans cet article2

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement