Gemini 3.8 Flash

google/gemini-3.8-flash
NouveauEn vedette
VisionAudioOutilsJSONRaisonnement
par Google · 2026-09-02

Gemini 3.8 Flash est le modèle Flash le plus intelligent de Google, avec des gains significatifs par rapport à 3.7 Flash dans l'ingénierie logicielle, les tâches agentiques et le raisonnement multi-étapes.

ctx1M tokens
Sortie max65K
Entréetext + image + video + file + audio
Sortietext
p50 TTFT4.53 s
ENTRÉE$0.75/ 1M tokens
SORTIE$3.75/ 1M tokens
p50 TTFT4.53 s7 j
TTFT p9510.00 s7 j
TRAFIC105.8Mtokens / 7 j

Gemini 3.8 Flash est destiné aux équipes qui ont besoin d’un modèle Google avec une entrée multimodale étendue, une longue fenêtre de contexte, une grande limite de sortie et une API compatible…

Qui devrait utiliser Gemini 3.8 Flash ?

Quelles entrées et sorties sont prises en charge ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Tarifs

Entrée / 1M tokens$0.750
Sortie / 1M tokens$3.75
Lecture cache / 1M$0.075
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $16.50 · Avec cache de prompt $14.14

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.001888

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
4.53 s
Vitesse de sortie
282 tok/s
TTFT p95
10.00 s
Taux d'erreur
0.54%

Benchmarks publics

76.3
AA Coding
Meilleur que 95 % des modèles comparés
n°7 sur 137
58.7
AA Intelligence
Meilleur que 92 % des modèles comparés
n°11 sur 139
GPQA Diamond
95.3
HLE-Verified
54.9
Humanity's Last Exam
47.8
Long-Context Recall
81.0
SciCode
53.6
tau_banking
44.9
terminalbench_v2_1
87.6
Source: artificialanalysis.ai, deepmind.google

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News13 mentions · 7 jen hausse de 13 vs la semaine précédente

Comparatif

Gemini 3.8 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Entrée $/M$0.75$2.00$4.00$0.50
Sortie $/M$3.75$12.00$18.00$3.00
Contexte1.0M1.0M1.0M1.0M
Qualité9/1010/1010/109/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte Gemini 3.8 Flash via OrcaRouter ?
OrcaRouter facture Gemini 3.8 Flash au tarif du fournisseur sans aucune majoration : 0,75 $ pour 1 million de jetons d’entrée et 3,75 $ pour 1 million de jetons de sortie. Le catalogue ne répertorie ni frais de session ni frais de plateforme. La sortie étant cinq fois plus chère que l’entrée, les longues générations coûteront proportionnellement plus cher que les longs prompts.
Quelles sont la fenêtre de contexte et la taille maximale de sortie ?
Gemini 3.8 Flash dispose d'une fenêtre de contexte de 1 048 576 jetons et d'une sortie maximale de 65 536 jetons. La fenêtre de contexte est annoncée pour les entrées texte, image, vidéo, fichier et audio. Le fournisseur ne fournit pas de formule distincte de jetons par support dans cette liste.
Quelles sont les principales forces de Gemini 3.8 Flash ?
Ses atouts répertoriés sont un contexte de 1 048 576 jetons, une sortie maximale de 65 536 jetons, une large entrée multimodale et un score de 54,9 sur HLE-Verified. Ces fonctionnalités conviennent au travail de questions de niveau expert, aux tâches sur documents longs et à la compréhension multimédia via une API compatible OpenAI. Aucune autre affirmation de qualité n’est faite dans le catalogue.
Comment Gemini 3.8 Flash se compare-t-il aux autres modèles ?
La fiche du catalogue ne contient ni scores de benchmark ni prix pour quelque modèle alternatif que ce soit. Les comparaisons doivent être effectuées en exécutant des jeux de tests identiques via OrcaRouter et en mesurant la précision, le coût et la vitesse. Utilisez l'ID de modèle google/gemini-3.8-flash avec d'autres ID et comparez les champs réellement renvoyés pour votre charge de travail.
Quels termes de traitement des données s'appliquent ?
Cette page de catalogue n'indique pas les règles de conservation, d'entraînement ou de partage des données. Si vous envoyez des données à Gemini 3.8 Flash via OrcaRouter, le contenu de la requête est traité pour mener à bien la transaction. Les conditions commerciales relatives au traitement des données figurent dans les conditions du fournisseur Google et les conditions d'OrcaRouter. Consultez ces documents avant d'envoyer des données réglementées ou confidentielles.
Comment appeler Gemini 3.8 Flash en utilisant une API compatible OpenAI ?
Utilisez l'URL de base OrcaRouter https://api.orcarouter.ai/v1 et définissez le champ modèle sur google/gemini-3.8-flash. Envoyez ensuite une requête de complétion de chat standard de type OpenAI avec votre clé API OrcaRouter. Les clients existants qui prennent en charge chat.completions.create devraient fonctionner après avoir modifié l'URL de base et le nom du modèle.
OrcaRouter ajoute-t-il une majoration au tarif du fournisseur ?
Non. La fiche du catalogue indique que le modèle est facturé au tarif du fournisseur avec zéro marge. Les prix des jetons d’entrée et de sortie affichés sont de 0,75 $ par million de jetons d’entrée et de 3,75 $ par million de jetons de sortie. Ainsi, le coût par jeton indiqué correspond directement au tarif du fournisseur.
La mise en cache des prompts est-elle disponible pour ce modèle ?
Les caractéristiques du modèle ne mentionnent pas la mise en cache des invites, la tarification des succès de cache ni le comportement automatique du cache. Vous ne devez pas vous fier aux invites mises en cache pour réduire les coûts. L'estimation la plus prudente repose sur la facturation complète des jetons d'entrée à 0,75 $ par million de jetons d'entrée.
Quelles modalités de saisie sont prises en charge ?
Le modèle accepte les entrées texte, image, vidéo, fichier et audio. La sortie peut atteindre jusqu'à 65 536 jetons, et aucune modalité de sortie média n'est documentée. Pour les invites (prompts) image, vidéo, fichier ou audio, testez le format de contenu de votre client, car le schéma média de l'API n'est pas décrit dans le catalogue.

Intégrer ce badge

Google: Gemini 3.8 Flash$0.75/M in4529ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg" alt="Google: Gemini 3.8 Flash sur OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.8 Flash](https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.8-flash)

Fiche du modèle en données

GET /api/public/models/google/gemini-3.8-flashOuvrir
Lisible par machine:/llms.txt/llms-full.txt