Gemini 3.5 Flash

google/gemini-3.5-flash
VisionAudioOutilsJSONRaisonnement
par google · 2026-05-23

Google Gemini 3.5 Flash — le modèle Flash le plus puissant de Google, se situant juste en dessous de 3.1-pro-preview en termes d'intelligence (AA Intel 55.3 vs 57.2) avec la latence Flash. Fenêtre de contexte de 1M tokens (1,048,576), sortie maximale de 64K (65,536). Entrée multimodale complète sur texte, image, audio, vidéo et fichier ; sortie texte uniquement. AA Coding 45, GPQA Diamond 92.2%, IFBench 76.3% (suivi d'instructions de premier ordre), Long-Context Recall 69.3%, SciCode 53.1%, τ²-Bench 95.3% (utilisation d'outils agentique), HLE 41%. Prend en charge le raisonnement (include_reasoning / reasoning), les sorties structurées, les appels d'outils, response_format, seed, stop et les contrôles d'échantillonnage standard. Points d'accès : chat_completions, gemini_generate. Meilleure utilisation : boucles agentiques à volume élevé, analyse de longs documents et extraction multimodale où la latence ou le coût de niveau Pro est excessif.

ctx1.05M tokens
Sortie max65.5K
Entréetext + image + video + file + audio
Sortietext
p50 TTFT864 ms
ENTRÉE$1.50/ 1M tokens
SORTIE$9.00/ 1M tokens
p50 TTFT864 ms7 j
TTFT p953.55 s7 j
TRAFIC4.4Mtokens / 7 j

Gemini 3.5 Flash est un grand modèle de langage développé par Google, optimisé pour la rapidité et l'efficacité. Il appartient à la famille Gemini et est conçu pour traiter des entrées multimodales —…

Qu'est-ce que Gemini 3.5 Flash ?

Qui devrait utiliser Gemini 3.5 Flash ?

Quelles modalités d’entrée Gemini 3.5 Flash prend-il en charge ?

Comment accède-t-on à Gemini 3.5 Flash via OrcaRouter ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Tarifs

Entrée / 1M tokens$1.50
Sortie / 1M tokens$9.00
Lecture cache / 1M$0.150
Écriture cache / 1M$0.083
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $37.50 · Avec cache de prompt $32.78

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.004526

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
864 ms
Vitesse de sortie
218 tok/s
TTFT p95
3.55 s
Taux d'erreur
1.7%

Benchmarks publics

49.0
AA Coding
Meilleur que 68 % des modèles comparés
n°34 sur 106
47.0
AA Intelligence
Meilleur que 58 % des modèles comparés
n°46 sur 110
51.0
AA Math
Meilleur que 27 % des modèles comparés
n°59 sur 81
GPQA Diamond
45.0 index
MMLU-Pro
59.0 index
τ²-Bench
42.0 index
Source: artificialanalysis.ai

Comparatif

Gemini 3.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Entrée $/M$1.50$2.00$4.00$0.50
Sortie $/M$9.00$12.00$18.00$3.00
Contexte1.0M1.0M1.0M1.0M
Qualité9/1010/1010/109/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte Gemini 3.5 Flash sur OrcaRouter ?
Les tokens d'entrée sont à 1,50 $ pour 1 million de tokens ; les tokens de sortie sont à 9,00 $ pour 1 million de tokens. OrcaRouter facture au tarif du fournisseur sans marge bénéficiaire. Il n'y a pas de frais supplémentaires.
Quelle est la taille de la fenêtre de contexte de Gemini 3.5 Flash ?
Il prend en charge une fenêtre de contexte de 1 048 576 tokens (environ 1 million de tokens). Cela inclut à la fois les tokens d'entrée et de sortie combinés.
Quelles sont les principales forces de Gemini 3.5 Flash ?
Il est optimisé pour une faible latence, un débit élevé et une rentabilité. Il prend en charge les entrées multimodales (texte, image, vidéo, fichier, audio) et une grande fenêtre de contexte, ce qui le rend idéal pour les applications en temps réel et le traitement de longs documents.
Comment Gemini 3.5 Flash se compare-t-il à Gemini 3.5 Pro ?
Flash est plus rapide et moins cher mais offre des performances de benchmark inférieures sur les tâches de raisonnement complexe et mathématiques. Pro est plus précis mais plus lent et plus cher. Flash est meilleur pour les applications à volume élevé et sensibles à la latence.
Comment les données sont-elles traitées lors de l'utilisation de Gemini 3.5 Flash via OrcaRouter ?
OrcaRouter agit comme un proxy et ne stocke pas vos données. Cependant, les politiques de traitement des données de Google s'appliquent au modèle sous-jacent. OrcaRouter recommande de consulter les conditions de Google concernant la conservation des données et la confidentialité.
Comment appeler Gemini 3.5 Flash via une API compatible OpenAI ?
Utilisez l'URL de base https://api.orcarouter.ai/v1, l'ID du modèle "google/gemini-3.5-flash", et transmettez une clé API OrcaRouter dans l'en-tête Authorization. L'API prend en charge les complétions de chat standard et le streaming.
Quelle longueur de sortie Gemini 3.5 Flash peut-il générer ?
Il peut générer jusqu'à 65 536 jetons par réponse. C'est considérablement plus que de nombreux modèles, permettant du contenu de longue forme, du code ou un raisonnement étendu.
Y a-t-il une réduction pour les jetons répétés ou mis en cache ?
D'après les faits fournis, OrcaRouter n'offre pas de mise en cache ni de remises sur le volume. Chaque jeton est facturé au tarif standard, indépendamment de la réutilisation.

Intégrer ce badge

Gemini 3.5 Flash$1.50/M in864ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg" alt="Gemini 3.5 Flash sur OrcaRouter" /> </a>
Markdown [![Gemini 3.5 Flash](https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.5-flash)

Fiche du modèle en données

GET /api/public/models/google/gemini-3.5-flashOuvrir
Lisible par machine:/llms.txt/llms-full.txt