Gemini 3.5 Flash

google/gemini-3.5-flash
VisionAudioOutilsJSONRaisonnement
par google · 2026-05-23

Google Gemini 3.5 Flash — le modèle Flash le plus puissant de Google, se situant juste en dessous de 3.1-pro-preview en termes d'intelligence (AA Intel 55.3 vs 57.2) avec la latence Flash. Fenêtre de contexte de 1M tokens (1,048,576), sortie maximale de 64K (65,536). Entrée multimodale complète sur texte, image, audio, vidéo et fichier ; sortie texte uniquement. AA Coding 45, GPQA Diamond 92.2%, IFBench 76.3% (suivi d'instructions de premier ordre), Long-Context Recall 69.3%, SciCode 53.1%, τ²-Bench 95.3% (utilisation d'outils agentique), HLE 41%. Prend en charge le raisonnement (include_reasoning / reasoning), les sorties structurées, les appels d'outils, response_format, seed, stop et les contrôles d'échantillonnage standard. Points d'accès : chat_completions, gemini_generate. Meilleure utilisation : boucles agentiques à volume élevé, analyse de longs documents et extraction multimodale où la latence ou le coût de niveau Pro est excessif.

ctx1M tokens
Sortie max65K
Entréetext + image + video + file + audio
Sortietext
p50 TTFT4.10 s
ENTRÉE$1.50/ 1M tokens
SORTIE$9.00/ 1M tokens
p50 TTFT4.10 s7 j
TTFT p9510.00 s7 j
TRAFIC33.4Mtokens / 7 j

Gemini 3.5 Flash est un grand modèle de langage développé par Google, optimisé pour la rapidité et l'efficacité. Il appartient à la famille Gemini et est conçu pour traiter des entrées multimodales —…

Qu'est-ce que Gemini 3.5 Flash ?

Qui devrait utiliser Gemini 3.5 Flash ?

Quelles modalités d’entrée Gemini 3.5 Flash prend-il en charge ?

Comment accède-t-on à Gemini 3.5 Flash via OrcaRouter ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Tarifs

Entrée / 1M tokens$1.50
Sortie / 1M tokens$9.00
Lecture cache / 1M$0.150
Écriture cache / 1M$0.083
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $37.50 · Avec cache de prompt $32.78

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.004526

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
4.10 s
Vitesse de sortie
362 tok/s
TTFT p95
10.00 s
Taux d'erreur
0.08%

Benchmarks publics

70.1
AA Coding
Meilleur que 84 % des modèles comparés
n°21 sur 133
52.0
AA Intelligence
Meilleur que 77 % des modèles comparés
n°29 sur 135
51.0
AA Math
Meilleur que 27 % des modèles comparés
n°60 sur 82
GPQA Diamond
92.2
Humanity's Last Exam
42.7
IFBench
76.3
Long-Context Recall
81.0
MMLU-Pro
59.0 index
SciCode
53.1
tau_banking
32.2
TerminalBench Hard
40.9
terminalbench_v2_1
78.7
τ²-Bench
95.3
Source: artificialanalysis.ai

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News0 mentions · 7 j

Comparatif

Gemini 3.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Entrée $/M$1.50$2.00$4.00$0.50
Sortie $/M$9.00$12.00$18.00$3.00
Contexte1.0M1.0M1.0M1.0M
Qualité9/1010/1010/109/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte Gemini 3.5 Flash sur OrcaRouter ?
Les tokens d'entrée sont à 1,50 $ pour 1 million de tokens ; les tokens de sortie sont à 9,00 $ pour 1 million de tokens. OrcaRouter facture au tarif du fournisseur sans marge bénéficiaire. Il n'y a pas de frais supplémentaires.
Quelle est la taille de la fenêtre de contexte de Gemini 3.5 Flash ?
Il prend en charge une fenêtre de contexte de 1 048 576 tokens (environ 1 million de tokens). Cela inclut à la fois les tokens d'entrée et de sortie combinés.
Quelles sont les principales forces de Gemini 3.5 Flash ?
Il est optimisé pour une faible latence, un débit élevé et une rentabilité. Il prend en charge les entrées multimodales (texte, image, vidéo, fichier, audio) et une grande fenêtre de contexte, ce qui le rend idéal pour les applications en temps réel et le traitement de longs documents.
Comment Gemini 3.5 Flash se compare-t-il à Gemini 3.5 Pro ?
Flash est plus rapide et moins cher mais offre des performances de benchmark inférieures sur les tâches de raisonnement complexe et mathématiques. Pro est plus précis mais plus lent et plus cher. Flash est meilleur pour les applications à volume élevé et sensibles à la latence.
Comment les données sont-elles traitées lors de l'utilisation de Gemini 3.5 Flash via OrcaRouter ?
OrcaRouter agit comme un proxy et ne stocke pas vos données. Cependant, les politiques de traitement des données de Google s'appliquent au modèle sous-jacent. OrcaRouter recommande de consulter les conditions de Google concernant la conservation des données et la confidentialité.
Comment appeler Gemini 3.5 Flash via une API compatible OpenAI ?
Utilisez l'URL de base https://api.orcarouter.ai/v1, l'ID du modèle "google/gemini-3.5-flash", et transmettez une clé API OrcaRouter dans l'en-tête Authorization. L'API prend en charge les complétions de chat standard et le streaming.
Quelle longueur de sortie Gemini 3.5 Flash peut-il générer ?
Il peut générer jusqu'à 65 536 jetons par réponse. C'est considérablement plus que de nombreux modèles, permettant du contenu de longue forme, du code ou un raisonnement étendu.
Y a-t-il une réduction pour les jetons répétés ou mis en cache ?
D'après les faits fournis, OrcaRouter n'offre pas de mise en cache ni de remises sur le volume. Chaque jeton est facturé au tarif standard, indépendamment de la réutilisation.

Intégrer ce badge

Gemini 3.5 Flash$1.50/M in4102ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg" alt="Gemini 3.5 Flash sur OrcaRouter" /> </a>
Markdown [![Gemini 3.5 Flash](https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.5-flash)

Fiche du modèle en données

GET /api/public/models/google/gemini-3.5-flashOuvrir
Lisible par machine:/llms.txt/llms-full.txt