Gemini 3 Flash Preview

google/gemini-3-flash-preview
VisionAudioOutilsJSONRaisonnement
par Google · 2025-12-17

Gemini 3 Flash Preview est un modèle de réflexion à haute vitesse et à haute valeur conçu pour les workflows agentiques, les conversations multi-tours et l'assistance au codage. Il offre un raisonnement quasi-niveau Pro et outil...

ctx1M tokens
Sortie max65K
Entréetext + image + file + audio + video
Sortietext
p50 TTFT10.00 s
ENTRÉE$0.50/ 1M tokens
SORTIE$3.00/ 1M tokens
p50 TTFT10.00 s7 j
TTFT p9510.00 s7 j
TRAFIC9.0Mtokens / 7 j

Google Gemini 3 Flash Preview est un modèle multimodal développé par Google, optimisé pour la vitesse et le traitement de grands contextes. Il accepte des entrées au format texte, image, fichier,…

Qu'est-ce que Google Gemini 3 Flash Preview ?

Qui est le public cible pour ce modèle ?

Quelles entrées multimodales supporte-t-il ?

Quel est le statut de la prévisualisation et à quel point est-elle stable ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3-flash-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Tarifs

Entrée / 1M tokens$0.500
Sortie / 1M tokens$3.00
Lecture cache / 1M$0.050
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $12.50 · Avec cache de prompt $10.93

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.001509

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
10.00 s
Vitesse de sortie
1195 tok/s
TTFT p95
10.00 s
Taux d'erreur
0%

Benchmarks publics

37.8
AA Coding
Meilleur que 37 % des modèles comparés
n°81 sur 133
27.9
AA Intelligence
Meilleur que 31 % des modèles comparés
n°93 sur 135
55.7
AA Math
Meilleur que 32 % des modèles comparés
n°56 sur 82
AIME 2025
55.7
GPQA Diamond
81.2
Humanity's Last Exam
15.0
IFBench
55.1
LiveCodeBench
79.7
Long-Context Recall
53.0
MMLU-Pro
88.2
SciCode
49.9
TerminalBench Hard
31.8
τ²-Bench
43.3
Source: artificialanalysis.ai

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News0 mentions · 7 j

Comparatif

Gemini 3 Flash PreviewGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3.5 Flash
Entrée $/M$0.50$2.00$4.00$1.50
Sortie $/M$3.00$12.00$18.00$9.00
Contexte1.0M1.0M1.0M1.0M
Qualité9/1010/1010/109/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût pour utiliser Gemini 3 Flash Preview ?
La tarification est de 0,50 $ par million de tokens d'entrée et de 3,00 $ par million de tokens de sortie, facturé au tarif du fournisseur sans aucune majoration ajoutée par OrcaRouter.
Quelle est la taille de la fenêtre de contexte ?
La fenêtre de contexte est de 1,048,576 tokens pour l'entrée et le modèle peut générer jusqu'à 65,536 tokens de sortie.
Quelles sont les modalités d'entrée prises en charge ?
Texte, image, fichier, audio et vidéo sont tous acceptés en entrée. La sortie est uniquement textuelle.
Comment se compare-t-il à Gemini 2 Flash ?
Gemini 3 Flash Preview dispose d'une fenêtre de contexte plus large (1M contre jusqu'à 1M mais souvent moins), d'un score MMLU-Pro plus élevé (88,2) et d'un support multimodal étendu incluant la vidéo. Il est plus rapide et plus performant pour les tâches complexes, mais Gemini 2 Flash est moins cher par jeton.
Comment OrcaRouter gère-t-il la confidentialité des données ?
OrcaRouter transmet vos demandes à l'API de Google. Le traitement des données suit la politique de confidentialité de Google. OrcaRouter ne consigne ni ne stocke votre contenu au-delà de ce qui est nécessaire pour traiter la demande. Consultez les politiques des deux fournisseurs pour plus de détails.
Puis-je appeler Gemini 3 Flash Preview en utilisant une API compatible OpenAI ?
Oui. Utilisez l'API d'OrcaRouter à l'adresse https://api.orcarouter.ai/v1 avec l'ID de modèle "google/gemini-3-flash-preview". L'authentification utilise une clé API OrcaRouter. Les formats de requête et de réponse suivent le schéma Chat Completions d'OpenAI.
Quelles sont les principales forces du modèle ?
Vitesse d'inférence élevée, grand contexte de 1M de tokens, entrée multimodale (texte, image, fichier, audio, vidéo), solide benchmark MMLU-Pro (88,2) et coût faible par rapport aux modèles plus grands.
Le Gemini 3 Flash Preview est-il disponible pour la production ?
Il s'agit d'une version préliminaire, ce qui signifie qu'elle peut comporter des modifications, une disponibilité intermittente ou un support limité. Elle est adaptée aux tests et au développement ; pour des charges de travail critiques en production, envisagez d'utiliser la version stable dès qu'elle sera disponible.
Comment estimer l'utilisation des tokens pour les entrées multimodales ?
Chaque modalité a sa propre tokenisation. Les images, l'audio et la vidéo sont divisés en tokens en fonction de la résolution et de la durée. OrcaRouter signale l'utilisation des tokens dans la réponse de l'API. Vous pouvez également consulter la documentation de Google pour les règles détaillées de comptage des tokens.
Que se passe-t-il si je dépasse la fenêtre de contexte ?
Les entrées dépassant 1 048 576 jetons seront tronquées à partir du contenu le plus ancien. Le modèle ignorera les jetons en excès. Assurez-vous que vos messages respectent la limite en surveillant le nombre total de jetons dans votre demande.

Intégrer ce badge

Google: Gemini 3 Flash Preview$0.50/M in10000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3-flash-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3-flash-preview.svg" alt="Google: Gemini 3 Flash Preview sur OrcaRouter" /> </a>
Markdown [![Google: Gemini 3 Flash Preview](https://www.orcarouter.ai/embed/google/gemini-3-flash-preview.svg)](https://www.orcarouter.ai/models/google/gemini-3-flash-preview)

Fiche du modèle en données

GET /api/public/models/google/gemini-3-flash-previewOuvrir
Lisible par machine:/llms.txt/llms-full.txt