Gemini 2.5 Flash

google/gemini-2.5-flash
VisionAudioOutilsJSONRaisonnement
par Google · 2025-06-17

Gemini 2.5 Flash est le modèle de cheval de bataille de pointe de Google, spécialement conçu pour le raisonnement avancé, le codage, les mathématiques et les tâches scientifiques. Il inclut des capacités de "réflexion" intégrées, lui permettant de fournir des réponses avec une plus grande...

ctx1.05M tokens
Sortie max65.5K
Entréefile + image + text + audio + video
Sortietext
p50 TTFT10.00 s
ENTRÉE$0.30/ 1M tokens
SORTIE$2.50/ 1M tokens
p50 TTFT10.00 s7 j
TTFT p9510.00 s7 j
TRAFIC433.8Ktokens / 7 j

Google Gemini 2.5 Flash est un modèle de langage multimodal développé par Google. Il appartient à la série Gemini 2.5, conçu pour le traitement efficace de textes, d'images, de contenus audio et…

Qu'est-ce que Google Gemini 2.5 Flash ?

Qui devrait utiliser Gemini 2.5 Flash ?

Quelles sont les spécifications clés de Gemini 2.5 Flash ?

En quoi Gemini 2.5 Flash diffère-t-il des autres modèles Gemini ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Tarifs

Entrée / 1M tokens$0.300
Sortie / 1M tokens$2.50
Lecture cache / 1M$0.030
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $9.60 · Avec cache de prompt $8.66

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.001255

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
10.00 s
Vitesse de sortie
1247 tok/s
TTFT p95
10.00 s
Taux d'erreur
2.3%

Benchmarks publics

17.8
AA Coding
Meilleur que 15 % des modèles comparés
n°105 sur 123
14.1
AA Intelligence
Meilleur que 14 % des modèles comparés
n°107 sur 125
60.3
AA Math
Meilleur que 44 % des modèles comparés
n°45 sur 81
AIME
50.0
AIME 2025
60.3
GPQA Diamond
68.3
Humanity's Last Exam
5.1
IFBench
39.0
LiveCodeBench
49.5
Long-Context Recall
45.9
MATH-500
93.2
MMLU-Pro
80.9
SciCode
29.1
TerminalBench Hard
12.1
τ²-Bench
14.9
Source: artificialanalysis.ai

Comparatif

Gemini 2.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Entrée $/M$0.30$2.00$4.00$0.50
Sortie $/M$2.50$12.00$18.00$3.00
Contexte1.0M1.0M1.0M1.0M
Qualité3/1010/1010/109/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte Gemini 2.5 Flash par token ?
L'entrée est à 0,30 $ par million de jetons, la sortie à 2,50 $ par million de jetons. Ce sont les tarifs fournisseurs de Google sans marge via OrcaRouter.
Quelle est la taille de la fenêtre de contexte de Gemini 2.5 Flash ?
La fenêtre de contexte est de 1 048 576 tokens (1M tokens). La sortie maximale est de 65 536 tokens.
Quels sont les principaux atouts de Gemini 2.5 Flash ?
Il obtient un score de 93,2 sur MATH-500, ce qui démontre un fort raisonnement mathématique. Il prend également en charge plusieurs modalités d'entrée (fichier, image, texte, audio, vidéo) et dispose d'une fenêtre de contexte très large à un prix compétitif.
Comment Gemini 2.5 Flash se compare-t-il à Gemini 2.0 Flash ?
Gemini 2.5 Flash est plus cher mais offre une performance mathématique améliorée (93.2 contre un score inférieur sur MATH-500). Les deux disposent de fenêtres de contexte de 1M. 2.0 Flash coûte $0.15/$0.60 par million de tokens, tandis que 2.5 Flash coûte $0.30/$2.50.
Est-ce qu'OrcaRouter ajoute une marge au prix du modèle ?
Non, OrcaRouter facture au taux exact du fournisseur sans marge. Vous payez 0,30 $ par 1M de tokens en entrée et 2,50 $ par 1M de tokens en sortie.
Puis-je utiliser Gemini 2.5 Flash via une API compatible OpenAI ?
Oui. Utilisez l'URL de base https://api.orcarouter.ai/v1 et l'ID de modèle "google/gemini-2.5-flash". Tous les SDK OpenAI et les clients HTTP fonctionnent avec les paramètres standard de complétion de chat.
Quelles modalités d'entrée Gemini 2.5 Flash prend-il en charge ?
Il prend en charge les entrées de fichiers, images, texte, audio et vidéo. Vous pouvez les mélanger dans une seule requête.
Comment mes données sont-elles traitées lors de l'utilisation de Gemini 2.5 Flash via OrcaRouter ?
Le traitement des données suit les politiques de confidentialité de l'API de Google et les conditions d'OrcaRouter. Google peut traiter les données pour l'amélioration du modèle, sauf si vous vous désinscrivez via votre compte Google Cloud. Consultez la documentation sur le traitement des données de Google pour plus de détails.

Intégrer ce badge

Google: Gemini 2.5 Flash$0.30/M in10000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg" alt="Google: Gemini 2.5 Flash sur OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash](https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash)

Fiche du modèle en données

GET /api/public/models/google/gemini-2.5-flashOuvrir
Lisible par machine:/llms.txt/llms-full.txt