Gemini 2.5 Flash

google/gemini-2.5-flash
VisioneAudioStrumentiJSONRagionamento
di Google · 2025-06-17

Gemini 2.5 Flash è il modello di punta all'avanguardia di Google, specificamente progettato per il ragionamento avanzato, la programmazione, la matematica e i compiti scientifici. Include capacità di "pensiero" integrate, che gli permettono di fornire risposte con maggiore...

ctx1.05M token
Output max65.5K
Inputfile + image + text + audio + video
Outputtext
p50 TTFT10.00 s
INGRESSO$0.30/ 1M token
USCITA$2.50/ 1M token
p50 TTFT10.00 s7 g
p95 TTFT10.00 s7 g
TRAFFICO433.8Ktoken / 7 g

Google Gemini 2.5 Flash è un modello linguistico multimodale sviluppato da Google. Appartiene alla serie Gemini 2.5, progettato per elaborare in modo efficiente input di testo, immagini, audio e…

Che cos'è Google Gemini 2.5 Flash?

Chi dovrebbe usare Gemini 2.5 Flash?

Quali sono le specifiche principali di Gemini 2.5 Flash?

In che modo Gemini 2.5 Flash si differenzia dagli altri modelli Gemini?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Prezzi

Input / 1M token$0.300
Output / 1M token$2.50
Lettura cache / 1M$0.030
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $9.60 · Con cache dei prompt $8.66

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.001255

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
10.00 s
Velocità di output
1247 tok/s
p95 TTFT
10.00 s
Tasso di errore
2.3%

Benchmark pubblici

17.8
AA Coding
Migliore del 15% dei modelli confrontati
n. 105 su 123
14.1
AA Intelligence
Migliore del 14% dei modelli confrontati
n. 107 su 125
60.3
AA Math
Migliore del 44% dei modelli confrontati
n. 45 su 81
AIME
50.0
AIME 2025
60.3
GPQA Diamond
68.3
Humanity's Last Exam
5.1
IFBench
39.0
LiveCodeBench
49.5
Long-Context Recall
45.9
MATH-500
93.2
MMLU-Pro
80.9
SciCode
29.1
TerminalBench Hard
12.1
τ²-Bench
14.9
Fonte: artificialanalysis.ai

A confronto

Gemini 2.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.30$2.00$4.00$0.50
Output $/M$2.50$12.00$18.00$3.00
Contesto1.0M1.0M1.0M1.0M
Qualità3/1010/1010/109/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Quanto costa Gemini 2.5 Flash per token?
L'input è $0.30 per 1 milione di token, l'output è $2.50 per 1 milione di token. Queste sono le tariffe del provider Google con zero markup attraverso OrcaRouter.
Qual è la dimensione della finestra di contesto di Gemini 2.5 Flash?
La finestra di contesto è di 1,048,576 token (1M tokens). L'output massimo è di 65,536 token.
Quali sono i principali punti di forza di Gemini 2.5 Flash?
Raggiunge un punteggio MATH-500 di 93.2, dimostrando un forte ragionamento matematico. Supporta inoltre molteplici modalità di input (file, immagine, testo, audio, video) e dispone di una finestra di contesto molto ampia a un prezzo competitivo.
Come si confronta Gemini 2.5 Flash con Gemini 2.0 Flash?
Gemini 2.5 Flash è più costoso ma offre prestazioni matematiche migliori (93,2 vs. punteggio inferiore su MATH-500). Entrambi hanno finestre di contesto da 1M. 2.0 Flash costa $0,15/$0,60 per 1M token, mentre 2.5 Flash costa $0,30/$2,50.
OrcaRouter aggiunge un margine al prezzo del modello?
No, OrcaRouter fattura esattamente alla tariffa del fornitore con zero margine. Paghi $0.30 per 1M token di input e $2.50 per 1M token di output.
Posso usare Gemini 2.5 Flash tramite un'API compatibile con OpenAI?
Sì. Usa l'URL di base https://api.orcarouter.ai/v1 e l'ID del modello "google/gemini-2.5-flash". Tutti gli SDK OpenAI e i client HTTP funzionano con i parametri standard di completamento chat.
Quali modalità di input supporta Gemini 2.5 Flash?
Supporta input di file, immagini, testo, audio e video. Puoi mescolarli in una singola richiesta.
Come vengono gestiti i miei dati quando utilizzo Gemini 2.5 Flash tramite OrcaRouter?
La gestione dei dati segue le politiche sulla privacy delle API di Google e i termini di OrcaRouter. Google potrebbe elaborare i dati per il miglioramento del modello, a meno che tu non rinunci tramite il tuo account Google Cloud. Controlla la documentazione sul trattamento dei dati di Google per i dettagli.

Incorpora questo badge

Google: Gemini 2.5 Flash$0.30/M in10000ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg" alt="Google: Gemini 2.5 Flash su OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash](https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash)

Scheda del modello come dati

GET /api/public/models/google/gemini-2.5-flashApri
Leggibile dalle macchine:/llms.txt/llms-full.txt