Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
VisioneAudioStrumentiJSONRagionamento
di Google · 2025-07-22

Gemini 2.5 Flash-Lite è un modello di ragionamento leggero della famiglia Gemini 2.5, ottimizzato per latenza ultra-bassa ed efficienza dei costi. Offre una migliore produttività, una generazione di token più rapida e prestazioni superiori...

ctx1M token
Output max65K
Inputtext + image + file + audio + video
Outputtext
p50 TTFT1.34 s
INGRESSO$0.10/ 1M token
USCITA$0.40/ 1M token
p50 TTFT1.34 s7 g
p95 TTFT8.52 s7 g
TRAFFICO11.3Mtoken / 7 g

Google Gemini 2.5 Flash Lite è una variante più piccola, più veloce e più conveniente del modello Gemini 2.5 Flash di Google. È progettato per gestire un'ampia gamma di input multimodali—inclusi…

Cos'è Google Gemini 2.5 Flash Lite?

Chi dovrebbe usare questo modello?

Quali modalità di input supporta?

Come si confronta con altri modelli Google?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Prezzi

Input / 1M token$0.100
Output / 1M token$0.400
Lettura cache / 1M$0.010
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $1.90 · Con cache dei prompt $1.59

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.000202

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
1.34 s
Velocità di output
541 tok/s
p95 TTFT
8.52 s
Tasso di errore
0.44%

Benchmark pubblici

7.4
AA Coding
Migliore del 1% dei modelli confrontati
n. 125 su 126
6.7
AA Intelligence
Migliore del 3% dei modelli confrontati
n. 122 su 128
35.3
AA Math
Migliore del 12% dei modelli confrontati
n. 71 su 81
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
Fonte: artificialanalysis.ai

Discussioni della community

Di cosa parlano gli sviluppatori questa settimana

Hacker News0 menzioni · 7 gg1 in meno rispetto alla settimana scorsa

A confronto

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.10$2.00$4.00$0.50
Output $/M$0.40$12.00$18.00$3.00
Contesto1.0M1.0M1.0M1.0M
Qualità2/1010/1010/109/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Qual è il costo per token per Gemini 2.5 Flash Lite su OrcaRouter?
I token di input costano $0,10 per 1 milione di token, i token di output costano $0,40 per 1 milione di token. OrcaRouter fattura alla tariffa del provider con margine zero.
Qual è la dimensione della finestra di contesto?
La finestra di contesto è di 1.048.576 token (1 milione di token), e l'output massimo è di 65.536 token.
Quali sono i principali punti di forza del modello?
I punti di forza includono basso costo, alta velocità, forte ragionamento matematico (92.6 su MATH-500), una finestra di contesto molto ampia e supporto multimodale per testo, immagini, file, audio e video.
Come si confronta con Gemini 2.5 Flash?
Gemini 2.5 Flash Lite è più economico e veloce, ma probabilmente ha prestazioni leggermente inferiori nel ragionamento complesso, nella scrittura creativa e nella generazione di codice rispetto al modello Flash completo.
OrcaRouter conserva o condivide i miei dati quando utilizzo questo modello?
I fatti forniti non specificano le politiche di gestione dei dati di OrcaRouter. Tipicamente, i fornitori di API possono elaborare i dati solo per soddisfare le richieste. Controlla l'informativa sulla privacy di OrcaRouter per i dettagli.
Come posso chiamare questo modello tramite un'API compatibile con OpenAI?
Utilizza l'URL di base https://api.orcarouter.ai/v1 con l'ID modello "google/gemini-2.5-flash-lite" nella tua libreria client OpenAI. Includi la tua chiave API OrcaRouter nell'intestazione Authorization.
Posso usare input multimodali come immagini e audio?
Sì, il modello accetta input di testo, immagini, file, audio e video. Puoi includerli come parti di contenuto nel messaggio dell'utente utilizzando il formato multimodale standard di OpenAI.
Qual è la latenza prevista?
Il modello è progettato per una bassa latenza, specialmente rispetto a modelli più grandi. I tempi esatti dipendono dalla lunghezza dell'input/output e dal carico del server. Non vengono forniti valori di latenza specifici.
Quali linguaggi di programmazione e framework sono supportati?
Qualsiasi linguaggio che supporti richieste HTTP e il formato API di OpenAI (Python, JavaScript, Go, Java, ecc.) può essere utilizzato. La libreria ufficiale di OpenAI per Python funziona perfettamente.
OrcaRouter offre caching o sconti per alti volumi?
Non sono state fornite informazioni su caching o sconti per volume. Il prezzo è per token alle tariffe del fornitore senza markup. Contatta OrcaRouter per richieste aziendali.

Incorpora questo badge

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="Google: Gemini 2.5 Flash Lite su OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

Scheda del modello come dati

GET /api/public/models/google/gemini-2.5-flash-liteApri
Leggibile dalle macchine:/llms.txt/llms-full.txt