Gemini 3 Flash Preview

google/gemini-3-flash-preview
VisioneAudioStrumentiJSONRagionamento
di Google · 2025-12-17

Gemini 3 Flash Preview è un modello di pensiero ad alta velocità e alto valore progettato per flussi di lavoro agentici, chat multi-turn e assistenza alla programmazione. Offre un ragionamento quasi a livello Pro e strumenti...

ctx1M token
Output max65K
Inputtext + image + file + audio + video
Outputtext
p50 TTFT10.00 s
INGRESSO$0.50/ 1M token
USCITA$3.00/ 1M token
p50 TTFT10.00 s7 g
p95 TTFT10.00 s7 g
TRAFFICO9.0Mtoken / 7 g

Google Gemini 3 Flash Preview è un modello multimodale sviluppato da Google, ottimizzato per la velocità e l'elaborazione di contesti estesi. Accetta input in formato testo, immagine, file, audio e…

Che cos'è Google Gemini 3 Flash Preview?

Chi è il pubblico di destinazione per questo modello?

Quali input multimodali supporta?

Qual è lo stato di anteprima e quanto è stabile?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3-flash-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Prezzi

Input / 1M token$0.500
Output / 1M token$3.00
Lettura cache / 1M$0.050
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $12.50 · Con cache dei prompt $10.93

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.001509

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
10.00 s
Velocità di output
1195 tok/s
p95 TTFT
10.00 s
Tasso di errore
0%

Benchmark pubblici

37.8
AA Coding
Migliore del 37% dei modelli confrontati
n. 81 su 133
27.9
AA Intelligence
Migliore del 31% dei modelli confrontati
n. 93 su 135
55.7
AA Math
Migliore del 32% dei modelli confrontati
n. 56 su 82
AIME 2025
55.7
GPQA Diamond
81.2
Humanity's Last Exam
15.0
IFBench
55.1
LiveCodeBench
79.7
Long-Context Recall
53.0
MMLU-Pro
88.2
SciCode
49.9
TerminalBench Hard
31.8
τ²-Bench
43.3
Fonte: artificialanalysis.ai

Discussioni della community

Di cosa parlano gli sviluppatori questa settimana

Hacker News0 menzioni · 7 gg

A confronto

Gemini 3 Flash PreviewGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3.5 Flash
Input $/M$0.50$2.00$4.00$1.50
Output $/M$3.00$12.00$18.00$9.00
Contesto1.0M1.0M1.0M1.0M
Qualità9/1010/1010/109/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Qual è il costo per utilizzare Gemini 3 Flash Preview?
Prezzo di $0.50 per milione di token di input e $3.00 per milione di token di output, fatturato al tasso del fornitore con zero ricarico aggiunto da OrcaRouter.
Qual è la dimensione della finestra di contesto?
Il contesto finestra è di 1.048.576 token per l'input e il modello può generare fino a 65.536 token di output.
Quali sono le modalità di input supportate?
Testo, immagine, file, audio e video sono tutti accettati come input. L'output è solo testo.
Come si confronta con Gemini 2 Flash?
Gemini 3 Flash Preview ha una finestra di contesto più grande (1M vs fino a 1M ma spesso più piccola), un punteggio MMLU-Pro più alto (88.2) e un supporto multimodale ampliato che include video. È più veloce e più capace per compiti complessi, ma Gemini 2 Flash è più economico per token.
Come gestisce OrcaRouter la privacy dei dati?
OrcaRouter inoltra le tue richieste all'API di Google. Il trattamento dei dati segue l'informativa sulla privacy di Google. OrcaRouter non registra né conserva i tuoi contenuti oltre quanto necessario per elaborare la richiesta. Consulta le politiche di entrambi i fornitori per i dettagli.
Posso chiamare Gemini 3 Flash Preview utilizzando un'API compatibile con OpenAI?
Sì. Usa l'API di OrcaRouter su https://api.orcarouter.ai/v1 con ID modello "google/gemini-3-flash-preview". L'autenticazione utilizza una chiave API OrcaRouter. I formati di richiesta e risposta seguono lo schema Chat Completions di OpenAI.
Quali sono i principali punti di forza del modello?
Velocità di inferenza elevata, contesto ampio di 1 milione di token, input multimodale (testo, immagine, file, audio, video), solido benchmark MMLU-Pro (88,2) e costo basso rispetto a modelli più grandi.
Gemini 3 Flash Preview è disponibile per la produzione?
È una versione di anteprima, il che significa che potrebbe subire modifiche, disponibilità intermittente o supporto limitato. È adatta per test e sviluppo; per carichi di lavoro critici in produzione, considera di utilizzare la versione stabile una volta disponibile.
Come posso stimare l'utilizzo dei token per input multimodali?
Ogni modalità ha la propria tokenizzazione. Immagini, audio e video vengono suddivisi in token in base a risoluzione e durata. OrcaRouter segnala l'utilizzo dei token nella risposta API. Puoi anche consultare la documentazione di Google per le regole dettagliate di conteggio dei token.
Cosa succede se supero la finestra di contesto?
Input superiori a 1.048.576 token verranno troncati a partire dal contenuto più vecchio. Il modello ignorerà i token in eccesso. Assicurati che i tuoi messaggi rientrino nel limite monitorando il totale dei token nella tua richiesta.

Incorpora questo badge

Google: Gemini 3 Flash Preview$0.50/M in10000ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3-flash-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3-flash-preview.svg" alt="Google: Gemini 3 Flash Preview su OrcaRouter" /> </a>
Markdown [![Google: Gemini 3 Flash Preview](https://www.orcarouter.ai/embed/google/gemini-3-flash-preview.svg)](https://www.orcarouter.ai/models/google/gemini-3-flash-preview)

Scheda del modello come dati

GET /api/public/models/google/gemini-3-flash-previewApri
Leggibile dalle macchine:/llms.txt/llms-full.txt