Gemini 3.1 Flash Lite Preview

google/gemini-3.1-flash-lite-preview
VisionAudioOutilsJSONRaisonnement
par Google · 2026-03-03

Gemini 3.1 Flash Lite Preview est le modèle à haute efficacité de Google optimisé pour les cas d'utilisation à volume élevé. Il surpasse Gemini 2.5 Flash Lite en termes de qualité globale et se rapproche des performances de Gemini 2.5 Flash dans...

ctx1M tokens
Sortie max65K
Entréetext + image + video + file + audio
Sortietext
p50 TTFT1.83 s
ENTRÉE$0.25/ 1M tokens
SORTIE$1.50/ 1M tokens
p50 TTFT1.83 s7 j
TTFT p958.48 s7 j
TRAFIC1.1Mtokens / 7 j

Google Gemini 3.1 Flash Lite Preview est une version préliminaire d’une variante légère de la série Gemini 3.1. Elle est conçue pour offrir un raisonnement solide et une compréhension multimodale à…

Qu'est-ce que Google Gemini 3.1 Flash Lite Preview ?

Qui devrait utiliser ce modèle ?

Quelles sont les spécifications clés ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.1-flash-lite-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Tarifs

Entrée / 1M tokens$0.250
Sortie / 1M tokens$1.50
Lecture cache / 1M$0.025
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $6.25 · Avec cache de prompt $5.46

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000754

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
1.83 s
Vitesse de sortie
101 tok/s
TTFT p95
8.48 s
Taux d'erreur
0%

Benchmarks publics

34.7
AA Coding
Meilleur que 34 % des modèles comparés
n°86 sur 130
25.6
AA Intelligence
Meilleur que 27 % des modèles comparés
n°96 sur 132
59.4
AA Math
Meilleur que 41 % des modèles comparés
n°48 sur 82
GPQA Diamond
82.2
Humanity's Last Exam
17.2
IFBench
77.2
Long-Context Recall
71.3
MMLU-Pro
62.4 index
SciCode
41.9
tau_banking
9.7
TerminalBench Hard
24.2
terminalbench_v2_1
31.1
τ²-Bench
31.3
Source: artificialanalysis.ai

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News0 mentions · 7 j

Comparatif

Gemini 3.1 Flash Lite PreviewGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Entrée $/M$0.25$2.00$4.00$0.50
Sortie $/M$1.50$12.00$18.00$3.00
Contexte1.0M1.0M1.0M1.0M
Qualité6/1010/1010/109/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût par token pour Google Gemini 3.1 Flash Lite Preview sur OrcaRouter ?
Le modèle est facturé à 0,25 $ par million de jetons d'entrée et 1,50 $ par million de jetons de sortie. Il s'agit du tarif exact du fournisseur Google ; OrcaRouter n'ajoute aucune majoration. Vous êtes facturé uniquement pour les jetons que vous utilisez.
Quelle est la longueur de la fenêtre de contexte ?
La fenêtre de contexte est de 1 048 576 jetons (environ 1 million de jetons). La longueur de sortie maximale est de 65 536 jetons. Cela vous permet de traiter des documents très longs ou des entrées multimodales en une seule requête.
Quels sont les principaux atouts de ce modèle ?
Ses principaux atouts sont la très grande fenêtre de contexte, la prise en charge des entrées multimodales (texte, image, vidéo, fichier, audio), et un score élevé de 82,2 sur le benchmark GPQA Diamond, indiquant une grande capacité de raisonnement. Il est également rentable pour les tâches à long contexte.
Comment se compare-t-il à GPT-4o mini ?
GPT-4o mini dispose d'un contexte de 128K et d'un prix réduit (0,15 $/0,60 $ par million de tokens). Gemini 3.1 Flash Lite Preview offre un contexte de 1M, une sortie de 65K et des scores de raisonnement similaires. Choisissez Gemini si vous avez besoin de plus de contexte ou d'une entrée fichier/audio ; choisissez GPT-4o mini pour des tâches à contexte court et à faible coût.
Comment les données sont-elles traitées lors de l'utilisation d'OrcaRouter ?
OrcaRouter ne consigne ni ne stocke vos invites ou complétions, sauf si vous configurez explicitement la journalisation. Les données sont transmises de manière sécurisée et traitées par l'infrastructure de Google. Vous devriez consulter la politique de confidentialité d'OrcaRouter et les conditions de traitement des données de Google pour tous les détails.
Puis-je appeler ce modèle en utilisant une API compatible OpenAI ?
Oui. Le modèle est accessible via l'API compatible OpenAI d'OrcaRouter à l'URL de base https://api.orcarouter.ai/v1 en utilisant l'identifiant de modèle "google/gemini-3.1-flash-lite-preview". Les paramètres standard de complétion de chat OpenAI sont pris en charge, y compris les tableaux de contenu multimodaux.

Intégrer ce badge

Google: Gemini 3.1 Flash Lite Preview$0.25/M in1833ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.1-flash-lite-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.1-flash-lite-preview.svg" alt="Google: Gemini 3.1 Flash Lite Preview sur OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.1 Flash Lite Preview](https://www.orcarouter.ai/embed/google/gemini-3.1-flash-lite-preview.svg)](https://www.orcarouter.ai/models/google/gemini-3.1-flash-lite-preview)

Fiche du modèle en données

GET /api/public/models/google/gemini-3.1-flash-lite-previewOuvrir
Lisible par machine:/llms.txt/llms-full.txt