Gemini 3.1 Flash Lite Preview

google/gemini-3.1-flash-lite-preview
VisiAudioAlatJSONPenalaran
oleh Google · 2026-03-03

Gemini 3.1 Flash Lite Preview adalah model berefisiensi tinggi milik Google yang dioptimalkan untuk kasus penggunaan volume tinggi. Model ini mengungguli Gemini 2.5 Flash Lite dalam kualitas keseluruhan dan mendekati performa Gemini 2.5 Flash di...

ctx1M token
Output maks65K
Masukantext + image + video + file + audio
Keluarantext
p50 TTFT1.83 s
INPUT$0.25/ 1M token
OUTPUT$1.50/ 1M token
p50 TTFT1.83 s7h
p95 TTFT8.48 s7h
LALU LINTAS1.1Mtoken / 7h

Google Gemini 3.1 Flash Lite Preview adalah rilis pratinjau dari varian ringan dari seri Gemini 3.1. Ia dirancang untuk memberikan penalaran yang kuat dan pemahaman multimodal dengan biaya yang jauh…

Apa itu Google Gemini 3.1 Flash Lite Preview?

Siapa yang harus menggunakan model ini?

Apa saja spesifikasi kuncinya?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.1-flash-lite-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Harga

Input / 1M token$0.250
Output / 1M token$1.50
Baca cache / 1M$0.025
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $6.25 · Dengan cache prompt $5.46

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000754

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
1.83 s
Kecepatan output
101 tok/s
p95 TTFT
8.48 s
Tingkat kesalahan
0%

Benchmark publik

34.7
AA Coding
Lebih baik dari 34% model yang dibandingkan
#86 dari 130
25.6
AA Intelligence
Lebih baik dari 27% model yang dibandingkan
#96 dari 132
59.4
AA Math
Lebih baik dari 41% model yang dibandingkan
#48 dari 82
GPQA Diamond
82.2
Humanity's Last Exam
17.2
IFBench
77.2
Long-Context Recall
71.3
MMLU-Pro
62.4 index
SciCode
41.9
tau_banking
9.7
TerminalBench Hard
24.2
terminalbench_v2_1
31.1
τ²-Bench
31.3
Sumber: artificialanalysis.ai

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News0 sebutan · 7 hr

Perbandingan

Gemini 3.1 Flash Lite PreviewGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.25$2.00$4.00$0.50
Output $/M$1.50$12.00$18.00$3.00
Konteks1.0M1.0M1.0M1.0M
Kualitas6/1010/1010/109/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya per token untuk Google Gemini 3.1 Flash Lite Preview di OrcaRouter?
Model ini ditagih sebesar $0,25 per 1 juta token input dan $1,50 per 1 juta token output. Ini adalah tarif penyedia yang tepat dari Google; OrcaRouter tidak menambahkan markup apa pun. Anda hanya dikenakan biaya untuk token yang Anda gunakan.
Apa panjang jendela konteks?
Jendela konteksnya adalah 1.048.576 token (sekitar 1 juta token). Panjang keluaran maksimum adalah 65.536 token. Hal ini memungkinkan Anda untuk memproses dokumen yang sangat panjang atau input multimodal dalam satu permintaan.
Apa kelebihan utama dari model ini?
Kekuatan utamanya adalah jendela konteks yang sangat besar, dukungan input multimodal (teks, gambar, video, file, audio), dan skor benchmark GPQA Diamond yang kuat sebesar 82.2, menunjukkan kemampuan penalaran yang tinggi. Ini juga hemat biaya untuk tugas konteks panjang.
Bagaimana perbandingannya dengan GPT-4o mini?
GPT-4o mini memiliki konteks 128K dan harga lebih rendah ($0.15/$0.60 per M token). Gemini 3.1 Flash Lite Preview menawarkan konteks 1M, output 65K, dan skor penalaran yang serupa. Pilih Gemini jika Anda memerlukan lebih banyak konteks atau input file/audio; pilih GPT-4o mini untuk tugas dengan konteks pendek dan biaya lebih rendah.
Bagaimana data ditangani saat menggunakan OrcaRouter?
OrcaRouter tidak mencatat atau menyimpan perintah atau penyelesaian Anda kecuali Anda secara eksplisit mengonfigurasi pencatatan. Data dikirimkan secara aman dan diproses oleh infrastruktur Google. Anda harus meninjau kebijakan privasi OrcaRouter dan ketentuan pemrosesan data Google untuk detail selengkapnya.
Apakah saya dapat memanggil model ini menggunakan API yang kompatibel dengan OpenAI?
Ya. Model ini diakses melalui API yang kompatibel dengan OpenAI dari OrcaRouter di URL dasar https://api.orcarouter.ai/v1 menggunakan id model "google/gemini-3.1-flash-lite-preview". Parameter penyelesaian obrolan OpenAI standar didukung, termasuk array konten multimodal.

Sematkan lencana ini

Google: Gemini 3.1 Flash Lite Preview$0.25/M in1833ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.1-flash-lite-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.1-flash-lite-preview.svg" alt="Google: Gemini 3.1 Flash Lite Preview di OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.1 Flash Lite Preview](https://www.orcarouter.ai/embed/google/gemini-3.1-flash-lite-preview.svg)](https://www.orcarouter.ai/models/google/gemini-3.1-flash-lite-preview)

Kartu model sebagai data

GET /api/public/models/google/gemini-3.1-flash-lite-previewBuka