Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
VisiAudioAlatJSONPenalaran
oleh Google · 2025-07-22

Gemini 2.5 Flash-Lite adalah model penalaran ringan dalam keluarga Gemini 2.5, yang dioptimalkan untuk latensi ultra-rendah dan efisiensi biaya. Model ini menawarkan peningkatan throughput, pembuatan token yang lebih cepat, dan kinerja yang lebih baik...

ctx1M token
Output maks65K
Masukantext + image + file + audio + video
Keluarantext
p50 TTFT1.34 s
INPUT$0.10/ 1M token
OUTPUT$0.40/ 1M token
p50 TTFT1.34 s7h
p95 TTFT8.52 s7h
LALU LINTAS11.3Mtoken / 7h

Google Gemini 2.5 Flash Lite adalah varian yang lebih kecil, lebih cepat, dan lebih terjangkau dari model Gemini 2.5 Flash milik Google. Model ini dirancang untuk menangani berbagai masukan…

Apa itu Google Gemini 2.5 Flash Lite?

Siapa yang harus menggunakan model ini?

Apa saja modalitas input yang didukung?

Bagaimana perbandingannya dengan model Google lainnya?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Harga

Input / 1M token$0.100
Output / 1M token$0.400
Baca cache / 1M$0.010
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $1.90 · Dengan cache prompt $1.59

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000202

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
1.34 s
Kecepatan output
541 tok/s
p95 TTFT
8.52 s
Tingkat kesalahan
0.44%

Benchmark publik

7.4
AA Coding
Lebih baik dari 1% model yang dibandingkan
#125 dari 126
6.7
AA Intelligence
Lebih baik dari 3% model yang dibandingkan
#122 dari 128
35.3
AA Math
Lebih baik dari 12% model yang dibandingkan
#71 dari 81
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
Sumber: artificialanalysis.ai

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News0 sebutan · 7 hrturun 1 dari minggu lalu

Perbandingan

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.10$2.00$4.00$0.50
Output $/M$0.40$12.00$18.00$3.00
Konteks1.0M1.0M1.0M1.0M
Kualitas2/1010/1010/109/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya per token untuk Gemini 2.5 Flash Lite di OrcaRouter?
Biaya token input $0.10 per 1 juta token, biaya token output $0.40 per 1 juta token. OrcaRouter menagih dengan tarif penyedia tanpa markup.
Berapa ukuran jendela konteksnya?
Jendela konteks adalah 1.048.576 token (1 juta token), dan output maksimum adalah 65.536 token.
Apa kekuatan utama model ini?
Kekuatan termasuk biaya rendah, kecepatan tinggi, penalaran matematika yang kuat (92.6 pada MATH-500), jendela konteks yang sangat besar, dan dukungan multimodal untuk teks, gambar, berkas, audio, dan video.
Bagaimana perbandingannya dengan Gemini 2.5 Flash?
Gemini 2.5 Flash Lite lebih murah dan lebih cepat tetapi kemungkinan memiliki kinerja yang sedikit lebih rendah pada penalaran kompleks, penulisan kreatif, dan pembuatan kode dibandingkan dengan model Flash penuh.
Apakah OrcaRouter menyimpan atau membagikan data saya saat menggunakan model ini?
Fakta yang diberikan tidak menyebutkan kebijakan penanganan data OrcaRouter. Biasanya, penyedia API hanya memproses data untuk memenuhi permintaan. Periksa kebijakan privasi OrcaRouter untuk detailnya.
Bagaimana cara memanggil model ini melalui API yang kompatibel dengan OpenAI?
Gunakan URL dasar https://api.orcarouter.ai/v1 dengan id model "google/gemini-2.5-flash-lite" di pustaka klien OpenAI Anda. Sertakan kunci API OrcaRouter Anda di header Authorization.
Bisakah saya menggunakan input multimodal seperti gambar dan audio?
Ya, model ini menerima input teks, gambar, file, audio, dan video. Anda dapat menyertakannya sebagai bagian konten dalam pesan pengguna menggunakan format multimodal OpenAI standar.
Berapa latensi yang diharapkan?
Model ini dirancang untuk latensi rendah, terutama dibandingkan dengan model yang lebih besar. Waktu pastinya tergantung pada panjang input/output dan beban server. Tidak ada angka latensi spesifik yang diberikan.
Bahasa pemrograman dan kerangka kerja apa yang didukung?
Bahasa pemrograman apa pun yang mendukung permintaan HTTP dan format API OpenAI (Python, JavaScript, Go, Java, dll.) dapat digunakan. Pustaka resmi OpenAI Python berfungsi dengan mulus.
Apakah OrcaRouter menawarkan caching atau diskon untuk volume tinggi?
Tidak ada informasi tentang caching atau diskon volume yang diberikan. Harga per token sesuai tarif penyedia tanpa markup. Hubungi OrcaRouter untuk pertanyaan perusahaan.

Sematkan lencana ini

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="Google: Gemini 2.5 Flash Lite di OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

Kartu model sebagai data

GET /api/public/models/google/gemini-2.5-flash-liteBuka