Gemini 2.5 Flash

google/gemini-2.5-flash
VisiAudioAlatJSONPenalaran
oleh Google · 2025-06-17

Gemini 2.5 Flash adalah model andalan (workhorse) terbaru dari Google, yang dirancang khusus untuk penalaran tingkat lanjut, pengkodean, matematika, dan tugas-tugas ilmiah. Model ini dilengkapi dengan kemampuan "berpikir" (thinking) bawaan, yang memungkinkannya memberikan respons dengan lebih...

ctx1.05M token
Output maks65.5K
Masukanfile + image + text + audio + video
Keluarantext
p50 TTFT10.00 s
INPUT$0.30/ 1M token
OUTPUT$2.50/ 1M token
p50 TTFT10.00 s7h
p95 TTFT10.00 s7h
LALU LINTAS433.8Ktoken / 7h

Google Gemini 2.5 Flash adalah model bahasa multimodal yang dikembangkan oleh Google. Model ini termasuk dalam seri Gemini 2.5, dirancang untuk pemrosesan yang efisien dari input teks, gambar, audio,…

Apa itu Google Gemini 2.5 Flash?

Siapa yang harus menggunakan Gemini 2.5 Flash?

Apa saja spesifikasi utama dari Gemini 2.5 Flash?

Bagaimana Gemini 2.5 Flash berbeda dari model Gemini lainnya?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Harga

Input / 1M token$0.300
Output / 1M token$2.50
Baca cache / 1M$0.030
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $9.60 · Dengan cache prompt $8.66

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.001255

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
10.00 s
Kecepatan output
1247 tok/s
p95 TTFT
10.00 s
Tingkat kesalahan
2.3%

Benchmark publik

17.8
AA Coding
Lebih baik dari 15% model yang dibandingkan
#105 dari 123
14.1
AA Intelligence
Lebih baik dari 14% model yang dibandingkan
#107 dari 125
60.3
AA Math
Lebih baik dari 44% model yang dibandingkan
#45 dari 81
AIME
50.0
AIME 2025
60.3
GPQA Diamond
68.3
Humanity's Last Exam
5.1
IFBench
39.0
LiveCodeBench
49.5
Long-Context Recall
45.9
MATH-500
93.2
MMLU-Pro
80.9
SciCode
29.1
TerminalBench Hard
12.1
τ²-Bench
14.9
Sumber: artificialanalysis.ai

Perbandingan

Gemini 2.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.30$2.00$4.00$0.50
Output $/M$2.50$12.00$18.00$3.00
Konteks1.0M1.0M1.0M1.0M
Kualitas3/1010/1010/109/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya Gemini 2.5 Flash per token?
Input adalah $0.30 per 1 juta token, output adalah $2.50 per 1 juta token. Ini adalah tarif penyedia Google dengan markup nol melalui OrcaRouter.
Berapa ukuran jendela konteks dari Gemini 2.5 Flash?
Jendela konteks adalah 1,048,576 token (1M token). Output maksimum adalah 65,536 token.
Apa keunggulan utama Gemini 2.5 Flash?
Ini mencapai skor MATH-500 sebesar 93,2, menunjukkan penalaran matematis yang kuat. Ini juga mendukung berbagai modalitas input (file, gambar, teks, audio, video) dan memiliki jendela konteks yang sangat besar dengan harga yang kompetitif.
Bagaimana perbandingan Gemini 2.5 Flash dengan Gemini 2.0 Flash?
Gemini 2.5 Flash lebih mahal tetapi menawarkan peningkatan performa matematika (93.2 vs skor lebih rendah pada MATH-500). Keduanya memiliki jendela konteks 1M. 2.0 Flash berbiaya $0.15/$0.60 per 1M token, sedangkan 2.5 Flash berbiaya $0.30/$2.50.
Apakah OrcaRouter menambahkan markup pada harga model?
Tidak, OrcaRouter menagih sesuai tarif penyedia yang tepat tanpa markup. Anda membayar $0,30 per 1M input dan $2,50 per 1M token output.
Dapatkah saya menggunakan Gemini 2.5 Flash melalui API yang kompatibel dengan OpenAI?
Ya. Gunakan base URL https://api.orcarouter.ai/v1 dan model ID "google/gemini-2.5-flash". Semua OpenAI SDK dan klien HTTP bekerja dengan parameter chat completion standar.
Apa saja modalitas input yang didukung oleh Gemini 2.5 Flash?
Ini mendukung input file, gambar, teks, audio, dan video. Anda dapat mencampurnya dalam satu permintaan.
Bagaimana data saya ditangani saat menggunakan Gemini 2.5 Flash melalui OrcaRouter?
Penanganan data mengikuti kebijakan privasi API Google dan ketentuan OrcaRouter. Google dapat memproses data untuk perbaikan model kecuali Anda memilih untuk tidak ikut serta melalui akun Google Cloud Anda. Periksa dokumentasi pemrosesan data Google untuk detailnya.

Sematkan lencana ini

Google: Gemini 2.5 Flash$0.30/M in10000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg" alt="Google: Gemini 2.5 Flash di OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash](https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash)

Kartu model sebagai data

GET /api/public/models/google/gemini-2.5-flashBuka