Gemini 3.8 Flash

google/gemini-3.8-flash
BaruUnggulan
VisiAudioAlatJSONPenalaran
oleh Google · 2026-09-02

Gemini 3.8 Flash adalah model Flash paling cerdas dari Google dengan peningkatan signifikan dibanding 3.7 Flash di bidang rekayasa perangkat lunak, tugas agen, dan penalaran multi-langkah.

ctx1M token
Output maks65K
Masukantext + image + video + file + audio
Keluarantext
p50 TTFT4.52 s
INPUT$0.75/ 1M token
OUTPUT$3.75/ 1M token
p50 TTFT4.52 s7h
p95 TTFT10.00 s7h
LALU LINTAS111.9Mtoken / 7h

Gemini 3.8 Flash ditujukan untuk tim yang membutuhkan model Google dengan input multimodal yang luas, jendela konteks yang panjang, batas output yang besar, dan API yang kompatibel dengan OpenAI.…

Siapa yang seharusnya menggunakan Gemini 3.8 Flash?

Input dan output apa yang didukung?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Harga

Input / 1M token$0.750
Output / 1M token$3.75
Baca cache / 1M$0.075
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $16.50 · Dengan cache prompt $14.14

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.001888

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
4.52 s
Kecepatan output
280 tok/s
p95 TTFT
10.00 s
Tingkat kesalahan
0.52%

Benchmark publik

76.3
AA Coding
Lebih baik dari 95% model yang dibandingkan
#7 dari 137
58.7
AA Intelligence
Lebih baik dari 92% model yang dibandingkan
#11 dari 139
GPQA Diamond
95.3
HLE-Verified
54.9
Humanity's Last Exam
47.8
Long-Context Recall
81.0
SciCode
53.6
tau_banking
44.9
terminalbench_v2_1
87.6
Sumber: artificialanalysis.ai, deepmind.google

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News13 sebutan · 7 hrnaik 13 dari minggu lalu

Perbandingan

Gemini 3.8 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Input $/M$0.75$2.00$4.00$0.50
Output $/M$3.75$12.00$18.00$3.00
Konteks1.0M1.0M1.0M1.0M
Kualitas9/1010/1010/109/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya Gemini 3.8 Flash melalui OrcaRouter?
OrcaRouter membebankan biaya Gemini 3.8 Flash sesuai tarif penyedia tanpa markup: $0,75 per 1 juta token input dan $3,75 per 1 juta token output. Tidak ada biaya sesi maupun biaya platform yang tercantum dalam katalog. Karena harga output lima kali lipat harga input, generasi yang panjang akan lebih mahal secara proporsional dibandingkan prompt yang panjang.
Berapa ukuran jendela konteks dan ukuran keluaran maksimumnya?
Gemini 3.8 Flash memiliki jendela konteks sebesar 1.048.576 token dan output maksimum sebesar 65.536 token. Jendela konteks tersebut diiklankan untuk input teks, gambar, video, file, dan audio. Penyedia tidak memberikan rumus token per media yang terpisah dalam daftar ini.
Apa kekuatan utama Gemini 3.8 Flash?
Keunggulan yang tercantum adalah konteks 1.048.576 token, output maksimum 65.536 token, input multimodal yang luas, dan skor 54,9 pada HLE-Verified. Fitur-fitur tersebut cocok untuk pekerjaan pertanyaan tingkat ahli, tugas dokumen panjang, dan pemahaman multimedia melalui API yang kompatibel dengan OpenAI. Tidak ada klaim kualitas tambahan yang dibuat dalam katalog.
Bagaimana perbandingan Gemini 3.8 Flash dengan model-model lain?
Catatan katalog tidak memuat skor benchmark atau harga untuk model alternatif mana pun. Perbandingan sebaiknya dilakukan dengan menjalankan set pengujian yang identik melalui OrcaRouter dan mengukur akurasi, biaya, serta kecepatan. Gunakan ID model google/gemini-3.8-flash bersama ID lainnya dan bandingkan kolom yang benar-benar dikembalikan untuk beban kerja Anda.
Istilah penanganan data apa yang berlaku?
Halaman katalog ini tidak mencantumkan aturan penyimpanan, pelatihan, atau berbagi data. Jika Anda mengirim data ke Gemini 3.8 Flash melalui OrcaRouter, konten permintaan diproses untuk menyelesaikan transaksi. Ketentuan bisnis untuk penanganan data dapat ditemukan dalam ketentuan penyedia Google dan ketentuan OrcaRouter. Periksa dokumen-dokumen tersebut sebelum mengirim data yang diatur atau bersifat rahasia.
Bagaimana cara memanggil Gemini 3.8 Flash menggunakan API yang kompatibel dengan OpenAI?
Gunakan URL dasar OrcaRouter https://api.orcarouter.ai/v1 dan atur kolom model ke google/gemini-3.8-flash. Kemudian kirim permintaan penyelesaian obrolan bergaya OpenAI standar dengan kunci API OrcaRouter Anda. Klien yang sudah ada yang mendukung chat.completions.create seharusnya tetap berfungsi setelah mengubah URL dasar dan nama model.
Apakah OrcaRouter menambahkan markup pada tarif penyedia?
Tidak. Daftar katalog menyatakan bahwa model ditagih dengan tarif penyedia tanpa markup. Harga token input dan output yang ditampilkan adalah $0,75 per 1M input dan $3,75 per 1M output. Hal ini menjadikan biaya per token yang tercantum sebagai tarif langsung penyedia.
Apakah prompt caching tersedia untuk model ini?
Fakta model tidak menyebutkan caching prompt, harga cache hit, atau perilaku cache otomatis. Anda tidak boleh mengandalkan prompt yang di-cache untuk mengurangi biaya. Perkiraan biaya paling aman didasarkan pada penagihan token input penuh sebesar $0,75 per 1M token input.
Modalitas input apa yang didukung?
Model menerima input teks, gambar, video, file, dan audio. Output tercantum hingga 65.536 token dan tidak ada modalitas output media yang didokumentasikan. Untuk prompt gambar, video, file, atau audio, uji format konten klien Anda karena skema media API tidak dijelaskan dalam katalog.

Sematkan lencana ini

Google: Gemini 3.8 Flash$0.75/M in4522ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg" alt="Google: Gemini 3.8 Flash di OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.8 Flash](https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.8-flash)

Kartu model sebagai data

GET /api/public/models/google/gemini-3.8-flashBuka