Gemini 3.8 Flash

google/gemini-3.8-flash
NowyPolecane
WizjaAudioNarzędziaJSONRozumowanie
przez Google · 2026-09-02

Gemini 3.8 Flash to najbardziej inteligentny model Flash firmy Google, oferujący znaczące ulepszenia względem 3.7 Flash w zakresie inżynierii oprogramowania, zadań agentowych i wieloetapowego rozumowania.

kont.1M tokenów
Maks. wyjście65K
Wejścietext + image + video + file + audio
Wyjścietext
p50 TTFT4.53 s
WEJŚCIE$0.75/ 1M tokenów
WYJŚCIE$3.75/ 1M tokenów
p50 TTFT4.53 s7 d
p95 TTFT10.00 s7 d
RUCH105.8Mtokenów / 7 d

Gemini 3.8 Flash jest skierowany do zespołów, które potrzebują modelu Google z szerokim wejściem multimodalnym, długim oknem kontekstu, dużym limitem tokenów wyjściowych oraz API zgodnym ze…

Kto powinien korzystać z Gemini 3.8 Flash?

Jakie wejścia i wyjścia są obsługiwane?

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Cennik

Wejście / 1M tokenów$0.750
Wyjście / 1M tokenów$3.75
Odczyt cache / 1M$0.075
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $16.50 · Z cache promptów $14.14

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.001889

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
4.53 s
Prędkość wyjścia
282 tok/s
p95 TTFT
10.00 s
Wskaźnik błędów
0.54%

Publiczne benchmarki

76.3
AA Coding
Lepszy niż 95% porównywanych modeli
7 z 137
58.7
AA Intelligence
Lepszy niż 92% porównywanych modeli
11 z 139
GPQA Diamond
95.3
HLE-Verified
54.9
Humanity's Last Exam
47.8
Long-Context Recall
81.0
SciCode
53.6
tau_banking
44.9
terminalbench_v2_1
87.6
Źródło: artificialanalysis.ai, deepmind.google

Aktywność społeczności

O czym mówią programiści w tym tygodniu

Hacker News13 wzmianek · 7 dniwzrost o 13 wobec poprzedniego tygodnia

Porównanie

Gemini 3.8 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Wejście $/M$0.75$2.00$4.00$0.50
Wyjście $/M$3.75$12.00$18.00$3.00
Kontekst1.0M1.0M1.0M1.0M
Jakość9/1010/1010/109/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Ile kosztuje Gemini 3.8 Flash przez OrcaRouter?
OrcaRouter rozlicza Gemini 3.8 Flash według stawki dostawcy, z zerową marżą: $0.75 za 1M tokenów wejściowych i $3.75 za 1M tokenów wyjściowych. W katalogu nie podano opłaty za sesję ani opłaty platformowej. Ponieważ cena wyjścia jest pięciokrotnie wyższa niż cena wejścia, długie generacje będą kosztować proporcjonalnie więcej niż długie prompty.
Ile wynosi okno kontekstu i maksymalny rozmiar odpowiedzi?
Gemini 3.8 Flash ma okno kontekstowe o pojemności 1 048 576 tokenów i maksymalne wyjście o wielkości 65 536 tokenów. Okno kontekstowe jest deklarowane dla danych wejściowych w postaci tekstu, obrazów, wideo, plików i audio. Dostawca nie podaje w tym zestawieniu osobnego wzoru na tokeny dla poszczególnych typów mediów.
Jakie są główne mocne strony Gemini 3.8 Flash?
Jego wymienione w katalogu atuty to kontekst o długości 1 048 576 tokenów, maksymalna długość wyjścia 65 536 tokenów, szerokie wejście multimodalne oraz wynik 54,9 w HLE-Verified. Te funkcje sprawdzają się w pracy z pytaniami na poziomie eksperckim, zadaniach z długimi dokumentami i rozumieniu multimediów przez API zgodne z OpenAI. W katalogu nie podano żadnych dodatkowych twierdzeń o jakości.
Jak Gemini 3.8 Flash wypada w porównaniu z innymi modelami?
Rekord katalogu nie zawiera wyników benchmarków ani cen dla żadnego alternatywnego modelu. Porównania należy przeprowadzać, przepuszczając identyczne zestawy testowe przez OrcaRouter i mierząc dokładność, koszt oraz szybkość. Użyj identyfikatora modelu google/gemini-3.8-flash wraz z innymi identyfikatorami i porównaj pola faktycznie zwracane dla Twojego obciążenia.
Jakie terminy dotyczące przetwarzania danych mają zastosowanie?
Ta strona katalogu nie określa zasad retencji, szkolenia ani udostępniania danych. Jeśli wysyłasz dane do Gemini 3.8 Flash przez OrcaRouter, treść żądania jest przetwarzana w celu zrealizowania transakcji. Warunki biznesowe dotyczące przetwarzania danych znajdują się w warunkach dostawcy Google oraz w warunkach OrcaRouter. Sprawdź te dokumenty przed wysłaniem danych podlegających regulacjom lub danych poufnych.
Jak wywołać Gemini 3.8 Flash za pomocą API zgodnego z OpenAI?
Użyj podstawowego adresu URL https://api.orcarouter.ai/v1 i ustaw pole modelu na google/gemini-3.8-flash. Następnie wyślij standardowe żądanie uzupełniania czatu w stylu OpenAI ze swoim kluczem API OrcaRouter. Istniejący klienci obsługujący chat.completions.create powinni działać po zmianie podstawowego adresu URL i nazwy modelu.
Czy OrcaRouter dodaje marżę do stawki dostawcy?
Nie. Wpis w katalogu mówi, że model jest rozliczany według stawki dostawcy z zerową marżą. Podane ceny tokenów wejściowych i wyjściowych wynoszą $0.75 za 1 mln tokenów wejściowych i $3.75 za 1 mln tokenów wyjściowych. To sprawia, że podany koszt za token jest bezpośrednią stawką dostawcy.
Czy dla tego modelu dostępne jest buforowanie promptów?
Informacje o modelu nie wspominają o buforowaniu promptów, cenach trafień w pamięć podręczną ani automatycznym działaniu pamięci podręcznej. Nie należy polegać na buforowanych promptach w celu obniżenia kosztów. Najbezpieczniejsze oszacowanie kosztów opiera się na pełnym rozliczeniu tokenów wejściowych po $0.75 za 1M tokenów wejściowych.
Jakie sposoby wprowadzania danych są obsługiwane?
Model akceptuje dane wejściowe w postaci tekstu, obrazu, wideo, pliku i audio. Dane wyjściowe są określone jako maksymalnie 65 536 tokenów, a żadna modalność wyjścia multimediów nie jest udokumentowana. W przypadku promptów zawierających obraz, wideo, plik lub audio, przetestuj format treści swojego klienta, ponieważ schemat multimediów API nie jest opisany w katalogu.

Osadź tę odznakę

Google: Gemini 3.8 Flash$0.75/M in4529ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg" alt="Google: Gemini 3.8 Flash w OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.8 Flash](https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.8-flash)

Karta modelu jako dane

GET /api/public/models/google/gemini-3.8-flashOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt