Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
WizjaAudioNarzędziaJSONRozumowanie
przez Google · 2025-07-22

Gemini 2.5 Flash-Lite to lekki model rozumowania z rodziny Gemini 2.5, zoptymalizowany pod kątem bardzo niskiego opóźnienia i efektywności kosztowej. Oferuje lepszą przepustowość, szybsze generowanie tokenów oraz lepszą wydajność...

kont.1M tokenów
Maks. wyjście65K
Wejścietext + image + file + audio + video
Wyjścietext
p50 TTFT1.34 s
WEJŚCIE$0.10/ 1M tokenów
WYJŚCIE$0.40/ 1M tokenów
p50 TTFT1.34 s7 d
p95 TTFT8.52 s7 d
RUCH11.3Mtokenów / 7 d

Google Gemini 2.5 Flash Lite to mniejsza, szybsza i tańsza wersja modelu Gemini 2.5 Flash od Google. Została zaprojektowana do obsługi szerokiego zakresu multimodalnych danych wejściowych — w tym…

Czym jest Google Gemini 2.5 Flash Lite?

Kto powinien używać tego modelu?

Jakie tryby wprowadzania obsługuje?

Jak wypada w porównaniu z innymi modelami Google?

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Cennik

Wejście / 1M tokenów$0.100
Wyjście / 1M tokenów$0.400
Odczyt cache / 1M$0.010
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $1.90 · Z cache promptów $1.59

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000202

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
1.34 s
Prędkość wyjścia
541 tok/s
p95 TTFT
8.52 s
Wskaźnik błędów
0.44%

Publiczne benchmarki

7.4
AA Coding
Lepszy niż 1% porównywanych modeli
125 z 126
6.7
AA Intelligence
Lepszy niż 3% porównywanych modeli
122 z 128
35.3
AA Math
Lepszy niż 12% porównywanych modeli
71 z 81
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
Źródło: artificialanalysis.ai

Aktywność społeczności

O czym mówią programiści w tym tygodniu

Hacker News0 wzmianek · 7 dnispadek o 1 wobec poprzedniego tygodnia

Porównanie

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Wejście $/M$0.10$2.00$4.00$0.50
Wyjście $/M$0.40$12.00$18.00$3.00
Kontekst1.0M1.0M1.0M1.0M
Jakość2/1010/1010/109/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Jaki jest koszt na token dla Gemini 2.5 Flash Lite w OrcaRouter?
Koszt tokenów wejściowych wynosi $0.10 za 1 milion tokenów, koszt tokenów wyjściowych wynosi $0.40 za 1 milion tokenów. OrcaRouter rozlicza według stawki dostawcy z zerową marżą.
Jaki jest rozmiar okna kontekstu?
Okno kontekstu ma 1 048 576 tokenów (1 milion tokenów), a maksymalna liczba tokenów na wyjściu wynosi 65 536.
Jakie są główne zalety modelu?
Zalety obejmują niski koszt, wysoką prędkość, silne rozumowanie matematyczne (92.6 w MATH-500), bardzo duże okno kontekstowe oraz wielomodalne wsparcie dla tekstu, obrazów, plików, dźwięku i wideo.
Jak to wypada w porównaniu z Gemini 2.5 Flash?
Gemini 2.5 Flash Lite jest tańszy i szybszy, ale prawdopodobnie ma nieco gorszą wydajność w zakresie złożonego rozumowania, kreatywnego pisania i generowania kodu w porównaniu do pełnego modelu Flash.
Czy OrcaRouter przechowuje lub udostępnia moje dane podczas korzystania z tego modelu?
Podane fakty nie określają zasad przetwarzania danych przez OrcaRouter. Zazwyczaj dostawcy API mogą przetwarzać dane wyłącznie w celu realizacji żądań. Sprawdź politykę prywatności OrcaRouter, aby uzyskać szczegóły.
Jak wywołać ten model przez API zgodne z OpenAI?
Użyj podstawowego adresu URL https://api.orcarouter.ai/v1 z identyfikatorem modelu "google/gemini-2.5-flash-lite" w swojej bibliotece klienta OpenAI. Umieść swój klucz API OrcaRouter w nagłówku autoryzacji.
Czy mogę używać wejść multimodalnych, takich jak obrazy i dźwięk?
Tak, model akceptuje tekst, obraz, plik, audio i wideo. Możesz dołączyć je jako części treści w wiadomości użytkownika, używając standardowego multimodalnego formatu OpenAI.
Jaka jest oczekiwana latencja?
Model zaprojektowano z myślą o niskim opóźnieniu, szczególnie w porównaniu z większymi modelami. Dokładne czasy zależą od długości wejścia/wyjścia oraz obciążenia serwera. Nie podano konkretnych wartości opóźnień.
Jakie języki programowania i frameworki są obsługiwane?
Każdy język, który obsługuje żądania HTTP i format API OpenAI (Python, JavaScript, Go, Java itp.), może być użyty. Oficjalna biblioteka OpenAI dla Pythona działa bezproblemowo.
Czy OrcaRouter oferuje jakiekolwiek buforowanie lub zniżki dla dużego wolumenu?
Nie podano informacji o buforowaniu ani rabatach ilościowych. Ceny są naliczane za token według stawek dostawcy bez marży. W przypadku zapytań korporacyjnych skontaktuj się z OrcaRouter.

Osadź tę odznakę

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="Google: Gemini 2.5 Flash Lite w OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

Karta modelu jako dane

GET /api/public/models/google/gemini-2.5-flash-liteOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt