Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
ЗрениеАудиоИнструментыJSONРассуждение
от Google · 2025-07-22

Gemini 2.5 Flash-Lite — это легковесная модель рассуждений из семейства Gemini 2.5, оптимизированная для сверхнизкой задержки и экономической эффективности. Она обеспечивает улучшенную пропускную способность, более быструю генерацию токенов и лучшую производительность...

конт.1M токенов
Макс. вывод65K
Вводtext + image + file + audio + video
Выводtext
p50 TTFT1.34 s
ВХОД$0.10/ 1M токенов
ВЫХОД$0.40/ 1M токенов
p50 TTFT1.34 s7 д
p95 TTFT8.52 s7 д
ТРАФИК11.3Mтокенов / 7 д

Google Gemini 2.5 Flash Lite — это меньшая, более быстрая и более доступная по цене разновидность модели Gemini 2.5 Flash от Google. Она предназначена для обработки широкого спектра мультимодальных…

Что такое Google Gemini 2.5 Flash Lite?

Кому следует использовать эту модель?

Какие входные модальности он поддерживает?

Как он соотносится с другими моделями Google?

Примеры кода

Вызов из любого SDK

Совместимо с OpenAI — оставьте свой SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Поддерживаемые параметры

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Цены

Ввод / 1M токенов$0.100
Вывод / 1M токенов$0.400
Чтение кэша / 1M$0.010
ВалютаUSD

Калькулятор стоимости

Токенов / месяц10MM
Доля ввода70%%
Оценка / месяц $1.90 · С кэшем промптов $1.59

Оценка по прайс-листу

Оценка токенов и стоимости

Токены ввода: 19Стоимость за запрос: $0.000202

Только оценка — фактическое число токенов зависит от токенизатора провайдера.

Производительность

p50 TTFT
1.34 s
Скорость вывода
541 tok/s
p95 TTFT
8.52 s
Частота ошибок
0.44%

Публичные тесты

7.4
AA Coding
Лучше, чем 1% сравниваемых моделей
125 из 126
6.7
AA Intelligence
Лучше, чем 3% сравниваемых моделей
122 из 128
35.3
AA Math
Лучше, чем 12% сравниваемых моделей
71 из 81
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
Источник: artificialanalysis.ai

Обсуждения в сообществе

О чём говорят разработчики на этой неделе

Hacker News0 упоминаний · 7 днснижение на 1 к прошлой неделе

Сравнение

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Ввод $/млн$0.10$2.00$4.00$0.50
Вывод $/млн$0.40$12.00$18.00$3.00
Контекст1.0M1.0M1.0M1.0M
Качество2/1010/1010/109/10
Сравнить бок о бокСравнить бок о бокСравнить бок о бокСравнить бок о бок

Больше от Google

FAQ

Какова стоимость за токен для Gemini 2.5 Flash Lite на OrcaRouter?
Входные токены стоят $0.10 за 1 миллион токенов, выходные токены стоят $0.40 за 1 миллион токенов. OrcaRouter выставляет счета по тарифу провайдера с нулевой наценкой.
Какой размер контекстного окна?
Контекстное окно составляет 1,048,576 токенов (1 миллион токенов), а максимальный вывод — 65,536 токенов.
Каковы основные сильные стороны модели?
К сильным сторонам относятся низкая стоимость, высокая скорость, сильные математические рассуждения (92.6 на MATH-500), очень большое окно контекста и мультимодальная поддержка текста, изображений, файлов, аудио и видео.
Как это соотносится с Gemini 2.5 Flash?
Gemini 2.5 Flash Lite дешевле и быстрее, но, вероятно, имеет несколько более низкую производительность в сложных рассуждениях, творческом письме и генерации кода по сравнению с полной моделью Flash.
Хранит или передаёт ли OrcaRouter мои данные при использовании этой модели?
Предоставленные факты не уточняют политику обработки данных OrcaRouter. Обычно поставщики API могут обрабатывать данные только для выполнения запросов. Ознакомьтесь с политикой конфиденциальности OrcaRouter для получения подробной информации.
Как вызвать эту модель через API, совместимый с OpenAI?
Используйте базовый URL https://api.orcarouter.ai/v1 с идентификатором модели \"google/gemini-2.5-flash-lite\" в вашей клиентской библиотеке OpenAI. Включите ваш ключ API OrcaRouter в заголовок Authorization.
Можно ли использовать мультимодальные входные данные, такие как изображения и аудио?
Да, модель принимает текстовые, графические, файловые, аудио- и видеовходы. Вы можете включать их как части содержимого в сообщении пользователя, используя стандартный мультимодальный формат OpenAI.
Какова ожидаемая задержка?
Модель разработана для низкой задержки, особенно по сравнению с более крупными моделями. Точное время зависит от длины ввода/вывода и нагрузки на сервер. Конкретные показатели задержки не предоставляются.
Какие языки программирования и фреймворки поддерживаются?
Можно использовать любой язык, поддерживающий HTTP-запросы и формат API OpenAI (Python, JavaScript, Go, Java и т.д.). Официальная библиотека OpenAI для Python работает без проблем.
Предлагает ли OrcaRouter кэширование или скидки для больших объемов?
Информация о кэшировании или оптовых скидках не предоставлена. Ценообразование осуществляется за токен по тарифам провайдера без наценки. Обращайтесь в OrcaRouter по вопросам корпоративных заказов.

Встроить значок

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50через OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="Google: Gemini 2.5 Flash Lite в OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

Карточка модели в виде данных

GET /api/public/models/google/gemini-2.5-flash-liteОткрыть
Машиночитаемо:/llms.txt/llms-full.txt