Gemini 3.5 Flash-Lite

google/gemini-3.5-flash-lite
НовинкаРекомендуем
ЗрениеАудиоИнструментыJSONРассуждение
от Google · 2026-07-21

Gemini 3.5 Flash-Lite — это самая экономичная модель Gemini от Google, специально созданная для рабочих нагрузок с очень большим объемом и чувствительных к задержкам, где доминирует стоимость за вызов. Несмотря на свою цену, она является нативно мультимодальной — принимает текст, изображения, видео, аудио и файлы с выводом текста — и имеет такое же окно контекста на 1M токенов и до 64K выходных токенов, как и более крупный уровень Flash, так что длинные документы и смешанные медиа-входные данные остаются доступными. Примерно за пятую часть цены 3.6 Flash, это правильный инструмент для классификации, извлечения, маршрутизации, суммаризации, легковесных агентов, генерации синтетических данных и любых конвейеров, выполняемых миллионы раз. Он по-прежнему поддерживает настраиваемые усилия по рассуждению, встроенный вызов инструментов и структурированные выходные данные, и превосходит свои возможности в агентских и длинно-контекстных бенчмарках для облегченной модели — например, 74.0% на OSWorld-Verified и 72.2% на извлечении 128k multi-needle, уверенно опережая предыдущую 3.1 Flash-Lite. Он поддерживает как формат чат-завершений OpenAI, так и собственный API generateContent от Gemini, поэтому вы можете смешивать его с более тяжелыми моделями в рамках одной интеграции — направляя легкий трафик большого объема на Flash-Lite и передавая сложные задачи на 3.6 Flash или модель Pro.

конт.1.05M токенов
Макс. вывод65.5K
Вводtext + image + video + file + audio
Выводtext
p50 TTFT1.30 s
ВХОД$0.30/ 1M токенов
ВЫХОД$2.50/ 1M токенов
p50 TTFT1.30 s7 д
p95 TTFT10.00 s7 д
ТРАФИК5.9Mтокенов / 7 д

Google Gemini 3.5 Flash-Lite — это мультимодальная языковая модель, разработанная Google и предлагаемая через совместимый с OpenAI API сервиса OrcaRouter. Она принимает текстовые, графические,…

Что такое Google Gemini 3.5 Flash-Lite?

Для кого предназначена эта модель?

Какие модальности поддерживает модель?

Каков размер контекстного окна и максимальный вывод?

Примеры кода

Вызов из любого SDK

Совместимо с OpenAI — оставьте свой SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Поддерживаемые параметры

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Цены

Ввод / 1M токенов$0.300
Вывод / 1M токенов$2.50
Чтение кэша / 1M$0.030
ВалютаUSD

Калькулятор стоимости

Токенов / месяц10MM
Доля ввода70%%
Оценка / месяц $9.60 · С кэшем промптов $8.66

Оценка по прайс-листу

Оценка токенов и стоимости

Токены ввода: 19Стоимость за запрос: $0.001256

Только оценка — фактическое число токенов зависит от токенизатора провайдера.

Производительность

p50 TTFT
1.30 s
Скорость вывода
829 tok/s
p95 TTFT
10.00 s
Частота ошибок
5.0%

Публичные тесты

49.3
AA Coding
Лучше, чем 60% сравниваемых моделей
49 из 122
36.5
AA Intelligence
Лучше, чем 54% сравниваемых моделей
57 из 124
CharXiv Reasoning (no tools)
74.5
CharXiv Reasoning (with tools)
76.5
GDM-MRCR v2 8-needle (128k avg)
72.2
GDM-MRCR v2 8-needle (1M pointwise)
21.3
GPQA Diamond
83.8
Humanity's Last Exam
17.5
Long-Context Recall
62.0
MLE-Bench
39.2
OSWorld-Verified
74.0
SciCode
40.9
SWE-Bench Pro (Public)
54.2
tau_banking
16.5
Terminal-bench 2.1 (Terminus-2)
54.0
terminalbench_v2_1
53.6
Источник: artificialanalysis.ai, deepmind.google

Сравнение

Gemini 3.5 Flash-LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Ввод $/млн$0.30$2.00$4.00$0.50
Вывод $/млн$2.50$12.00$18.00$3.00
Контекст1.0M1.0M1.0M1.0M
Качество6/1010/1010/109/10
Сравнить бок о бокСравнить бок о бокСравнить бок о бокСравнить бок о бок

Больше от Google

FAQ

Какова цена за токен для Gemini 3.5 Flash-Lite на OrcaRouter?
Цена составляет $0.30 за миллион входных токенов и $2.50 за миллион выходных токенов. Это тарифы провайдера без наценки. Входные токены включают все модальности (текст, изображение, видео, аудио, файл). Выходные токены — это сгенерированный текст.
Какой размер контекстного окна?
Контекстное окно составляет 1,048,576 токенов (примерно 1 миллион). Максимальная длина вывода — 65,536 токенов. Это позволяет обрабатывать очень длинные документы, видео или аудиозаписи в одном запросе API.
Каковы ключевые сильные стороны этой модели?
Его основные преимущества: очень низкая стоимость за токен, поддержка пяти входных модальностей (текст, изображение, видео, аудио, файл), огромное окно контекста в 1M и способность использования инструментов (оценка CharXiv Reasoning 76.5 с инструментами). Он предназначен для высокопроизводительных, чувствительных к стоимости производственных конвейеров.
Как он соотносится с более крупными моделями, такими как Gemini 3.5 Pro?
Прямые сравнительные тесты производительности не приводятся. Как облегченная версия flash‑lite, эта модель ставит во главу угла эффективность и низкую стоимость, а не чистую производительность. Более крупные модели, такие как Gemini 3.5 Pro, вероятно, добьются более высокой точности в сложных задачах рассуждения, но будут стоить значительно больше за токен. Используйте эту модель, когда критичны стоимость и пропускная способность.
Кеширует ли модель подсказки для снижения затрат?
Предоставленная информация не упоминает механизм кэширования или скидочные цены на кэшированные токены. Следует считать, что все токены оплачиваются по стандартной ставке за входные токены. Если кэширование важно, уточните у OrcaRouter или Google о возможных скидках.
Как получить доступ к этой модели через API, совместимый с OpenAI?
Используйте API OrcaRouter по базовому URL https://api.orcarouter.ai/v1. Установите параметр model в значение "google/gemini-3.5-flash-lite". API полностью совместим с форматом чата OpenAI (chat completions), включая мультимодальный контент и определения инструментов.
Какую обработку данных и конфиденциальность я могу ожидать?
Обработка данных регулируется политиками Google (провайдер) и условиями OrcaRouter. Модель обрабатывает ваши входные данные, а результат возвращается вам. Для данной модели не предоставлено специальных сертификатов конфиденциальности. Для чувствительных данных ознакомьтесь с соглашением об обработке данных провайдера.
Могу ли я использовать эту модель для приложений реального времени?
Детали задержки не указаны. Модель может возвращать ответы за секунды для коротких входных данных, но обработка очень длинных запросов (около 1M токенов) может занимать десятки секунд. Она подходит для приложений, работающих в режиме, близком к реальному времени, с входными данными умеренного размера. Для строгих требований реального времени протестируйте с ожидаемой длиной входных данных.
Какой балл в тесте CharXiv Reasoning benchmark?
Модель достигла результата 76,5 на CharXiv Reasoning с инструментами. Этот бенчмарк проверяет понимание диаграмм и рассуждения. Результат указывает на средние показатели: модель может интерпретировать диаграммы и отвечать на вопросы, но не на уровне специализированных моделей рассуждений. Другие результаты бенчмарков не предоставлены.
Существует ли минимальная стоимость или обязательство для использования OrcaRouter?
OrcaRouter не устанавливает минимальную ежемесячную сумму расходов. Вы платите только за использованные токены по тарифам провайдера без наценки. Никакой предоплаты или долгосрочного контракта. Просто зарегистрируйтесь для получения API-ключа и начните отправлять запросы.

Встроить значок

Google: Gemini 3.5 Flash-Lite$0.30/M in1298ms p50через OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.5-flash-lite.svg" alt="Google: Gemini 3.5 Flash-Lite в OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.5 Flash-Lite](https://www.orcarouter.ai/embed/google/gemini-3.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-3.5-flash-lite)

Карточка модели в виде данных

GET /api/public/models/google/gemini-3.5-flash-liteОткрыть
Машиночитаемо:/llms.txt/llms-full.txt