Gemini 3.6 Flash

google/gemini-3.6-flash
НовинкаРекомендуем
ЗрениеАудиоИнструментыJSONРассуждение
от Google · 2026-07-21

Gemini 3.6 Flash — это последняя быстрая и экономичная модель Google в семействе Gemini 3, изначально мультимодальная модель, которая читает текст, изображения, видео, аудио и файлы и отвечает текстом, с окном контекста в 1M токенов и до 64K выходных токенов. Она создана для команд, которым нужно качество, близкое к передовым моделям, при скорости и цене уровня Flash, и является надежным выбором для кодовых агентов, понимания документов и медиа, генерации с дополнением извлеченной информации и высокопроизводительной автоматизации. По сравнению с предыдущей версией 3.5 Flash она заметно более эффективна по токенам и менее многословна — достигает того же или лучшего качества, генерируя меньше выходных токенов, что напрямую снижает стоимость и задержку при длительных агентных запусках. Она поддерживает настраиваемые усилия при рассуждении (так что вызывающие пользователи могут регулировать глубину в зависимости от скорости на запрос), нативный вызов инструментов и структурированные выходные данные, и показывает отличные результаты в оценках длинного контекста и агентного кодирования для своего уровня, включая 91,8% при извлечении множественных иголок в среднем по 128K, а также конкурентные баллы на SWE-Bench Pro, Terminal-Bench и OSWorld. Gemini 3.6 Flash поддерживает как формат chat-completions от OpenAI, так и собственный API generateContent от Gemini, что позволяет легко обновить существующие интеграции, совместимые с Gemini и OpenAI. Используйте её как повседневную рабочую лошадку, когда вам нужно большинство функций передовой модели без оплаты передовых цен.

конт.1.05M токенов
Макс. вывод65.5K
Вводtext + image + video + file + audio
Выводtext
p50 TTFT1.67 s
ВХОД$1.50/ 1M токенов
ВЫХОД$7.50/ 1M токенов
p50 TTFT1.67 s7 д
p95 TTFT5.38 s7 д
ТРАФИК7.6Kтокенов / 7 д

Google Gemini 3.6 Flash — это крупная мультимодальная модель, разработанная Google, предлагаемая через API OrcaRouter с прозрачной ценовой политикой (без наценки). Она принимает текст, изображения,…

Что такое Google Gemini 3.6 Flash и для кого он предназначен?

Чем вариант Flash отличается от других моделей Gemini?

Какие входные модальности поддерживает Gemini 3.6 Flash?

Примеры кода

Вызов из любого SDK

Совместимо с OpenAI — оставьте свой SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3.6-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Поддерживаемые параметры

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Цены

Ввод / 1M токенов$1.50
Вывод / 1M токенов$7.50
Чтение кэша / 1M$0.150
ВалютаUSD

Калькулятор стоимости

Токенов / месяц10MM
Доля ввода70%%
Оценка / месяц $33.00 · С кэшем промптов $28.28

Оценка по прайс-листу

Оценка токенов и стоимости

Токены ввода: 19Стоимость за запрос: $0.003778

Только оценка — фактическое число токенов зависит от токенизатора провайдера.

Производительность

p50 TTFT
1.67 s
Скорость вывода
712 tok/s
p95 TTFT
5.38 s
Частота ошибок
25.0%

Публичные тесты

69.2
AA Coding
Лучше, чем 87% сравниваемых моделей
16 из 122
50.1
AA Intelligence
Лучше, чем 82% сравниваемых моделей
22 из 124
CharXiv Reasoning (no tools)
85.2
CharXiv Reasoning (with tools)
89.4
DeepSWE v1.1
49.0
GDM-MRCR v2 8-needle (128k avg)
91.8
GDM-MRCR v2 8-needle (1M pointwise)
54.0
GPQA Diamond
92.8
Humanity's Last Exam
38.3
Long-Context Recall
69.7
MLE-Bench
63.9
OSWorld-Verified
83.0
SciCode
52.7
SWE-Bench Pro (Public)
58.7
tau_banking
24.5
Terminal-bench 2.1 (Terminus-2)
78.0
terminalbench_v2_1
77.5
Источник: artificialanalysis.ai, deepmind.google

Сравнение

Gemini 3.6 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Ввод $/млн$1.50$2.00$4.00$0.50
Вывод $/млн$7.50$12.00$18.00$3.00
Контекст1.0M1.0M1.0M1.0M
Качество8/1010/1010/109/10
Сравнить бок о бокСравнить бок о бокСравнить бок о бокСравнить бок о бок

Больше от Google

FAQ

Какова стоимость использования Gemini 3.6 Flash через OrcaRouter?
Цена составляет $1.50 за 1 миллион входных токенов и $7.50 за 1 миллион выходных токенов. OrcaRouter выставляет счёт по тарифу провайдера без наценки. Никаких дополнительных комиссий нет.
Каков размер контекстного окна у Gemini 3.6 Flash?
Окно контекста составляет 1,048,576 токенов (примерно 1 миллион токенов). Максимальный вывод — 65,536 токенов. Контекст включает все входные модальности (текст, изображение, видео, файл, аудио).
Каковы ключевые сильные стороны этой модели?
Gemini 3.6 Flash предлагает очень большое окно контекста, поддерживает пять модальностей ввода (текст, изображение, видео, файл, аудио) и достигает высокого показателя в тесте на извлечение — 91,8 балла на GDM-MRCR v2 8-needle (в среднем 128k). Кроме того, как вариант Flash, он экономически эффективен.
Как Gemini 3.6 Flash сравнивается с GPT-4o или Claude 3.5 Sonnet?
Он имеет больший размер контекстного окна (1M против 128K/200K) и более низкую цену за токен ($1.50/$7.50 против ~$2.50/$10 или $3/$15). Результаты бенчмарков напрямую не сопоставимы, но Gemini Flash оптимизирован для извлечения из длинного контекста. GPT-4o и Claude могут предлагать более высокую точность рассуждений в некоторых задачах.
Как OrcaRouter обрабатывает мои данные при использовании этой модели?
OrcaRouter перенаправляет ваши запросы на серверы логических выводов Google. OrcaRouter не обучается на ваших данных и не хранит запросы дольше, чем необходимо для обработки и выставления счетов. Применяются политики конфиденциальности данных Google. Подробности можно найти в политике конфиденциальности OrcaRouter.
Могу ли я вызвать Gemini 3.6 Flash с помощью OpenAI Python SDK?
Да. Установите базовый URL на https://api.orcarouter.ai/v1 и идентификатор модели на "google/gemini-3.6-flash". Используйте библиотеку OpenAI Python с вашим ключом API OrcaRouter. Пример: client = OpenAI(api_key="your_key", base_url="https://api.orcarouter.ai/v1"), затем client.chat.completions.create(model="google/gemini-3.6-flash", messages=[...]).
Поддерживает ли модель потоковую передачу и вызов функций?
Через OrcaRouter, да. Вы можете установить stream=true и включить инструменты в запрос. API переводит формат OpenAI в API Google. Проверьте на своем примере использования, чтобы подтвердить полную совместимость.
Каково значение бенчмарк-счета 91.8 на GDM-MRCR v2 8-needle?
Он измеряет точность модели при извлечении нескольких конкретных фрагментов информации из длинного контекста (в среднем 128 тысяч токенов). Показатель 91,8% означает, что модель дала правильный ответ в 91,8% протестированных сценариев извлечения. Это указывает на высокую производительность в задачах с длинным контекстом.

Встроить значок

Google: Gemini 3.6 Flash$1.50/M in1666ms p50через OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.6-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.6-flash.svg" alt="Google: Gemini 3.6 Flash в OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.6 Flash](https://www.orcarouter.ai/embed/google/gemini-3.6-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.6-flash)

Карточка модели в виде данных

GET /api/public/models/google/gemini-3.6-flashОткрыть
Машиночитаемо:/llms.txt/llms-full.txt