
Gemini 3.7 Flash против DeepSeek V4 Flash: две модели «Flash», противоположные ответы на один и тот же вопрос
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Две модели 2026 года с самыми запутанными названиями обе называются Flash, и они не могли бы ответить на один и тот же вопрос более по-разному. Gemini 3.7 Flash, выпущенный 13 августа 2026 года, — закрытая рабочая лошадка Google: примерно 340 выходных токенов в секунду, индекс интеллекта 56 и акционная цена $0,75 за миллион входных токенов и $3,75 за миллион выходных токенов. DeepSeek V4 Flash — это половина семейства DeepSeek V4 с открытыми весами. Она вышла в апреле и была обновлена в конце июля: распространяется по лицензии MIT, доступна для скачивания, а в собственном API DeepSeek стоит $0,14 за миллион входных токенов и $0,28 за миллион выходных — примерно пятая часть акционной цены Google за входные токены и тринадцатая часть цены за выходные. Обе — «флеш»-модели, созданные для быстрой и дешёвой работы с большими объёмами. На этом слове сходство и заканчивается.
Вопрос, на который они отвечают по-разному, — определяющий для этого поколения: арендуете ли вы интеллект или владеете им? DeepSeek V4 Flash — это модель смеси экспертов с 284 миллиардами параметров, примерно 13B активных на токен, окном контекста в 1M токенов и потолком вывода в 384K токенов, выпущенная под лицензией MIT — веса представляют собой загрузку объёмом ~160GB, а обновление от 31 июля (V4-Flash-0731) добавило существенно более сильные агентные возможности. Gemini 3.7 Flash — проприетарная модель, построенная на базе Gemini 3.6 Flash, с контекстом в 1M, ограничением вывода в 64K, мультимодальным вводом и без возможности самостоятельного хостинга. Одну из этих моделей можно изолировать от сети, тонко настраивать и запускать на собственном оборудовании. Другая работает только там, где её запускает Google.

Два Флэша, бок о бок
Обе модели ориентированы на одного и того же покупателя — высоконагруженные производственные задачи, которые не могут позволить себе флагманскую модель по цене за токен, — но достигают этого через противоположные архитектуры. Гибридное внимание DeepSeek V4 Flash (сжатое разреженное плюс сильно сжатое внимание) делает его контекст в 1M достаточно экономичным, чтобы продавать его по таким ценам; это модель, на которую DeepSeek направляет устаревшие конечные точки `deepseek-chat` и `deepseek-reasoner`, выведенные из эксплуатации в июле. Gemini 3.7 Flash — это алгоритмическое усовершенствование Google собственной линейки Flash, и его преимущество — пропускная способность при обслуживании: независимые измерения дают около 340 токенов/с против примерно 113 у DeepSeek V4 Flash, причём он достигает этого, принимая аудио- и видеовходные данные, которые DeepSeek V4 Flash не принимает.
• Индекс интеллекта — 56 для Gemini 3.7 Flash против 50 для DeepSeek V4 Flash, по данным Artificial Analysis.
• Скорость вывода — ~340 токенов/с против ~113 токенов/с, оба по данным Artificial Analysis.
• Контекстное окно — 1M токенов для обоих; DeepSeek V4 Flash выдаёт до 384K против 64K у Gemini 3.7 Flash.
• Цена ввода — $0.75 (промо-цена, до 2026 года) по сравнению с $0.14 на собственном API DeepSeek.
• Цена вывода — $3.75 (по акции) против $0.28.
• Веса — проприетарные, в отличие от распространяемых под лицензией MIT и доступных для загрузки.

Что на самом деле дают шесть пунктов индекса
Разрыв в шесть пунктов по Index значим, но не пропасть, и приходится он в основном на области, под которые DeepSeek V4 Flash не был оптимизирован. Заявленные показатели Gemini 3.7 Flash в агентном кодинге (65.3 на DeepSWE v1.1, 43.6 на FrontierCode 1.1 Main, по данным вендора) заметно выше, а её Elo в веб-разработке (1588, также по данным вендора) отражает реальный прогресс в генерации UI. Собственные заявленные цифры DeepSeek V4 Flash — 79.0 на SWE-bench Verified, 91.6 на LiveCodeBench, 95.0 на τ²-Bench, который подтверждают независимые трекеры, — хорошо держатся в ограниченных задачах кодинга и в работе с инструментами, а извлечение информации из контекста в 1 млн токенов (78.7 на MRCR, 60.5 на CorpusQA) не уступает любому продукту в этом ценовом классе. Закономерность простая: Gemini 3.7 Flash лидирует по глубине агентных возможностей и по веб-разработке, а DeepSeek V4 Flash обменивает это на чистую экономику токенов и потолок по длине контекста, до которого не дотягивается ни одна закрытая рабочая лошадка.
Открытые веса меняют процесс закупки, а не только цену.
Лицензия MIT — это та часть этого сравнения, которую не отражает ни одна таблица бенчмарков. DeepSeek V4 Flash можно скачать и запускать на собственном оборудовании, дообучать на собственных данных и использовать в средах, где вызовы API запрещены, — и в лицензии нет ограничений, зависящих от масштаба, так что ничто в вашем росте не меняет условий. Практическая цена — операционная: обслуживание MoE-модели на 284 млрд параметров со скоростью, которую хочет production-команда, требует реального парка GPU, и для большинства команд честный выбор — размещённый API. Именно здесь разница в цене делает свою настоящую работу: даже размещённый маршрут за $0,14 / $0,28 достаточно дёшев, чтобы быть вариантом по умолчанию для длинного хвоста трафика. Gemini 3.7 Flash не предлагает никакого пути к владению — вы покупаете надёжно управляемый, быстрый, мультимодальный сервис с акционным ценником и обрывом в январе.
Счет по объему
Запустите в один и тот же день на обоих: 20 миллионов входных токенов и 4 миллиона выходных токенов. На собственном API DeepSeek V4 Flash это $2.80 + $1.12, примерно $3.92. На Gemini 3.7 Flash по акционному тарифу это $15 + $15, примерно $30 — разрыв в 7.6 раза, даже пока действует скидка Google. После 1 января 2027 года, когда Gemini 3.7 Flash вернётся к $1.50 / $7.50, тот же день обойдётся примерно в $58, что в пятнадцать раз больше, чем у DeepSeek. Преимущество в скорости частично компенсирует это для интерактивных нагрузок — более быстрые токены означают меньше одновременных запросов — но для пакетной и фоновой работы открытая модель безоговорочно выигрывает по стоимости. Эти две модели даже не нацелены на одну и ту же кривую затрат, в этом и заключается весь смысл.

Кто на чем должен строить
Выбирайте DeepSeek V4 Flash, когда цена за токен является ограничивающим фактором, когда вам нужны длинные ответы до 384K, когда вам нужна возможность собственного хостинга или изолированного развертывания, или когда вы создаете продукт, чья маржа не выдержит цен на токены флагманских моделей. Выбирайте Gemini 3.7 Flash, когда вам нужна скорость в интерактивном цикле, мультимодальный ввод, управляемая надежность Google или более сильные результаты агентной разработки кода, о которых заявляет Google — и когда вы готовы к тому, что акционная цена временна. Они не соперники в том смысле, в каком соперничают два флагмана; это две разные стратегии закупок, носящие одно и то же название. На уровне маршрутизации стратегии встречаются: DeepSeek V4 Flash доступен на OrcaRouter по прейскурантной цене DeepSeek с нулевой наценкой, и схема отказоустойчивого переключения естественно вписывается в эту пару — правило, которое направляет основную часть трафика на V4 Flash, а сложные случаи передает более сильной закрытой модели, при этом Gemini 3.7 Flash доступен через собственный Gemini API Google на другом плече того же маршрутизатора.
Честное прочтение
Если вы можете развернуть модель самостоятельно или руководствуетесь исключительно стоимостью, DeepSeek V4 Flash — лучшая модель для создания продукта, а лицензия превращает это решение в то, к которому вам не придётся возвращаться. Если вам нужна скорость обслуживания Google, мультимодальный ввод или заявленное преимущество в агентном кодировании, Gemini 3.7 Flash — лучший сервис, пока действует акция — с уже запланированным удвоением цены в январе. Две модели, одно название — и рынок увидит, какой философии отдаст голоса трафик следующего года.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
