Титульная карточка для сравнения Gemini 3.7 Flash и DeepSeek V4 Flash, показывающая две молнии: закрытый сейф с надписью Gemini 3.7 Flash и ценником $0.75 / $3.75, а также открытую коробку со стрелкой загрузки с надписью DeepSeek V4 Flash и ценником $0.14 / $0.28.
Guides & Insights

Gemini 3.7 Flash против DeepSeek V4 Flash: две модели «Flash», противоположные ответы на один и тот же вопрос

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Две модели 2026 года с самыми запутанными названиями обе называются Flash, и они не могли бы ответить на один и тот же вопрос более по-разному. Gemini 3.7 Flash, выпущенный 13 августа 2026 года, — закрытая рабочая лошадка Go​ogle: примерно 340 выходных токенов в секунду, индекс интеллекта 56 и акционная цена $0,75 за миллион входных токенов и $3,75 за миллион выходных токенов. DeepSeek V4 Flash — это половина семейства Deep​Seek V4 с открытыми весами. Она вышла в апреле и была обновлена в конце июля: распространяется по лицензии MIT, доступна для скачивания, а в собственном API Deep​Seek стоит $0,14 за миллион входных токенов и $0,28 за миллион выходных — примерно пятая часть акционной цены Go​ogle за входные токены и тринадцатая часть цены за выходные. Обе — «флеш»-модели, созданные для быстрой и дешёвой работы с большими объёмами. На этом слове сходство и заканчивается.

Вопрос, на который они отвечают по-разному, — определяющий для этого поколения: арендуете ли вы интеллект или владеете им? DeepSeek V4 Flash — это модель смеси экспертов с 284 миллиардами параметров, примерно 13B активных на токен, окном контекста в 1M токенов и потолком вывода в 384K токенов, выпущенная под лицензией MIT — веса представляют собой загрузку объёмом ~160GB, а обновление от 31 июля (V4-Flash-0731) добавило существенно более сильные агентные возможности. Gemini 3.7 Flash — проприетарная модель, построенная на базе Gemini 3.6 Flash, с контекстом в 1M, ограничением вывода в 64K, мультимодальным вводом и без возможности самостоятельного хостинга. Одну из этих моделей можно изолировать от сети, тонко настраивать и запускать на собственном оборудовании. Другая работает только там, где её запускает Google.

The Google DeepMind model card for Gemini 3.7 Flash, showing the model's headline description as Google's workhorse model for coding and agents, its 1M-token context window and 64K output cap, and benchmark tables of its gains over Gemini 3.6 Flash.

Два Флэша, бок о бок

Обе модели ориентированы на одного и того же покупателя — высоконагруженные производственные задачи, которые не могут позволить себе флагманскую модель по цене за токен, — но достигают этого через противоположные архитектуры. Гибридное внимание DeepSeek V4 Flash (сжатое разреженное плюс сильно сжатое внимание) делает его контекст в 1M достаточно экономичным, чтобы продавать его по таким ценам; это модель, на которую Deep​Seek направляет устаревшие конечные точки `deepseek-chat` и `deepseek-reasoner`, выведенные из эксплуатации в июле. Gemini 3.7 Flash — это алгоритмическое усовершенствование Go​ogle собственной линейки Flash, и его преимущество — пропускная способность при обслуживании: независимые измерения дают около 340 токенов/с против примерно 113 у DeepSeek V4 Flash, причём он достигает этого, принимая аудио- и видеовходные данные, которые DeepSeek V4 Flash не принимает.

Индекс интеллекта — 56 для Gemini 3.7 Flash против 50 для DeepSeek V4 Flash, по данным Artificial Analysis.

Скорость вывода — ~340 токенов/с против ~113 токенов/с, оба по данным Artificial Analysis.

Контекстное окно — 1M токенов для обоих; DeepSeek V4 Flash выдаёт до 384K против 64K у Gemini 3.7 Flash.

Цена ввода — $0.75 (промо-цена, до 2026 года) по сравнению с $0.14 на собственном API Deep​Seek.

Цена вывода — $3.75 (по акции) против $0.28.

Веса — проприетарные, в отличие от распространяемых под лицензией MIT и доступных для загрузки.

A comparison scoreboard for Gemini 3.7 Flash and DeepSeek V4 Flash: Gemini 3.7 Flash leads 56 to 50 on the AA Index and ~340 to ~113 tokens per second, while DeepSeek V4 Flash leads 384K to 64K on max output, $0.14 to $0.75 on input and $0.28 to $3.75 on output, with both at 1M context and proprietary weights against MIT open weights.

Что на самом деле дают шесть пунктов индекса

Разрыв в шесть пунктов по Index значим, но не пропасть, и приходится он в основном на области, под которые DeepSeek V4 Flash не был оптимизирован. Заявленные показатели Gemini 3.7 Flash в агентном кодинге (65.3 на DeepSWE v1.1, 43.6 на FrontierCode 1.1 Main, по данным вендора) заметно выше, а её Elo в веб-разработке (1588, также по данным вендора) отражает реальный прогресс в генерации UI. Собственные заявленные цифры DeepSeek V4 Flash — 79.0 на SWE-bench Verified, 91.6 на LiveCodeBench, 95.0 на τ²-Bench, который подтверждают независимые трекеры, — хорошо держатся в ограниченных задачах кодинга и в работе с инструментами, а извлечение информации из контекста в 1 млн токенов (78.7 на MRCR, 60.5 на CorpusQA) не уступает любому продукту в этом ценовом классе. Закономерность простая: Gemini 3.7 Flash лидирует по глубине агентных возможностей и по веб-разработке, а DeepSeek V4 Flash обменивает это на чистую экономику токенов и потолок по длине контекста, до которого не дотягивается ни одна закрытая рабочая лошадка.

Открытые веса меняют процесс закупки, а не только цену.

Лицензия MIT — это та часть этого сравнения, которую не отражает ни одна таблица бенчмарков. DeepSeek V4 Flash можно скачать и запускать на собственном оборудовании, дообучать на собственных данных и использовать в средах, где вызовы API запрещены, — и в лицензии нет ограничений, зависящих от масштаба, так что ничто в вашем росте не меняет условий. Практическая цена — операционная: обслуживание MoE-модели на 284 млрд параметров со скоростью, которую хочет production-команда, требует реального парка GPU, и для большинства команд честный выбор — размещённый API. Именно здесь разница в цене делает свою настоящую работу: даже размещённый маршрут за $0,14 / $0,28 достаточно дёшев, чтобы быть вариантом по умолчанию для длинного хвоста трафика. Gemini 3.7 Flash не предлагает никакого пути к владению — вы покупаете надёжно управляемый, быстрый, мультимодальный сервис с акционным ценником и обрывом в январе.

Счет по объему

Запустите в один и тот же день на обоих: 20 миллионов входных токенов и 4 миллиона выходных токенов. На собственном API DeepSeek V4 Flash это $2.80 + $1.12, примерно $3.92. На Gemini 3.7 Flash по акционному тарифу это $15 + $15, примерно $30 — разрыв в 7.6 раза, даже пока действует скидка Go​ogle. После 1 января 2027 года, когда Gemini 3.7 Flash вернётся к $1.50 / $7.50, тот же день обойдётся примерно в $58, что в пятнадцать раз больше, чем у Deep​Seek. Преимущество в скорости частично компенсирует это для интерактивных нагрузок — более быстрые токены означают меньше одновременных запросов — но для пакетной и фоновой работы открытая модель безоговорочно выигрывает по стоимости. Эти две модели даже не нацелены на одну и ту же кривую затрат, в этом и заключается весь смысл.

The OrcaRouter model page for DeepSeek V4 Flash, showing the ~$0.15 per million input and ~$0.29 per million output pass-through pricing, a 1M-token context window with 384K max output, and the text-only 284B-total / 13B-active mixture-of-experts description.

Кто на чем должен строить

Выбирайте DeepSeek V4 Flash, когда цена за токен является ограничивающим фактором, когда вам нужны длинные ответы до 384K, когда вам нужна возможность собственного хостинга или изолированного развертывания, или когда вы создаете продукт, чья маржа не выдержит цен на токены флагманских моделей. Выбирайте Gemini 3.7 Flash, когда вам нужна скорость в интерактивном цикле, мультимодальный ввод, управляемая надежность Go​ogle или более сильные результаты агентной разработки кода, о которых заявляет Go​ogle — и когда вы готовы к тому, что акционная цена временна. Они не соперники в том смысле, в каком соперничают два флагмана; это две разные стратегии закупок, носящие одно и то же название. На уровне маршрутизации стратегии встречаются: DeepSeek V4 Flash доступен на OrcaRouter по прейскурантной цене Deep​Seek с нулевой наценкой, и схема отказоустойчивого переключения естественно вписывается в эту пару — правило, которое направляет основную часть трафика на V4 Flash, а сложные случаи передает более сильной закрытой модели, при этом Gemini 3.7 Flash доступен через собственный Gemini API Go​ogle на другом плече того же маршрутизатора.

Честное прочтение

Если вы можете развернуть модель самостоятельно или руководствуетесь исключительно стоимостью, DeepSeek V4 Flash — лучшая модель для создания продукта, а лицензия превращает это решение в то, к которому вам не придётся возвращаться. Если вам нужна скорость обслуживания Go​ogle, мультимодальный ввод или заявленное преимущество в агентном кодировании, Gemini 3.7 Flash — лучший сервис, пока действует акция — с уже запланированным удвоением цены в январе. Две модели, одно название — и рынок увидит, какой философии отдаст голоса трафик следующего года.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно