
Ling-3.1-flash против Gemini 3.8 Flash: пробная модель на 256K против действующей модели на 1M токенов
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 219 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 117 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1064 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 41 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Поставьте Ling-3.1-flash и Gemini 3.8 Flash рядом — и несоответствие окажется не в интеллекте, а в статусе. Ling-3.1-flash, mixture-of-experts от Ant Group с ~560 млрд параметров, анонсированная 29–30 сентября 2026 года, — это бесплатная двухнедельная пробная версия с обслуживаемым контекстом 256K, лимитом вывода в 32 768 токенов, только текстовым вводом и без опубликованных весов, лицензии или цены. Gemini 3.8 Flash, модель рассуждений уровня Flash от Google, выпущенная 2 сентября 2026 года, — это общедоступный API с полным окном в 1 048 576 токенов, выводом в 65 536 токенов, мультимодальным вводом и публичной тарифной сеткой. На бумаге это сравнение двух моделей; на практике — сравнение модели, на которой можно строить уже сегодня, с той, которую можно только протестировать в этом месяце.
Это не повод отвергать Ling-3.1-flash. Бесплатная 560B MoE с агентным уклоном стоит двух недель чьего угодно времени на оценку. Но это меняет то, для чего нужно очное сравнение: не «что мне выбрать в качестве стандарта», а «достаточно ли хороша пробная модель, чтобы мне подстраховаться насчёт ответа через пятнадцать дней». Это разные вопросы, и по каждой из осей ниже у них разные ответы.
Три вещи, которые решают исход ещё до того, как это сделает любой бенчмарк
Большинство сравнений начинается со счёта. Это следует начать с доступности, потому что разрыв там — не вопрос степени.
• Цены — Ling-3.1-flash бесплатен на протяжении пробного периода, и опубликованной тарифной сетки после его окончания у него нет вообще. Gemini 3.8 Flash в течение промо-периода указан по цене $0,75 за миллион входных токенов и $3,75 за миллион выходных, а с 1 января 2027 года вернётся к $1,50 / $7,50. Цены из прайс-листа, заявленные производителем; обе могут измениться.
• Контекст — Ling-3.1-flash обслуживает 262 144 токена в пробной версии, а 1 000 000 заявлены как конечная цель. Gemini 3.8 Flash уже сегодня поддерживает полные 1 048 576 токенов. Если ваша рабочая нагрузка зависит от окна в миллион токенов, сейчас оно есть только у одного из этих двух.
• Веса — у Ling-3.1-flash опубликованных весов нет: ни репозитория, ни лицензии, ни чекпоинта — лишь заявленное намерение открыть исходный код после испытательного периода. Gemini 3.8 Flash закрыт и всегда таким останется, но это управляемый API, который сегодня можно вызывать без всякой двусмысленности.
Если читать их вместе, эти три пункта складываются в один тезис: главные преимущества модели Ling — либо промо-характера (бесплатность), либо перспективные (контекст 1M, открытые веса), тогда как преимущества модели Gemini — договорные. Эта асимметрия пронизывает всё последующее.
Где модель Ling действительно выигрывает
Два места, и оба настоящие.
Первый — это стоимость на этапе оценки. Двухнедельный бесплатный пробный период для модели такого размера — не маркетинговый трюк, от которого можно отмахнуться, — это самый дешёвый способ выяснить, справляется ли смесь экспертов на 560B с вашими промптами. Gemini 3.8 Flash, какова бы ни была его цена, не бесплатен, а серьёзная оценка на нескольких тысячах вызовов стоит реальных денег.
Второй — траектория открытости. Ling-3.1-flash — преемник модели, которая действительно выпустила веса под лицензией MIT, и Ant публично заявила, что намерена открыть исходный код и этой. Если это произойдёт под разрешительной лицензией, вы получите то, чего Gemini 3.8 Flash никогда не сможет предложить: возможность самостоятельно размещать, дообучать или дистиллировать базовую модель на 560B. Подвох — тот, что важнее всего: вы ставите на обещание, а обещание предыдущего поколения было выполнено с двухнедельной задержкой, а не гарантированно.
Где Gemini 3.8 Flash и близко не проигрывает
Если отбросить судебный процесс и вопрос открытости, то операционное сравнение складывается явно не в пользу Google.
• Ввод — Gemini 3.8 Flash принимает текст, изображения, видео, файлы и аудио. Ling-3.1-flash принимает текст и возвращает текст. Для рабочих процессов с документами, скриншотами или видео это не предпочтение, а граница возможностей.
• Потолок вывода — 65 536 токенов против 32 768. Актуально с того момента, как вы генерируете отчёты, файлы кода или длинный структурированный вывод за один проход.
• Пропускная способность — независимое тестирование оценивает медианную скорость вывода Gemini 3.8 Flash примерно в 249 токенов в секунду, а собственная семидневная телеметрия OrcaRouter фиксирует 552 токена в секунду при p50 времени до первого токена 4,95 секунды. Для пробного хостинга Ling-3.1-flash сообщалось о примерно 63 токенах в секунду. Модель Gemini относится к совершенно иному классу скорости.
• Глубина референса — за Gemini 3.8 Flash стоит массив независимых измерений; все показатели Ling-3.1-flash — собственные, на совершенно новом эндпоинте, и пока ни одна третья сторона их не воспроизводила.
• Мультимодальные агенты — всё, что должно прочитать скриншот, PDF или запись звонка, — это задача для Gemini по определению, а не по качеству.

Бенчмарки, и почему эти два набора на самом деле нельзя сравнивать
Заявленный вендором результат для Ling-3.1-flash — это совокупный показатель 81,0 по пяти агентным бенчмаркам, при этом 40,4% на Terminal-Bench 4.0, 55,9% на SWE-Atlas и 65,35% на HealthBench Professional; собственные данные Ant добавляют 1 673 Elo на GDPVal-AA v2.1 и 75,16 на FrontierSWE. Каждое из этих значений — измерение самой Ant. Не опубликовано ни харнесса, ни, что важнее, весов, на которых кто-либо мог бы повторно прогнать этот набор.
Картина с Gemini 3.8 Flash качественно иная. В текущей сборке Intelligence Index от Artificial Analysis (v4.3.2) он набирает 40,9 при высоких усилиях рассуждения, 39,8 — при средних и 33,5 — при низких; и стоит отметить, что индекс недавно был пересмотрен, поэтому цифры, опубликованные об этой модели ранее осенью, были рассчитаны на другой сборке и не сопоставимы напрямую с этими. Собственные заявления Google об этой модели включают 54,9 на HLE-Verified и сильные результаты Terminal-Bench 2.1 — в верхней части диапазона 80-х. Независимые и вендорские цифры — рядом, обе правомерны, но не взаимозаменяемы.
Стоит сделать одно чистое перекрёстное сравнение, потому что обе модели относятся к одному семейству бенчмарков. На Terminal-Bench 4.0 заявленный вендором показатель Ling-3.1-flash составляет 40.4%. Claude Sonnet 5.5 — модель среднего уровня, а не флагман — набирает 70.6% на той же версии. Эта единственная строка — сильнейший аргумент против того, чтобы воспринимать карточку Ant как «близкую к фронтиру»: модель конкурентоспособна по агентным метрикам, которые Ant решил выделить, и явно уступает по метрике терминального кодинга, где существует внешняя цифра.

Практическая форма выбора
Если вам нужно что-то построить в ближайшие две недели, ответ однозначен, и это не упрёк Ling-3.1-flash. Gemini 3.8 Flash — единственная из двух, которая даёт стабильный эндпоинт, опубликованную цену, полное окно в миллион токенов, мультимодальный ввод и лицензию, которую можно прочитать. Это продакшн-модель уровня Flash.
Ling-3.1-flash — это объект оценки. Её ценность сейчас в том, что оценка бесплатна, а модель интересна: 560B MoE всего с ~25B активных параметров на токен — это ставка на разреженность, и Ant позиционировала её именно под агентные и поисковые рабочие нагрузки, а также нагрузки в офисной автоматизации, за которые конкурируют модели уровня Flash. Прогонять через неё свои промпты в течение пробного периода стоит именно потому, что никто за пределами Ant ещё этого не делал, — вы окажетесь среди первых, у кого будет мнение, независимое от вендора.
Дерево решений, которое имеет смысл в этом месяце: направьте продакшен на Gemini 3.8 Flash, потратьте бесплатный пробный период на прогон Ling-3.1-flash на ваших самых сложных промптах и оставьте вопрос об открытых весах как настоящую развилку. Если веса появятся с разрешительной лицензией и цена окажется близкой к уровню Flash, Ling-3.1-flash станет реальной второй опцией — той, которую вы сможете разместить у себя, чем Gemini никогда не станет. Если же они появятся с оговорками, пробный период закончится — как и сравнение.
Запускать оба с одного ключа и честно говорить о том, чего не хватает
Gemini 3.8 Flash уже сегодня доступна в каталоге OrcaRouter под идентификатором модели google/gemini-3.8-flash по собственной прейскурантной цене Google без наценки — так что, когда в январе промо-тариф перестанет действовать, цена, которую вы платите здесь, будет отслеживать её автоматически, без необходимости заключать новый договор. DeepSeek-V4.1-Flash — другая недорогая модель уровня Flash, которую стоит измерить в том же эксперименте, — присутствует в том же каталоге по прейскурантной цене своего провайдера, поэтому тройственное сравнение тестируемой модели с проверенными вариантами уровня Flash выполняется через один API-ключ с автоматическим переключением при сбое между ними.
Ling-3.1-flash отсутствует в нашем каталоге, и запрос к нашему публичному API моделей возвращает not-found для неё и для предыдущего поколения — поэтому честная формулировка такова: пробный доступ работает там, где он работает, через собственную площадку вендора и сторонние платформы инференса, и мы не заявляем, что размещаем её у себя. Это та часть сравнения, которая может измениться быстрее всего: модель в бесплатном пробном режиме с необъявленной ценой — ровно то, что попадает на слой маршрутизации в тот момент, когда Ant и её хостинг-провайдеры публикуют тарифную сетку, а сквозная передача с нулевой наценкой означает, что в тот же день цена здесь — это цена там.
Итак, вывод оказывается более узким, чем можно заключить по количеству параметров. Ling-3.1-flash — более амбициозная модель и более интересный исследовательский результат; Gemini 3.8 Flash — та, которую можно выпускать в продакшен. Пока лицензия и цена не появились, в этом и состоит вся разница — и это не та разница, которую решит одна строка в бенчмарке.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
