
Ling-3.1-flash уже доступна и бесплатна в течение двух недель: что на самом деле даёт 560B MoE
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 219 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 117 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1064 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 41 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Ling-3.1-flash — примерно 560-миллиардная mixture-of-experts (смесь экспертов), о которой лаборатория inclusionAI компании Ant Group объявила 29–30 сентября 2026 года, — на этой неделе перестала быть пресс-релизом: теперь она отвечает на запросы через действующий коммерческий API. Модель доступна в рамках двухнедельного бесплатного тестирования на стороннем инференс-шлюзе, а также появилась в собственном продукте Ant — Ling Studio, — что смещает вопрос с «существует ли она» на «что она на самом деле обслуживает». Ответ уже, чем можно предположить по заголовочным цифрам. Ling-3.1-flash работает с текстом на входе и текстом на выходе; она обслуживает контекст в 262 144 токена (256K), хотя в анонсе как конечная цель указан 1M; её вывод ограничен 32 768 токенами; и никто не опубликовал цену, которую вы заплатите на пятнадцатый день, когда бесплатное окно закроется и, как предполагается, следом появятся веса.
Этот зазор между карточкой анонса и работающим эндпоинтом — это то полезное, что стоит запомнить, потому что большинство материалов об этом релизе читают спецификации так, будто модель выпускает их сегодня. Но это не так. Ling-3.1-flash — это вторая модель от этой лаборатории за три месяца, которая появляется как то, что независимый трекер LLM Releases прямо относит к категории "weights not released", и разница между тем, чем Ant называет модель, и тем, что разработчик может вызвать прямо сейчас, — это то место, где бюджет или пилотный проект могут незаметно пойти не так.
Что изменилось между анонсом и сегодняшним днём
Само объявление было постом со спецификацией: ~560 млрд параметров всего, ~25 млрд активных на токен, до 1 млн токенов контекста, три ключевых числа из оценки и обещание — «мы планируем вскоре открыть исходный код модели». Ничего из этого не изменилось. Изменилась доступность. В течение дня после объявления модель стала доступна на коммерческом edge-сервисе, а бесплатная пробная версия предоставляет тот же реальный эндпоинт, что и платная: та же поверхность API, та же текстовая модальность, тот же переключатель режима размышления для долгосрочной работы агентов.
Для тех, кто решает, стоит ли тратить на это инженерное время: на этой неделе всё сводится к пробному периоду, и у него есть две стороны. Бесплатный инференс на две недели — действительно дешёвый способ увидеть, как модель ведёт себя на ваших собственных промптах; редкость для модели такого размера. Но бесплатный доступ — это промоакция, а не цена. Опубликованной тарифной сетки для Ling-3.1-flash после пробного периода пока нигде нет, так что любая модель затрат, построенная на бесплатном уровне, — лишь заглушка, пока Ant и его хостинг-провайдеры не выставят цифры.
Спецификация и три цифры, которые всё ещё остаются обещаниями
• Параметры — 560 млрд всего, ~25 млрд активных на токен. Согласно заявлению производителя, это примерно вчетверо больше, чем у предыдущего поколения — 124 млрд всего / 5,1 млрд активных. Коэффициент разреженности сохраняется на уровне около 1 к 22, так что активация не стала значительно экономнее — модель просто гораздо крупнее той, которую она сменяет.
• Контекст — сегодня обслуживает 262 000 токенов. «1M» — это лимит токенов, когда он будет включён; это не то, что даёт пробный эндпоинт, и это самое главное в этом релизе.
Вывод — максимум 32 768 токенов. Разумно для циклов агента, но впритык, если вы собираетесь генерировать длинные документы за один проход.
• Модальность — текст на входе, текст на выходе. Это текстовая модель. Визуальный ввод, аудиоввод и ввод файлов не входят в запуск, и для них не указана дата.
• Рассуждение — гибридный стек с явным переключателем режима размышления, та же схема, которую использовало предыдущее поколение, ориентированная на многошаговую работу агентов и вызов инструментов, а не на однотуровый чат.
• Веса и лицензия — не опубликованы. Это самый важный показатель и в то же время тот, у которого пока вообще нет значения: по состоянию на сегодня не существует ни репозитория Hugging Face, ни текста лицензии, ни доступного для скачивания чекпоинта.

Карточка бенчмарка, прочитанная с необходимой ей скидкой
Собственная отчётность Ant ставит Ling-3.1-flash на совокупный показатель 81,0 по пяти агентным бенчмаркам: 40,4% на Terminal-Bench 4.0, 55,9% на SWE-Atlas и 65,35% на HealthBench Professional; собственные данные компании добавляют 1 673 Elo на GDPVal-AA v2.1 и 75,16 на FrontierSWE. Каждое из этих чисел получено самим производителем. Нет ни харнесса, ни набора промптов, ни весов, чтобы кто-то другой мог заново прогнать весь набор тестов, — а это стандартная оговорка для модели на данном этапе, и здесь стоит сказать прямо: невоспроизведённая оценка вендора — это утверждение о модели, а не её измерение.
Карточка также информативна в том смысле, который её авторы, возможно, не имели в виду. Результат 40,4% в Terminal-Bench 4.0 заметно отстаёт от передового эшелона; Claude Sonnet 5.5 — модель среднего веса, а не флагман — набирает 70,6% в той же версии этого бенчмарка. Честная трактовка не в том, что Ling-3.1-flash слаба — 40,4% это достойный показатель для агентного терминала для модели, позиционируемой по стоимости, — а в том, что формулировка «близко к фронтиру по ключевым бенчмаркам», ходившая в соцсетях в день анонса, не выдерживает сопоставления с конкретными строками. Бенчмарк, где модель выглядит сильнее всего, HealthBench Professional с 65,35, — это также тот, который несёт неловкую сноску: Ant заявляет, что модель оценивали в среде, которую она называет AQ, и что возможности модели в области здравоохранения «сейчас можно испытать только в AQ», нигде публично не определяя, что такое AQ. Результат, вынесенный в заголовок, с привязанной к нему безымянной средой — это демонстрация, а не воспроизводимый результат.
Почему выход большой модели в качестве пробной версии — это и есть настоящая новость
Самое интересное здесь — это последовательность, а не параметры. Ling-3.0-flash сразу перешла к открытым весам. Эта же выходит сначала в пробном режиме: веса, лицензия и официальные цены пока не раскрываются, а публичное обязательство открыть исходный код даётся только после окончания бесплатного периода. Это коммерческий сценарий выпуска, поданный как анонс открытой модели, и это реальное изменение, за которым стоит следить: если веса появятся под разрешительной лицензией, сообщество получит базовую модель на 560B для дообучения и дистилляции; если же они появятся с коммерческими условиями, то продуктом был двухнедельный пробный период, а фраза об «открытом исходном коде» — маркетингом. В любом случае выбор произойдёт в пределах пробного окна, и следить нужно именно за этим, а не за какой-то отдельной строкой бенчмарка.
Где это выполняется, и честная картина маршрутизации
Пока что Ling-3.1-flash доступна через собственный интерфейс продукта вендора и через сторонние платформы инференса, на которых проходит триал, — и это всё. Сегодня её нет в каталоге OrcaRouter; поиск в нашем публичном API моделей для всех трёх — Ling-3.1-flash, Ling-3.0-flash и варианта Ling-3.0 vision — возвращает not-found, и мы не станем делать вид, что это не так. Когда эндпоинт Ant действительно станет общедоступным с опубликованной прейскурантной ценой, сквозная модель, на которой работает OrcaRouter, — прейскурантная цена провайдера, передаваемая с нулевой наценкой, так что снижение цены вендором становится доступным на нашей стороне в тот же день, — это именно та схема, которая подходит модели, ценообразование которой ещё не прописано.
Что вы можете сделать сегодня, не дожидаясь решения по лицензии, — запустить то сравнение, которое действительно важно для непроверенной модели: измерить её против моделей уровня Flash, к которым можно обратиться прямо сейчас. Gemini 3.8 Flash и DeepSeek-V4.1-Flash — обе есть в нашем каталоге по прейскурантным ценам их провайдеров, за одним API-ключом, с автоматическим переключением при сбое между ними. Для модели в бесплатном пробном периоде, у которой неизвестны ни веса, ни тарифная сетка, это разумный способ её держать — ещё один кандидат, на который можно маршрутизировать, пока длится пробный период, и производственный путь, не зависящий от того, что произойдёт на пятнадцатый день.

Что делать на этой неделе
Если модель имеет отношение к вашей работе, пробный период — это причина действовать сейчас, а не ждать, пока прояснится вопрос с открытыми весами — две недели бесплатного инференса на 560B MoE — это самая дешёвая оценка, которую вы можете получить, и ответ на вопрос «выдерживает ли она мои промпты» доступен уже сегодня, хотя ответ на вопрос «могу ли я развернуть её самостоятельно» — нет. Три вещи, которые стоит проверить, пока окно открыто, по порядку:
• Запускайте собственную нагрузку, а не карточку бенчмарка. Опубликованные цифры — это набор задач, выбранных Ant; именно ваши промпты решают, каким будет ваш стек.
• Проверьте контекст, который вы действительно будете использовать. Эндпоинт обслуживает 262 144 токена, а не 1M. Если ваш дизайн зависит от большего окна, вы проектируете, исходя из обещания.
• Не стройте модель затрат на «бесплатности». Бесплатность — это состояние на две недели. Пока тарифная сетка не опубликована, планируйте возврат к платной модели уровня Flash как вариант по умолчанию, а Ling-3.1-flash рассматривайте как дополнительную мощность.
Анонс настоящий, и модель работает — это больше, чем можно было сказать неделю назад. Но «выпущена и открыта» и «работает в тестовом режиме» — разные состояния, и текущее уверенно второе: спецификация на 560B, эндпоинт на 256K, бенчмарк-карта только от вендора и двухнедельный отсчёт, который является единственным жёстким дедлайном во всём релизе.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
