Сгенерированная редакционная hero-карточка под названием «Ling-3.1-flash уже доступен и бесплатен в течение двух недель» с подзаголовком «Что 560B MoE на самом деле обслуживает сегодня». Четыре карточки со скруглёнными углами гласят: «Параметры: всего 560B / ~25B активных», «Контекст: 262 144 токена», «Лимит вывода: 32 768 токенов» и «Веса: не опубликованы», над строкой нижнего колонтитула: «Характеристики заявлены производителем; опубликованной цены после пробного периода нет».
Guides & Insights

Ling-3.1-flash уже доступна и бесплатна в течение двух недель: что на самом деле даёт 560B MoE

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Ling-3.1-flash — примерно 560-миллиардная mixture-of-experts (смесь экспертов), о которой лаборатория inclusionAI компании Ant Group объявила 29–30 сентября 2026 года, — на этой неделе перестала быть пресс-релизом: теперь она отвечает на запросы через действующий коммерческий API. Модель доступна в рамках двухнедельного бесплатного тестирования на стороннем инференс-шлюзе, а также появилась в собственном продукте Ant — Ling Studio, — что смещает вопрос с «существует ли она» на «что она на самом деле обслуживает». Ответ уже, чем можно предположить по заголовочным цифрам. Ling-3.1-flash работает с текстом на входе и текстом на выходе; она обслуживает контекст в 262 144 токена (256K), хотя в анонсе как конечная цель указан 1M; её вывод ограничен 32 768 токенами; и никто не опубликовал цену, которую вы заплатите на пятнадцатый день, когда бесплатное окно закроется и, как предполагается, следом появятся веса.

Этот зазор между карточкой анонса и работающим эндпоинтом — это то полезное, что стоит запомнить, потому что большинство материалов об этом релизе читают спецификации так, будто модель выпускает их сегодня. Но это не так. Ling-3.1-flash — это вторая модель от этой лаборатории за три месяца, которая появляется как то, что независимый трекер LLM Releases прямо относит к категории "weights not released", и разница между тем, чем Ant называет модель, и тем, что разработчик может вызвать прямо сейчас, — это то место, где бюджет или пилотный проект могут незаметно пойти не так.

Что изменилось между анонсом и сегодняшним днём

Само объявление было постом со спецификацией: ~560 млрд параметров всего, ~25 млрд активных на токен, до 1 млн токенов контекста, три ключевых числа из оценки и обещание — «мы планируем вскоре открыть исходный код модели». Ничего из этого не изменилось. Изменилась доступность. В течение дня после объявления модель стала доступна на коммерческом edge-сервисе, а бесплатная пробная версия предоставляет тот же реальный эндпоинт, что и платная: та же поверхность API, та же текстовая модальность, тот же переключатель режима размышления для долгосрочной работы агентов.

Для тех, кто решает, стоит ли тратить на это инженерное время: на этой неделе всё сводится к пробному периоду, и у него есть две стороны. Бесплатный инференс на две недели — действительно дешёвый способ увидеть, как модель ведёт себя на ваших собственных промптах; редкость для модели такого размера. Но бесплатный доступ — это промоакция, а не цена. Опубликованной тарифной сетки для Ling-3.1-flash после пробного периода пока нигде нет, так что любая модель затрат, построенная на бесплатном уровне, — лишь заглушка, пока Ant и его хостинг-провайдеры не выставят цифры.

Спецификация и три цифры, которые всё ещё остаются обещаниями

• Параметры — 560 млрд всего, ~25 млрд активных на токен. Согласно заявлению производителя, это примерно вчетверо больше, чем у предыдущего поколения — 124 млрд всего / 5,1 млрд активных. Коэффициент разреженности сохраняется на уровне около 1 к 22, так что активация не стала значительно экономнее — модель просто гораздо крупнее той, которую она сменяет.

• Контекст — сегодня обслуживает 262 000 токенов. «1M» — это лимит токенов, когда он будет включён; это не то, что даёт пробный эндпоинт, и это самое главное в этом релизе.

Вывод — максимум 32 768 токенов. Разумно для циклов агента, но впритык, если вы собираетесь генерировать длинные документы за один проход.

• Модальность — текст на входе, текст на выходе. Это текстовая модель. Визуальный ввод, аудиоввод и ввод файлов не входят в запуск, и для них не указана дата.

• Рассуждение — гибридный стек с явным переключателем режима размышления, та же схема, которую использовало предыдущее поколение, ориентированная на многошаговую работу агентов и вызов инструментов, а не на однотуровый чат.

• Веса и лицензия — не опубликованы. Это самый важный показатель и в то же время тот, у которого пока вообще нет значения: по состоянию на сегодня не существует ни репозитория Hugging Face, ни текста лицензии, ни доступного для скачивания чекпоинта.

Ant Group's own Ling-3.1-flash benchmark chart, published 30 September 2026. Twelve bar-chart panels cover GDPval-AA v2.1 (1,673 for Ling-3.1-flash), tau-squared Banking (47.60), SkillsBench (69.70), Automationbench public (52.50), Terminal-Bench 4.0 (40.40), CyberGym (87.90), FrontierSWE (75.16), SWE Atlas Codebase QnA (55.92), Finance Agent v2 (57.87), HealthBench Professional (65.35), DRACO (85.49) and MultiChallenge (69.78), with GPT-5.6 Sol, Claude Opus 5, Kimi K3, GLM 5.3, GLM 5.3 flash and DeepSeek-V4.1-Flash as the comparison set. A footnote states HealthBench Professional was evaluated in the AQ environment and that Ling-3.1-flash's healthcare capabilities can currently be experienced only in AQ.

Карточка бенчмарка, прочитанная с необходимой ей скидкой

Собственная отчётность Ant ставит Ling-3.1-flash на совокупный показатель 81,0 по пяти агентным бенчмаркам: 40,4% на Terminal-Bench 4.0, 55,9% на SWE-Atlas и 65,35% на HealthBench Professional; собственные данные компании добавляют 1 673 Elo на GDPVal-AA v2.1 и 75,16 на FrontierSWE. Каждое из этих чисел получено самим производителем. Нет ни харнесса, ни набора промптов, ни весов, чтобы кто-то другой мог заново прогнать весь набор тестов, — а это стандартная оговорка для модели на данном этапе, и здесь стоит сказать прямо: невоспроизведённая оценка вендора — это утверждение о модели, а не её измерение.

Карточка также информативна в том смысле, который её авторы, возможно, не имели в виду. Результат 40,4% в Terminal-Bench 4.0 заметно отстаёт от передового эшелона; Claude Sonnet 5.5 — модель среднего веса, а не флагман — набирает 70,6% в той же версии этого бенчмарка. Честная трактовка не в том, что Ling-3.1-flash слаба — 40,4% это достойный показатель для агентного терминала для модели, позиционируемой по стоимости, — а в том, что формулировка «близко к фронтиру по ключевым бенчмаркам», ходившая в соцсетях в день анонса, не выдерживает сопоставления с конкретными строками. Бенчмарк, где модель выглядит сильнее всего, HealthBench Professional с 65,35, — это также тот, который несёт неловкую сноску: Ant заявляет, что модель оценивали в среде, которую она называет AQ, и что возможности модели в области здравоохранения «сейчас можно испытать только в AQ», нигде публично не определяя, что такое AQ. Результат, вынесенный в заголовок, с привязанной к нему безымянной средой — это демонстрация, а не воспроизводимый результат.

Почему выход большой модели в качестве пробной версии — это и есть настоящая новость

Самое интересное здесь — это последовательность, а не параметры. Ling-3.0-flash сразу перешла к открытым весам. Эта же выходит сначала в пробном режиме: веса, лицензия и официальные цены пока не раскрываются, а публичное обязательство открыть исходный код даётся только после окончания бесплатного периода. Это коммерческий сценарий выпуска, поданный как анонс открытой модели, и это реальное изменение, за которым стоит следить: если веса появятся под разрешительной лицензией, сообщество получит базовую модель на 560B для дообучения и дистилляции; если же они появятся с коммерческими условиями, то продуктом был двухнедельный пробный период, а фраза об «открытом исходном коде» — маркетингом. В любом случае выбор произойдёт в пределах пробного окна, и следить нужно именно за этим, а не за какой-то отдельной строкой бенчмарка.

Где это выполняется, и честная картина маршрутизации

Пока что Ling-3.1-flash доступна через собственный интерфейс продукта вендора и через сторонние платформы инференса, на которых проходит триал, — и это всё. Сегодня её нет в каталоге OrcaRouter; поиск в нашем публичном API моделей для всех трёх — Ling-3.1-flash, Ling-3.0-flash и варианта Ling-3.0 vision — возвращает not-found, и мы не станем делать вид, что это не так. Когда эндпоинт Ant действительно станет общедоступным с опубликованной прейскурантной ценой, сквозная модель, на которой работает OrcaRouter, — прейскурантная цена провайдера, передаваемая с нулевой наценкой, так что снижение цены вендором становится доступным на нашей стороне в тот же день, — это именно та схема, которая подходит модели, ценообразование которой ещё не прописано.

Что вы можете сделать сегодня, не дожидаясь решения по лицензии, — запустить то сравнение, которое действительно важно для непроверенной модели: измерить её против моделей уровня Flash, к которым можно обратиться прямо сейчас. Gemini 3.8 Flash и DeepSeek-V4.1-Flash — обе есть в нашем каталоге по прейскурантным ценам их провайдеров, за одним API-ключом, с автоматическим переключением при сбое между ними. Для модели в бесплатном пробном периоде, у которой неизвестны ни веса, ни тарифная сетка, это разумный способ её держать — ещё один кандидат, на который можно маршрутизировать, пока длится пробный период, и производственный путь, не зависящий от того, что произойдёт на пятнадцатый день.

Headless capture of Ant's Ling Studio interface with Ling-3.1-flash selected in the model picker. The centre panel shows the model-experience card headed "Ling-3.1-flash Model Experience", describing the model as strong at general-purpose agents, search, routine office work and software/code development, above three starter tasks (Hot Spot Scout, Interaction Design Master, Product Assistant). The Model Settings panel on the right shows Max Length 262144, temperature 0.6, top_k 20, top_p 0.95 and Thinking enabled.

Что делать на этой неделе

Если модель имеет отношение к вашей работе, пробный период — это причина действовать сейчас, а не ждать, пока прояснится вопрос с открытыми весами — две недели бесплатного инференса на 560B MoE — это самая дешёвая оценка, которую вы можете получить, и ответ на вопрос «выдерживает ли она мои промпты» доступен уже сегодня, хотя ответ на вопрос «могу ли я развернуть её самостоятельно» — нет. Три вещи, которые стоит проверить, пока окно открыто, по порядку:

• Запускайте собственную нагрузку, а не карточку бенчмарка. Опубликованные цифры — это набор задач, выбранных Ant; именно ваши промпты решают, каким будет ваш стек.

• Проверьте контекст, который вы действительно будете использовать. Эндпоинт обслуживает 262 144 токена, а не 1M. Если ваш дизайн зависит от большего окна, вы проектируете, исходя из обещания.

• Не стройте модель затрат на «бесплатности». Бесплатность — это состояние на две недели. Пока тарифная сетка не опубликована, планируйте возврат к платной модели уровня Flash как вариант по умолчанию, а Ling-3.1-flash рассматривайте как дополнительную мощность.

Анонс настоящий, и модель работает — это больше, чем можно было сказать неделю назад. Но «выпущена и открыта» и «работает в тестовом режиме» — разные состояния, и текущее уверенно второе: спецификация на 560B, эндпоинт на 256K, бенчмарк-карта только от вендора и двухнедельный отсчёт, который является единственным жёстким дедлайном во всём релизе.

Generated editorial card titled "Ling-3.1-flash on trial - what to verify this week" listing six rounded rows: "Your workload: run it, not the card"; "Context: 262,144 served, not 1M"; "Cost model: free is a two-week state"; "Weights: none published, promise only"; "Fallback: keep a priced Flash-tier route"; "Deadline: the trial window is the only firm date", above a footer reading "Vendor-stated specs; no published post-trial rate card."

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно