SK Telecom A.X K2: Объяснение корейской модели с открытыми весами на 688 миллиардов параметров
Guides & Insights

SK Telecom A.X K2: Объяснение корейской модели с открытыми весами на 688 миллиардов параметров

Автор

jinhao song

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

SK Telecom A.X K2 является одним из самых значительных релизов «суверенного ИИ» 2026 года: 688-миллиарднопараметровая фундаментальная модель, выпущенная с открытыми весами на Hugging Face, построенная крупнейшим оператором связи Кореи для укрепления математических и научных рассуждений, знаний корейского языка и понимания длинного контекста. Она является преемником 519B A.X K1 — первой корейской гипермасштабной модели масштаба 500B — и удваивает ставку на явно национальную стратегию: модель пограничного масштаба, построенная с нуля, принадлежащая и контролируемая внутри страны и направленная прямо на промышленность. Это руководство объясняет, что такое A.X K2 на самом деле, что в нем нового, что утверждает SK Telecom и как его оценивать в сравнении с глобальным полем открытых весов.

Каждый показатель ниже указан с источником. Приросты в бенчмарках A.X K2 — сообщаемые SK Telecom (в основном измеряемые относительно A.X K1) и не прошедшие независимый аудит; показатели конкурентов указаны с указанием источника. Тесты и доступность меняются — проверьте перед использованием.

Кратко. A.X K2 масштабирует линейку A.X компании SK Telecom с 519B до 688B параметров и выпускается с открытыми весами на Hugging Face. SK Telecom сообщает о среднем приросте производительности на 32,2 процентных пункта по 14 корейским и международным бенчмаркам по сравнению с A.X K1, при этом оценки длинного контекста и агентные оценки выросли примерно на 83,9 пункта, и утверждает, что модель соответствует или превосходит недавние релизы Alibaba Qwen и DeepSeek в задачах по математике и корейскому языку. Технической основой является собственная архитектура Sparse Gate Attention (SGA) от SK Telecom для эффективного рассуждения в длинном контексте. Она предназначена для производства, обороны и биоинженерии, с долгосрочной дорожной картой к триллиону параметров.

Основные выводы

• 688 миллиардов параметров, открытые веса. Корейская модель передового масштаба, открыто опубликованная на Hugging Face, по сравнению с 519 миллиардами у A.X K1.

• Значительные улучшения по сравнению с K1. В среднем +32.2 п.п. по 14 тестам; +~83.9 п.п. на оценках длинного контекста и агентов (по данным SK Telecom).

• Новая архитектура: Sparse Gate Attention (SGA). Собственная разработка SK Telecom для точной и эффективной обработки длинных контекстов.

• Сильный в корейском и математике. SK Telecom утверждает, что A.X K2 сравнялся или превзошел недавние релизы Qwen и DeepSeek по показателям математики и корейского языка.

• Суверенный + промышленный. Создан с нуля для корейского ИИ-суверенитета, нацелен на производство, оборону и био, с дорожной картой на триллион параметров.

Что такое A.X K2 на самом деле

A.X (произносится как «Эй дот Икс») — это проприетарная линейка больших языковых моделей SK Telecom. A.X K2 — её новый флагман: фундаментальная модель с 688 миллиардами параметров, которую SK Telecom выпустила с открытыми весами на Hugging Face. Такое сочетание — масштаб уровня frontier плюс открытые веса, причём от телеком-оператора, а не от профильной AI-лаборатории — необычно, и в этом вся суть. SK Telecom позиционирует программу A.X как построение корейского «суверенного» ИИ: гипермасштабной модели, разработанной внутри страны с нуля, чтобы стратегические отрасли Кореи не зависели от иностранных закрытых API. A.X K1 (519B) заложила этот фундамент в 2025 году как первая модель Кореи масштаба 500B; A.X K2 масштабирует её и заостряет фокус.

Что нового по сравнению с A.X K1

Переход от A.X K1 к A.X K2 — это как увеличение размера, так и расширение возможностей. Параметры возрастают с 519B до 688B, и SK Telecom сосредоточила улучшения на трех областях: математическое и научное рассуждение, знание корейского языка и рассуждение в длинном контексте. Сообщаемые результаты значительны: средняя производительность по 14 внутренним и международным тестам улучшилась на 32,2 процентных пункта по сравнению с A.X K1, и — что наиболее поразительно — понимание длинного контекста и оценки, связанные с агентами, улучшились примерно на 83,9 процентных пункта. Это собственные данные SK Telecom, измеренные по сравнению с предшественником, поэтому их следует рассматривать как заявленный вендором скачок поколения, а не независимый рейтинг. Для контекста о базовом уровне: A.X K1 показала 80,2 на KMMLU (корейский аналог MMLU), что подчеркивает силу линейки в корейском языке.

Архитектура: Sparse Gate Attention (SGA)

Главным техническим вкладом является проприетарная технология SK Telecom Sparse Gate Attention (SGA). Простыми словами, SGA разработана для того, чтобы модель могла выборочно обращаться только к наиболее релевантным частям длинного контекста, вместо того чтобы уделять внимание всему одинаково. Цель — достичь как точности, так и операционной эффективности, требуемой для промышленного применения: длинные документы, журналы и многошаговые задачи агентов обрабатываются без взрывного роста вычислительных затрат. Сообщаемые значительные улучшения в оценках на длинных контекстах и агентских задачах (тот прирост на +83.9 пункта) приписываются SGA, и это логично: именно такие задачи должен лучше всего решать более умный механизм внимания для длинных контекстов.

Что утверждает SK Telecom о бенчмарках — и оговорки

Помимо поколенческих улучшений по сравнению с K1, SK Telecom заявляет, что A.X K2 соответствует или превосходит недавние релизы от Alibaba Qwen и DeepSeek по тестам, охватывающим математику и корейский язык. Это значимое утверждение — Qwen и DeepSeek входят в число сильнейших открытых/склоняющихся к открытости моделей в мире — но оно сопровождается важными оговорками. Сравнения проводятся SK Telecom, они сосредоточены на конкретных областях (математика и корейский), а не на широком независимом композите, и пока нет сторонней оценки в стиле Intelligence-Index для A.X K2. Поэтому справедливая интерпретация такова: A.X K2 — это действительно сильная модель с открытым весом, особенно в корейском языке и математике, по словам её создателя — но «соответствует или превосходит Qwen и DeepSeek» — это предметное заявление вендора, а не глобальная корона.

Открытые веса: как их получить

A.X K2 имеет открытые веса и доступен на Hugging Face (поиск 'SK Telecom A.X K2', репозиторий skt/A.X-K2), так же как и A.X K1. Это означает, что команды могут загружать, изучать, донастраивать и размещать его самостоятельно — ценно для организаций с требованиями к местонахождению данных или суверенитету, которые составляют значительную часть целевой аудитории A.X K2. Как и для любой модели размером 688B, «открытый» означает, что вы можете разместить самостоятельно, а не то, что это дешево или тривиально для обслуживания; запуск такой большой модели требует серьезного оборудования, поэтому многие команды будут получать доступ к передовым открытым моделям через хостинг-провайдеров.

Почему промышленное и суверенное обрамление имеет значение

A.X K2 не гонится за лидерством в рейтингах чат-ботов; она нацелена на промышленность. SK Telecom расширяет сценарии использования A.X K2 в производстве, обороне и биоинженерии — например, разрабатывая специализированных AI-агентов совместно со сталелитейной компанией KG Steel и с Connec, а также тестируя модель на линии холодной прокатки и на процессах литья и механообработки. В сочетании с открытым весом, разработкой с нуля и подходом, контролируемым на национальном уровне, это позиционирует A.X K2 как суверенный промышленный AI: модель, которую стратегические сектора страны могут использовать на своих условиях. Это иное ценностное предложение по сравнению с универсальной западной моделью переднего края, и именно через эту призму лучше всего оценивать A.X K2.

Дорожная карта

SK Telecom дал понять, что A.X K2 — это шаг, а не конечная цель: его заявленный долгосрочный план заключается в масштабировании линейки A.X до диапазона в триллион параметров. Если траектория от K1 (519B) к K2 (688B) сохранится, то A.X с триллионом параметров станет серьёзным заявлением о намерении Кореи конкурировать на самом верхнем уровне шкалы открытых весовых моделей.

Как использовать его вместе с другими моделями

Поскольку ландшафт моделей фрагментирован и быстро меняется, имеет смысл сохранять вашу интеграцию независимой от поставщика.a href="https://www.orcarouter.ai/">OrcaRouter/a> предоставляет одну OpenAI-совместимую конечную точку для большого каталога моделей — включая сильные открытые и склоняющиеся к открытости модели, такие как DeepSeek V4 Pro, Qwen 3.8 и Kimi K3, с которыми A.X K2 естественным образом сравнивается. Сама A.X K2 имеет открытый вес и может быть развернута самостоятельно, а не в виде хостинговой API-модели, поэтому практический паттерн для многих команд таков: развертывать A.X K2 самостоятельно там, где этого требуют корейский язык, суверенитет или промышленные требования, а доступ к другим передовым моделям получать через одну независимую от поставщика конечную точку — так что добавление или замена моделей остается изменением конфигурации, а не повторной интеграцией.

Три реальных сценария

1. Корейскоязычная и внутренняя интеллектуальная работа.

Корейская сила A.X K2 (родословная KMMLU линейки A.X) делает её естественным выбором для корейских корпоративных, государственных и потребительских приложений, где язык и местные знания имеют наибольшее значение.

2. Долгоконтекстные и агентные промышленные задачи

SGA и заявленные улучшения на +83,9 пункта в области длинного контекста/агентов нацелены именно на документоёмкие многоэтапные рабочие процессы, встречающиеся в производстве, обороне и биологии.

3. Суверенное самостоятельное развертывание

Открытые веса позволяют регулируемым или заботящимся о суверенитете организациям запускать модель передового масштаба полностью внутри компании — это основная причина, по которой телекоммуникационная компания построила её с нуля.

Когда не стоит использовать A.X K2

Не считайте, что эта модель возглавляет мировые рейтинги общего назначения — сильнейшие утверждения SK Telecom относятся к узким областям (корейский язык, математика) и поддерживаются вендором, при этом независимого комплексного показателя пока нет. Не рассчитывайте на дешёвый готовый доступ: это 688B-модель с открытыми весами, поэтому для её обслуживания требуется настоящая инфраструктура. А если ваша рабочая нагрузка — общий чат на английском без требований суверенитета или промышленного уклона, то хостинговая западная frontier-модель может быть проще. Воспринимайте заявленные показатели A.X K2 как предварительные, пока не появятся тесты от третьих сторон.

Часто задаваемые вопросы

Что такое SK Telecom A.X K2?

Фундаментальная модель с открытыми весами от SK Telecom, содержащая 688 миллиардов параметров, выпущенная на Hugging Face в 2026 году — преемник модели 519B A.X K1, — сфокусированная на математическом/научном мышлении, корейских знаниях и понимании длинного контекста.

Чем A.X K2 отличается от A.X K1?

Он больше (688B против 519B) и, по данным SK Telecom, в среднем на 32,2 балла выше по 14 бенчмаркам, при этом оценки длинного контекста и агента повышаются примерно на 83,9 балла, благодаря новой архитектуре Sparse Gate Attention.

Является ли A.X K2 открытым исходным кодом?

Это выпущено с открытыми весами на Hugging Face, так что вы можете скачать, донастроить и самостоятельно разместить модель. Ознакомьтесь с репозиторием для уточнения условий лицензии.

Лучше ли A.X K2, чем Qwen или DeepSeek?

SK Telecom заявляет, что превзошла или сравнялась с недавними релизами Qwen и DeepSeek, особенно в математических и корейскоязычных тестах. Это доменно-специфичное утверждение от самого поставщика — а не независимый глобальный рейтинг.

Что такое Sparse Gate Attention (SGA)?

Собственная разработка SK Telecom в области механизма внимания, которая избирательно фокусируется на наиболее релевантных частях длинного контекста, стремясь к точности и эффективности в промышленных нагрузках.

Для чего используется A.X K2?

SK Telecom нацеливается на производство, оборону и биотехнологии, на ранних этапах работая вместе с такими партнерами, как KG Steel и Connec, в рамках корейской стратегии суверенного ИИ и промышленности.

Суть

A.X K2 — это заявление о намерениях: корейская модель с открытыми весами, построенная с нуля, с 688 миллиардами параметров, которая, по заявлению SK Telecom, значительно превосходит A.X K1 (в среднем на +32,2 балла, на ~83,9 балла по длинному контексту и агентам) и уверенно конкурирует с Qwen и DeepSeek в математике и корейском языке — с прицелом на триллион параметров в будущем. Цифры предоставлены вендором, а модель тяжела для самостоятельного размещения, поэтому стоит сдержать восторг до появления независимых тестов. Но как суверенная, промышленная ИИ-модель с открытыми весами, A.X K2 — один из самых интересных релизов 2026 года. Оценивайте её на собственных задачах на корейском языке и длинном контексте, а остальной доступ к моделям сохраняйте вендорно-нейтральным через единую совместимую с OpenAI точку доступа OrcaRouter.

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

Свяжитесь с нами

Присоединяйтесь к сообществу

DiscordEmailXGitHubYouTube