SK Telecom A.X K2: Koreas Open-Weight-Modell mit 688 Milliarden Parametern, erklärt
Guides & Insights

SK Telecom A.X K2: Koreas Open-Weight-Modell mit 688 Milliarden Parametern, erklärt

Autor

jinhao song

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

SK Telecoms A.X K2 ist eine der bedeutendsten „souveräne KI“-Veröffentlichungen des Jahres 2026: eine 688-Milliarden-Parameter Grundlagenmodell, veröffentlicht mit offenen Gewichten auf Hugging Face, erbaut vom größten Telekommunikationsbetreiber Koreas, um mathematisches und naturwissenschaftliches Denken, koreanisches Sprachwissen und das Verständnis langer Kontexte zu stärken. Es ist der Nachfolger des 519B A.X K1 — Koreas erstes hyperskaliges Modell im 500B-Maßstab — und setzt noch stärker auf eine klar nationale Strategie: ein Modell an der Spitze, von Grund auf selbst entwickelt, im Inland besessen und kontrolliert und direkt auf die Industrie ausgerichtet. Dieser Leitfaden erklärt, was A.X K2 tatsächlich ist, was neu ist, was SK Telecom behauptet und wie es im Vergleich zum globalen Feld der offenen Gewichte zu bewerten ist.

Jede Abbildung unten ist mit der Quelle gekennzeichnet. Die Benchmark-Gewinne von A.X K2 sind SK Telecom-gemeldet (größtenteils im Vergleich zu A.X K1 gemessen) und nicht unabhängig geprüft; Konkurrenzzahlen werden, wenn sie von einer Quelle stammen, vermerkt. Benchmarks und Verfügbarkeit ändern sich — überprüfen Sie diese, bevor Sie darauf aufbauen.

TL;DR. A.X K2 skaliert die A.X-Linie von SK Telecom von 519B auf 688B Parameter und stellt Open-Weight-Modelle auf Hugging Face bereit. SK Telecom berichtet durchschnittliche Leistungssteigerungen über 14 koreanische und internationale Benchmarks von 32,2 Prozentpunkten gegenüber A.X K1, mit Langkontext- und Agentenbewertungen, die um etwa 83,9 Punkte gestiegen sind, und sagt, dass es mit den neuesten Veröffentlichungen von Alibaba Qwen und DeepSeek bei Mathematik- und Koreanischaufgaben mithält oder diese übertrifft. Das technische Herzstück ist SK Telecoms eigene Sparse Gate Attention (SGA)-Architektur für effizientes Langkontext-Denken. Es richtet sich an Fertigung, Verteidigung und Biowissenschaften, mit einem längerfristigen Fahrplan in Richtung einer Billion Parameter.

Wichtige Erkenntnisse

• 688B Parameter, offene Gewichte. Ein auf Hugging Face offen veröffentlichtes koreanisches Modell im Frontier-Bereich, gesteigert von A.X K1's 519B.

• Große berichtete Gewinne gegenüber K1. +32,2 Prozentpunkte Durchschnitt über 14 Benchmarks; +~83,9 Prozentpunkte bei Langkontext- und Agentenbewertungen (von SK Telecom berichtet).

• Neue Architektur: Sparse Gate Attention (SGA). SK Telecoms hauseigenes Design für präzise, effiziente Langkontext-Verarbeitung.

• Stark in Koreanisch und Mathematik. SK Telecom sagt, A.X K2 habe die aktuellen Qwen- und DeepSeek-Veröffentlichungen in Mathematik und koreanischsprachigen Benchmarks erreicht oder übertroffen.

• Souverän + industriell. Von Grund auf für die koreanische KI-Souveränität entwickelt, mit Fokus auf Fertigung, Verteidigung und Bio, mit einer Billionen-Parameter-Roadmap.

Was A.X K2 eigentlich ist

A.X (ausgesprochen „A dot X“) ist SK Telecoms proprietäre Large-Language-Model-Linie. A.X K2 ist das neue Flaggschiff: ein Foundation-Modell mit 688 Milliarden Parametern, das SK Telecom mit offenen Gewichten auf Hugging Face veröffentlicht hat. Diese Kombination – Frontier-Skalierung plus offene Gewichte, von einem Telekommunikationsbetreiber statt einem speziellen KI-Labor – ist ungewöhnlich, und genau darum geht es. SK Telecom hat das A.X-Programm als den Aufbau einer koreanischen „souveränen“ KI positioniert: ein im Inland von Grund auf entwickeltes Hyperscale-Modell, damit Koreas strategische Industrien nicht von ausländischen geschlossenen APIs abhängig sind. A.X K1 (519B) legte dieses Fundament im Jahr 2025 als Koreas erstes Modell im 500B-Maßstab; A.X K2 skaliert es hoch und schärft seinen Fokus.

Was ist neu gegenüber A.X K1

Der Sprung von A.X K1 zu A.X K2 ist sowohl eine Frage der Größe als auch der Leistungsfähigkeit. Die Parameter steigen von 519B auf 688B, und SK Telecom konzentrierte die Verbesserungen auf drei Bereiche: mathematisches und wissenschaftliches Denken, Koreanisch-Sprachkenntnisse und Langkontext-Denken. Die gemeldeten Ergebnisse sind beträchtlich: Die durchschnittliche Leistung über 14 nationale und internationale Benchmarks verbesserte sich gegenüber A.X K1 um 32,2 Prozentpunkte, und – am auffälligsten – das Verständnis für lange Kontexte und agentenbezogene Bewertungen verbesserten sich um etwa 83,9 Prozentpunkte. Dies sind SK Telecoms eigene Zahlen, gemessen im Vergleich zum Vorgänger, also betrachten Sie sie als herstellergemeldeten Generationssprung und nicht als unabhängiges Ranking. Zum Kontext der Basislinie: A.X K1 erzielte 80,2 bei KMMLU (dem koreanischen Gegenstück zu MMLU), was die Koreanisch-Stärke der Reihe unterstreicht.

Die Architektur: Sparse Gate Attention (SGA)

Der wichtigste technische Beitrag ist SK Telecoms proprietäre Sparse Gate Attention (SGA). In einfachen Worten ist SGA so konzipiert, dass das Modell selektiv nur die hochrelevanten Teile eines langen Kontexts referenzieren kann, anstatt alles gleich zu beachten. Das Ziel ist es, sowohl die Genauigkeit als auch die operative Effizienz zu erreichen, die industrielle Einsätze erfordern – lange Dokumente, Logs und mehrstufige Agentenaufgaben, die ohne unkontrollierten Rechenaufwand verarbeitet werden. Die außergewöhnlich hohen gemeldeten Zuwächse bei Long-Context- und Agentenevaluierungen (der +83.9-Punkte-Wert) werden SGA zugeschrieben, was Sinn ergibt: Das sind genau die Arbeitslasten, bei denen ein intelligenterer Attention-Mechanismus für lange Kontexte am meisten helfen sollte.

Was SK Telecom bei Benchmarks behauptet – und die Einschränkungen

Über die generationsbedingten Verbesserungen gegenüber K1 hinaus sagt SK Telecom, dass A.X K2 die jüngsten Veröffentlichungen von Alibabas Qwen und DeepSeek bei Benchmarks zu Mathematik und koreanischer Sprache erreicht oder übertroffen hat. Das ist eine bedeutungsvolle Behauptung – Qwen und DeepSeek gehören zu den stärksten offenen bzw. offenheitsorientierten Modellen weltweit –, aber sie kommt mit wichtigen Einschränkungen. Die Vergleiche werden von SK Telecom durchgeführt, sie konzentrieren sich auf spezifische Bereiche (Mathe und Koreanisch) und nicht auf eine breite, unabhängige Gesamtbewertung, und es gibt noch keinen Drittanbieter-Intelligence-Index-ähnlichen Score für A.X K2. Die faire Lesart ist also: A.X K2 ist ein wirklich starkes Open-Weight-Modell, insbesondere in Koreanisch und Mathe, so der Hersteller – aber „hat Qwen und DeepSeek erreicht oder übertroffen“ ist eine domainspezifische Herstelleraussage, keine globale Krone.

Offene Gewichte: wie man sie bekommt

A.X K2 ist Open-Weight und auf Hugging Face verfügbar (Suche nach "SK Telecom A.X K2", Repository skt/A.X-K2), genau wie A.X K1. Das bedeutet, dass Teams es herunterladen, inspizieren, feinabstimmen und selbst hosten können – wertvoll für Organisationen mit Datenresidenz- oder Souveränitätsanforderungen, was einen Großteil der Zielgruppe von A.X K2 ausmacht. Wie bei jedem 688B-Modell bedeutet "open", dass Sie können selbst hosten, nicht dass es günstig oder trivial zu betreiben ist; ein so großes Modell zu betreiben erfordert ernsthafte Hardware, daher werden viele Teams stattdessen über gehostete Anbieter auf Frontier-Open-Modelle zugreifen.

Warum der industrielle und souveräne Rahmen wichtig ist

A.X K2 jagt nicht den Chatbot-Bestenlisten hinterher; es zielt auf die Industrie ab. SK Telecom erweitert die Anwendungsfälle von A.X K2 in den Bereichen Fertigung, Verteidigung und Biotechnologie – zum Beispiel durch die Entwicklung spezialisierter KI-Agenten mit dem Stahlhersteller KG Steel und mit Connec sowie durch den Pilotbetrieb des Modells an einer Kaltwalzlinie und an Guss-/Bearbeitungsprozessen. In Kombination mit dem Open-Weight-, von Grund auf selbst entwickelten und inländisch kontrollierten Ansatz positioniert sich A.X K2 als souveräne industrielle KI: ein Modell, das die strategischen Sektoren eines Landes nach eigenen Bedingungen betreiben können. Das ist ein anderes Wertversprechen als ein allgemeines westliches Spitzenmodell, und durch diese Linse sollte A.X K2 am besten beurteilt werden.

Der Fahrplan

SK Telecom hat signalisiert, dass A.X K2 ein Schritt und nicht das Ziel ist: Der erklärte langfristige Plan besteht darin, die A.X-Linie in den Billionen-Parameter-Bereich zu skalieren. Wenn K1 (519B) → K2 (688B) die Entwicklung ist, wäre ein A.X mit einer Billion Parametern eine bedeutende Aussage über Koreas Absicht, an der allerobersten Spitze der Open-Weight-Skala zu konkurrieren.

Wie man es zusammen mit anderen Modellen verwendet

Da die Modelllandschaft fragmentiert und schnelllebig ist, lohnt es sich, Ihre Integration anbieterneutral zu halten.a href="https://www.orcarouter.ai/">OrcaRouter/a> bietet einen OpenAI-kompatiblen Endpunkt über einen großen Modellkatalog – einschließlich starker offener und offenheitsorientierter Modelle wie DeepSeek V4 Pro, Qwen 3.8 und Kimi K3, mit denen A.X K2 natürlicherweise verglichen wird. A.X K2 selbst ist offen gewichtet und selbst hostbar, kein gehostetes API-Modell. Daher ist das praktische Muster für viele Teams: Hosten Sie A.X K2 selbst, wo Koreanisch-, Souveränitäts- oder Industrieanforderungen dies erfordern, und erreichen Sie die anderen Grenzmodelle über einen anbieterneutralen Endpunkt – so bleibt das Hinzufügen oder Wechseln von Modellen eine Konfigurationsänderung und keine Neuintegration.

Drei reale Szenarien

1. Koreanischsprachige und inländische Wissensarbeit

A.X K2's koreanische Stärke (die KMMLU-Abstammung der A.X-Linie) macht es zu einer natürlichen Wahl für koreanische Unternehmen, Regierungen und Verbraucheranwendungen, bei denen Sprache und lokales Wissen am wichtigsten sind.

2. Langkontext und agentische industrielle Aufgaben

SGA und die berichteten +83,9-Punkte-Gewinne bei Long-Context/Agent zielen genau auf die dokumentenintensiven, mehrstufigen Arbeitsabläufe ab, die in der Fertigung, Verteidigung und Biotechnologie vorkommen.

3. Souveräne, selbst gehostete Bereitstellung

Offene Gewichte ermöglichen es regulierten oder souveränitätsbewussten Organisationen, ein Modell auf Spitzenniveau vollständig intern zu betreiben – der Hauptgrund, warum ein Telekommunikationsunternehmen es von Grund auf selbst entwickelt hat.

Wann man nicht zu A.X K2 greifen sollte

Gehen Sie nicht davon aus, dass es die Spitze der globalen Allzweck-Bestenlisten einnimmt – SK Telecoms stärkste Behauptungen sind domänenspezifisch (Koreanisch, Mathematik) und anbieterbetrieben, und es gibt noch keine unabhängige zusammengesetzte Bewertung. Rechnen Sie nicht mit günstigem, schlüsselfertigem Zugang: Es handelt sich um ein 688B Open-Weight-Modell, dessen Bereitstellung echte Infrastruktur erfordert. Und wenn Ihre Workload englischsprachiger allgemeiner Chat ohne Souveränitäts- oder Industrieaspekt ist, könnte ein gehostetes westliches Frontier-Modell einfacher sein. Behandeln Sie die gemeldeten Zahlen von A.X K2 als vorläufig, bis Drittanbieter sie testen.

FAQ

Was ist SK Telecom A.X K2?

Ein 688-Milliarden-Parameter, Open-Weight-Basismodell von SK Telecom, veröffentlicht auf Hugging Face im Jahr 2026 — der Nachfolger des 519B A.X K1 — konzentriert auf mathematisch-naturwissenschaftliches Denken, koreanisches Wissen und Long-Context-Verständnis.

Wie unterscheidet sich A.X K2 von A.X K1?

Es ist größer (688B vs 519B) und laut SK Telecom im Durchschnitt um 32,2 Punkte besser bei 14 Benchmarks, wobei Langkontext- und Agentenbewertungen um etwa 83,9 Punkte gestiegen sind, unterstützt durch die neue Sparse Gate Attention-Architektur.

Ist A.X K2 Open Source?

Es wird mit offenen Gewichten auf Hugging Face veröffentlicht, sodass Sie es herunterladen, feinabstimmen und selbst hosten können. Sehen Sie im Repository nach den genauen Lizenzbedingungen.

Ist A.X K2 besser als Qwen oder DeepSeek?

SK Telecom sagt, dass es die aktuellen Qwen- und DeepSeek-Veröffentlichungen speziell bei Mathematik- und Koreanisch-Benchmarks erreicht oder übertroffen hat. Das ist eine domänenspezifische, anbietergeführte Behauptung – keine unabhängige globale Rangliste.

Was ist Sparse Gate Attention (SGA)?

SK Telecoms hauseigenes Attention-Design, das sich selektiv auf die relevantesten Teile eines langen Kontexts konzentriert und sowohl Genauigkeit als auch Effizienz bei industriellen Workloads anstrebt.

Wofür wird A.X K2 verwendet?

SK Telecom zielt auf die Bereiche Fertigung, Verteidigung und Biotechnologie ab, mit frühen Arbeiten zusammen mit Partnern wie KG Steel und Connec, als Teil einer koreanischen Sovereign-AI- und Industriestrategie.

Fazit

A.X K2 ist eine Absichtserklärung: ein 688-Milliarden-Parameter, Open-Weight, von Grund auf neu entwickeltes koreanisches Modell, das nach Angaben von SK Telecom weit über A.X K1 hinausgeht (+32,2 Punkte im Durchschnitt, +~83,9 bei langem Kontext und Agenten) und sich in Mathematik und Koreanisch gegen Qwen und DeepSeek behauptet – mit einer Billionen-Parameter-Zukunft in Aussicht. Die Zahlen stammen vom Anbieter und das Modell ist schwer selbst zu hosten, also dämpfen Sie die Begeisterung, bis unabhängige Tests vorliegen. Aber als souveräne, industrielle, Open-Weight-KI ist A.X K2 eine der interessantesten Veröffentlichungen des Jahres 2026. Bewerten Sie es mit Ihren eigenen koreanischsprachigen und langen Kontext-Workloads und behalten Sie den Rest Ihres Modellzugriffs anbieterneutral über einen OpenAI-kompatiblen Endpunkt bei OrcaRouter.

© 2026 OrcaRouter

Für Anbieter

Sie betreiben eine Inferenz-Plattform? Bringen Sie Ihre Modelle auf OrcaRouter.

Kontaktieren Sie uns

Community beitreten

DiscordEmailXGitHubYouTube