SK Telecom A.X K2:韓國6880億參數的開放權重模型解析
Guides & Insights

SK Telecom A.X K2:韓國6880億參數的開放權重模型解析

作者

jinhao song

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

SK Telecom 的A.X K2是2026年最重要的「主權 AI」發布之一:一個6880億參數的基礎模型,以Hugging Face 上的開放權重形式釋出,由韓國最大電信業者打造,旨在強化數學與科學推理、韓語知識以及長上下文理解。它是 519B 參數 A.X K1(韓國首個 500B 規模的超大模型)的後繼者,並更加堅定地貫徹一項明確的國家策略:從零建構、國內自主擁有與控制、並直接對準產業應用的前沿規模模型。本指南將說明 A.X K2 的實際內容、新功能、SK Telecom 的宣稱,以及如何在全球開放權重模型領域中評估其定位。

以下每個數字均標註來源。A.X K2 的基準增益為 SK Telecom 報告的(主要相對於 A.X K1 衡量)且未經獨立審計;競爭對手的數字在來源處標註。基準測試和可用性會變動 — 在依賴它們之前請進行驗證。

TL;DR. A.X K2 將 SK Telecom 的 A.X 系列從 519B 參數擴展到 688B 參數,並在 Hugging Face 上以開放權重發佈。SK Telecom 報告,在 14 個韓國和國際基準測試中,平均性能比 A.X K1 提升了 32.2 個百分點,長上下文和代理評估提升約 83.9 點,並表示在數學和韓語任務上與近期阿里巴巴的 QwenDeepSeek 的發佈相當或更優。技術核心是 SK Telecom 自有的 Sparse Gate Attention (SGA) 架構,用於高效的長上下文推理。它針對製造、國防和生物領域,長期路線圖朝向萬億參數。

關鍵要點

• 688B 參數,開放權重。一個前沿規模的韓語模型,在 Hugging Face 上公開釋出,相較於 A.X K1 的 519B 有所提升。

• 相較於 K1,報告顯示大幅提升。在14個基準測試中平均增加32.2個百分點;在長上下文和代理評估中增加約83.9個百分點(SK Telecom 報告)。

• 全新架構:稀疏閘門注意力(SGA)。SK Telecom 內部設計,用於準確、高效的長上下文處理。

• 在韓語和數學方面表現強勁。SK Telecom 表示,A.X K2 在數學和韓語基準測試中與最近的 Qwen 和 DeepSeek 版本相當或更勝一籌。

• 主權 + 工業。專為韓國AI主權從零打造,聚焦製造、國防與生技,並配備兆級參數路線圖。

A.X K2 究竟是什麼

A.X(讀作「A點X」)是SK Telecom專有的大型語言模型系列。A.X K2是其最新旗艦模型:一個擁有6880億參數的基礎模型,SK Telecom以開放權重形式在Hugging Face上發布。這種組合——前沿規模加上開放權重,且來自電信運營商而非專門的AI實驗室——實屬罕見,而這正是關鍵所在。SK Telecom將A.X計畫定位為打造韓國「主權」AI:一個從零開始在國內開發的超大規模模型,使韓國戰略產業不依賴於外國的封閉API。A.X K1(519B)在2025年奠定了這一基礎,成為韓國首個500B規模的模型;A.X K2則進一步擴大規模並強化其重點。

相較於 A.X K1 的新功能

從 A.X K1 到 A.X K2 的躍升體現在規模和能力兩個方面。參數從 519B 增加到 688B,而 SK Telecom 將這些進步集中在三個領域:數學與科學推理、韓語知識以及長上下文推理。報告的成果顯著:在 14 項國內外基準測試中的平均表現較 A.X K1 提升了 32.2 個百分點,而最引人注目的是,長上下文理解和與代理相關的評估改善了約 83.9 個百分點。這些是 SK Telecom 與其前代產品相比的自身數據,因此應將其視為供應商報告的世代躍進,而非獨立評測。至於基準的背景,A.X K1 在 KMMLU(MMLU 的韓語對應)上取得了 80.2 分,這突出了該系列的韓語優勢。

架構:稀疏門控注意力(SGA)

首要技術貢獻是SK Telecom的專有Sparse Gate Attention (SGA)。簡而言之,SGA的設計目的是讓模型選擇性地只參考長上下文中的高度相關部分,而不是平等地關注所有內容。目標是達到工業部署所需的準確性和運算效率——處理長文件、日誌和多步驟代理任務,而不會造成運算失控。報告中指出的在長上下文和代理評估上的巨大收益(那個+83.9分的數字)歸功於SGA,這很合理:這些正是更智能的長上下文注意力機制最應該幫助的工作負載。

SK Telecom 在基準測試上的宣稱 — 以及注意事項

超越K1的世代進步,SK Telecom表示A.X K2在涵蓋數學與韓語的基準測試中,已追平或超越阿里巴巴的Qwen與DeepSeek近期發布的成果。這是一項有意義的主張——Qwen與DeepSeek是全球最強大的開放/傾向開放模型之一——但此說法伴隨重要但書。該比較由SK Telecom自行執行,聚焦於特定領域(數學與韓語),而非廣泛的獨立綜合指標,且A.X K2目前尚無第三方Intelligence-Index風格的評分。因此合理的解讀是:根據其開發者說法,A.X K2確實是一款實力堅強的開放權重模型,尤其在韓語與數學方面——但「追平或超越Qwen與DeepSeek」是特定領域的供應商宣稱,而非全球性的桂冠。

開放權重:如何取得

A.X K2 是開放權重模型,如同 A.X K1 一樣,可在 Hugging Face 上取得(搜尋「SK Telecom A.X K2」,repo 為 skt/A.X-K2)。這表示團隊可以下載、檢查、微調並自行託管——對於有資料駐留或主權需求的組織極具價值,而這些正是 A.X K2 的主要目標用戶。與任何 688B 模型相同,「開放」意味著你可以自行託管,但不代表成本低廉或容易部署;要運行如此龐大的模型需要嚴謹的硬體支援,因此許多團隊會透過託管服務提供商來存取前沿的開放模型。

為何工業與主權框架至關重要

A.X K2 並非追逐聊天機器人排行榜,而是瞄準產業應用。SK Telecom 正將 A.X K2 的使用場景擴展至製造、國防與生技領域——例如與鋼鐵業者 KG Steel 及 Connec 合作開發專屬 AI 代理,並在冷軋產線與鑄造/加工製程中進行模型試行。結合開放權重、從零打造、國內自主掌控的策略,A.X K2 定位為主權級工業 AI:一個國家戰略產業能以自身條件運作的模型。這與通用型的西方前沿模型有著截然不同的價值主張,也是評判 A.X K2 時最應採用的視角。

路線圖

SK Telecom已表示A.X K2是一個步驟,而非最終目標:其公布的長期計畫是將A.X系列擴展到兆參數範圍。如果K1 (519B) → K2 (688B)是發展軌跡,那麼一個兆參數的A.X將是韓國意圖在開放權重規模頂端競爭的重大宣言。

如何與其他模型一起使用

由於模型領域分散且變化快速,保持整合的廠商中立性是有益的。a href="https://www.orcarouter.ai/">OrcaRouter/a> 提供一個跨大型模型目錄的 OpenAI 相容端點——包括 A.X K2 自然會被拿來比較的強勁開放及傾向開放模型,如 DeepSeek V4 Pro、Qwen 3.8 和 Kimi K3。A.X K2 本身是開放權重且可自行託管,而非託管 API 模型,因此對許多團隊而言,實務模式是:在需要韓語、主權或工業需求之處自行託管 A.X K2,並透過一個廠商中立的端點存取其他前沿模型——如此新增或切換模型僅需變更配置,無需重新整合。

三個現實世界場景

1. 韓語與國內知識工作

A.X K2 的韓語實力(A.X 系列的 KMMLU 血統)使其自然適合於韓國的企業、政府和消費者應用,因為在這些應用中語言和本地知識最為重要。

2. 長上下文與智能代理的工業任務

SGA 與報告的 +83.9 點長上下文/代理增益恰好針對製造業、國防和生物領域中常見的文件密集型、多步驟工作流程。

3. 自主、自託管部署

開放權重讓受監管或注重主權的組織能夠完全在內部運行前沿規模模型——這是一家電信公司從頭開始構建它的核心原因。

何時不該伸手拿取 A.X K2

不要假設它在全球通用型排行榜上位居榜首——SK Telecom最有力的聲明是特定領域(韓語、數學)且由廠商自行評測,目前還沒有獨立的綜合評分。別指望廉價、現成的存取方式:這是一個688B的開放權重模型,因此提供服務需要真實的基礎設施。如果你的工作負載是優先英語的一般對話,沒有主權或產業方面的考量,使用託管的西方前沿模型可能更簡單。在第三方測試之前,請將A.X K2的報告數據視為暫定結果。

常見問題

什麼是SK Telecom A.X K2?

SK Telecom 於 2026 年在 Hugging Face 上發布的一款擁有 6880 億參數的開放權重基礎模型——519B A.X K1 的後繼者——專注於數學/科學推理、韓語知識與長上下文理解。

A.X K2 與 A.X K1 有何不同?

它更大(688B vs 519B),而且根據SK Telecom的說法,在14個基準測試中平均高出32.2分,長上下文和代理評估提升約83.9分,由新的Sparse Gate Attention架構驅動。

A.X K2 是開源的嗎?

它已在Hugging Face上以開放權重發布,因此您可以下載、微調並自行託管。請查看倉庫以了解確切的許可條款。

A.X K2 是否比 Qwen 或 DeepSeek 更好?

SK Telecom 表示,它在數學和韓語基準測試上與近期 Qwen 和 DeepSeek 的版本持平或更勝一籌。這是特定領域、由供應商自行提出的說法,並非獨立的全球排名。

什么是稀疏门控注意力(SGA)?

SK Telecom 的內部注意力設計,選擇性地專注於長上下文中最相關的部分,旨在工業工作負載中實現準確性與效率。

A.X K2 有何用途?

SK Telecom正瞄準製造業、國防與生技領域,並與KG Steel及Connec等合作夥伴進行初期合作,作為韓國主權AI與產業戰略的一部分。

底線

A.X K2 是一份意圖宣言:一個擁有 6880 億參數、開放權重、從零打造的韓語模型,SK Telecom 表示其性能遠超 A.X K1(平均提升 +32.2 分,在長上下文與代理任務上提升約 +83.9 分),並在數學與韓語方面與 Qwen 和 DeepSeek 旗鼓相當 —— 未來還有望推出萬億參數版本。這些數據由供應商自行報告,且模型自託管負擔沉重,因此在獨立測試結果出爐前,請先冷靜看待宣傳。但作為主權級、產業級、開放權重的 AI,A.X K2 無疑是 2026 年最引人注目的發佈之一。請在您自己的韓語與長上下文工作負載上評估它,並透過 OrcaRouter 上的一個 OpenAI 相容端點,保持其餘模型存取的供應商中立性。

© 2026 OrcaRouter

推理服務商

經營推理平台?讓您的模型上架 OrcaRouter。

聯絡我們

加入我們的社區

DiscordEmailXGitHubYouTube