
Ling-3.1-flash, 발표됐지만 오픈은 아님: ~560B 파라미터, 1M 토큰 컨텍스트, 그리고 Ant만이 돌려본 차트
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 262 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2237지능
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- xAINEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당 · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- xAISpaceXAI: Grok 4.62026-08-1244지능77코딩
Ant Group의 Ling 팀은 2026년 9월 30일 차세대 고속 등급 모델의 수치를 공개하면서, 동시에 아직 이 모델을 가질 수 없다고 밝혔다. Ling-3.1-flash는 약 5,600억 개 파라미터 규모의 전문가 혼합(MoE) 모델로, 토큰당 약 250억 개 파라미터를 활성화하며 최대 100만 토큰의 컨텍스트 윈도를 갖는다고 Ant가 자체 @AntLingAGI 계정에서 발표한 모델 공지에서 설명했다. 이번 출시를 규정하는 문장은 사양 뒤에 나온다: "우리는 이 모델을 오픈소스로 공개할 계획이다." 오늘 기준으로 Hugging에 Ling-3.1-flash 리포지토리는 없고, 라이선스도, 공개된 가중치 파일도, Ant Group 외부의 평가도 없다. 존재하는 것은 차트, 실제 접속 가능한 화면, 그리고 약속뿐이다.
그 구분이 전부다. 그리고 이 점은 대놓고 말할 가치가 있다. 대부분의 사람에게 가장 먼저 닿는 프레이밍, 즉 최전선에 근접하는 중국의 500B급 오픈 웨이트 릴리스는 일어나지 않은 일을 묘사하기 때문이다. Ling-3.1-flash는 오픈 릴리스가 아니다. 발표된 것일 뿐이다. 이 둘은 가깝지 않고, 그 간극이 바로 독자가 낭패를 볼 수 있는 지점이다: 아직 존재하지 않는 오픈 웨이트를 놓고 용량을 계획하거나, 파일럿 예산을 편성하거나, 조달 문서를 작성한다면, 당신은 보도자료를 상대로 계획하고 있는 것이다.
그 발표가 실제로 담고 있는 내용
게시물은 짧고 그 안의 숫자들은 구체적이다. Ant는 전체 파라미터 수가 약 5,600억이고 토큰당 활성 파라미터가 약 250억이라고 밝힌다. 비율은 약 22분의 1로, 이 모델이 뒤를 잇는 Ling-3.0-flash 세대보다 약간 더 조밀하다. 그 모델은 전체 124B 대 활성 5.1B, 약 24분의 1 비율이며, 전체 몸집이 4분의 1도 되지 않는 모델에서 작동한다. 컨텍스트는 "최대 1M 토큰"으로 제시되는데, 이는 오늘날 Ling-3.0-flash 제품군이 제공하는 262,144토큰 윈도우의 네 배다. 세 가지 주요 점수가 함께 제시된다: GDPVal-AA v2.1에서 1,673 Elo, FrontierSWE에서 75.16, HealthBench Professional에서 65.35.
그 수치들은 모두 벤더가 보고한 자사 출처이며, 제3자가 재실행할 수 있는 어떤 형태로도 공개되지 않았다. 평가 하네스도, 프롬프트 세트도, 실행 설정도, 시드도 없다 — 그리고 더 근본적으로는, 그것들을 실행할 가중치도 없다. Ant의 수치가 맞다면, 이 모델은 중국 오픈 모델 공개작 가운데 최상위권에 속한다. 현재로서는 그 수치가 맞는지 알아낼 방법이 없다.
차트, 그리고 그 안에 내재된 주의사항

앤트는 Ling-3.1-flash를 다중 패널 벤치마크 카드와 함께 공개했는데, 이 카드는 이 모델을 최전선 및 준최전선 모델들의 집합 안에 위치시킨다: GPT-5.6 Sol, Claude Opus 5, Kimi K3, GLM 패밀리에서 나온 두 항목, 그리고 DeepSeek-V4.1-Flash. 각 패널에서 Ling 막대는 에이전트 작업 및 코딩 지표에서는 최상위 또는 그 근처에, 멀티턴 및 도메인 특화 지표에서는 중간권에 자리한다. 있는 그대로 읽어보자 — 벤더가 직접 고른 과제들로, 범용 에이전트 작업, 코딩, 뱅킹 도메인 과제, 헬스케어를 포함하는 스위트에서 가져온 것이다 — 그러면 충분히 신뢰할 만해 보이는 카드다.
그런데 그 안에 누가 들어 있는지 보면, 한 가지가 눈에 띈다. Ant가 고른 프런티어 동료 모델은 GPT-5.6 Sol과 Claude Opus 5다. 이 두 모델은 이제 한 세대 뒤처져 있다. Opus 5.5와 GPT-6 Sol은 2026년 9월 22일 같은 날 공개되었고, 둘 다 오늘날 라우팅할 수 있다. Ant가 카드에 올리지 않은 최신 모델들이야말로 독자가 이 모델을 견주어 평가했으면 하는 바로 그 대상인데, 이는 이번 출시에 대한 첫 번째 논평 물결에서 나온 것과 같은 불만이다 — 10월에 등장한 모델이 7월의 최전선이 아니라 10월의 최전선과 벤치마크되었으면 한다는 바람이다. 그것은 이 모델에 대한 비난이 아니다. 이 모델은 충분히 잘 견딜 수도 있다. 그것은 이 카드를 최종 판정이라기보다 방향성 주장으로 다룰 이유이며, Ant가 선택한 비교가 그 결과를 미화하기보다는 결과가 언제 것인지를 드러낸다는 점을 지적할 이유다.
당신이 그것을 만질 수 있는 곳, 그리고 설명되지 않은 각주 하나
오늘날 사용자에게 Ling-3.1-flash가 실행되는 곳은 정확히 한 곳뿐입니다: Ant의 자체 제품입니다. ling.tbox.cn의 Ling Studio 인터페이스는 모델 선택기에서 Ling-3.1-flash를 나열하며, 앱 자체의 모델 설명은 벤치마크 카드보다 더 넓습니다 — "범용 에이전트, 검색, 일상 사무 업무, 소프트웨어/코드 개발"에 적합하다고 내세우는데, 이는 이 계층에서 익숙한 포지셔닝입니다: 패밀리에서 가장 깊이 추론하는 모델은 아니지만, 끊임없이 그리고 저렴하게 호출되도록 만들어진 모델입니다.
그 표면은 또한 이번 릴리스에서 가장 어색한 세부 사항을 담고 있습니다. 벤치마크 카드 자체의 각주에는 HealthBench Professional — 발표문에 나온 세 가지 수치 중 하나인 65.35 — 이 "AQ 환경에서 평가되었다"고 적혀 있으며, Ling-3.1-flash의 의료 역량은 "현재 AQ에서만 체험할 수 있다"고 덧붙입니다. 카드 어디에도 AQ가 무엇인지 설명되어 있지 않고, 우리가 찾을 수 있었던 어떤 공개 문서에서도 이를 정의하지 않습니다. 환경 이름이 밝혀지지 않은 채 환경 한정 조건이 붙은 헤드라인 점수는 재현 가능한 결과가 아닙니다. 그것은 옆에 숫자가 붙은 제품 데모일 뿐입니다.
알 수 있는 것과 알 수 없는 것은 무엇인가
이 릴리스를 그 두 가지 범주로 분류하는 것이 오늘날 독자가 이 릴리스로 할 수 있는 가장 유용한 일이다.
현재 알 수 있는 것: 벤더가 밝힌 파라미터, 활성 파라미터 수, 컨텍스트 윈도우; 세 가지 벤더 벤치마크; Ant 자체 제품에 해당 모델이 존재한다는 사실; Ant가 선택한 비교 세트; 가중치, 라이선스, 모델 카드가 공개되지 않았다는 사실; 그리고 이전 세대를 독립적으로 평가한 Artificial Analysis에 Ling-3.1-flash 페이지가 없다는 사실. 이 글을 쓰는 시점까지, Ling-3.0-flash의 20점 Intelligence Index 수치를 해석 가능하게 만들었던 독립 평가 파이프라인은 3.1에 관해 전혀 아무것도 공개하지 않았다.
지금으로서는 알 수 없다: 가중치가 실제로 공개될지, 그리고 어떤 라이선스로 공개될지; 아키텍처가 Ling-3.0 하이브리드 스택을 확장한 버전인지 아니면 새로운 것인지; 모델이 Ant의 API를 통해 얼마의 비용이 드는지, API 가격이 아예 있는지조차; 실제로 긴 컨텍스트에서 어떻게 동작하는지, 윈도우가 명시되는 방식과는 대조적으로; 그리고 Ant가 아닌 누군가가 같은 작업을 실행할 때 벤치마크 격차가 그대로 유지되는지. 이 각각은 출시된 모델이라면 첫날에 답하는 질문이고, 발표된 모델이라면 아직 일정이 잡히지 않은 나중 어느 날에 답하는 질문이다.

이런 날을 읽는 법
이 패턴은 이제 이름을 붙일 수 있을 만큼 흔해졌다. 탄탄한 실적을 지닌 중국 연구소가 모델 카드와 벤치마크 차트를 공개하고, 수치는 최전선 근처에 도달하며, 커뮤니티는 그 수치에 반응하고, 가중치는 몇 주 뒤에 도착한다 — 혹은 도착하지 않는다. Ling-3.0-flash는 지난여름 정확히 그 시나리오를 실행했고, 그것이 어떻게 결말이 났는지 기억해 둘 가치가 있다: Ant는 2026년 7월 24일 라이선스 표명도, 독립 벤치마크도 없는 API 전용 모델로 이를 발표했으며, MIT 라이선스의 가중치는 발표로부터 2주 뒤인 8월 7일에야 Hugging Face에 나타났다. Ling-3.1-flash는 첫날 그 흐름의 동일한 지점에 있으며, 이번에는 오픈소스화 약속이 추론된 것이 아니라 발표문에 명시되어 있다는 추가적인 차이가 있다.
Ant가 비교 지점으로 선택한 모델 중 이 글의 주제로서 우리 카탈로그에 올라 있는 모델은 하나도 없습니다 — Ling-3.1-flash, Ling-3.0-flash, Ling-3.0-flash-VL 모두 오늘 OrcaRouter 카탈로그에서 not-found를 반환하며, 우리는 그것을 아닌 척하지 않겠습니다. 하지만 그 차트에 있는 동료 모델 중 셋은 지금 당장 라우팅할 수 있습니다: Claude Opus 5, GPT-5.6 Sol, DeepSeek-V4.1-Flash 모두 단일 키 뒤에 있고, 공급자 정가에 마크업 제로, 그리고 이들 사이의 자동 장애 조치까지 갖추고 있습니다. 이 점은 들리는 것보다 더 중요합니다, 특히 이번 주 같은 주에는요. 발표된 모델을 평가하는 정직한 방법은 Ant가 권하는 비교를 — 실제로 호출할 수 있는 모델을 상대로 — 실행하는 것이기 때문입니다. 비교 대상이 아직 차트에 머물러 있는 동안에 말이죠.
가중치가 공개될 때, 유용한 질문은 Ling-3.1-flash가 하나의 Elo 평점에서 Opus 5를 이겼는지가 아닐 것이다. 약 560B MoE가 활성 파라미터 약 25B로, 그 희소성이 값을 하게 만드는 가격에 1M 토큰 컨텍스트를 유지할 수 있는지, 그리고 라이선스가 자체 호스팅을 하기에 충분히 허용적인지일 것이다. 이것이 그 발표가 답하지 않는 두 가지 질문이며, 이것이 이 모델이 사람들이 그 위에 구축하는 모델이 될지, 아니면 누군가의 다음 발표 자료에 들어갈 슬라이드 하나가 될지를 결정할 유일한 질문들이다. 당장은: 이름은 실재하고, 숫자는 Ant만의 것이며, 가중치는 아직 한 문장에 불과하다.

