Genererat redaktionellt hero-kort med titeln "Ling-3.1-flash: aviserad, inte öppen" och underrubriken "~560B totala parametrar · ~25B aktiva per token · upp till 1M kontext". Tre märkta kort där det står "Vikter: inte släppta ännu", "Benchmarks: endast leverantörsrapporterade" och "Ingen licens · inget modellkort · ingen nedladdning".
Guides & Insights

Ling-3.1-flash tillkännages, inte öppen: ~560B parametrar, en 1M-tokenkontext och ett diagram som bara Ant har kört

Författare

Alistair Wren

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Ant Groups Ling-team publicerade siffror för sin nästa modell i snabbklassen den 30 september 2026 och sade i samma andetag att du inte kan få den ännu. Ling-3.1-flash är en mixture-of-experts-modell med ungefär 560 miljarder parametrar som aktiverar omkring 25 miljarder parametrar per token och har ett kontextfönster på upp till 1 miljon token, enligt det modellmeddelande som Ant publicerade från sitt eget @AntLingAGI-konto. Meningen som definierar den här lanseringen är den som följer specifikationerna: "Vi planerar att öppna källkoden för modellen snart." I dag finns det inget Ling-3.1-flash-repository på Hugging Face, ingen licens, ingen nedladdningsbar viktfil och ingen utvärdering från någon utanför Ant Group. Det som finns är ett benchmarkdiagram, en live-produktyta och ett löfte.

Den skillnaden är hela historien, och det är värt att vara rakt på sak om den, eftersom den inramning som når de flesta först – ett öppen-vikt-släpp i 500B-klass från Kina som landar nära fronten – beskriver något som inte har hänt. Ling-3.1-flash är inte ett öppet släpp. Det är ett annonserat sådant. De två är inte nära varandra, och gapet mellan dem är precis där en läsare kan bränna sig: om du planerar kapacitet, avsätter budget för en pilot eller skriver en upphandlingspromemoria kring öppna vikter som ännu inte finns, planerar du mot ett pressmeddelande.

Vad tillkännagivandet faktiskt innehåller

Inlägget är kort och siffrorna i det är specifika. Ant anger ett totalt parameterantal på omkring 560 miljarder mot ungefär 25 miljarder aktiva per token, ett förhållande nära 1 på 22, marginellt tätare än den Ling-3.0-flash-generation den efterträder — den modellen kör 124 miljarder totalt mot 5,1 miljarder aktiva, ungefär 1 på 24, på en kropp mindre än en fjärdedel av storleken. Kontext anges som "upp till 1M tokens," fyra gånger så stort som det 262 144-token-fönster som Ling-3.0-flash-familjen erbjuder idag. Tre huvudresultat anges: 1 673 Elo på GDPVal-AA v2.1, 75,16 på FrontierSWE och 65,35 på HealthBench Professional.

Alla dessa siffror är leverantörsrapporterade förstapartsdata och opublicerade i någon form som en tredje part kan köra om. Det finns ingen utvärderingsram, ingen promptuppsättning, ingen körningskonfiguration och inget seed — och, mer grundläggande, inga vikter att köra dem på. Om Ants siffror stämmer ligger modellen i toppskiktet av kinesiska släpp av öppna modeller; för närvarande finns det inget sätt att ta reda på om de stämmer.

Diagrammet, och förbehållet som är inbyggt i det

Ant Group's own Ling-3.1-flash benchmark card, published from the @AntLingAGI account on 30 September 2026. Multi-panel bar charts compare Ling-3.1-flash against GPT-5.6 Sol, Claude Opus 5, Kimi K3, GLM 5.3 and GLM 5.3 Flash, and DeepSeek-V4.1-Flash across GDPval-AA v2.1 (1,673 Elo), tau-Banking, SkillsBench, Automationbench, Terminal-Bench 4.0, CyberGym, FrontierSWE (75.16), SWE Atlas Codebase QnA, Finance Agent v2, HealthBench Professional (65.35), DRACO and MultiChallenge. A footnote states that HealthBench Professional was evaluated in the AQ environment.

Ant publicerade Ling-3.1-flash tillsammans med ett benchmark-kort med flera paneler som placerar den i ett fält av frontier- och nära-frontier-modeller: GPT-5.6 Sol, Claude Opus 5, Kimi K3, två poster från GLM-familjen och DeepSeek-V4.1-Flash. I panelerna ligger Ling-stapeln i eller nära toppen för de agentiska och kodningsrelaterade måtten och i mitten av fältet för de flerturms- och domänspecifika. Läs det för vad det är – leverantörens eget urval av uppgifter, hämtat från en testsvit som omfattar allmänt agentarbete, kodning, bankdomänuppgifter och hälso- och sjukvård – och det är ett kort som ser trovärdigt ut.

Titta dock på vilka som är med på den, och en sak sticker ut. De frontier-motparter Ant valde är GPT-5.6 Sol och Claude Opus 5. Båda dessa modeller ligger nu en generation efter. Opus 5.5 och GPT-6 Sol gick båda live den 22 september 2026, samma dag, och båda går att routa i dag. De nyaste modellerna som Ant inte satte på kortet är just de som en läsare skulle vilja se den mätas mot, vilket är samma klagomål som dök upp i den första vågen av kommentarer om lanseringen – önskan att en modell som kommer i oktober hade benchmarkats mot oktober månads frontier i stället för juli månads. Det är inte någon kritik av modellen, som mycket väl kan stå sig. Det är ett skäl att betrakta kortet som ett riktningsgivande anspråk snarare än en dom, och att notera att jämförelsen Ant valde inte så mycket smickrar resultatet som den daterar det.

Där du kan röra vid det, och en oförklarad fotnot

Det finns exakt en plats där Ling-3.1-flash körs för en användare idag: Ants egen produkt. Ling Studio-gränssnittet på ling.tbox.cn listar Ling-3.1-flash i sin modellväljare, och appens egen beskrivning av modellen är bredare än benchmarkkortet – den marknadsför den som ”allmänna agenter, sökning, rutinmässigt kontorsarbete och mjukvaru-/kodutveckling”, vilket är den välbekanta positioneringen för den här nivån: inte familjens djupaste resonemangsmotor, utan den som är avsedd att anropas ständigt och billigt.

Den ytan bär också släppets mest besvärande detalj. Benchmark-kortets egen fotnot säger att HealthBench Professional – siffran 65,35, ett av de tre talen i meddelandetexten – ”utvärderades i AQ-miljön”, och tillägger att Ling-3.1-flashs vårdkapaciteter ”för närvarande endast kan upplevas i AQ”. Inget på kortet förklarar vad AQ är, och ingen offentlig dokumentation som vi kunde hitta definierar det. Ett rubrikresultat med en miljöangivelse kopplad till sig, där miljön inte namnges, är inte ett reproducerbart resultat; det är en produktdemo med en siffra bredvid sig.

Vad är vetbart, och vad är inte det

Att sortera denna release i dessa två fack är det mest användbara en läsare kan göra med den idag.

Känt nu: parametrarna, antalet aktiva parametrar och kontextfönstret enligt tillverkarens uppgifter; de tre benchmarkarna från tillverkaren; att modellen finns i Ants egen produkt; den jämförelseuppsättning som Ant valde; att inga vikter, ingen licens och inget modellkort har publicerats; och att Artificial Analysis, som oberoende poängsatte den föregående generationen, inte har någon sida för Ling-3.1-flash. Vid tidpunkten för detta skrivande har den oberoende poängsättningspipeline som gjorde Ling-3.0-flashs 20-poängsvärde i Intelligence Index läsbart inte publicerat något alls om 3.1.

Går inte att veta nu: huruvida vikterna faktiskt kommer att öppnas, och under vilken licens; huruvida arkitekturen är en uppskalad version av Ling-3.0:s hybridstack eller något nytt; vad modellen kostar via Ants API, om den ens har ett API-pris; hur den beter sig under lång kontext i praktiken, i motsats till hur fönstret specificeras; och huruvida benchmarkgapen håller när någon som inte är Ant kör samma uppgifter. Var och en av dessa är en fråga som en släppt modell besvarar dag ett och en aviserad modell besvarar någon senare dag som inte har schemalagts.

Generated two-column information card. Left column headed "Knowable today" lists five cards: "~560B total / ~25B active (vendor)", "up to 1M-token context (vendor)", "1,673 Elo GDPval-AA v2.1 (vendor)", "available in Ant's Ling Studio only" and "no independent score exists". Right column headed "Not knowable" lists five cards: "whether the weights will open", "the licence terms", "API price per million tokens", "long-context behaviour in practice" and "whether the benchmark gaps hold".

Hur man läser en dag som denna

Mönstret är nu tillräckligt vanligt för att få ett namn. Ett kinesiskt labb med stark meritlista släpper ett modellkort och ett benchmarkdiagram, siffrorna landar nära frontlinjen, communityt reagerar på siffrorna, och vikterna anländer – eller inte – veckor senare. Ling-3.0-flash körde exakt det spelet i somras, och det är värt att minnas hur det löste sig: Ant tillkännagav modellen den 24 juli 2026 som en API-only-modell utan licensangivelse och utan oberoende benchmark, och vikterna under MIT dök inte upp på Hugging Face förrän den 7 augusti, två veckor efter tillkännagivandet. Ling-3.1-flash befinner sig vid motsvarande punkt i den bågen på dag ett, med den ytterligare skillnaden att löftet om öppen källkod den här gången är explicit i tillkännagivandet i stället för underförstått.

Ingen av de modeller som Ant valde som jämförelsepunkter finns med i vår katalog som artikelns ämne — Ling-3.1-flash, Ling-3.0-flash och Ling-3.0-flash-VL ger alla not-found i {{2}}OrcaRouter-katalogen idag{{/2}}, och vi tänker inte låtsas något annat. Men tre av motparterna i det diagrammet går att routa just nu: Claude Opus 5, GPT-5.6 Sol och DeepSeek-V4.1-Flash ligger alla bakom en enda nyckel, till leverantörens listpris utan påslag, med automatisk failover mellan sig. Det spelar större roll än det låter i en vecka som den här, för det ärliga sättet att utvärdera en utannonserad modell är att köra jämförelsen som Ant bjuder in till — mot de modeller du faktiskt kan anropa — medan jämförelsens objekt fortfarande bara är ett diagram.OrcaRouter-katalogen idag

När vikterna väl släpps kommer den relevanta frågan inte att vara huruvida Ling-3.1-flash slog Opus 5 på en enskild Elo-rating. Det kommer att vara huruvida en MoE på ~560B med ~25B aktiva parametrar kan hantera en kontext på 1M tokens till ett pris som gör sparsiteten värd det, och huruvida licensen är tillräckligt tillåtande för att man ska kunna självhosta den. Det är de två frågorna som tillkännagivandet inte besvarar, och de är de enda som kommer att avgöra huruvida detta blir en modell som folk bygger vidare på eller en bild i någons nästa bildspel. Tills vidare: namnet är verkligt, siffrorna tillhör enbart Ant, och vikterna är fortfarande bara en mening.

Generated horizontal timeline with four milestone nodes. "Jul 24, 2026 — Ling-3.0-flash announced, API-only, no weights, no licence"; "Aug 7, 2026 — MIT weights land on Hugging Face, 14 days later"; "Sep 30, 2026 — Ling-3.1-flash announced: ~560B, ~25B active, 1M context"; and a dashed open node reading "Weights: not yet — 'we plan to open-source soon'", captioned "the same point in the same arc, on day one".