Gegenereerde redactionele herokaart met de titel "Ling-3.1-flash: aangekondigd, niet open" en de ondertitel "~560B totale params · ~25B actief per token · tot 1M context". Drie gelabelde kaarten luiden "Gewichten: nog niet uitgeleverd", "Benchmarks: alleen door leverancier gerapporteerd" en "Geen licentie · geen modelkaart · geen download".
Guides & Insights

Ling-3.1-flash wordt aangekondigd, niet open: ~560B parameters, een context van 1M tokens, en een grafiek die alleen Ant heeft gedraaid

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Het Ling-team van Ant Group gaf op 30 september 2026 cijfers vrij over zijn volgende fast-tier-model, en zei in één adem dat je het nog niet kunt krijgen. Ling-3.1-flash is een mixture-of-experts-model met ruwweg 560 miljard parameters dat ongeveer 25 miljard parameters per token activeert en een contextvenster van maximaal 1 miljoen tokens heeft, volgens de modelaankondiging die Ant via zijn eigen @AntLingAGI-account publiceerde. De zin die deze release typeert, is de zin die na de specificaties komt: "We zijn van plan het model binnenkort open source te maken." Vandaag de dag is er geen Ling-3.1-flash-repository op Hugging Face, geen licentie, geen downloadbaar gewichtenbestand en geen evaluatie door iemand buiten Ant Group. Wat bestaat, is een benchmarkgrafiek, een live productoppervlak en een belofte.

Dat onderscheid is het hele verhaal, en het is de moeite waard om er bot over te zijn, want de framing die de meeste mensen het eerst bereikt — een open-weight release van 500B-klasse uit China die dicht bij de frontier uitkomt — beschrijft iets dat niet is gebeurd. Ling-3.1-flash is geen open release. Het is een aangekondigde release. Die twee liggen niet dicht bij elkaar, en precies daar, in de kloof ertussen, kan een lezer zich branden: als je capaciteit plant, een pilot begroot of een inkoopnotitie schrijft rond open weights die nog niet bestaan, dan plan je op basis van een persbericht.

Wat de aankondiging daadwerkelijk bevat

De post is kort en de cijfers erin zijn specifiek. Ant stelt een totaal aantal parameters van ongeveer 560 miljard tegenover ongeveer 25 miljard actieve per token, een verhouding van bijna 1 op 22, iets dichter dan de Ling-3.0-flash-generatie die het opvolgt — dat model draait op 124 miljard totaal tegen 5,1 miljard actieve, ongeveer 1 op 24, met een omvang van minder dan een kwart. Context wordt geciteerd als 'tot 1M tokens', vier keer het venster van 262.144 tokens dat de Ling-3.0-flash-familie vandaag bedient. Er worden drie opvallende scores genoemd: 1.673 Elo op GDPVal-AA v2.1, 75,16 op FrontierSWE, en 65,35 op HealthBench Professional.

Elk van die cijfers is door de leverancier gerapporteerd, first-party, en in geen enkele vorm gepubliceerd die een derde partij opnieuw kan uitvoeren. Er is geen evaluatieharnas, geen promptset, geen runconfiguratie en geen seed — en, fundamenteler nog, geen gewichten waarop ze kunnen draaien. Als de cijfers van Ant kloppen, behoort het model tot de topklasse van Chinese open-modelreleases; er is momenteel geen manier om erachter te komen of ze kloppen.

De grafiek, en het voorbehoud dat erin besloten ligt

Ant Group's own Ling-3.1-flash benchmark card, published from the @AntLingAGI account on 30 September 2026. Multi-panel bar charts compare Ling-3.1-flash against GPT-5.6 Sol, Claude Opus 5, Kimi K3, GLM 5.3 and GLM 5.3 Flash, and DeepSeek-V4.1-Flash across GDPval-AA v2.1 (1,673 Elo), tau-Banking, SkillsBench, Automationbench, Terminal-Bench 4.0, CyberGym, FrontierSWE (75.16), SWE Atlas Codebase QnA, Finance Agent v2, HealthBench Professional (65.35), DRACO and MultiChallenge. A footnote states that HealthBench Professional was evaluated in the AQ environment.

Ant publiceerde Ling-3.1-flash samen met een benchmarkkaart met meerdere panelen die het in een veld van frontier- en bijna-frontiermodellen plaatst: GPT-5.6 Sol, Claude Opus 5, Kimi K3, twee inzendingen uit de GLM-familie en DeepSeek-V4.1-Flash. Over de panelen heen staat de Ling-balk bovenaan of bijna bovenaan bij de agentische en codeermaatstaven, en in de middenmoot bij de multiturn- en domeinspecifieke maatstaven. Lees het als wat het is — de eigen selectie van taken door de leverancier, geput uit een suite met algemeen agentwerk, coderen, taken uit het bankdomein en gezondheidszorg — en het is een geloofwaardig ogende kaart.

Kijk echter naar wie erop staat, en één ding springt eruit. De frontier-peers die Ant koos, zijn GPT-5.6 Sol en Claude Opus 5. Beide modellen lopen inmiddels een generatie achter. Opus 5.5 en GPT-6 Sol gingen beide live op 22 september 2026, op dezelfde dag, en beide zijn vandaag routeerbaar. De nieuwste modellen die Ant niet op de kaart heeft gezet, zijn precies de modellen waartegen een lezer het zou willen meten, wat dezelfde klacht is die opdook in de eerste golf commentaar op de release — de wens dat een model dat in oktober verschijnt, was gebenchmarkt tegen de frontier van oktober in plaats van die van juli. Dat is geen kritiek op het model, dat best stand kan houden. Het is een reden om de kaart als een directionele claim te behandelen in plaats van als een eindoordeel, en om op te merken dat de vergelijking die Ant koos het resultaat niet zozeer vleit als wel dateert.

Waar je het kunt aanraken, en één onverklaarde voetnoot

Er is vandaag precies één plek waar Ling-3.1-flash voor een gebruiker draait: Ants eigen product. De Ling Studio-interface op ling.tbox.cn vermeldt Ling-3.1-flash in zijn modelkiezer, en de beschrijving die de app zelf van het model geeft, is breder dan de benchmarkkaart — het positioneert het voor "algemene agents, zoeken, routinematig kantoorwerk en software-/codeontwikkeling", wat de bekende positionering voor dit segment is: niet de diepste redeneerder in de familie, maar degene die bedoeld is om constant en goedkoop te worden aangeroepen.

Dat oppervlak draagt ook het meest ongemakkelijke detail van de release. De voetnoot van de benchmarkkaart zelf zegt dat HealthBench Professional — de 65,35-figuur, een van de drie getallen in de aankondigingstekst — "in de AQ-omgeving is geëvalueerd", en voegt eraan toe dat de zorgmogelijkheden van Ling-3.1-flash "momenteel alleen in AQ kunnen worden ervaren." Niets op de kaart legt uit wat AQ is, en geen openbare documentatie die we konden vinden, definieert het. Een opvallende score met een omgevingskwalificatie eraan vast, waarbij de omgeving niet wordt genoemd, is geen reproduceerbaar resultaat; het is een productdemo met een getal ernaast.

Wat kenbaar is, en wat niet

Deze release in die twee categorieën indelen is het nuttigste wat een lezer er vandaag mee kan doen.

Nu bekend: de parameters, het aantal actieve parameters en het contextvenster zoals vermeld door de leverancier; de drie benchmarks van de leverancier; het bestaan van het model in Ants eigen product; de door Ant gekozen vergelijkingsset; het feit dat er geen gewichten, licentie of modelkaart is gepubliceerd; en het feit dat Artificial Analysis, dat de vorige generatie onafhankelijk scoorde, geen Ling-3.1-flash-pagina heeft. Op het moment van schrijven heeft de onafhankelijke scorepijplijn die het cijfer van 20 punten op de Intelligence Index van Ling-3.0-flash leesbaar maakte, helemaal niets over 3.1 gepubliceerd.

Nu niet te weten: of de gewichten daadwerkelijk open gaan, en onder welke licentie; of de architectuur een opgeschaalde versie is van de Ling-3.0 hybride stack of iets nieuws; wat het model kost via de API van Ant, als het al een API-prijs heeft; hoe het zich in de praktijk gedraagt bij lange context, in tegenstelling tot hoe het venster is gespecificeerd; en of de benchmarkverschillen standhouden wanneer iemand die niet van Ant is dezelfde taken uitvoert. Elk daarvan is een vraag die een uitgebracht model op dag één beantwoordt en een aangekondigd model beantwoordt op een latere dag die nog niet is gepland.

Generated two-column information card. Left column headed "Knowable today" lists five cards: "~560B total / ~25B active (vendor)", "up to 1M-token context (vendor)", "1,673 Elo GDPval-AA v2.1 (vendor)", "available in Ant's Ling Studio only" and "no independent score exists". Right column headed "Not knowable" lists five cards: "whether the weights will open", "the licence terms", "API price per million tokens", "long-context behaviour in practice" and "whether the benchmark gaps hold".

Hoe je een dag zoals deze leest

Het patroon komt nu zo vaak voor dat het een naam verdient. Een Chinees lab met een sterke staat van dienst brengt een modelkaart en een benchmarkgrafiek uit, de cijfers belanden dicht bij de frontier, de community reageert op de cijfers, en de gewichten arriveren — of niet — weken later. Ling-3.0-flash speelde deze zomer precies dat spel, en het is de moeite waard om te onthouden hoe het afliep: Ant kondigde het op 24 juli 2026 aan als een model dat uitsluitend via een API beschikbaar is, zonder licentieverklaring en zonder onafhankelijke benchmark, en de gewichten onder MIT verschenen pas op 7 augustus op Hugging Face, twee weken na de aankondiging. Ling-3.1-flash bevindt zich op dag één op het equivalente punt in dat traject, met als extra verschil dat de belofte om open source te gaan ditmaal expliciet in de aankondiging staat in plaats van te worden afgeleid.

Geen van de modellen die Ant als vergelijkingspunten koos, staat als onderwerp van dit stuk in onze catalogus — Ling-3.1-flash, Ling-3.0-flash en Ling-3.0-flash-VL geven allemaal not-found op de OrcaRouter-catalogus van vandaag, en we zullen niet doen alsof het anders is. Maar drie van de peers op die grafiek zijn nu routeerbaar: Claude Opus 5, GPT-5.6 Sol en DeepSeek-V4.1-Flash zitten allemaal achter één sleutel, tegen de lijstprijs van de provider zonder markup, met automatische failover tussen hen. Dat is belangrijker dan het klinkt in een week als deze, want de eerlijke manier om een aangekondigd model te evalueren is de vergelijking uitvoeren waar Ant om vraagt — met de modellen die je daadwerkelijk kunt aanroepen — terwijl het onderwerp van de vergelijking nog een grafiek is.

Wanneer de gewichten arriveren, is de nuttige vraag niet of Ling-3.1-flash Opus 5 heeft verslagen op één Elo-rating. Het is of een ~560B MoE met ~25B actief een context van 1M tokens kan vasthouden tegen een prijs die de sparsity de moeite waard maakt, en of de licentie permissief genoeg is om zelf te hosten. Dat zijn de twee vragen die de aankondiging niet beantwoordt, en het zijn de enige die zullen bepalen of dit een model wordt waar mensen op voortbouwen of een dia in iemands volgende presentatie. Voor nu: de naam is echt, de cijfers zijn alleen van Ant, en de gewichten zijn nog steeds een zin.

Generated horizontal timeline with four milestone nodes. "Jul 24, 2026 — Ling-3.0-flash announced, API-only, no weights, no licence"; "Aug 7, 2026 — MIT weights land on Hugging Face, 14 days later"; "Sep 30, 2026 — Ling-3.1-flash announced: ~560B, ~25B active, 1M context"; and a dashed open node reading "Weights: not yet — 'we plan to open-source soon'", captioned "the same point in the same arc, on day one".