
Ling-3.1-flash wordt aangekondigd, niet open: ~560B parameters, een context van 1M tokens, en een grafiek die alleen Ant heeft gedraaid
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 262 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- xAISpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
Het Ling-team van Ant Group gaf op 30 september 2026 cijfers vrij over zijn volgende fast-tier-model, en zei in één adem dat je het nog niet kunt krijgen. Ling-3.1-flash is een mixture-of-experts-model met ruwweg 560 miljard parameters dat ongeveer 25 miljard parameters per token activeert en een contextvenster van maximaal 1 miljoen tokens heeft, volgens de modelaankondiging die Ant via zijn eigen @AntLingAGI-account publiceerde. De zin die deze release typeert, is de zin die na de specificaties komt: "We zijn van plan het model binnenkort open source te maken." Vandaag de dag is er geen Ling-3.1-flash-repository op Hugging Face, geen licentie, geen downloadbaar gewichtenbestand en geen evaluatie door iemand buiten Ant Group. Wat bestaat, is een benchmarkgrafiek, een live productoppervlak en een belofte.
Dat onderscheid is het hele verhaal, en het is de moeite waard om er bot over te zijn, want de framing die de meeste mensen het eerst bereikt — een open-weight release van 500B-klasse uit China die dicht bij de frontier uitkomt — beschrijft iets dat niet is gebeurd. Ling-3.1-flash is geen open release. Het is een aangekondigde release. Die twee liggen niet dicht bij elkaar, en precies daar, in de kloof ertussen, kan een lezer zich branden: als je capaciteit plant, een pilot begroot of een inkoopnotitie schrijft rond open weights die nog niet bestaan, dan plan je op basis van een persbericht.
Wat de aankondiging daadwerkelijk bevat
De post is kort en de cijfers erin zijn specifiek. Ant stelt een totaal aantal parameters van ongeveer 560 miljard tegenover ongeveer 25 miljard actieve per token, een verhouding van bijna 1 op 22, iets dichter dan de Ling-3.0-flash-generatie die het opvolgt — dat model draait op 124 miljard totaal tegen 5,1 miljard actieve, ongeveer 1 op 24, met een omvang van minder dan een kwart. Context wordt geciteerd als 'tot 1M tokens', vier keer het venster van 262.144 tokens dat de Ling-3.0-flash-familie vandaag bedient. Er worden drie opvallende scores genoemd: 1.673 Elo op GDPVal-AA v2.1, 75,16 op FrontierSWE, en 65,35 op HealthBench Professional.
Elk van die cijfers is door de leverancier gerapporteerd, first-party, en in geen enkele vorm gepubliceerd die een derde partij opnieuw kan uitvoeren. Er is geen evaluatieharnas, geen promptset, geen runconfiguratie en geen seed — en, fundamenteler nog, geen gewichten waarop ze kunnen draaien. Als de cijfers van Ant kloppen, behoort het model tot de topklasse van Chinese open-modelreleases; er is momenteel geen manier om erachter te komen of ze kloppen.
De grafiek, en het voorbehoud dat erin besloten ligt

Ant publiceerde Ling-3.1-flash samen met een benchmarkkaart met meerdere panelen die het in een veld van frontier- en bijna-frontiermodellen plaatst: GPT-5.6 Sol, Claude Opus 5, Kimi K3, twee inzendingen uit de GLM-familie en DeepSeek-V4.1-Flash. Over de panelen heen staat de Ling-balk bovenaan of bijna bovenaan bij de agentische en codeermaatstaven, en in de middenmoot bij de multiturn- en domeinspecifieke maatstaven. Lees het als wat het is — de eigen selectie van taken door de leverancier, geput uit een suite met algemeen agentwerk, coderen, taken uit het bankdomein en gezondheidszorg — en het is een geloofwaardig ogende kaart.
Kijk echter naar wie erop staat, en één ding springt eruit. De frontier-peers die Ant koos, zijn GPT-5.6 Sol en Claude Opus 5. Beide modellen lopen inmiddels een generatie achter. Opus 5.5 en GPT-6 Sol gingen beide live op 22 september 2026, op dezelfde dag, en beide zijn vandaag routeerbaar. De nieuwste modellen die Ant niet op de kaart heeft gezet, zijn precies de modellen waartegen een lezer het zou willen meten, wat dezelfde klacht is die opdook in de eerste golf commentaar op de release — de wens dat een model dat in oktober verschijnt, was gebenchmarkt tegen de frontier van oktober in plaats van die van juli. Dat is geen kritiek op het model, dat best stand kan houden. Het is een reden om de kaart als een directionele claim te behandelen in plaats van als een eindoordeel, en om op te merken dat de vergelijking die Ant koos het resultaat niet zozeer vleit als wel dateert.
Waar je het kunt aanraken, en één onverklaarde voetnoot
Er is vandaag precies één plek waar Ling-3.1-flash voor een gebruiker draait: Ants eigen product. De Ling Studio-interface op ling.tbox.cn vermeldt Ling-3.1-flash in zijn modelkiezer, en de beschrijving die de app zelf van het model geeft, is breder dan de benchmarkkaart — het positioneert het voor "algemene agents, zoeken, routinematig kantoorwerk en software-/codeontwikkeling", wat de bekende positionering voor dit segment is: niet de diepste redeneerder in de familie, maar degene die bedoeld is om constant en goedkoop te worden aangeroepen.
Dat oppervlak draagt ook het meest ongemakkelijke detail van de release. De voetnoot van de benchmarkkaart zelf zegt dat HealthBench Professional — de 65,35-figuur, een van de drie getallen in de aankondigingstekst — "in de AQ-omgeving is geëvalueerd", en voegt eraan toe dat de zorgmogelijkheden van Ling-3.1-flash "momenteel alleen in AQ kunnen worden ervaren." Niets op de kaart legt uit wat AQ is, en geen openbare documentatie die we konden vinden, definieert het. Een opvallende score met een omgevingskwalificatie eraan vast, waarbij de omgeving niet wordt genoemd, is geen reproduceerbaar resultaat; het is een productdemo met een getal ernaast.
Wat kenbaar is, en wat niet
Deze release in die twee categorieën indelen is het nuttigste wat een lezer er vandaag mee kan doen.
Nu bekend: de parameters, het aantal actieve parameters en het contextvenster zoals vermeld door de leverancier; de drie benchmarks van de leverancier; het bestaan van het model in Ants eigen product; de door Ant gekozen vergelijkingsset; het feit dat er geen gewichten, licentie of modelkaart is gepubliceerd; en het feit dat Artificial Analysis, dat de vorige generatie onafhankelijk scoorde, geen Ling-3.1-flash-pagina heeft. Op het moment van schrijven heeft de onafhankelijke scorepijplijn die het cijfer van 20 punten op de Intelligence Index van Ling-3.0-flash leesbaar maakte, helemaal niets over 3.1 gepubliceerd.
Nu niet te weten: of de gewichten daadwerkelijk open gaan, en onder welke licentie; of de architectuur een opgeschaalde versie is van de Ling-3.0 hybride stack of iets nieuws; wat het model kost via de API van Ant, als het al een API-prijs heeft; hoe het zich in de praktijk gedraagt bij lange context, in tegenstelling tot hoe het venster is gespecificeerd; en of de benchmarkverschillen standhouden wanneer iemand die niet van Ant is dezelfde taken uitvoert. Elk daarvan is een vraag die een uitgebracht model op dag één beantwoordt en een aangekondigd model beantwoordt op een latere dag die nog niet is gepland.

Hoe je een dag zoals deze leest
Het patroon komt nu zo vaak voor dat het een naam verdient. Een Chinees lab met een sterke staat van dienst brengt een modelkaart en een benchmarkgrafiek uit, de cijfers belanden dicht bij de frontier, de community reageert op de cijfers, en de gewichten arriveren — of niet — weken later. Ling-3.0-flash speelde deze zomer precies dat spel, en het is de moeite waard om te onthouden hoe het afliep: Ant kondigde het op 24 juli 2026 aan als een model dat uitsluitend via een API beschikbaar is, zonder licentieverklaring en zonder onafhankelijke benchmark, en de gewichten onder MIT verschenen pas op 7 augustus op Hugging Face, twee weken na de aankondiging. Ling-3.1-flash bevindt zich op dag één op het equivalente punt in dat traject, met als extra verschil dat de belofte om open source te gaan ditmaal expliciet in de aankondiging staat in plaats van te worden afgeleid.
Geen van de modellen die Ant als vergelijkingspunten koos, staat als onderwerp van dit stuk in onze catalogus — Ling-3.1-flash, Ling-3.0-flash en Ling-3.0-flash-VL geven allemaal not-found op de OrcaRouter-catalogus van vandaag, en we zullen niet doen alsof het anders is. Maar drie van de peers op die grafiek zijn nu routeerbaar: Claude Opus 5, GPT-5.6 Sol en DeepSeek-V4.1-Flash zitten allemaal achter één sleutel, tegen de lijstprijs van de provider zonder markup, met automatische failover tussen hen. Dat is belangrijker dan het klinkt in een week als deze, want de eerlijke manier om een aangekondigd model te evalueren is de vergelijking uitvoeren waar Ant om vraagt — met de modellen die je daadwerkelijk kunt aanroepen — terwijl het onderwerp van de vergelijking nog een grafiek is.
Wanneer de gewichten arriveren, is de nuttige vraag niet of Ling-3.1-flash Opus 5 heeft verslagen op één Elo-rating. Het is of een ~560B MoE met ~25B actief een context van 1M tokens kan vasthouden tegen een prijs die de sparsity de moeite waard maakt, en of de licentie permissief genoeg is om zelf te hosten. Dat zijn de twee vragen die de aankondiging niet beantwoordt, en het zijn de enige die zullen bepalen of dit een model wordt waar mensen op voortbouwen of een dia in iemands volgende presentatie. Voor nu: de naam is echt, de cijfers zijn alleen van Ant, en de gewichten zijn nog steeds een zin.

