
Ling-3.1-flash annunciato, non open: ~560 miliardi di parametri, un contesto da 1M token e un grafico che solo Ant ha eseguito
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 261 tok/s
- OpenAINUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- OpenAINUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAINUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 216 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- xAISpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
Il team Ling di Ant Group ha reso noti i numeri del suo prossimo modello di fascia veloce il 30 settembre 2026 e, nello stesso respiro, ha detto che non potete ancora averlo. Ling-3.1-flash è un mixture-of-experts da circa 560 miliardi di parametri che attiva circa 25 miliardi di parametri per token e dispone di una finestra di contesto fino a 1 milione di token, secondo l'annuncio del modello che Ant ha pubblicato dal proprio account @AntLingAGI. La frase che definisce questo rilascio è quella che segue le specifiche: "Prevediamo di rendere open source il modello presto." A oggi non esiste alcun repository Ling-3.1-flash su Hugging Face, nessuna licenza, nessun file di pesi scaricabile e nessuna valutazione da parte di qualcuno esterno ad Ant Group. Ciò che esiste è un grafico di benchmark, una superficie di prodotto attiva e una promessa.
Questa distinzione è tutta la storia, e vale la pena essere schietti al riguardo, perché l'inquadramento che raggiunge per primo la maggior parte delle persone — un rilascio open-weight di classe 500B dalla Cina che si colloca vicino alla frontiera — descrive qualcosa che non è accaduto. Ling-3.1-flash non è un rilascio aperto. È un rilascio annunciato. I due non sono vicini, e il divario tra loro è esattamente il punto in cui un lettore può scottarsi: se pianifichi capacità, metti a budget un progetto pilota o scrivi una nota di approvvigionamento attorno a pesi aperti che non esistono ancora, stai pianificando sulla base di un comunicato stampa.
Cosa contiene effettivamente l'annuncio
Il post è breve e i numeri al suo interno sono specifici. Ant afferma un numero totale di parametri di circa 560 miliardi contro circa 25 miliardi attivi per token, un rapporto vicino a 1 su 22, leggermente più denso della generazione Ling-3.0-flash a cui succede — quel modello ha 124 miliardi totali contro 5,1 miliardi attivi, circa 1 su 24, su un corpo grande meno di un quarto. Il contesto è citato come "fino a 1 milione di token", quattro volte la finestra di 262.144 token che la famiglia Ling-3.0-flash offre oggi. Sono associati tre punteggi principali: 1.673 Elo su GDPVal-AA v2.1, 75,16 su FrontierSWE e 65,35 su HealthBench Professional.
Ognuno di quei numeri è dichiarato dal fornitore, di prima parte e non pubblicato in alcuna forma che una terza parte possa rieseguire. Non esiste un'infrastruttura di valutazione, nessun set di prompt, nessuna configurazione di esecuzione e nessun seed — e, più fondamentalmente, nessun peso su cui eseguirli. Se i numeri di Ant sono corretti, il modello si colloca nella fascia più alta dei rilasci cinesi di modelli aperti; al momento non c'è modo di scoprire se sono corretti.
Il grafico, e l'avvertenza che vi è insita

Ant ha pubblicato Ling-3.1-flash insieme a una scheda di benchmark multi-pannello che lo colloca in un campo di modelli di frontiera e quasi di frontiera: GPT-5.6 Sol, Claude Opus 5, Kimi K3, due voci della famiglia GLM e DeepSeek-V4.1-Flash. Nei vari pannelli la barra di Ling si colloca in cima o vicino alla cima nelle misure agentiche e di coding, e a metà classifica in quelle multi-turn e specifiche di dominio. Leggila per quello che è — la selezione di attività dello stesso fornitore, tratta da una suite che comprende lavoro agentico generico, coding, attività del dominio bancario e sanità — ed è una scheda dall'aspetto credibile.
Guardate però chi c'è dentro, e una cosa salta all'occhio. I modelli di frontiera che Ant ha scelto come termini di paragone sono GPT-5.6 Sol e Claude Opus 5. Entrambi questi modelli sono ormai una generazione indietro. Opus 5.5 e GPT-6 Sol sono entrati in funzione il 22 settembre 2026, lo stesso giorno, ed entrambi oggi sono instradabili. I modelli più recenti che Ant non ha inserito nella scheda sono esattamente quelli rispetto ai quali un lettore vorrebbe vederlo misurato, che è la stessa lamentela emersa nella prima ondata di commenti sul rilascio — il desiderio che un modello arrivato in ottobre fosse stato valutato rispetto alla frontiera di ottobre anziché a quella di luglio. Non è una critica al modello, che potrebbe benissimo reggere. È un motivo per considerare la scheda come un'indicazione di tendenza più che come un verdetto, e per notare che il confronto scelto da Ant, più che lusingare il risultato, lo fa sembrare datato.
Dove puoi toccarlo, e una nota a piè di pagina inspiegata
Oggi c'è esattamente un solo posto in cui un utente può eseguire Ling-3.1-flash: il prodotto della stessa Ant. L’interfaccia Ling Studio su ling.tbox.cn elenca Ling-3.1-flash nel suo selettore di modelli, e la descrizione del modello fornita dall’app stessa è più ampia della scheda di benchmark — lo presenta come adatto ad «agenti generici, ricerca, normale lavoro d’ufficio e sviluppo software/codice», che è il posizionamento consueto per questa fascia: non il ragionatore più profondo della famiglia, ma quello pensato per essere invocato di continuo e a basso costo.
Quella superficie porta con sé anche il dettaglio più scomodo del rilascio. La nota a piè di pagina della scheda del benchmark afferma che HealthBench Professional — il valore 65.35, uno dei tre numeri nel testo dell'annuncio — è stato «valutato nell'ambiente AQ», e aggiunge che le capacità sanitarie di Ling-3.1-flash «al momento possono essere provate solo in AQ». Nulla sulla scheda spiega che cosa sia AQ, e nessuna documentazione pubblica che siamo riusciti a trovare lo definisce. Un punteggio di richiamo con un qualificatore ambientale allegato, in cui l'ambiente non è nominato, non è un risultato riproducibile; è una demo di prodotto con un numero accanto.
Ciò che è conoscibile, e ciò che non lo è
Classificare questa release in quelle due categorie è la cosa più utile che un lettore possa farne oggi.
Quel che è conoscibile ora: i parametri, il numero di parametri attivi e la finestra di contesto come dichiarati dal fornitore; i tre benchmark del fornitore; l'esistenza del modello in un prodotto di Ant stesso; l'insieme di confronto selezionato da Ant; il fatto che non siano stati pubblicati pesi, licenza o scheda del modello; e il fatto che Artificial Analysis, che ha valutato in modo indipendente la generazione precedente, non abbia una pagina per Ling-3.1-flash. Al momento in cui scriviamo, la pipeline di valutazione indipendente che ha reso leggibile il valore di 20 punti dell'Intelligence Index di Ling-3.0-flash non ha pubblicato proprio nulla su 3.1.
Non è possibile saperlo ora: se i pesi saranno effettivamente aperti e con quale licenza; se l'architettura è una versione ingrandita dello stack ibrido Ling-3.0 o qualcosa di nuovo; quanto costa il modello tramite l'API di Ant, se mai ha un prezzo per API; come si comporta in pratica con contesti lunghi, rispetto a come viene specificata la finestra; e se i divari nei benchmark reggono quando qualcuno che non è Ant esegue gli stessi compiti. Ognuna di queste è una domanda a cui un modello rilasciato risponde dal primo giorno e un modello annunciato risponde in un giorno successivo che non è stato programmato.

Come leggere una giornata come questa
Lo schema è ormai così comune da meritare un nome. Un laboratorio cinese con un solido curriculum pubblica una model card e un grafico di benchmark, i numeri si collocano vicino alla frontiera, la comunità reagisce ai numeri, e i pesi arrivano — o non arrivano — settimane dopo. Ling-3.0-flash ha recitato esattamente questo copione quest'estate, e vale la pena ricordare come si è risolta: Ant lo ha annunciato il 24 luglio 2026 come modello solo API, senza dichiarazione di licenza e senza benchmark indipendenti, e i pesi con licenza MIT non sono comparsi su Hugging Face fino al 7 agosto, due settimane dopo l'annuncio. Ling-3.1-flash si trova nel punto equivalente di quell'arco già dal primo giorno, con l'ulteriore differenza che questa volta la promessa di open source è esplicita nell'annuncio anziché dedotta.
Nessuno dei modelli che Ant ha scelto come termini di confronto è presente nel nostro catalogo come oggetto dell'analisi — Ling-3.1-flash, Ling-3.0-flash e Ling-3.0-flash-VL restituiscono tutti un "non trovato" sul catalogo OrcaRouter oggi, e non intendiamo far finta del contrario. Ma tre dei peer presenti in quel grafico sono instradabili in questo momento: Claude Opus 5, GPT-5.6 Sol e DeepSeek-V4.1-Flash sono tutti accessibili dietro un'unica chiave, al prezzo di listino del provider senza alcun ricarico, con failover automatico tra loro. Questo conta più di quanto sembri in una settimana come questa, perché il modo onesto di valutare un modello annunciato è eseguire il confronto che Ant ci invita a fare — rispetto ai modelli che si possono effettivamente chiamare — mentre l'oggetto del confronto è ancora un grafico.
Quando i pesi arriveranno, la domanda utile non sarà se Ling-3.1-flash ha battuto Opus 5 su un singolo punteggio Elo. Sarà se un MoE da ~560B con ~25B attivi può reggere un contesto da 1M di token a un prezzo che renda la sparsità vantaggiosa, e se la licenza è abbastanza permissiva da consentire il self-hosting. Queste sono le due domande a cui l'annuncio non risponde, e sono le uniche che decideranno se questo diventerà un modello su cui le persone costruiscono o una slide nella prossima presentazione di qualcuno. Per ora: il nome è reale, i numeri sono solo di Ant, e i pesi sono ancora una frase.

