Kartu hero editorial yang dihasilkan berjudul "Ling-3.1-flash: diumumkan, belum terbuka" dengan subjudul "~560B total parameter · ~25B aktif per token · konteks hingga 1M". Tiga kartu berlabel bertuliskan "Bobot: belum dirilis", "Benchmark: hanya dilaporkan vendor" dan "Tanpa lisensi · tanpa kartu model · tanpa unduhan".
Guides & Insights

Ling-3.1-flash Diumumkan, Tidak Terbuka: ~560B Parameter, Konteks 1M Token, dan Grafik yang Hanya Telah Dijalankan oleh Ant

Penulis

Alistair Wren

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Tim Ling milik Ant Group merilis angka untuk model tingkat cepat berikutnya pada 30 September 2026, dan pada saat yang sama mengatakan Anda belum bisa memilikinya. Ling-3.1-flash adalah model mixture-of-experts dengan sekitar 560 miliar parameter yang mengaktifkan sekitar 25 miliar parameter per token dan memiliki jendela konteks hingga 1 juta token, menurut pengumuman model yang dipublikasikan Ant dari akun @AntLingAGI miliknya sendiri. Kalimat yang mendefinisikan rilis ini adalah kalimat yang mengikuti spesifikasi: "Kami berencana untuk segera merilis model ini sebagai open-source." Per hari ini, tidak ada repositori Ling-3.1-flash di Hugging Face, tidak ada lisensi, tidak ada file bobot yang dapat diunduh, dan tidak ada evaluasi dari siapa pun di luar Ant Group. Yang ada hanyalah bagan benchmark, tampilan produk yang sudah live, dan sebuah janji.

Perbedaan itu adalah inti persoalannya, dan perlu dikatakan secara terus terang, karena bingkai yang lebih dulu sampai kepada kebanyakan orang — rilis berbobot terbuka kelas 500B dari Tiongkok yang mendekati garis depan — menggambarkan sesuatu yang belum terjadi. Ling-3.1-flash bukan rilis terbuka. Ini rilis yang baru diumumkan. Keduanya tidak berdekatan, dan celah di antara keduanya justru tempat pembaca bisa celaka: jika Anda merencanakan kapasitas, menganggarkan uji coba, atau menulis catatan pengadaan berdasarkan bobot terbuka yang belum ada, Anda merencanakan berdasarkan siaran pers.

Apa yang sebenarnya terkandung dalam pengumuman itu

Postingannya singkat dan angka-angka di dalamnya spesifik. Ant menyatakan jumlah parameter total sekitar 560 miliar dengan sekitar 25 miliar yang aktif per token, rasio hampir 1 banding 22, sedikit lebih padat daripada generasi Ling-3.0-flash yang digantikannya — model itu berjalan dengan total 124B dengan 5,1B aktif, sekitar 1 banding 24, pada ukuran bodi kurang dari seperempatnya. Konteks dikutip sebagai "hingga 1 juta token," empat kali jendela 262.144 token yang dilayani keluarga Ling-3.0-flash saat ini. Tiga skor utama dilampirkan: 1.673 Elo pada GDPVal-AA v2.1, 75,16 pada FrontierSWE, dan 65,35 pada HealthBench Professional.

Setiap angka tersebut dilaporkan oleh vendor, berasal dari pihak pertama, dan tidak dipublikasikan dalam bentuk apa pun yang dapat dijalankan ulang oleh pihak ketiga. Tidak ada perangkat evaluasi, tidak ada kumpulan prompt, tidak ada konfigurasi eksekusi, dan tidak ada seed — dan, yang lebih mendasar, tidak ada bobot untuk menjalankannya. Jika angka Ant benar, model ini berada di jajaran teratas rilis model terbuka Tiongkok; saat ini tidak ada cara untuk mengetahui apakah angka itu benar.

Grafik itu, dan peringatan yang sudah melekat di dalamnya

Ant Group's own Ling-3.1-flash benchmark card, published from the @AntLingAGI account on 30 September 2026. Multi-panel bar charts compare Ling-3.1-flash against GPT-5.6 Sol, Claude Opus 5, Kimi K3, GLM 5.3 and GLM 5.3 Flash, and DeepSeek-V4.1-Flash across GDPval-AA v2.1 (1,673 Elo), tau-Banking, SkillsBench, Automationbench, Terminal-Bench 4.0, CyberGym, FrontierSWE (75.16), SWE Atlas Codebase QnA, Finance Agent v2, HealthBench Professional (65.35), DRACO and MultiChallenge. A footnote states that HealthBench Professional was evaluated in the AQ environment.

Ant menerbitkan Ling-3.1-flash bersama kartu tolok ukur multi-panel yang menempatkannya di antara model-model frontier dan near-frontier: GPT-5.6 Sol, Claude Opus 5, Kimi K3, dua entri dari keluarga GLM, dan DeepSeek-V4.1-Flash. Di seluruh panel, batang Ling berada di atau dekat puncak pada metrik agentik dan pengodean serta di pertengahan kelompok pada metrik multi-turn dan spesifik domain. Bacalah sebagaimana adanya — pilihan tugas dari vendor itu sendiri, yang diambil dari rangkaian yang mencakup pekerjaan agen serbaguna, pengodean, tugas domain perbankan, dan layanan kesehatan — dan ini adalah kartu yang tampak kredibel.

Namun, lihatlah siapa saja yang ada di dalamnya, dan satu hal menonjol. Model-model terdepan yang dipilih Ant adalah GPT-5.6 Sol dan Claude Opus 5. Kedua model itu sekarang tertinggal satu generasi. Opus 5.5 dan GPT-6 Sol sama-sama aktif pada 22 September 2026, di hari yang sama, dan keduanya dapat dirutekan hari ini. Model-model terbaru yang tidak dicantumkan Ant di kartu itu justru tepat model yang ingin dijadikan pembanding oleh pembaca, yang merupakan keluhan yang sama yang muncul dalam gelombang pertama komentar tentang rilis tersebut — keinginan agar model yang hadir pada Oktober diukur terhadap model terdepan Oktober, bukan model terdepan Juli. Itu bukanlah celaan terhadap model tersebut, yang bisa saja terbukti kuat. Ini adalah alasan untuk memperlakukan kartu itu sebagai klaim arah, bukan putusan akhir, dan untuk mencatat bahwa perbandingan yang dipilih Ant tidak banyak menyanjung hasilnya, melainkan lebih membuatnya tampak ketinggalan zaman.

Di mana Anda dapat menyentuhnya, dan satu catatan kaki yang tidak dijelaskan

Ada tepat satu tempat Ling-3.1-flash dijalankan untuk pengguna saat ini: produk Ant sendiri. Antarmuka Ling Studio di ling.tbox.cn mencantumkan Ling-3.1-flash di pemilih modelnya, dan deskripsi aplikasi itu sendiri tentang model tersebut lebih luas daripada kartu benchmark-nya — model ini diposisikan untuk "agen serbaguna, pencarian, pekerjaan kantor rutin, serta pengembangan perangkat lunak/kode," yang merupakan positioning familier untuk tingkat ini: bukan penalar terdalam di keluarganya, melainkan model yang dimaksudkan untuk dipanggil terus-menerus dan dengan biaya murah.

Permukaan itu juga memuat detail paling janggal dari rilis ini. Catatan kaki pada kartu benchmark itu sendiri menyatakan HealthBench Professional — angka 65,35, salah satu dari tiga angka dalam teks pengumuman — "dievaluasi di lingkungan AQ," dan menambahkan bahwa kemampuan layanan kesehatan Ling-3.1-flash "saat ini hanya dapat dicoba di AQ." Tidak ada apa pun di kartu itu yang menjelaskan apa itu AQ, dan tidak ada dokumentasi publik yang dapat kami temukan yang mendefinisikannya. Skor utama dengan kualifikasi lingkungan yang melekat, ketika lingkungannya tidak disebutkan namanya, bukanlah hasil yang dapat direproduksi; itu hanyalah demo produk dengan angka di sampingnya.

Apa yang dapat diketahui, dan apa yang tidak

Membagi rilis ini ke dalam dua kelompok itu adalah hal paling berguna yang bisa dilakukan seorang pembaca dengannya hari ini.

Yang dapat diketahui sekarang: parameter, jumlah parameter aktif, dan jendela konteks sebagaimana dinyatakan oleh vendor; tiga benchmark vendor; keberadaan model dalam produk Ant sendiri; kumpulan pembanding yang dipilih Ant; fakta bahwa tidak ada bobot, lisensi, atau kartu model yang telah dipublikasikan; dan fakta bahwa Artificial Analysis, yang menilai generasi sebelumnya secara independen, tidak memiliki halaman Ling-3.1-flash. Hingga tulisan ini dibuat, pipeline penilaian independen yang membuat angka Intelligence Index 20 poin milik Ling-3.0-flash dapat terbaca belum mempublikasikan apa pun tentang 3.1 sama sekali.

Belum dapat diketahui sekarang: apakah bobotnya benar-benar akan dibuka, dan di bawah lisensi apa; apakah arsitekturnya merupakan versi yang diperbesar dari stack hibrida Ling-3.0 atau sesuatu yang baru; berapa biaya model ini melalui API Ant, jika memang ada harga API-nya sama sekali; bagaimana perilakunya dalam konteks panjang secara praktik, alih-alih bagaimana jendela konteksnya ditentukan; dan apakah selisih benchmark tetap bertahan ketika seseorang yang bukan Ant menjalankan tugas yang sama. Masing-masing dari itu adalah pertanyaan yang dijawab model yang telah dirilis pada hari pertama dan dijawab model yang baru diumumkan pada suatu hari yang lebih lambat yang belum dijadwalkan.

Generated two-column information card. Left column headed "Knowable today" lists five cards: "~560B total / ~25B active (vendor)", "up to 1M-token context (vendor)", "1,673 Elo GDPval-AA v2.1 (vendor)", "available in Ant's Ling Studio only" and "no independent score exists". Right column headed "Not knowable" lists five cards: "whether the weights will open", "the licence terms", "API price per million tokens", "long-context behaviour in practice" and "whether the benchmark gaps hold".

Cara membaca hari seperti ini

Pola ini sekarang cukup umum untuk diberi nama. Sebuah laboratorium Tiongkok dengan rekam jejak yang kuat merilis kartu model dan bagan tolok ukur, angka-angkanya mendekati garis terdepan, komunitas bereaksi terhadap angka-angka itu, dan bobotnya tiba — atau tidak — beberapa minggu kemudian. Ling-3.0-flash menjalankan persis skenario itu pada musim panas ini, dan ada baiknya mengingat bagaimana hal itu berakhir: Ant mengumumkannya pada 24 Juli 2026 sebagai model khusus API tanpa pernyataan lisensi dan tanpa tolok ukur independen, dan bobotnya di bawah MIT baru muncul di Hugging Face pada 7 Agustus, dua minggu setelah pengumuman. Ling-3.1-flash berada pada titik yang setara dalam alur itu pada hari pertama, dengan perbedaan tambahan bahwa kali ini janji untuk membuka sumbernya dinyatakan secara eksplisit dalam pengumuman, bukan disimpulkan.

Tidak ada satu pun model yang dipilih Ant sebagai titik pembanding yang ada di katalog kami sebagai subjek artikel — Ling-3.1-flash, Ling-3.0-flash, dan Ling-3.0-flash-VL semuanya mengembalikan status tidak ditemukan di katalog OrcaRouter hari ini, dan kami tidak akan berpura-pura sebaliknya. Tetapi tiga dari model pembanding pada bagan itu bisa dirutekan sekarang juga: Claude Opus 5, GPT-5.6 Sol, dan DeepSeek-V4.1-Flash semuanya berada di balik satu kunci, dengan harga daftar penyedia tanpa markup, dengan failover otomatis di antara mereka. Itu lebih penting daripada kedengarannya pada minggu seperti ini, karena cara jujur untuk mengevaluasi model yang baru diumumkan adalah menjalankan perbandingan yang Ant tawarkan — terhadap model yang benar-benar bisa Anda panggil — selagi subjek perbandingannya masih berupa bagan.

Saat bobotnya dirilis, pertanyaan yang berguna bukanlah apakah Ling-3.1-flash mengalahkan Opus 5 pada satu peringkat Elo. Melainkan apakah MoE ~560B dengan ~25B aktif dapat mempertahankan konteks 1M-token pada harga yang membuat sparsitasnya sepadan, dan apakah lisensinya cukup permisif untuk di-host sendiri. Itulah dua pertanyaan yang tidak dijawab oleh pengumuman tersebut, dan hanya itu yang akan menentukan apakah ini menjadi model yang orang bangun di atasnya atau sekadar slide di presentasi berikutnya seseorang. Untuk saat ini: namanya nyata, angkanya hanya milik Ant, dan bobotnya masih sekadar kalimat.

Generated horizontal timeline with four milestone nodes. "Jul 24, 2026 — Ling-3.0-flash announced, API-only, no weights, no licence"; "Aug 7, 2026 — MIT weights land on Hugging Face, 14 days later"; "Sep 30, 2026 — Ling-3.1-flash announced: ~560B, ~25B active, 1M context"; and a dashed open node reading "Weights: not yet — 'we plan to open-source soon'", captioned "the same point in the same arc, on day one".