
Ling-3.1-flash Diumumkan, Tidak Terbuka: ~560B Parameter, Konteks 1M Token, dan Grafik yang Hanya Telah Dijalankan oleh Ant
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 262 tok/s
- OpenAIBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- OpenAIBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- xAISpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
Tim Ling milik Ant Group merilis angka untuk model tingkat cepat berikutnya pada 30 September 2026, dan pada saat yang sama mengatakan Anda belum bisa memilikinya. Ling-3.1-flash adalah model mixture-of-experts dengan sekitar 560 miliar parameter yang mengaktifkan sekitar 25 miliar parameter per token dan memiliki jendela konteks hingga 1 juta token, menurut pengumuman model yang dipublikasikan Ant dari akun @AntLingAGI miliknya sendiri. Kalimat yang mendefinisikan rilis ini adalah kalimat yang mengikuti spesifikasi: "Kami berencana untuk segera merilis model ini sebagai open-source." Per hari ini, tidak ada repositori Ling-3.1-flash di Hugging Face, tidak ada lisensi, tidak ada file bobot yang dapat diunduh, dan tidak ada evaluasi dari siapa pun di luar Ant Group. Yang ada hanyalah bagan benchmark, tampilan produk yang sudah live, dan sebuah janji.
Perbedaan itu adalah inti persoalannya, dan perlu dikatakan secara terus terang, karena bingkai yang lebih dulu sampai kepada kebanyakan orang — rilis berbobot terbuka kelas 500B dari Tiongkok yang mendekati garis depan — menggambarkan sesuatu yang belum terjadi. Ling-3.1-flash bukan rilis terbuka. Ini rilis yang baru diumumkan. Keduanya tidak berdekatan, dan celah di antara keduanya justru tempat pembaca bisa celaka: jika Anda merencanakan kapasitas, menganggarkan uji coba, atau menulis catatan pengadaan berdasarkan bobot terbuka yang belum ada, Anda merencanakan berdasarkan siaran pers.
Apa yang sebenarnya terkandung dalam pengumuman itu
Postingannya singkat dan angka-angka di dalamnya spesifik. Ant menyatakan jumlah parameter total sekitar 560 miliar dengan sekitar 25 miliar yang aktif per token, rasio hampir 1 banding 22, sedikit lebih padat daripada generasi Ling-3.0-flash yang digantikannya — model itu berjalan dengan total 124B dengan 5,1B aktif, sekitar 1 banding 24, pada ukuran bodi kurang dari seperempatnya. Konteks dikutip sebagai "hingga 1 juta token," empat kali jendela 262.144 token yang dilayani keluarga Ling-3.0-flash saat ini. Tiga skor utama dilampirkan: 1.673 Elo pada GDPVal-AA v2.1, 75,16 pada FrontierSWE, dan 65,35 pada HealthBench Professional.
Setiap angka tersebut dilaporkan oleh vendor, berasal dari pihak pertama, dan tidak dipublikasikan dalam bentuk apa pun yang dapat dijalankan ulang oleh pihak ketiga. Tidak ada perangkat evaluasi, tidak ada kumpulan prompt, tidak ada konfigurasi eksekusi, dan tidak ada seed — dan, yang lebih mendasar, tidak ada bobot untuk menjalankannya. Jika angka Ant benar, model ini berada di jajaran teratas rilis model terbuka Tiongkok; saat ini tidak ada cara untuk mengetahui apakah angka itu benar.
Grafik itu, dan peringatan yang sudah melekat di dalamnya

Ant menerbitkan Ling-3.1-flash bersama kartu tolok ukur multi-panel yang menempatkannya di antara model-model frontier dan near-frontier: GPT-5.6 Sol, Claude Opus 5, Kimi K3, dua entri dari keluarga GLM, dan DeepSeek-V4.1-Flash. Di seluruh panel, batang Ling berada di atau dekat puncak pada metrik agentik dan pengodean serta di pertengahan kelompok pada metrik multi-turn dan spesifik domain. Bacalah sebagaimana adanya — pilihan tugas dari vendor itu sendiri, yang diambil dari rangkaian yang mencakup pekerjaan agen serbaguna, pengodean, tugas domain perbankan, dan layanan kesehatan — dan ini adalah kartu yang tampak kredibel.
Namun, lihatlah siapa saja yang ada di dalamnya, dan satu hal menonjol. Model-model terdepan yang dipilih Ant adalah GPT-5.6 Sol dan Claude Opus 5. Kedua model itu sekarang tertinggal satu generasi. Opus 5.5 dan GPT-6 Sol sama-sama aktif pada 22 September 2026, di hari yang sama, dan keduanya dapat dirutekan hari ini. Model-model terbaru yang tidak dicantumkan Ant di kartu itu justru tepat model yang ingin dijadikan pembanding oleh pembaca, yang merupakan keluhan yang sama yang muncul dalam gelombang pertama komentar tentang rilis tersebut — keinginan agar model yang hadir pada Oktober diukur terhadap model terdepan Oktober, bukan model terdepan Juli. Itu bukanlah celaan terhadap model tersebut, yang bisa saja terbukti kuat. Ini adalah alasan untuk memperlakukan kartu itu sebagai klaim arah, bukan putusan akhir, dan untuk mencatat bahwa perbandingan yang dipilih Ant tidak banyak menyanjung hasilnya, melainkan lebih membuatnya tampak ketinggalan zaman.
Di mana Anda dapat menyentuhnya, dan satu catatan kaki yang tidak dijelaskan
Ada tepat satu tempat Ling-3.1-flash dijalankan untuk pengguna saat ini: produk Ant sendiri. Antarmuka Ling Studio di ling.tbox.cn mencantumkan Ling-3.1-flash di pemilih modelnya, dan deskripsi aplikasi itu sendiri tentang model tersebut lebih luas daripada kartu benchmark-nya — model ini diposisikan untuk "agen serbaguna, pencarian, pekerjaan kantor rutin, serta pengembangan perangkat lunak/kode," yang merupakan positioning familier untuk tingkat ini: bukan penalar terdalam di keluarganya, melainkan model yang dimaksudkan untuk dipanggil terus-menerus dan dengan biaya murah.
Permukaan itu juga memuat detail paling janggal dari rilis ini. Catatan kaki pada kartu benchmark itu sendiri menyatakan HealthBench Professional — angka 65,35, salah satu dari tiga angka dalam teks pengumuman — "dievaluasi di lingkungan AQ," dan menambahkan bahwa kemampuan layanan kesehatan Ling-3.1-flash "saat ini hanya dapat dicoba di AQ." Tidak ada apa pun di kartu itu yang menjelaskan apa itu AQ, dan tidak ada dokumentasi publik yang dapat kami temukan yang mendefinisikannya. Skor utama dengan kualifikasi lingkungan yang melekat, ketika lingkungannya tidak disebutkan namanya, bukanlah hasil yang dapat direproduksi; itu hanyalah demo produk dengan angka di sampingnya.
Apa yang dapat diketahui, dan apa yang tidak
Membagi rilis ini ke dalam dua kelompok itu adalah hal paling berguna yang bisa dilakukan seorang pembaca dengannya hari ini.
Yang dapat diketahui sekarang: parameter, jumlah parameter aktif, dan jendela konteks sebagaimana dinyatakan oleh vendor; tiga benchmark vendor; keberadaan model dalam produk Ant sendiri; kumpulan pembanding yang dipilih Ant; fakta bahwa tidak ada bobot, lisensi, atau kartu model yang telah dipublikasikan; dan fakta bahwa Artificial Analysis, yang menilai generasi sebelumnya secara independen, tidak memiliki halaman Ling-3.1-flash. Hingga tulisan ini dibuat, pipeline penilaian independen yang membuat angka Intelligence Index 20 poin milik Ling-3.0-flash dapat terbaca belum mempublikasikan apa pun tentang 3.1 sama sekali.
Belum dapat diketahui sekarang: apakah bobotnya benar-benar akan dibuka, dan di bawah lisensi apa; apakah arsitekturnya merupakan versi yang diperbesar dari stack hibrida Ling-3.0 atau sesuatu yang baru; berapa biaya model ini melalui API Ant, jika memang ada harga API-nya sama sekali; bagaimana perilakunya dalam konteks panjang secara praktik, alih-alih bagaimana jendela konteksnya ditentukan; dan apakah selisih benchmark tetap bertahan ketika seseorang yang bukan Ant menjalankan tugas yang sama. Masing-masing dari itu adalah pertanyaan yang dijawab model yang telah dirilis pada hari pertama dan dijawab model yang baru diumumkan pada suatu hari yang lebih lambat yang belum dijadwalkan.

Cara membaca hari seperti ini
Pola ini sekarang cukup umum untuk diberi nama. Sebuah laboratorium Tiongkok dengan rekam jejak yang kuat merilis kartu model dan bagan tolok ukur, angka-angkanya mendekati garis terdepan, komunitas bereaksi terhadap angka-angka itu, dan bobotnya tiba — atau tidak — beberapa minggu kemudian. Ling-3.0-flash menjalankan persis skenario itu pada musim panas ini, dan ada baiknya mengingat bagaimana hal itu berakhir: Ant mengumumkannya pada 24 Juli 2026 sebagai model khusus API tanpa pernyataan lisensi dan tanpa tolok ukur independen, dan bobotnya di bawah MIT baru muncul di Hugging Face pada 7 Agustus, dua minggu setelah pengumuman. Ling-3.1-flash berada pada titik yang setara dalam alur itu pada hari pertama, dengan perbedaan tambahan bahwa kali ini janji untuk membuka sumbernya dinyatakan secara eksplisit dalam pengumuman, bukan disimpulkan.
Tidak ada satu pun model yang dipilih Ant sebagai titik pembanding yang ada di katalog kami sebagai subjek artikel — Ling-3.1-flash, Ling-3.0-flash, dan Ling-3.0-flash-VL semuanya mengembalikan status tidak ditemukan di katalog OrcaRouter hari ini, dan kami tidak akan berpura-pura sebaliknya. Tetapi tiga dari model pembanding pada bagan itu bisa dirutekan sekarang juga: Claude Opus 5, GPT-5.6 Sol, dan DeepSeek-V4.1-Flash semuanya berada di balik satu kunci, dengan harga daftar penyedia tanpa markup, dengan failover otomatis di antara mereka. Itu lebih penting daripada kedengarannya pada minggu seperti ini, karena cara jujur untuk mengevaluasi model yang baru diumumkan adalah menjalankan perbandingan yang Ant tawarkan — terhadap model yang benar-benar bisa Anda panggil — selagi subjek perbandingannya masih berupa bagan.
Saat bobotnya dirilis, pertanyaan yang berguna bukanlah apakah Ling-3.1-flash mengalahkan Opus 5 pada satu peringkat Elo. Melainkan apakah MoE ~560B dengan ~25B aktif dapat mempertahankan konteks 1M-token pada harga yang membuat sparsitasnya sepadan, dan apakah lisensinya cukup permisif untuk di-host sendiri. Itulah dua pertanyaan yang tidak dijawab oleh pengumuman tersebut, dan hanya itu yang akan menentukan apakah ini menjadi model yang orang bangun di atasnya atau sekadar slide di presentasi berikutnya seseorang. Untuk saat ini: namanya nyata, angkanya hanya milik Ant, dan bobotnya masih sekadar kalimat.

