Kimi K3.1: Klaim Kebocoran — dan yang Sebenarnya Terkonfirmasi
Guides & Insights

Kimi K3.1: Klaim Kebocoran — dan yang Sebenarnya Terkonfirmasi

Penulis

jinhao song

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Peringatan: ini adalah kebocoran, bukan pengumuman. Per 27 Juli 2026, Moonshot AI telah tidak secara resmi merilis atau mengonfirmasi sebuah "Kimi K3.1." Segala sesuatu tentang K3.1 di bawah ini berasal dari satu posting media sosial yang tidak terverifikasi dan harus diperlakukan sebagai rumor sampai Moonshot mengirim bobot atau kartu model. Apa adalah yang dikonfirmasi adalah Kimi K3 — model bobot terbuka dengan 2,8 triliun parameter yang dirilis Moonshot pada 16 Juli 2026. Artikel ini memisahkan keduanya: apa yang diklaim oleh kebocoran untuk K3.1, dan apa yang sebenarnya kita ketahui hari ini.

Mengapa menulisnya sekarang? Karena "Kimi K3.1" sudah mulai dicari, dan versi jujur dari cerita ini — yang dengan jelas memberi label antara rumor dan fakta — lebih bermanfaat daripada hype atau diam saja. Kami akan memperbarui postingan ini jika dan saat Moonshot menerbitkan sesuatu yang resmi.

TL;DR. Sebuah unggahan pada 26 Juli 2026 di X (@Mr_Salio, berlabel "Kimi K3.1 Leak") mencantumkan serangkaian fitur yang dirumorkan untuk pembaruan K3.1: performa yang menutup kesenjangan dengan GPT-5.6 dan Claude Fable, inferensi yang lebih cepat/dengan latensi lebih rendah, efisiensi token yang lebih baik pada penalaran panjang, alur kerja coding dan agen yang lebih andal, langkah penalaran yang lebih sedikit terbuang, keunggulan berkelanjutan atas Claude Opus 5 pada beberapa tugas coding/agen, dan rilis open-weight yang berkelanjutan. Tidak ada yang dikonfirmasi, tidak ada angka tolok ukur, dan tidak ada tanggal rilis resmi. Dasar yang dikonfirmasi adalah Kimi K3: 2,8T parameter, open-weight, #1 di Frontend Code Arena saat peluncuran.

Poin-poin penting

• Kebocoran tidak terverifikasi. Satu posting X, tanpa angka, tanpa tanggal, tanpa konfirmasi Moonshot. Anggap sebagai rumor.

• Tema yang dirumorkan dari K3.1 adalah efisiensi, bukan ukuran baru. Inferensi lebih cepat, latensi lebih rendah, efisiensi token lebih baik, langkah penalaran lebih sedikit.

• Posisi yang diklaim: menutup kesenjangan dengan GPT-5.6 Sol dan Claude Fable 5, mempertahankan keunggulan atas Claude Opus 5 pada beberapa tugas coding/agent.

• Open-weight diklaim akan berlanjut — konsisten dengan rilis Modified MIT dari K3.

• Yang nyata saat ini adalah Kimi K3 (2.8T, open-weight, dirilis 16 Juli 2026), bukan K3.1.

Apa yang sebenarnya dikatakan oleh kebocoran itu

Sumbernya adalah satu unggahan di X dari @Mr_Salio, dengan stempel waktu 26 Juli 2026 dan secara eksplisit berjudul "Kimi K3.1 Leak." Unggahan tersebut mencantumkan kumpulan poin yang dirumorkan (diubah kata-katanya, dikaitkan dengan unggahan itu):

• Performa yang "menutup kesenjangan" dengan GPT-5.6 dan Fable.

• Mempertahankan kemampuannya yang dilaporkan sebagai tingkat atas ("level Mythos") — kata-kata dalam unggahan; "Mythos" tidak didefinisikan dalam kebocoran.

• Inferensi lebih cepat dan latensi lebih rendah.

• Efisiensi token yang lebih baik pada tugas penalaran yang panjang.

• Alur kerja pengkodean dan agen yang lebih andal.

• Lebih sedikit langkah penalaran yang tidak perlu.

• Terus mengungguli Claude Opus 5 dalam tugas-tugas pengkodean dan agen yang penting.

• Tetap open-weight, menjaga AI tingkat frontier tetap dapat diakses secara bebas.

Itulah seluruh substansi dari kebocoran tersebut. Yang secara mencolok tidak ada: skor tolok ukur, jumlah parameter, panjang konteks, harga, atau tanggal rilis. Postingan tersebut bahkan diakhiri dengan pertanyaan terbuka kepada pembaca ("apakah Anda pikir ini akan mengalahkan mythos?"), yang merupakan sinyal kuat bahwa ini adalah spekulasi, bukan pengumuman yang telah diarahkan.

Seberapa kredibel itu?

Rendah hingga sedang, dan inilah penilaian jujurnya. Di satu sisi, arah yang dirumorkan adalah masuk akal: rilis poin (a ".1") hampir selalu berfokus pada efisiensi dan keandalan — inferensi lebih cepat, ekonomi token yang lebih baik, langkah penalaran yang lebih sedikit terbuang — daripada arsitektur yang benar-benar baru, dan itulah yang dijelaskan oleh daftar ini. Ini juga cocok dengan strategi bobot terbuka Moonshot dengan K3.

Di sisi lain, tidak ada yang perlu diverifikasi: itu adalah akun yang hampir anonim, tanpa nomor, tanpa tangkapan layar dari kartu model, tanpa repositori Hugging Face, dan tanpa liputan yang mengonfirmasi di tempat lain pada saat penulisan. Istilah yang tidak terdefinisi seperti "Mythos-level" membuatnya mustahil untuk diperiksa. Sampai Moonshot menerbitkan bobot, kartu model, atau tabel tolok ukur—atau outlet terkemuka yang mengonfirmasi—ini harus diajukan sebagai rumor, bukan peta jalan.

Yang dikonfirmasi: Kimi K3

Model nyata yang sudah dirilis adalah Kimi K3, dirilis pada 16 Juli 2026 — model Mixture-of-Experts berbobot terbuka dengan 2,8 triliun parameter yang dibangun untuk pengkodean, penalaran, dan alur kerja agen jangka panjang, dengan input multimodal asli dan jendela konteks 1 juta token. Saat peluncuran, model ini melompat ke #1 di Frontend Code Arena independen (dilaporkan ~1.679 Elo), mengungguli Claude Fable 5, GPT-5.6 Sol, dan GLM-5.2, dan mencatat 93,5% pada GPQA Diamond serta ~91,2 pada BrowseComp. Moonshot berkomitmen untuk merilis bobot penuh di bawah lisensi MIT yang Dimodifikasi. Itulah angka-angka yang menjadi patokan — dan dasar realistis yang akan digunakan oleh "K3.1" mana pun.

(Sumber untuk K3: materi peluncuran Moonshot dan papan peringkat independen termasuk Frontend Code Arena dan Artificial Analysis; angka-angka tersebut sebagaimana dilaporkan saat peluncuran dan dapat berubah.)

Jika kebocoran itu benar, apa arti K3.1?

Membaca daftar rumor secara baik, K3.1 akan menjadi sebuah efisiensi dan keandalan rilis daripada lompatan kapabilitas: secara kasar kualitas setingkat K3, tetapi lebih cepat, lebih murah per tugas (efisiensi token yang lebih baik), dan lebih stabil dalam loop agen (langkah penalaran yang lebih sedikit terbuang, penggunaan alat yang lebih andal). Bagi tim yang sudah menjalankan K3, itu adalah jenis pembaruan yang paling berharga — ini menurunkan biaya dan latensi tanpa memaksa evaluasi ulang kualitas. Klaim "menutup kesenjangan dengan GPT-5.6 dan Fable" dan "keunggulan atas Opus 5 pada beberapa tugas pengkodean/agen" akan, jika benar, menjaga K3.1 sebagai opsi bobot terbuka terkuat untuk agen pengkodean. Tapi sekali lagi — jika benar.

Haruskah Anda menunggunya?

Jangan — jangan membangun berdasarkan rumor. Jika Anda membutuhkan model coding open-weight teratas hari ini, Kimi K3 sudah dirilis, terbuka, dan secara independen #1 di Frontend Code Arena. Jika K3.1 hadir dengan peningkatan efisiensi nyata, mengadopsinya nanti itu sepele (keluarga yang sama, bobot terbuka). Langkah rasional adalah menggunakan K3 sekarang dan menguji ulang jika dan ketika K3.1 benar-benar dirilis dengan kartu model dan angka. Jangan menunda proyek untuk ".1." yang belum dikonfirmasi.

Cara mencoba Kimi K3 hari ini

Kimi K3 adalah model open-weight dan tersedia melalui penyedia yang dihosting, termasuk melalui endpoint yang kompatibel dengan OpenAI di OrcaRouter (model Kimi K3). Tim yang netral terhadap vendor merutekan Kimi K3 bersama GPT-5.6 Sol, Claude Fable 5, dan Claude Opus 5 di belakang satu endpoint, sehingga jika K3.1 (atau model baru lainnya) dirilis, peralihan hanya merupakan perubahan satu baris daripada migrasi.

Bagaimana perbandingan ini dengan para pemimpin saat ini

Pada gambar yang dikonfirmasi: Kimi K3 memimpin Frontend Code Arena di antara semua model saat diluncurkan dan merupakan rilis open-weight terkuat hingga saat ini, sementara model perbatasan tertutup seperti Claude Fable 5 (pemimpin SWE-bench Verified) dan Claude Opus 5 (#1 pada Artificial Analysis Intelligence Index) masih memimpin pada sumbu lainnya. K3.1 yang dirumorkan dapat "menutup kesenjangan" akan memperketat persaingan yang sudah ketat — tetapi kebocoran tidak memberikan angka untuk menempatkannya, jadi kami tidak akan menciptakan angka apa pun.

FAQ

Apakah Kimi K3.1 sudah dirilis?

Tidak. Per tanggal 27 Juli 2026, belum ada Kimi K3.1 resmi dari Moonshot AI. Satu-satunya sumber adalah sebuah postingan bocoran yang belum terverifikasi pada 26 Juli di X.

Apakah kebocoran itu dapat dipercaya?

Anggap saja ini rumor. Ini adalah unggahan sosial tunggal tanpa angka tolok ukur, tanpa kartu model, tanpa tanggal rilis, dan tanpa bukti pendukung. Arahnya (rilis poin yang berfokus pada efisiensi) masuk akal tetapi belum dikonfirmasi.

Apa yang akan berubah di K3.1 jika kebocoran itu benar?

Kabar angin: inferensi lebih cepat, latensi lebih rendah, efisiensi token lebih baik pada penalaran panjang, alur kerja coding/agen yang lebih andal, lebih sedikit langkah penalaran yang terbuang — sambil tetap berbobot terbuka dan kira-kira setingkat K3 dalam kualitas.

Apa yang dikonfirmasi tentang Kimi K3?

K3 adalah model bobot terbuka dengan 2,8 triliun parameter yang nyata dan telah dirilis (16 Juli 2026), peringkat #1 di Frontend Code Arena saat peluncuran, dengan konteks 1 juta token, serta dilaporkan memperoleh 93,5% GPQA Diamond dan ~91,2 BrowseComp.

Apa itu "Mythos"?

Kebocoran tersebut merujuk pada kemampuan "Mythos-level" dan menanyakan apakah K3.1 akan "mengalahkan mythos," tetapi tidak mendefinisikan istilah tersebut. Kami tidak dapat memverifikasi apa yang dimaksud, jadi kami menandainya daripada menebak.

Haruskah saya menunggu K3.1 sebelum memilih model?

Tidak. Gunakan Kimi K3 (atau model terbaru lainnya) sekarang; evaluasi ulang jika K3.1 hadir dengan spesifikasi resmi. Jangan merencanakan berdasarkan rumor.

Di mana saya bisa menjalankan Kimi K3?

Melalui penyedia yang dihosting dan melalui API yang kompatibel dengan OpenAI dari OrcaRouter, bersama dengan model-model frontier lainnya untuk perbandingan yang mudah.

Intinya

"Kimi K3.1" untuk saat ini hanyalah bocoran — sebuah unggahan X pada 26 Juli yang mendeskripsikan pembaruan efisiensi dan keandalan (lebih cepat, lebih murah per tugas, agen yang lebih stabil, masih bersifat open-weight) tanpa angka, tanpa model card, dan tanpa tanggal. Ini masuk akal tetapi belum terverifikasi, jadi kami melaporkannya sebagai rumor, bukan fakta. Realitas yang dikonfirmasi adalah Kimi K3: model open-weight 2,8T, peringkat #1 di Frontend Code Arena saat diluncurkan, yang dapat Anda gunakan hari ini. Jika Moonshot merilis K3.1 dengan tolak ukur nyata, kami akan memperbarui unggahan ini — dan Anda dapat mengujinya dalam hitungan menit melalui satu endpoint yang kompatibel dengan OpenAI di OrcaRouter.

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

Hubungi kami

Gabung komunitas kami

DiscordEmailXGitHubYouTube