
Ox Alpha: Model Tercanggih Anonim yang Gratis Selama Seminggu — dan Tak Ada yang Mau Mengungkap Siapa Pembuatnya
- z-aiBARUZ.ai: GLM 5.32026-08-1860Kecerdasan75Koding
- obsidianBARUQwen3.8 27B2026-08-1552Kecerdasan68Koding
- qwenBARUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekBARUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Kecerdasan69Koding
- grokBARUSpaceXAI: Grok 4.62026-08-1261Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0557Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0358Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Kecerdasan69Koding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Kecerdasan49Koding
- metaMeta: Muse Spark 1.12026-07-1653Kecerdasan71Koding
- kimiMoonshotAI: Kimi K32026-07-1560Kecerdasan76Koding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Kecerdasan71Koding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Kecerdasan77Koding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Kecerdasan77Koding
- grokxAI: Grok 4.52026-07-0856Kecerdasan72Koding
Pada 20 Agustus, sebuah model frontier anonim bernama Ox Alpha muncul di platform API AI pihak ketiga dengan jendela konteks 1 juta token, masukan teks/gambar/video, dan harga nol. Tidak ada yang mengungkapkan siapa yang membuatnya — dan keheningan itu sendiri adalah ceritanya. Empat model terakhir yang dirilis dengan cara anonim yang sama semuanya akhirnya diklaim oleh laboratorium Tiongkok: Zhipu AI punya GLM-5, Xiaomi punya MiMo-V2-Pro, Ant Group punya Lingxi Ling-2.6-flash, dan Meituan punya LongCat-2.0. Ox Alpha, terdaftar dengan ID stealth/ox-alpha, adalah entri kelima dalam seri tersebut. Ini gratis untuk minggu berikutnya, dan mengikuti pola empat sebelumnya, pengungkapan biasanya datang dengan cepat.
Setiap angka dalam karya ini merupakan klaim dari operator itu sendiri, data dari daftar platform itu sendiri, atau pengumuman publik — belum ada tolok ukur independen, dan tidak ada satu pun di sini yang boleh dianggap sebagai tolok ukur independen.
Apa yang kita tahu — dan apa yang tidak kita tahu.
Versi cepat:
• Operator menggambarkan Ox Alpha sebagai "model frontier yang dibangun untuk pengkodean yang efisien, pekerjaan agentik yang berkelanjutan, dan penggunaan produksi dunia nyata" — model penalaran yang ditujukan untuk rekayasa perangkat lunak jangka panjang dan alur kerja yang menggabungkan teks dengan konteks visual.
• Ia memiliki jendela konteks 1.048.576 token (1M), batas keluaran 131.072 token, dan menerima masukan teks, gambar, serta video — yang pertama dari rilis anonim yang mengiklankan masukan video.
• Gratis selama satu minggu: $0 per juta token masuk dan keluar, dengan operator mengklaim "batas laju yang longgar, penggunaan yang hampir tanpa batas" dan kapasitas layanan 100 triliun token per hari.
• Data aktivitas awal di platform sudah menunjukkan lalu lintas produksi nyata, termasuk agen pengkodean dari Nous Research dan editor Zed.
• Tidak ada perusahaan yang mengklaimnya per 21 Agustus, tidak ada skor tolok ukur apa pun, harga sebenarnya setelah minggu gratis tidak diketahui, dan arsitektur serta jumlah parameter model tidak diungkapkan.
Apa itu Ox Alpha
Deskripsi platform menggambarkan Ox Alpha sebagai "model penalaran yang dirancang untuk pengkodean, pekerjaan agen berkelanjutan, dan beban kerja produksi — rekayasa perangkat lunak jangka panjang, penalaran kompleks, dan alur kerja yang menggabungkan teks dengan konteks visual." Itu adalah posisi yang spesifik: model ini dibangun untuk loop agen yang berjalan lama dan untuk kode, bukan untuk obrolan umum. Konteks 1M adalah petunjuknya — itu cukup ruang untuk sesi agen multi-jam atau repositori besar — dan batas output 131K memungkinkan generasi tunggal yang panjang. Model ini mendukung pemanggilan alat dan fungsi serta output JSON terstruktur, yang merupakan sisa dari daftar periksa agen.

Input video adalah fitur paling khas pada lembar spesifikasi tersebut. Tidak ada model anonim terdahulu yang mengiklankannya, dan model yang dapat menerima bingkai video sekaligus teks dan gambar ditujukan untuk kelas beban kerja yang berbeda dari rilis yang disetel untuk obrolan yang mendahuluinya. Semua ini — deskripsi, spesifikasi, angka kecepatan — berasal dari operator dan daftar platform tersebut. Tidak ada satu pun yang diverifikasi secara independen.
Penawaran gratis selama seminggu
Promosinya agresif. Gratis selama seminggu ke depan, "batas rate yang murah hati, penggunaan hampir tanpa batas," dan klaim kapasitas 100 triliun token per hari, dengan catatan operator yang mengundang pengguna untuk "lihat apa yang bisa Anda lakukan." Jika diartikan secara harfiah, 100T token per hari akan menempatkan operator ini di antara penyedia inferensi terbesar di mana pun — klaim tersebut lebih terdengar seperti tantangan uji stres daripada spesifikasi, yang sesuai dengan polanya: rilis anonim adalah cara sebuah lab mendapatkan lalu lintas dunia nyata berskala frontier tanpa mencantumkan namanya di pintu.
Sisi lain dari "gratis selama seminggu" adalah tidak ada harga yang diketahui setelah seminggu tersebut. Model anonim sebelumnya tetap gratis atau digabungkan ke dalam pengungkapan mereka nanti; jendela gratis Ox Alpha menciptakan tenggat waktu, dan angka sebenarnya bisa berada di mana saja. Itulah alasan utama untuk tidak merancang anggaran produksi berdasarkan $0 saat ini.
Belum ada benchmark — tetapi sudah ada traffic nyata
Daftar Ox Alpha tidak memiliki data benchmark: tidak ada indeks kecerdasan, tidak ada skor coding, tidak ada skor agentik, dan tidak muncul di papan peringkat independen seperti Artificial Analysis. Kata "frontier" adalah milik operator itu sendiri, dan belum ada bukti terverifikasi tentang seberapa bagus model tersebut sebenarnya.

Yang ada hanyalah penggunaan. Data aktivitas platform menunjukkan lalu lintas produksi nyata dalam beberapa jam pertama — termasuk Hermes Agent, proyek coding agenik dari Nous Research, dan editor Zed. Keduanya persis dengan kasus penggunaan “pekerjaan agenik berkelanjutan dan coding” yang menjadi posisi model ini. Ini bukan skor, melainkan sinyal: pengembang dengan beban kerja nyata memutuskan bahwa taruhan anonim gratis kelas frontier layak untuk dihubungkan. Untuk model tanpa benchmark yang dipublikasikan sama sekali, adopsi awal itu adalah satu-satunya bukti yang ada.
Tulisan kecil tentang retensi data
Pengumuman minggu gratis itu menggaungkan "tanpa penyimpanan data sama sekali." Deskripsi model di platform tersebut menceritakan kisah yang lebih bernuansa: prompt dan respons disimpan oleh penyedia tetapi tidak digunakan untuk pelatihan, sesuai ketentuan model tersembunyi platform. Perbedaan ini penting jika Anda hendak menempelkan kode proprietary ke dalam jendela 1M-token yang dimiliki operator anonim. Anggap saja "tanpa penyimpanan data sama sekali" sebagai pemasaran sampai operator menerbitkan ketentuan yang menyatakan demikian secara eksplisit — dan arahkan apa pun yang tidak ingin Anda catat ke model terpisah yang dapat diatribusikan.
Buku pedoman model anonim
Ox Alpha adalah rilis anonim kelima dalam enam bulan, dan empat sebelumnya berakhir dengan cara yang sama — debut anonim, ledakan lalu lintas gratis, lalu sebuah perusahaan yang melangkah maju:
• Pony Alpha (Februari 2026) — dikonfirmasi oleh Zhipu AI sekitar lima hari setelah peluncuran sebagai GLM-5, produk unggulan MoE dengan 744 miliar parameter.
• Hunter Alpha (11 Maret) — model gratis dengan triliunan parameter dan konteks 1M yang menjadi bahan spekulasi sepanjang musim semi, banyak yang menduga sebagai DeepSeek V4; kemudian terungkap sebagai MiMo-V2-Pro milik Xiaomi, dengan pendampingnya Healer Alpha yang teridentifikasi sebagai MiMo-V2-Omni.
• Elephant Alpha (April) — model teks gratis yang berfokus pada efisiensi, yang diklaim Ant Group sebagai Lingxi Ling-2.6-flash sekitar dua minggu setelah kemunculannya.
• Owl Alpha (akhir April) — model yang berfokus pada agen dengan pemanggilan alat bawaan dan konteks ~1M yang oleh Meituan dikonfirmasi sebagai LongCat-2.0 pada 30 Juni, model triliunan parameter pertama yang dilatih dan dilayani sepenuhnya di atas chip Tiongkok domestik.
• Ox Alpha (20 Agustus) — belum diklaim hingga tulisan ini dibuat.

Mengapa meluncurkan model bagus di balik topeng? Pembacaan standar, yang dibuat konkret oleh siklus Hunter Alpha, adalah bahwa anonimitas menghilangkan bias merek dari evaluasi, dan penggunaan gratis mengumpulkan data evaluasi dunia nyata dari banyak sumber {{1}}dalam skala frontier{{/1}} sementara semua orang berdebat tentang pemiliknya. Sebagaimana salah satu analisis tentang pola ini mengatakannya, {{2}}"the lack of a brand is the marketing."{{/2}} Keuntungan tambahannya adalah kecepatan: {{3}}model anonim dapat menjangkau audiens developer global dalam hitungan jam tanpa acara peluncuran, dan misteri itu sendiri menjadi distribusi.{{/3}}
Siapa Ox Alpha?
Belum ada yang mengklaimnya, dan belum ada bukti kuat. Yang ada hanyalah prior: empat dari empat rilis anonim yang terungkap ternyata adalah laboratorium Tiongkok, dan profil Ox Alpha cocok dengan pola yang sama — model penalaran yang berfokus pada pengkodean dan agen dengan konteks 1M dan klaim kapasitas yang penuh keyakinan adalah persis seperti yang dikirim vendor besar untuk menguji tumpukan penyajiannya dalam skala besar.
Sinyal pembedanya adalah input video, yang tidak diiklankan oleh model-model anonim sebelumnya; itu mempersempit kandidat ke laboratorium dengan pekerjaan multimodal dan video yang serius. Tetapi prior bukanlah bukti, dan rilis ini berbeda dari pendahulunya dalam satu hal yang perlu dicatat: operator mengklaim postur tanpa retensi, sedangkan model anonim sebelumnya eksplisit tentang pengumpulan data Anda. Jika itu berlaku, motifnya bergeser dari data-flywheel ke pengujian skala murni atau positioning pra-peluncuran. Sampai sebuah perusahaan maju — atau modelnya membocorkan petunjuk arsitektur — setiap tebakan hanyalah tebakan.
Haruskah Anda mengembangkannya minggu ini?
Minggu ini biayanya tidak ada apa-apa selain waktu integrasi. Jika Anda melakukan pekerjaan agenik dengan horizon panjang, menulis kode pada konteks panjang, atau menjalankan pipeline yang sarat video, justru di titik pertemuan itulah Ox Alpha diposisikan — dan jendela gratis adalah waktu yang tepat untuk mencari tahu apakah posisi tersebut nyata. Dua peringatan. Pertama, tidak ada bukti independen bahwa ia setara kelas frontier; label "frontier" hanyalah klaim. Kedua, tidak ada jaminan bahwa tingkat gratis — atau modelnya — akan bertahan seminggu. Itulah bentuk sebuah ujian, bukan ketergantungan.
Cara yang aman untuk produksi dalam menjalankan tes seperti itu adalah rantai fallback: model eksperimental menjawab saat sehat, dan permintaan dialihkan ke model yang sudah terbukti begitu model tersebut macet, error, atau menghilang. Itulah gunanya lapisan routing. Satu API untuk 200+ model, failover otomatis sehingga lalu lintas peluncuran minggu gratis model anonim tidak menjadi gangguan Anda, dan markup 0% — harga daftar penyedia diteruskan — sehingga ketika harga asli Ox Alpha muncul setelah minggu gratis, angka yang Anda lihat adalah angka yang Anda bayar, pada hari yang sama operator mengubahnya. Gunakan minggu gratis untuk mengaudisi; putuskan setelah pengungkapan.
Apa yang harus ditonton
Empat hal akan menceritakan kisahnya. Pengungkapan: model anonim sebelumnya diklaim beberapa hari hingga beberapa minggu setelah peluncuran, dan ketika sebuah perusahaan tampil, halaman model akan menyebutkannya. Harga: apa pun yang menggantikan tingkat gratis, dan apakah tingkat gratis tetap bertahan sama sekali. Tolok ukur independen pertama: entri Artificial Analysis atau LMArena akan memastikan apakah "frontier" itu fakta atau sekadar slogan. Dan kapasitas: apakah klaim 100T token/hari bertahan saat beban nyata menghantamnya.
Kesimpulan yang jujur: Ox Alpha adalah eksperimen yang luar biasa murah di kedua arah. Platform ini menguji apakah model kelas frontier anonim seharga $0 dapat memenangkan lalu lintas produksi nyata dalam seminggu; Anda bisa menguji apakah model itu layak mendapatkannya. Jalankan eksperimen ini, tetapi jalankan dengan fallback di bawahnya. Pada saat minggu gratis berakhir, kemungkinan besar kita akan tahu siapa pembuatnya, berapa biayanya, dan apakah ia layak mendapat tempat di stack Anda — dan tiga jawaban itulah yang membuat audisi ini layak diikuti.
