
North Small Translate 1.0: Model Besar Paling Tenang dari Cohere Sejauh Ini
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-10$0.15 / $0.60 per 1 juta token
- openaiBARUOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleBARUGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenBARUQwen: Qwen3.8 Max (0902)2026-09-0240Kecerdasan72Koding
- anthropicBARUAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0340Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2134Kecerdasan69Koding
North Small Translate 1.0 adalah model terjemahan mixture-of-experts dengan 218 miliar parameter dari Cohere dan Cohere Labs, dan ia hadir dengan cara yang hanya dilakukan oleh sangat sedikit rilis berskala terdepan: dengan catatan rilis dan tidak ada yang lain. Changelog Cohere mencantumkan pengumuman tersebut pada 9 September 2026, tetapi ketiga checkpoint-nya sudah berada di Hugging Face di balik gerbang sejak 14 Agustus — tiga setengah minggu bobot tanpa tulisan blog, tanpa liputan pers, dan tanpa utas peluncuran. Saat tulisan ini dibuat, repositori utama menunjukkan nol suka, 26 unduhan dalam sebulan terakhir, dan satu diskusi komunitas yang belum terjawab. Model 218B dengan skor WMT26 yang dilaporkan vendor sebesar 83,60 yang hampir tidak diperhatikan siapa pun layak untuk dijelaskan, jadi inilah yang sebenarnya dapat dipastikan oleh dokumentasi dan repositori, terpisah dari yang tidak dapat dipastikan.
Angka-angka yang disetujui Cohere
Mulai dari spesifikasinya, karena semuanya tidak ambigu dan merupakan bagian dari rilis ini yang sepenuhnya dapat diketahui. North Small Translate 1.0 adalah model decoder-only sparse mixture-of-experts — bentuk yang sama yang digunakan Cohere untuk Command A+ pada Mei 2026 — dengan 128 expert, delapan diaktifkan per token, plus expert bersama yang berjalan pada setiap token. Router mengambil aktivasi sigmoid atas logit expert dan menormalisasi di seluruh pemilihan top-k. Attention bergantian dengan rasio 3:1 antara lapisan sliding-window (jendela 4.096, RoPE) dan lapisan attention global yang sama sekali tidak membawa embedding posisional.
• Parameter — total 218B, 25B aktif per token
• Konteks — input 16K dan output 16K
• Bahasa — Inggris plus 49 lainnya, totalnya 50
• Bahasa tingkat satu — Arab Standar Modern, Jerman, Prancis, Jepang, Korea, Rusia, Ukraina
• Pos pemeriksaan — BF16, FP8, dan NVFP4 W4A16
• Perangkat keras minimum — BF16: 4×B200 atau 8×H100; FP8: 2×B200 atau 4×H100; W4A16: 1×B200 atau 2×H100
• Lisensi — CC BY-NC 4.0, dengan penggunaan komersial dialihkan ke Cohere's Model Vault
• Kualitas yang dilaporkan — WMT26 83.60, meningkat menjadi 84.36 dengan alur kerja penerjemahan multi-tahap berbasis agen
Dua dari baris-baris itu pantas mendapat lebih dari sekadar butir. Jendela konteksnya adalah 16K keluaran, yang tidak biasa untuk model terjemahan dan merupakan perbedaan antara menerjemahkan satu paragraf dan menerjemahkan seluruh dokumen prosedur dalam satu kali proses. Dan angka agentik — 84,36 versus 83,60 — adalah Cohere yang menggambarkan sebuah alur kerja, bukan model: beberapa kali proses, mungkin dengan agen yang memutuskan apa yang harus diterjemahkan ulang. Itu adalah gagasan yang sama yang dijual Cohere sebagai "Deep Translation" dengan Command A Translate pada Agustus 2025, dan hal itu muncul kembali di sini pada skala yang lebih besar.

Apa yang ditunjukkan repositori tetapi tidak ditunjukkan oleh catatan rilis.
Catatan rilis adalah dokumen pemasaran; repositori adalah dokumen rekayasa, dan beberapa detail di sana lebih penting daripada spesifikasi utama. Penyajian didukung melalui vLLM dengan cohere_melody>=0.9.0, dan Cohere merekomendasikan decoding greedy secara eksplisit "sesuai dengan penerapan produksi" — model terjemahan yang memberi tahu Anda untuk menonaktifkan sampling adalah model terjemahan yang ditujukan untuk determinisme, bukan untuk penulisan kreatif. Keluaran dibungkus dalam <|START_TEXT|> dan <|END_TEXT|> penanda, dan penguraian mengharapkan pustaka melody milik Cohere. Penanda tersebut tidak terdaftar sebagai token khusus, jadi menyetel skip_special_tokens=True tidak akan menghapusnya — jebakan kecil yang akan menghasilkan sampah tag yang terlihat dalam integrasi naif.
Ada juga templat chat dengan instruksi sistem bawaan yang memperkenalkan model dengan nama "North Small Translate" dan menyatakan bahwa model ini dibuat oleh Cohere. Pesan sistem per percakapan ditambahkan ke bawaan tersebut alih-alih menggantinya — ada platform_instruction_override slot terpisah jika Anda perlu menggantinya. Ini semacam perpipaan yang memberi tahu Anda bahwa ini adalah model chat pasca-pelatihan yang menjalankan tugas terjemahan, bukan encoder-decoder klasik.
Di mana posisinya dalam lini Cohere
Silsilah adalah konteks paling berguna untuk membaca rilis ini, dan hal itu didokumentasikan. Command A Translate, yang diumumkan pada 28 Agustus 2025, adalah model penerjemahan mesin pertama Cohere — 111B parameter, jendela 16K yang terbagi 8K untuk input dan 8K untuk output, 23 bahasa, dan rilis riset CC-BY-NC. North Small Translate 1.0 lebih dari menggandakan jumlah bahasa menjadi 50, melipattigakan jumlah parameter aktif menjadi 25B, mempertahankan total jendela pada 16K tetapi membuat seluruhnya dapat digunakan untuk output, dan mengganti satu model yang agak padat dengan MoE sparse dengan jejak yang sama yang sudah digunakan Cohere di tempat lain di lini North.
Pembacaan yang jujur adalah bahwa ini merupakan turunan spesialis dari inti MoE Cohere saat ini, yang dilatih lanjut untuk penerjemahan, bukan arsitektur baru. Kartu model menyatakan hal itu dalam satu baris — model ini "dilatih lanjut secara khusus untuk kualitas penerjemahan" — dan tidak mengungkap apa pun tentang korpus pelatihan, jumlah token, atau pipeline data. Laporan teknis Command A Translate menjelaskan secara rinci teknik penyaringan data berdasarkan tingkat kesulitan; tidak ada yang setara yang telah dipublikasikan untuk model ini.

Apa yang benar-benar tidak dikonfirmasi
Di sinilah peluncuran senyap harus ditangani dengan hati-hati, karena ketiadaan kebisingan bisa berdampak ke dua arah. Berikut ini adalah hal-hal yang saat ini tidak diketahui oleh siapa pun di luar Cohere:
• Apa yang diukur oleh WMT26 83.60. Tidak ada metrik yang disebutkan di kartu model atau dalam catatan rilis, dan tidak ada halaman hasil WMT26 yang dipublikasikan untuk model ini. "83.60" tanpa nama metrik hanyalah sebuah angka, bukan hasil.
• Apakah skor tersebut dapat direproduksi. Tidak ada kelompok independen yang telah menjalankan model ini. Setiap angka dalam artikel ini adalah milik Cohere sendiri.
• Apa sebenarnya alur kerja multi-pass agentic itu. Angka 84,36 dijelaskan dalam satu klausa. Itu adalah klaim tingkat sistem yang dilampirkan pada kartu model, dan sistemnya tidak ditentukan.
• Berapa biaya lisensi komersial. Cohere mengarahkan perusahaan ke tim penjualan dan Model Vault. Tidak ada harga yang dipublikasikan di halaman dokumentasi.
• Apakah akan ada pos blog. Cohere punya blog. Command A Translate mendapat satu pos lengkap. Model ini mendapat catatan rilis.
Tidak ada dari semua itu yang merupakan tuduhan. Itu adalah perbedaan antara model yang bisa Anda evaluasi dan produk yang bisa Anda beli, dan saat ini North Small Translate 1.0 sepenuhnya adalah yang pertama — plus satu hal yang dapat Anda gunakan secara gratis.
Tier gratis adalah bagian yang benar-benar bisa Anda coba hari ini.
Berbeda dari rilis bobot murni, yang ini memiliki sisi langsung yang aktif: North Small Translate 1.0 tersedia di tier gratis Cohere melalui Chat V2 API, dan catatan rilis Cohere menyatakan bahwa ini gratis untuk kunci trial dan produksi hingga batas laju tercapai. Ini adalah jendela evaluasi yang luar biasa permisif — Anda tidak perlu kontrak berbayar untuk melewatkan lalu lintas nyata melaluinya. Bobotnya sendiri adalah set FP8 di Hugging Face dengan lisensi CC BY-NC 4.0, jadi self-hosting untuk tujuan komersial tidak bisa dilakukan tanpa perjanjian Model Vault.
Bentuk praktis dari keputusan ini, kalau begitu: evaluasi melalui API tanpa biaya, dan bayar hanya jika Anda memutuskan untuk merilisnya. Itu adalah uji coba berisiko rendah, dan itulah hal yang memang dirancang untuk dilakukan oleh lapisan routing. Jika Anda sudah memanggil terjemahan melalui OrcaRouter — satu kunci untuk katalog lebih dari 200 model, harga daftar penyedia diteruskan dengan markup 0% — pertanyaan yang dapat dievaluasi bukanlah "haruskah saya bermigrasi" melainkan "apakah ini mengalahkan yang sudah saya gunakan untuk dokumen saya sendiri," yang dapat Anda jawab dengan menjalankan teks yang sama melalui keduanya. Vendor yang memangkas harganya adalah perubahan yang langsung berlaku di sisi kami pada hari yang sama, karena tidak ada selisih harga penjual ulang yang dilapiskan di atasnya. Dan untuk model dengan satu benchmark yang belum direproduksi dan tanpa evaluasi pihak ketiga, failover adalah mekanisme yang memungkinkan Anda mencobanya tanpa mempertaruhkan jalur produksi padanya: lalu lintas Anda tetap mengalir ke model yang sudah berfungsi sementara model yang baru dinilai berdasarkan input nyata.

Apa yang akan mengubah ini dari catatan rilis menjadi rilis?
Tiga hal akan mengubah North Small Translate 1.0 dari entri dokumentasi menjadi pesaing sungguhan, dan ketiganya dapat diamati dari luar. Pertama, metrik bernama untuk angka WMT26 — skor 83.60 dengan metrik yang disertakan dapat dibandingkan, sedangkan yang tanpa metrik tidak bisa. Kedua, reproduksi independen pertama, baik yang berasal dari kampanye evaluasi WMT26 itu sendiri maupun dari pihak ketiga yang menjalankan tes bergaya FLORES pada bobot FP8. Ketiga, postingan peluncuran yang sebenarnya, yang akan menandakan bahwa Cohere berniat menjual ini alih-alih hanya mempublikasikannya.
Sampai saat itu, sikap yang benar adalah sikap yang didukung bukti: spesialis terjemahan 218B MoE yang benar-benar menarik dengan jalur evaluasi gratis, lima puluh bahasa, dan jendela keluaran sepanjang dokumen, yang klaim kualitasnya sepenuhnya bersandar pada kata-kata pembuatnya. Cohere telah merilis empat model yang mampu menerjemahkan dalam tiga belas bulan dan hanya satu di antaranya yang mendapat postingan blog. Manakah dari kedua fakta itu yang lebih informatif adalah pertanyaan yang layak direnungkan.
