Kartu judul hero untuk 'Mercury 2.5 Preview vs Grok 4.6' dengan subjudul 'Bisakah Pratinjau 1,107 token/detik Mengungguli Sang Juara Nilai?', menampilkan chip petir berlabel '1,107 tok/s', chip timbangan berlabel 'HARGA vs KECEPATAN', chip piala berlabel 'AA #3', dan logo OrcaRouter di pojok kanan bawah.
Guides & Insights

Mercury 2.5 Preview vs Grok 4.6: Dapatkah Preview 1.107-token/detik Mengalahkan Juara Nilai?

Penulis

Alistair Wren

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Berikut jawabannya dalam satu kalimat: Mercury 2.5 Preview adalah model penalaran kredibel termurah yang beroperasi saat ini dengan harga $0.04 / $0.15 per juta token, dan Grok 4.6 adalah model termurah di garis depan kecerdasan dengan harga $2.00 / $6.00 — jadi pertanyaan praktis di antara keduanya adalah apakah model difusi pratinjau yang menurut Inception hanya "sebanding dengan" GPT-5.6 Luna (Low) dan Claude Haiku 4.5 dapat melakukan pekerjaan yang seharusnya Anda bayar untuk kelas frontier. Mercury 2.5 Preview, dirilis 31 Agustus 2026, menghasilkan token secara paralel dan mengklaim 1.107 token per detik pada GPU standar; Grok 4.6, unggulan frontier yang dirilis 12 Agustus 2026, mencetak 61 pada Artificial Analysis Intelligence Index, sejajar di peringkat #3 global, dan melakukannya dengan harga yang belum pernah terlihat sebelumnya di kelas frontier. Benturan itu — klaim tercepat di dasar kurva harga yang bertemu dengan nilai terbaik di puncaknya — adalah inti dari artikel ini.

Poin-poin penting

• Grok 4.6 seharga $2.00 / $6.00 dengan AA Intelligence Index 61 adalah juara nilai di tingkat frontier; Mercury 2.5 Preview seharga $0.04 / $0.15 adalah taruhan bahwa kualitas yang cukup baik dengan harga 1/50 dari harga tersebut mengalahkan kualitas frontier yang jarang Anda butuhkan.

• Klaim kecepatan dan kualitas Mercury 2.5 Preview sepenuhnya berasal dari Inception; tidak ada skor benchmark independen pada hari pertama perilisannya.

• Diskon peluncuran 80% untuk Mercury 2.5 Preview berakhir pada 8 September 2026, setelah itu harga daftarnya adalah $0.20 / $0.75 — masih 10× lebih murah daripada Grok 4.6 untuk input, tetapi cerita yang lebih kecil.

• Grok 4.6 dirutekan di OrcaRouter hari ini dengan harga daftar; Mercury 2.5 Preview belum dirutekan dan dilayani melalui API milik Inception serta beberapa platform pihak ketiga.

Papan skor

A two-column scoreboard titled 'Mercury 2.5 Preview vs Grok 4.6 — the scoreboard': left column Mercury 2.5 Preview — Intelligence claimed cheap-tier parity, Price $0.04/$0.15 (80% off), Speed 1,107 tok/s (claimed), Context 260K, Agentic no public scores, Weights closed; right column Grok 4.6 — Intelligence AA Index 61 (#3), Price $2.00/$6.00, Speed not a headline spec, Context 500K, Agentic APEX-Agents 57.5, Weights closed; footer 'Mercury figures vendor-reported, unreproduced; Grok per xAI and Artificial Analysis'.

Kecerdasan — Mercury 2.5 Preview: tidak ada indeks independen; Inception mengklaim paritas dengan tier yang dioptimalkan biaya. Grok 4.6: AA Intelligence Index 61, berbagi peringkat #3 global (menurut Artificial Analysis; angka labnya sendiri dilaporkan vendor).

Harga — Mercury 2.5 Preview: $0.04 / $0.15 per 1 juta token (diskon 80% dari $0.20 / $0.75, berlaku hingga 8 September 2026). Grok 4.6: $2.00 / $6.00 per 1 juta token; naik dua kali lipat menjadi $4.00 / $12.00 untuk prompt dengan 200 ribu token atau lebih.

Kecepatan — Mercury 2.5 Preview: klaim 1.107 token/detik, dilaporkan vendor. Grok 4.6: kecepatan bukan spesifikasi utama; model ini dirancang untuk proses agentik yang panjang, bukan untuk streaming cepat.

Konteks — Mercury 2.5 Preview: 260K. Grok 4.6: 500K.

Pekerjaan agen — Mercury 2.5 Preview: belum ada skor publik, meskipun pemanggilan alat paralel didukung. Grok 4.6: APEX-Agents 57.5, DeepSWE v1.1 65.9, CursorBench v3.2 69.9 (dilaporkan vendor, sebagian besar belum direproduksi).

Bobot — Mercury 2.5 Preview: tertutup, proprietary. Grok 4.6: tertutup, proprietary.

Juara nilai dan lompatan harga

Posisi Grok 4.6 tidak biasa. Ia menempati peringkat kecerdasan #3 pada indeks Artificial Analysis — imbang dengan GPT-5.6 Sol Max — sementara harganya lebih murah daripada semua model dalam jarak sepuluh poin darinya, dan liputan peluncurannya menyoroti rangkaian tugas agenik panjang yang selesai dengan rata-rata sekitar $0,84 per tugas pada satu evaluasi yang dijalankan vendor. Itulah definisi juara nilai: kemampuan setara frontier dengan harga yang membuat biaya per tugas terlihat di spreadsheet. Mercury 2.5 Preview tidak berusaha menjadi itu. Inception memposisikannya melawan model seperti GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite, dan Claude Haiku 4.5 — tingkatan yang dioptimalkan untuk biaya, bukan frontier. Jika Inception benar, Mercury 2.5 Preview berada satu tingkat di bawah Grok 4.6 dalam hal kemampuan dan beberapa tingkat di bawah dalam hal harga, yang merupakan produk yang sepenuhnya koheren: lompatan harga untuk beban kerja di mana tingkatan frontier hanyalah pemborosan.

Apa yang sebenarnya diubah oleh dekode paralel

Arsitektur adalah bagian yang layak dipahami, karena mengubah arti "cepat". Model autoregresif mengeluarkan satu token per langkah, sehingga throughput dibatasi oleh latensi sekuensial; LLM difusi seperti Mercury 2.5 Preview menghasilkan blok token secara paralel dan menyempurnakannya melalui langkah-langkah denoising, yang memisahkan throughput dari jumlah token yang dihasilkan. Itulah sebabnya Inception dapat mengklaim 1.107 token/detik pada GPU standar — tanpa akselerator khusus, tanpa trik batching — dan mengapa klaim produk yang sesungguhnya adalah waktu-ke-token-pertama di bawah 300 milidetik untuk beban kerja interaktif. Untuk agen suara, pipeline pencarian, atau sub-agen pengkodean yang memanggil model pada setiap giliran, perbedaan latensi itulah produknya: perbedaan antara percakapan suara yang terasa hidup dan yang berhenti sejenak. Masalahnya adalah model bahasa difusi masih merupakan area penelitian yang muda, angka 1.107 adalah milik Inception, dan belum ada laboratorium independen yang mereproduksi kecepatan tersebut atau mengukur penurunan kualitas, jika ada, yang diperkenalkan oleh generasi paralel pada prompt yang panjang atau adversarial.

Di mana Grok 4.6 masih menguasai pekerjaan itu.

Tidak ada apa pun tentang Mercury 2.5 Preview yang menyentuh bagian pasar yang sebenarnya sedang dimenangkan Grok 4.6. Peningkatan Grok dibandingkan Grok 4.5 terkonsentrasi pada benchmark agen dan coding — DeepSWE naik 11,9 poin, APEX-Agents naik 10,4, Terminal-Bench naik 10,3 — dan jendela konteks 500K-nya ada untuk agen berhorizon panjang yang harus menyimpan seluruh tugas dalam konteks. Mercury 2.5 Preview menawarkan panggilan alat paralel, tetapi model tanpa skor agen independen, batas keluaran 65.536 token, dan konteks 260K bukanlah alat yang tepat untuk menjalankan rekayasa perangkat lunak 50 langkah. Kedua model ini nyaris tidak tumpang tindih dalam penggunaannya: Grok 4.6 adalah mesin untuk pekerjaan yang harus benar-benar selesai; Mercury 2.5 Preview adalah mesin untuk pekerjaan yang harus terasa instan dan berbiaya hampir nol per panggilan.

Jendela diskon 80%

Penetapan harga di sini memiliki tanggal kedaluwarsa, dan itu mengubah keputusan. Tarif $0,04 / $0,15 untuk Mercury 2.5 Preview adalah diskon 80% dari harga daftar $0,20 / $0,75, dan Inception telah mengatakan promo ini berlangsung hingga 8 September 2026. $2,00 / $6,00 untuk Grok 4.6 adalah harga daftar yang stabil dengan struktur yang bersih — input cache sebesar $0,50, tingkat prioritas sebesar 2×, dan kenaikan tarif untuk prompt panjang pada 200K token yang menagih seluruh permintaan pada tarif yang lebih tinggi. Jika Anda membandingkan angka hari ini, Mercury tampak 50× lebih murah untuk input dan 40× lebih murah untuk output; jika diskon berakhir sesuai jadwal, selisih jangka panjang yang sesungguhnya adalah 10× untuk input dan 5× untuk output. Kedua pembingkaian itu sama-sama jujur — keduanya hanyalah cakrawala waktu yang berbeda, dan pipeline yang berpatokan pada diskon tanpa titik evaluasi ulang adalah pipeline yang akan terkejut pada 9 September. $2,00 / $6,00 untuk Grok 4.6 adalah persis apa yang Anda bayar di OrcaRouter, tempat harga daftar penyedia diteruskan dengan markup 0% — ketika penyedia mengubah angka, harga itu langsung aktif pada key yang sama di hari yang sama, dengan failover otomatis jika salah satu jalur penyedia menerapkan rate-limit.

Kesimpulan satu kalimat.

Jika pekerjaan harus selesai dan Anda menginginkan kemampuan frontier dengan harga terbaik di tier tersebut, belilah Grok 4.6 — ia adalah juara nilai yang terbukti, sudah tersedia di OrcaRouter hari ini dengan harga $2.00 / $6.00. Jika pekerjaannya berupa penalaran teks bervolume tinggi yang sensitif terhadap latensi, yang jawaban cukup baiknya murah untuk diverifikasi, Mercury 2.5 Preview dengan harga $0.04 / $0.15 adalah peluang harga yang layak diuji dalam masa diskon — ingat saja bahwa setiap klaim di sisi Mercury di papan tersebut adalah klaim Inception, dan buktinya masih belum ada.

A screenshot of the Inception documentation page 'Models, Endpoints, and Pricing' (captured September 1, 2026), showing the Mercury family pricing table — Mercury 2 and Mercury Edit 2 both at $0.25 input / $0.025 cached / $0.75 output per 1M tokens — and a cURL chat-completions API example.A screenshot of the OrcaRouter model page for Grok 4.6 (grok/grok-4.6), showing the model header, the '$2.00' price badge, and the model description noting the August 12, 2026 release.

OrcaRouter meneruskan harga daftar penyedia denganmarkup 0% dan failover otomatis, sehingga perubahan harga vendor langsung aktif pada kunci yang sama di hari yang sama.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

providers@orcarouter.ai

Gabung komunitas kami

Discordsupport@orcarouter.aiXGitHubYouTube