
LongCat-2.5-Preview vs MiniMax M3: Kursi Murah Sudah Diambil
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 610 tok/s
- openaiBARUOpenAI: GPT-6 Luna2026-09-2237Kecerdasan
- openaiBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- anthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- grokBARUGrok 4.72026-09-2146Kecerdasan
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token · 189 tok/s
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
Premis di balik sebagian besar liputan LongCat-2.5-Preview adalah bahwa Meituan telah menawarkan harga lebih murah daripada pesaing lain. Dibandingkan MiniMax M3, premis itu langsung sirna. MiniMax M3 tercantum dengan harga $0.30 per juta token masukan dan $1.20 per juta token keluaran di katalog kami. Daftar tarif yang dipublikasikan LongCat-2.5-Preview adalah $0.30 per juta token masukan tanpa cache dan $1.20 per juta token keluaran. Itu bukan angka yang mirip; itu angka yang sama. Satu-satunya tempat keduanya berbeda adalah input cache, di mana Meituan menawarkan $0.006 per juta dibandingkan $0.06 milik pemain lama — selisih sepuluh kali lipat pada pos termurah dalam tagihan. Jadi pertanyaan yang menarik bukanlah apakah LongCat-2.5-Preview murah. Melainkan apa yang Anda beli dan korbankan ketika sebuah model baru hadir dengan harga yang persis sama dengan pemain lama.
Jawaban singkatnya: batas output yang jauh lebih besar, basis bukti yang jauh lebih tipis, dan diskon cache.
Harga utama sama, plafon yang dipublikasikan sangat berbeda
MiniMax M3 telah tercatat sejak 31 Mei 2026. Katalog kami memuatnya dengan jendela konteks 1.048.576 token dan output maksimum 512.000 token — lebih banyak daripada yang diizinkan sebagian besar model, dan empat kali lipat 131.072 milik LongCat-2.5-Preview. Model ini menerima teks, gambar, dan video sebagai input serta mengembalikan teks, dengan pemanggilan alat, mode JSON, dan penalaran yang tersedia.

LongCat-2.5-Preview, yang terdaftar di LongCat API Platform milik Meituan pada 25 September 2026, cocok pada konteks 1.000.000 token dan jauh di bawah pada keluaran di 131.072. Profil inputnya adalah pertanyaan yang masih hidup: changelog menyajikan pemahaman gambar sebagai tambahan utamanya, tetapi contoh respons dalam dokumentasi "Retrieve Model" milik Meituan sendiri masih menampilkan input_modalities/ sebagai ["text"]/ dengan text->text/ string modalitas. MiniMax M3 juga menerima video, yang sama sekali tidak diklaim oleh LongCat-2.5-Preview. Jika pipeline Anda memasukkan rekaman layar atau urutan frame, perbandingan ini berakhir di sini.
Asimetri cache berjalan ke arah sebaliknya dan layak disebut sebagai keunggulan Meituan, karena inilah satu-satunya dimensi di mana model baru benar-benar membedakan diri. $0,006 per juta input cache dibandingkan $0,06 adalah keunggulan nyata untuk beban kerja agen yang mengirim ulang prefiks panjang yang sama pada setiap giliran — yang merupakan sebagian besar dari mereka. Ini juga pos biaya yang paling mungkin berubah tanpa pemberitahuan, karena Meituan menandai seluruh kartu sebagai diskon waktu terbatas.
Kesenjangan bukti, diukur secara jujur di kedua arah
Posisi benchmark MiniMax M3 tidak kuat, dan mengatakan demikian adalah bagian dari melakukan perbandingan ini dengan benar. Artificial Analysis mencatat Coding Index 58,6 untuknya — peringkat keempat puluh enam dari model yang dilacak — dan Intelligence Index 29,2 di peringkat keenam puluh. GPQA Diamond 92,9%, Humanity's Last Exam 39%, SciCode 47,1%, Long-Context Recall 83, τ²-Bench perbankan 15,3, Terminal-Bench v2.1 65,2. Angka yang diterbitkan MiniMax sendiri mencakup ranah yang berbeda: BrowseComp 83,5, rubrik GDPval 76,7, MCP Atlas 74,2, BankerToolBench 76,1. Itu adalah angka yang dilaporkan vendor dan seharusnya berada di kolom yang berbeda dari angka independen, tetapi angka-angka itu ada, dan kata "ada" itulah yang menentukan.

LongCat-2.5-Preview tidak memiliki kolom sama sekali. Tidak ada tabel tolok ukur yang diterbitkan, tidak ada kartu model, tidak ada laporan teknis, tidak ada repositori di HuggingFace atau di organisasi GitHub Meituan, dan metadata katalog mencatat bobot terbuka sebagai false. Jumlah parameter sekitar 1,6 triliun total / 48 miliar aktif dilaporkan dari metadata situs Meituan dan liputan perdagangan Tiongkok, bukan dari dokumentasi. Jadi pernyataan yang akurat adalah: skor M3 biasa-biasa saja dan bersumber independen; skor LongCat-2.5-Preview tidak ada. Model yang mencetak skor di angka empat puluhan pada indeks pengodean adalah besaran yang diketahui dan dapat Anda perhitungkan. Model tanpa skor adalah jenis risiko yang berbeda, dan harga yang identik menghilangkan kompensasi yang biasanya membenarkan pengambilan model tersebut.
Ketika harga yang sama mengubah apa yang harus Anda lakukan
Ketika model baru memangkas harga di pasar, langkah rasional adalah mengevaluasinya — keuntungannya adalah diskon nyata. Ketika model baru hadir dengan harga yang persis sama seperti pemain lama yang sudah tersedia sejak Mei, keuntungannya bukanlah harga. Melainkan kemampuan, dan kemampuan adalah satu hal yang belum dipublikasikan oleh LongCat-2.5-Preview. Itu mengubah kerangka evaluasi sepenuhnya: Anda tidak menguji apakah model itu lebih murah, Anda menguji apakah model itu lebih baik, pada tugas-tugas Anda, dari titik awal tanpa bukti yang bisa dijadikan acuan.
Ada detail tingkat kedua yang membuat uji itu lebih murah daripada kelihatannya. LongCat-2.5-Preview gratis dan tanpa batas melalui OpenCode selama jendela yang durasinya tidak disebutkan, dengan kebijakan retensi nol yang didokumentasikan OpenCode secara eksplisit — pelatihan model "Not used", retensi data "0 days", dibandingkan tiga puluh hari untuk daftar perbandingan. Jadi biaya menghasilkan evaluasi Anda sendiri hampir nol, dan kebijakan retensi berarti Anda dapat menjalankannya terhadap kode privat. Satu detail harness yang perlu diselesaikan lebih dahulu adalah bahwa model mengembalikan jejak penalarannya dalam bentuk yang disisipkan reasoning_content/ field; klien yang mengurai chat completions tanpa mengharapkannya akan membuang penalaran itu secara diam-diam dan membuat model tampak lebih buruk daripada sebenarnya.

Argumen perutean, khusus untuk perbandingan harga yang sama
Kami menyediakan MiniMax M3 dengan harga daftar MiniMax, tanpa markup. LongCat-2.5-Preview bukan salah satu rute kami — kami tidak menyediakannya, dan tidak ada apa pun di sini yang boleh ditafsirkan sebagai klaim sebaliknya.
Pertarungan dengan harga yang sama justru merupakan kasus di mana routing benar-benar membuktikan nilainya, bukan sekadar kemudahan. Jika dua model berbiaya sama, keputusan di antara keduanya bersifat per permintaan dan per tugas: M3 untuk batas keluaran 512.000 token dan masukan video, LongCat-2.5-Preview untuk diskon prefiks yang di-cache pada loop agen yang panjang setelah Anda yakin dengan kualitasnya. Fusi model adalah mekanisme yang membuatnya menjadi harfiah — tahap pengambilan dan langkah sintesis dapat menggunakan model yang berbeda dalam satu permintaan, sehingga Anda tidak dipaksa memilih pemenang sebelum memiliki bukti. Dan karena kami meneruskan harga daftar penyedia tanpa markup, perubahan tarif vendor langsung masuk ke tagihan Anda pada hari yang sama alih-alih pada pembaruan kontrak berikutnya, yang lebih penting dari biasanya ketika salah satu dari dua kartu tersebut secara eksplisit bersifat promosi. Failover otomatis kemudian menangani kasus ketika salah satu penyedia mengalami penurunan layanan, dan ini paling penting untuk model yang tidak memiliki riwayat layanan untuk diperiksa.
Sering diajukan
• Apakah LongCat-2.5-Preview lebih murah daripada MiniMax M3? Tidak. Pada kartu yang dipublikasikan, tarif input dan output identik, yaitu $0,30 dan $1,20 per juta. Satu-satunya keunggulan harga ada pada input yang di-cache, $0,006 versus $0,06, dan Meituan menyebut seluruh kartunya sebagai diskon waktu terbatas tanpa menjelaskan apa yang akan menyusul.
• Mana yang memiliki keluaran yang dapat digunakan lebih besar? MiniMax M3 dengan selisih yang lebar: 512.000 token versus 131.072. Untuk pembuatan konten panjang, ekstraksi terstruktur dari dokumen besar, atau apa pun yang menulis lebih dari satu bab, batas maksimum itu adalah spesifikasi yang menentukan.
• Yang mana yang dapat saya verifikasi? MiniMax M3, dan hasil verifikasinya tidak menyanjungnya — Coding 58.6 di peringkat keempat puluh enam dan Intelligence Index 29.2 di peringkat keenam puluh dari Artificial Analysis. LongCat-2.5-Preview tidak memiliki evaluasi yang dipublikasikan dari siapa pun. Jika benchmark LongCat-2.5-Preview muncul minggu ini, anggap saja tidak dapat diverifikasi sampai Anda dapat melacaknya ke evaluator yang disebutkan namanya.
• Mana yang harus saya terapkan di produksi? Tidak ada, tanpa pengujian dari Anda sendiri. Di antara keduanya, M3 adalah pilihan dengan varians lebih rendah karena kelemahannya terdokumentasi dan modalitas masukannya sudah dikonfirmasi; LongCat-2.5-Preview adalah pilihan dengan varians lebih tinggi, dengan klaim konteks yang lebih besar, batas keluaran yang jauh lebih kecil, diskon cache, dan nol bukti publik. Jalankan secara gratis selama jendelanya masih terbuka, simpan keduanya di balik satu kunci, dan biarkan angka Anda sendiri yang menentukan.
