Kartu judul hero yang dihasilkan bertuliskan 'LongCat-2.5-Preview vs MiniMax M3' dengan overline 'Kursi murahnya sudah terisi', dan dua panel: 'LongCat-2.5-Preview: $0.30 / $1.20 per 1 juta, output maks 131.072' dan 'MiniMax M3: $0.30 / $1.20 per 1 juta, output maks 512.000'. Logo OrcaRouter di kanan bawah.
Guides & Insights

LongCat-2.5-Preview vs MiniMax M3: Kursi Murah Sudah Diambil

Penulis

Magnus Corvin

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Premis di balik sebagian besar liputan LongCat-2.5-Preview adalah bahwa Meituan telah menawarkan harga lebih murah daripada pesaing lain. Dibandingkan MiniMax M3, premis itu langsung sirna. MiniMax M3 tercantum dengan harga $0.30 per juta token masukan dan $1.20 per juta token keluaran di katalog kami. Daftar tarif yang dipublikasikan LongCat-2.5-Preview adalah $0.30 per juta token masukan tanpa cache dan $1.20 per juta token keluaran. Itu bukan angka yang mirip; itu angka yang sama. Satu-satunya tempat keduanya berbeda adalah input cache, di mana Meituan menawarkan $0.006 per juta dibandingkan $0.06 milik pemain lama — selisih sepuluh kali lipat pada pos termurah dalam tagihan. Jadi pertanyaan yang menarik bukanlah apakah LongCat-2.5-Preview murah. Melainkan apa yang Anda beli dan korbankan ketika sebuah model baru hadir dengan harga yang persis sama dengan pemain lama.

Jawaban singkatnya: batas output yang jauh lebih besar, basis bukti yang jauh lebih tipis, dan diskon cache.

Harga utama sama, plafon yang dipublikasikan sangat berbeda

MiniMax M3 telah tercatat sejak 31 Mei 2026. Katalog kami memuatnya dengan jendela konteks 1.048.576 token dan output maksimum 512.000 token — lebih banyak daripada yang diizinkan sebagian besar model, dan empat kali lipat 131.072 milik LongCat-2.5-Preview. Model ini menerima teks, gambar, dan video sebagai input serta mengembalikan teks, dengan pemanggilan alat, mode JSON, dan penalaran yang tersedia.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

LongCat-2.5-Preview, yang terdaftar di LongCat API Platform milik Meituan pada 25 September 2026, cocok pada konteks 1.000.000 token dan jauh di bawah pada keluaran di 131.072. Profil inputnya adalah pertanyaan yang masih hidup: changelog menyajikan pemahaman gambar sebagai tambahan utamanya, tetapi contoh respons dalam dokumentasi "Retrieve Model" milik Meituan sendiri masih menampilkan input_modalities/ sebagai ["text"]/ dengan text->text/ string modalitas. MiniMax M3 juga menerima video, yang sama sekali tidak diklaim oleh LongCat-2.5-Preview. Jika pipeline Anda memasukkan rekaman layar atau urutan frame, perbandingan ini berakhir di sini.

Asimetri cache berjalan ke arah sebaliknya dan layak disebut sebagai keunggulan Meituan, karena inilah satu-satunya dimensi di mana model baru benar-benar membedakan diri. $0,006 per juta input cache dibandingkan $0,06 adalah keunggulan nyata untuk beban kerja agen yang mengirim ulang prefiks panjang yang sama pada setiap giliran — yang merupakan sebagian besar dari mereka. Ini juga pos biaya yang paling mungkin berubah tanpa pemberitahuan, karena Meituan menandai seluruh kartu sebagai diskon waktu terbatas.

Kesenjangan bukti, diukur secara jujur di kedua arah

Posisi benchmark MiniMax M3 tidak kuat, dan mengatakan demikian adalah bagian dari melakukan perbandingan ini dengan benar. Artificial Analysis mencatat Coding Index 58,6 untuknya — peringkat keempat puluh enam dari model yang dilacak — dan Intelligence Index 29,2 di peringkat keenam puluh. GPQA Diamond 92,9%, Humanity's Last Exam 39%, SciCode 47,1%, Long-Context Recall 83, τ²-Bench perbankan 15,3, Terminal-Bench v2.1 65,2. Angka yang diterbitkan MiniMax sendiri mencakup ranah yang berbeda: BrowseComp 83,5, rubrik GDPval 76,7, MCP Atlas 74,2, BankerToolBench 76,1. Itu adalah angka yang dilaporkan vendor dan seharusnya berada di kolom yang berbeda dari angka independen, tetapi angka-angka itu ada, dan kata "ada" itulah yang menentukan.

A screenshot of OrcaRouter's own model page for MiniMax M3 at /models/minimax/minimax-m3, showing the minimax/minimax-m3 identifier, a 1M-token context window, 512K maximum output, text + image + video input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-05-31, a p50 first-token figure of 3.35 s, $0.30 and $1.20 rate tiles, and the OpenAI-compatible code samples.

LongCat-2.5-Preview tidak memiliki kolom sama sekali. Tidak ada tabel tolok ukur yang diterbitkan, tidak ada kartu model, tidak ada laporan teknis, tidak ada repositori di HuggingFace atau di organisasi GitHub Meituan, dan metadata katalog mencatat bobot terbuka sebagai false. Jumlah parameter sekitar 1,6 triliun total / 48 miliar aktif dilaporkan dari metadata situs Meituan dan liputan perdagangan Tiongkok, bukan dari dokumentasi. Jadi pernyataan yang akurat adalah: skor M3 biasa-biasa saja dan bersumber independen; skor LongCat-2.5-Preview tidak ada. Model yang mencetak skor di angka empat puluhan pada indeks pengodean adalah besaran yang diketahui dan dapat Anda perhitungkan. Model tanpa skor adalah jenis risiko yang berbeda, dan harga yang identik menghilangkan kompensasi yang biasanya membenarkan pengambilan model tersebut.

Ketika harga yang sama mengubah apa yang harus Anda lakukan

Ketika model baru memangkas harga di pasar, langkah rasional adalah mengevaluasinya — keuntungannya adalah diskon nyata. Ketika model baru hadir dengan harga yang persis sama seperti pemain lama yang sudah tersedia sejak Mei, keuntungannya bukanlah harga. Melainkan kemampuan, dan kemampuan adalah satu hal yang belum dipublikasikan oleh LongCat-2.5-Preview. Itu mengubah kerangka evaluasi sepenuhnya: Anda tidak menguji apakah model itu lebih murah, Anda menguji apakah model itu lebih baik, pada tugas-tugas Anda, dari titik awal tanpa bukti yang bisa dijadikan acuan.

Ada detail tingkat kedua yang membuat uji itu lebih murah daripada kelihatannya. LongCat-2.5-Preview gratis dan tanpa batas melalui OpenCode selama jendela yang durasinya tidak disebutkan, dengan kebijakan retensi nol yang didokumentasikan OpenCode secara eksplisit — pelatihan model "Not used", retensi data "0 days", dibandingkan tiga puluh hari untuk daftar perbandingan. Jadi biaya menghasilkan evaluasi Anda sendiri hampir nol, dan kebijakan retensi berarti Anda dapat menjalankannya terhadap kode privat. Satu detail harness yang perlu diselesaikan lebih dahulu adalah bahwa model mengembalikan jejak penalarannya dalam bentuk yang disisipkan reasoning_content/ field; klien yang mengurai chat completions tanpa mengharapkannya akan membuang penalaran itu secara diam-diam dan membuat model tampak lebih buruk daripada sebenarnya.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs MiniMax M3' with the subhead 'Identical headline rates, four times the output ceiling, ten times the cache discount'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, $1.20 output flagged limited-time, coding index not published, long-context recall not published, no repo and catalogue open_weights false. Right column 'MiniMax M3' (MiniMax, released 2026-05-31, independently scored): 1,048,576-token context, 512,000 max output described as four times as much, text, image and video to text, $0.30 uncached / $0.06 cached input, $1.20 output, coding index 58.6 at rank 46 and intelligence index 29.2 at rank 60 by Artificial Analysis, long-context recall 83. Footnote credits the left column to Meituan's changelog and pricing page and the right column to OrcaRouter's catalogue with index figures sourced to Artificial Analysis, and notes that LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

Argumen perutean, khusus untuk perbandingan harga yang sama

Kami menyediakan MiniMax M3 dengan harga daftar MiniMax, tanpa markup. LongCat-2.5-Preview bukan salah satu rute kami — kami tidak menyediakannya, dan tidak ada apa pun di sini yang boleh ditafsirkan sebagai klaim sebaliknya.

Pertarungan dengan harga yang sama justru merupakan kasus di mana routing benar-benar membuktikan nilainya, bukan sekadar kemudahan. Jika dua model berbiaya sama, keputusan di antara keduanya bersifat per permintaan dan per tugas: M3 untuk batas keluaran 512.000 token dan masukan video, LongCat-2.5-Preview untuk diskon prefiks yang di-cache pada loop agen yang panjang setelah Anda yakin dengan kualitasnya. Fusi model adalah mekanisme yang membuatnya menjadi harfiah — tahap pengambilan dan langkah sintesis dapat menggunakan model yang berbeda dalam satu permintaan, sehingga Anda tidak dipaksa memilih pemenang sebelum memiliki bukti. Dan karena kami meneruskan harga daftar penyedia tanpa markup, perubahan tarif vendor langsung masuk ke tagihan Anda pada hari yang sama alih-alih pada pembaruan kontrak berikutnya, yang lebih penting dari biasanya ketika salah satu dari dua kartu tersebut secara eksplisit bersifat promosi. Failover otomatis kemudian menangani kasus ketika salah satu penyedia mengalami penurunan layanan, dan ini paling penting untuk model yang tidak memiliki riwayat layanan untuk diperiksa.

Sering diajukan

• Apakah LongCat-2.5-Preview lebih murah daripada MiniMax M3? Tidak. Pada kartu yang dipublikasikan, tarif input dan output identik, yaitu $0,30 dan $1,20 per juta. Satu-satunya keunggulan harga ada pada input yang di-cache, $0,006 versus $0,06, dan Meituan menyebut seluruh kartunya sebagai diskon waktu terbatas tanpa menjelaskan apa yang akan menyusul.

• Mana yang memiliki keluaran yang dapat digunakan lebih besar? MiniMax M3 dengan selisih yang lebar: 512.000 token versus 131.072. Untuk pembuatan konten panjang, ekstraksi terstruktur dari dokumen besar, atau apa pun yang menulis lebih dari satu bab, batas maksimum itu adalah spesifikasi yang menentukan.

• Yang mana yang dapat saya verifikasi? MiniMax M3, dan hasil verifikasinya tidak menyanjungnya — Coding 58.6 di peringkat keempat puluh enam dan Intelligence Index 29.2 di peringkat keenam puluh dari Artificial Analysis. LongCat-2.5-Preview tidak memiliki evaluasi yang dipublikasikan dari siapa pun. Jika benchmark LongCat-2.5-Preview muncul minggu ini, anggap saja tidak dapat diverifikasi sampai Anda dapat melacaknya ke evaluator yang disebutkan namanya.

• Mana yang harus saya terapkan di produksi? Tidak ada, tanpa pengujian dari Anda sendiri. Di antara keduanya, M3 adalah pilihan dengan varians lebih rendah karena kelemahannya terdokumentasi dan modalitas masukannya sudah dikonfirmasi; LongCat-2.5-Preview adalah pilihan dengan varians lebih tinggi, dengan klaim konteks yang lebih besar, batas keluaran yang jauh lebih kecil, diskon cache, dan nol bukti publik. Jalankan secara gratis selama jendelanya masih terbuka, simpan keduanya di balik satu kunci, dan biarkan angka Anda sendiri yang menentukan.