Wygenerowana karta tytułowa hero o treści „LongCat-2.5-Preview vs MiniMax M3”, z nadtytułem „Tanie miejsce jest już zajęte”, oraz dwa panele: „LongCat-2.5-Preview: $0.30 / $1.20 za 1 mln, 131 072 maks. wyjścia” i „MiniMax M3: $0.30 / $1.20 za 1 mln, 512 000 maks. wyjścia”. Logo OrcaRouter w prawym dolnym rogu.
Guides & Insights

LongCat-2.5-Preview vs MiniMax M3: Tanie miejsce jest już zajęte

Autor

Magnus Corvin

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Założeniem większości materiałów o LongCat-2.5-Preview jest to, że Meituan przebił cenowo konkurencję. W zestawieniu z MiniMax M3 to założenie pryska przy pierwszym kontakcie. W naszym katalogu MiniMax M3 wyceniono na 0,30 USD za milion tokenów wejściowych i 1,20 USD za milion tokenów wyjściowych. Opublikowany cennik LongCat-2.5-Preview to 0,30 USD za milion tokenów wejściowych spoza pamięci podręcznej i 1,20 USD za milion tokenów wyjściowych. To nie są podobne liczby; to te same liczby. Jedyne miejsce, w którym się rozchodzą, to wejście z pamięci podręcznej, gdzie Meituan podaje 0,006 USD za milion wobec 0,06 USD u dotychczasowego gracza — dziesięciokrotna różnica na najtańszej pozycji rachunku. Ciekawe pytanie nie brzmi więc: czy LongCat-2.5-Preview jest tani. Brzmi: co kupujesz i z czego rezygnujesz, gdy nowy model pojawia się w dokładnie tej samej cenie co dotychczasowy lider.

Krótka odpowiedź: znacznie większy limit wyjściowy, znacznie uboższa baza dowodowa i rabat za pamięć podręczną.

Ta sama cena nagłówkowa, bardzo różne publikowane pułapy

MiniMax M3 figuruje w oficjalnych zapisach od 31 maja 2026 r. Nasz katalog zawiera go z oknem kontekstowym 1 048 576 tokenów i maksymalnym wyjściem 512 000 tokenów — więcej niż pozwala większość modeli i czterokrotnie więcej niż 131 072 w LongCat-2.5-Preview. Przyjmuje jako dane wejściowe tekst, obrazy i wideo, a zwraca tekst, udostępniając wywoływanie narzędzi, tryb JSON i rozumowanie.

A screenshot of Meituan's LongCat API Platform change-log page, headlined 'Version: 2026-09-25 - LongCat-2.5-Preview Now Available', listing the model's three stated features - multimodal image understanding, coding capability, and compatibility with Claude Code, Hermes, OpenClaw, OpenCode and Kilo Code - with the platform's Guide, API, Tools and Pricing navigation and its column of earlier dated releases visible.

LongCat-2.5-Preview, wpisany na platformę LongCat API firmy Meituan 25 września 2026 r., dorównuje pod względem kontekstu na poziomie 1 000 000 tokenów, ale mocno wypada poniżej oczekiwań w zakresie wyjścia na poziomie 131 072. Jego profil wejściowy to aktualne pytanie: dziennik zmian przedstawia rozumienie obrazów jako swoją sztandarową nowość, ale przykładowa odpowiedź w dokumentacji „Retrieve Model” samej firmy Meituan nadal pokazuje input_modalities/ jako ["text"]/ z text->text/ ciąg modalności. MiniMax M3 również obsługuje wideo, czego LongCat-2.5-Preview w ogóle nie deklaruje. Jeśli Twój potok przetwarzania przyjmuje nagrania ekranu lub sekwencje klatek, to porównanie kończy się tutaj.

Asymetria pamięci podręcznej działa w drugą stronę i warto ją podkreślić na korzyść Meituan, ponieważ to jedyny wymiar, w którym nowy model rzeczywiście się wyróżnia. 0,006 USD za milion buforowanych danych wejściowych w porównaniu z 0,06 USD to realna przewaga w przypadku obciążeń agentowych, które przy każdej turze ponownie wysyłają ten sam długi prefiks — a dotyczy to większości z nich. To także pozycja cennika najbardziej narażona na zmianę bez powiadomienia, ponieważ Meituan oznacza całą kartę jako objętą ograniczoną czasowo zniżką.

Luka dowodowa, uczciwie zmierzona w obu kierunkach

Pozycja MiniMax M3 w benchmarkach nie jest mocna, a powiedzenie tego wprost to część rzetelnego przeprowadzenia tego porównania. Artificial Analysis odnotowuje dla niego Coding Index na poziomie 58,6 — czterdzieste szóste miejsce wśród śledzonych modeli — oraz Intelligence Index 29,2 na sześćdziesiątym miejscu. GPQA Diamond 92,9%, Humanity's Last Exam 39%, SciCode 47,1%, Long-Context Recall 83, τ²-Bench banking 15,3, Terminal-Bench v2.1 65,2. Opublikowane przez samego MiniMaxa wyniki obejmują inny obszar: BrowseComp 83,5, kryteria GDPval 76,7, MCP Atlas 74,2, BankerToolBench 76,1. To liczby podane przez producenta i należą do innej kolumny niż niezależne, ale istnieją, i to jest tu kluczowe.

A screenshot of OrcaRouter's own model page for MiniMax M3 at /models/minimax/minimax-m3, showing the minimax/minimax-m3 identifier, a 1M-token context window, 512K maximum output, text + image + video input and text output, Vision, Tools, JSON and Reasoning capability chips, a release date of 2026-05-31, a p50 first-token figure of 3.35 s, $0.30 and $1.20 rate tiles, and the OpenAI-compatible code samples.

LongCat-2.5-Preview nie ma żadnej kolumny. Brak opublikowanej tabeli benchmarków, brak karty modelu, brak raportu technicznego, brak repozytorium na HuggingFace ani w organizacji GitHub Meituana, a metadane katalogowe określają otwarte wagi jako fałsz. Liczbę parametrów wynoszącą około 1,6 biliona łącznie / 48 miliardów aktywnych podaje się na podstawie metadanych strony Meituana i chińskich publikacji branżowych, a nie na podstawie dokumentacji. Zatem trafne stwierdzenie brzmi: wyniki M3 są przeciętne i pochodzą z niezależnych źródeł; w przypadku LongCat-2.5-Preview ich brak. Model, który uzyskuje wyniki w przedziale czterdziestu kilku punktów w indeksie kodowania, to znana wielkość, wokół której można planować. Model bez wyniku to inny rodzaj ryzyka, a identyczna cena usuwa rekompensatę, która zwykle uzasadnia sięgnięcie po niego.

Gdzie ta sama cena zmienia to, co powinieneś zrobić

Gdy nowy model okazuje się tańszy od całej konkurencji, racjonalnym krokiem jest poddać go ocenie — potencjalną korzyścią jest realna zniżka. Gdy nowy model pojawia się w dokładnie tej samej cenie co obecny na rynku od maja konkurent, korzyścią nie jest cena. Chodzi o możliwości, a możliwości to jedyna rzecz, której LongCat-2.5-Preview nie opublikował. To całkowicie zmienia ramy oceny: nie testujesz, czy jest tańszy, tylko czy jest lepszy — na twoich zadaniach, startując z miejsca i nie mając żadnych dowodów, na których można by się oprzeć.

Jest pewien szczegół drugiego rzędu, który sprawia, że ten test jest tańszy, niż wygląda. LongCat-2.5-Preview jest darmowy i bez ograniczeń przez OpenCode w oknie o nieokreślonej długości, z polityką zerowego przechowywania, którą OpenCode jawnie dokumentuje — trenowanie modelu: „Not used", przechowywanie danych: „0 days", w porównaniu z trzydziestoma dniami w przypadku pozycji porównawczej. Koszt wygenerowania własnej ewaluacji jest więc bliski zeru, a polityka przechowywania oznacza, że można ją uruchomić na prywatnym kodzie. Jeden szczegół dotyczący harnessu trzeba najpierw ustalić: model zwraca swój ślad rozumowania w przeplatanym reasoning_content/ field; klienci, którzy parsują ukończenia czatu bez oczekiwania tego, po cichu odrzucą tok myślenia i sprawią, że model będzie wyglądał gorzej, niż jest.

A generated two-column scoreboard titled 'LongCat-2.5-Preview vs MiniMax M3' with the subhead 'Identical headline rates, four times the output ceiling, ten times the cache discount'. Left column 'LongCat-2.5-Preview' (Meituan, listed 2026-09-25, no benchmark published): 1,000,000-token context, 131,072 max output, text with image input claimed not confirmed, $0.30 uncached / $0.006 cached input, $1.20 output flagged limited-time, coding index not published, long-context recall not published, no repo and catalogue open_weights false. Right column 'MiniMax M3' (MiniMax, released 2026-05-31, independently scored): 1,048,576-token context, 512,000 max output described as four times as much, text, image and video to text, $0.30 uncached / $0.06 cached input, $1.20 output, coding index 58.6 at rank 46 and intelligence index 29.2 at rank 60 by Artificial Analysis, long-context recall 83. Footnote credits the left column to Meituan's changelog and pricing page and the right column to OrcaRouter's catalogue with index figures sourced to Artificial Analysis, and notes that LongCat-2.5-Preview is not routed by OrcaRouter. OrcaRouter logo bottom-right.

Argument dotyczący routingu, właściwy dla porównania przy tej samej cenie

Udostępniamy MiniMax M3 w cenie katalogowej MiniMax z zerową marżą. LongCat-2.5-Preview nie należy do naszych tras — nie obsługujemy go i nic tutaj nie powinno być odczytywane jako twierdzenie przeciwne.

Pojedynek przy tej samej cenie to dokładnie ten przypadek, w którym routing zarabia na siebie, a nie jest tylko udogodnieniem. Jeśli dwa modele kosztują tyle samo, decyzja między nimi zapada dla każdego żądania i każdego zadania: M3 ze względu na limit wyjścia wynoszący 512 000 tokenów i wejście wideo, LongCat-2.5-Preview ze względu na zniżkę za buforowany prefiks w długich pętlach agentowych, gdy już upewnisz się co do jego jakości. Fuzja modeli to mechanizm, który czyni to dosłownym — etap wyszukiwania i krok syntezy mogą być różnymi modelami w ramach jednego żądania, więc nie musisz wybierać zwycięzcy, zanim masz dowody. A ponieważ przekazujemy ceny katalogowe dostawców bez marży, zmiana stawek dostawcy pojawia się na twoim rachunku tego samego dnia, a nie przy kolejnym odnowieniu umowy, co ma większe znaczenie niż zwykle, gdy jedna z dwóch kart jest wyraźnie promocyjna. Z kolei automatyczny failover obejmuje przypadek, w którym jeden z dostawców ulega degradacji, i ma to największe znaczenie dla modelu, który nie ma historii obsługi, którą można sprawdzić.

Często zadawane

• Czy LongCat-2.5-Preview jest tańszy niż MiniMax M3? Nie. W opublikowanych cennikach stawki za dane wejściowe i wyjściowe są identyczne i wynoszą 0,30 USD oraz 1,20 USD za milion. Jedyna przewaga cenowa dotyczy buforowanych danych wejściowych: 0,006 USD wobec 0,06 USD, a Meituan określa cały swój cennik jako ograniczoną czasowo promocję, nie mówiąc, co będzie później.

• Który ma większą użyteczną wielkość wyjścia? MiniMax M3 zdecydowanie: 512 000 tokenów w porównaniu z 131 072. W przypadku generowania długich treści, ekstrakcji strukturalnej z dużych dokumentów lub czegokolwiek, co pisze więcej niż rozdział, ten pułap jest decydującym parametrem.

• Który z nich mogę zweryfikować? MiniMax M3, a weryfikacja nie wypada dla niego pochlebnie — Coding 58,6 na czterdziestym szóstym miejscu i Intelligence Index 29,2 na sześćdziesiątym miejscu według Artificial Analysis. LongCat-2.5-Preview nie ma żadnej opublikowanej oceny od nikogo. Jeśli w tym tygodniu pojawi się benchmark LongCat-2.5-Preview, traktuj go jako niezweryfikowalny, dopóki nie prześledzisz go do nazwanego ewaluatora.

• Który powinienem wdrożyć na produkcję? Żadnego bez własnego testu. Między tymi dwoma M3 jest wyborem o mniejszej wariancji, ponieważ jego słabości są udokumentowane, a jego modalności wejściowe są potwierdzone; LongCat-2.5-Preview jest tym o większej wariancji, z deklaracją większego kontekstu, znacznie mniejszym limitem wyjściowym, zniżką za cache i zerem publicznych dowodów. Uruchom go za darmo, póki okno jest otwarte, trzymaj oba za jednym kluczem i pozwól, by twoje własne liczby zdecydowały.