
LongCat-2.5-Preview vs MiniMax M3: Tanie miejsce jest już zajęte
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 610 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 189 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
Założeniem większości materiałów o LongCat-2.5-Preview jest to, że Meituan przebił cenowo konkurencję. W zestawieniu z MiniMax M3 to założenie pryska przy pierwszym kontakcie. W naszym katalogu MiniMax M3 wyceniono na 0,30 USD za milion tokenów wejściowych i 1,20 USD za milion tokenów wyjściowych. Opublikowany cennik LongCat-2.5-Preview to 0,30 USD za milion tokenów wejściowych spoza pamięci podręcznej i 1,20 USD za milion tokenów wyjściowych. To nie są podobne liczby; to te same liczby. Jedyne miejsce, w którym się rozchodzą, to wejście z pamięci podręcznej, gdzie Meituan podaje 0,006 USD za milion wobec 0,06 USD u dotychczasowego gracza — dziesięciokrotna różnica na najtańszej pozycji rachunku. Ciekawe pytanie nie brzmi więc: czy LongCat-2.5-Preview jest tani. Brzmi: co kupujesz i z czego rezygnujesz, gdy nowy model pojawia się w dokładnie tej samej cenie co dotychczasowy lider.
Krótka odpowiedź: znacznie większy limit wyjściowy, znacznie uboższa baza dowodowa i rabat za pamięć podręczną.
Ta sama cena nagłówkowa, bardzo różne publikowane pułapy
MiniMax M3 figuruje w oficjalnych zapisach od 31 maja 2026 r. Nasz katalog zawiera go z oknem kontekstowym 1 048 576 tokenów i maksymalnym wyjściem 512 000 tokenów — więcej niż pozwala większość modeli i czterokrotnie więcej niż 131 072 w LongCat-2.5-Preview. Przyjmuje jako dane wejściowe tekst, obrazy i wideo, a zwraca tekst, udostępniając wywoływanie narzędzi, tryb JSON i rozumowanie.

LongCat-2.5-Preview, wpisany na platformę LongCat API firmy Meituan 25 września 2026 r., dorównuje pod względem kontekstu na poziomie 1 000 000 tokenów, ale mocno wypada poniżej oczekiwań w zakresie wyjścia na poziomie 131 072. Jego profil wejściowy to aktualne pytanie: dziennik zmian przedstawia rozumienie obrazów jako swoją sztandarową nowość, ale przykładowa odpowiedź w dokumentacji „Retrieve Model” samej firmy Meituan nadal pokazuje input_modalities/ jako ["text"]/ z text->text/ ciąg modalności. MiniMax M3 również obsługuje wideo, czego LongCat-2.5-Preview w ogóle nie deklaruje. Jeśli Twój potok przetwarzania przyjmuje nagrania ekranu lub sekwencje klatek, to porównanie kończy się tutaj.
Asymetria pamięci podręcznej działa w drugą stronę i warto ją podkreślić na korzyść Meituan, ponieważ to jedyny wymiar, w którym nowy model rzeczywiście się wyróżnia. 0,006 USD za milion buforowanych danych wejściowych w porównaniu z 0,06 USD to realna przewaga w przypadku obciążeń agentowych, które przy każdej turze ponownie wysyłają ten sam długi prefiks — a dotyczy to większości z nich. To także pozycja cennika najbardziej narażona na zmianę bez powiadomienia, ponieważ Meituan oznacza całą kartę jako objętą ograniczoną czasowo zniżką.
Luka dowodowa, uczciwie zmierzona w obu kierunkach
Pozycja MiniMax M3 w benchmarkach nie jest mocna, a powiedzenie tego wprost to część rzetelnego przeprowadzenia tego porównania. Artificial Analysis odnotowuje dla niego Coding Index na poziomie 58,6 — czterdzieste szóste miejsce wśród śledzonych modeli — oraz Intelligence Index 29,2 na sześćdziesiątym miejscu. GPQA Diamond 92,9%, Humanity's Last Exam 39%, SciCode 47,1%, Long-Context Recall 83, τ²-Bench banking 15,3, Terminal-Bench v2.1 65,2. Opublikowane przez samego MiniMaxa wyniki obejmują inny obszar: BrowseComp 83,5, kryteria GDPval 76,7, MCP Atlas 74,2, BankerToolBench 76,1. To liczby podane przez producenta i należą do innej kolumny niż niezależne, ale istnieją, i to jest tu kluczowe.

LongCat-2.5-Preview nie ma żadnej kolumny. Brak opublikowanej tabeli benchmarków, brak karty modelu, brak raportu technicznego, brak repozytorium na HuggingFace ani w organizacji GitHub Meituana, a metadane katalogowe określają otwarte wagi jako fałsz. Liczbę parametrów wynoszącą około 1,6 biliona łącznie / 48 miliardów aktywnych podaje się na podstawie metadanych strony Meituana i chińskich publikacji branżowych, a nie na podstawie dokumentacji. Zatem trafne stwierdzenie brzmi: wyniki M3 są przeciętne i pochodzą z niezależnych źródeł; w przypadku LongCat-2.5-Preview ich brak. Model, który uzyskuje wyniki w przedziale czterdziestu kilku punktów w indeksie kodowania, to znana wielkość, wokół której można planować. Model bez wyniku to inny rodzaj ryzyka, a identyczna cena usuwa rekompensatę, która zwykle uzasadnia sięgnięcie po niego.
Gdzie ta sama cena zmienia to, co powinieneś zrobić
Gdy nowy model okazuje się tańszy od całej konkurencji, racjonalnym krokiem jest poddać go ocenie — potencjalną korzyścią jest realna zniżka. Gdy nowy model pojawia się w dokładnie tej samej cenie co obecny na rynku od maja konkurent, korzyścią nie jest cena. Chodzi o możliwości, a możliwości to jedyna rzecz, której LongCat-2.5-Preview nie opublikował. To całkowicie zmienia ramy oceny: nie testujesz, czy jest tańszy, tylko czy jest lepszy — na twoich zadaniach, startując z miejsca i nie mając żadnych dowodów, na których można by się oprzeć.
Jest pewien szczegół drugiego rzędu, który sprawia, że ten test jest tańszy, niż wygląda. LongCat-2.5-Preview jest darmowy i bez ograniczeń przez OpenCode w oknie o nieokreślonej długości, z polityką zerowego przechowywania, którą OpenCode jawnie dokumentuje — trenowanie modelu: „Not used", przechowywanie danych: „0 days", w porównaniu z trzydziestoma dniami w przypadku pozycji porównawczej. Koszt wygenerowania własnej ewaluacji jest więc bliski zeru, a polityka przechowywania oznacza, że można ją uruchomić na prywatnym kodzie. Jeden szczegół dotyczący harnessu trzeba najpierw ustalić: model zwraca swój ślad rozumowania w przeplatanym reasoning_content/ field; klienci, którzy parsują ukończenia czatu bez oczekiwania tego, po cichu odrzucą tok myślenia i sprawią, że model będzie wyglądał gorzej, niż jest.

Argument dotyczący routingu, właściwy dla porównania przy tej samej cenie
Udostępniamy MiniMax M3 w cenie katalogowej MiniMax z zerową marżą. LongCat-2.5-Preview nie należy do naszych tras — nie obsługujemy go i nic tutaj nie powinno być odczytywane jako twierdzenie przeciwne.
Pojedynek przy tej samej cenie to dokładnie ten przypadek, w którym routing zarabia na siebie, a nie jest tylko udogodnieniem. Jeśli dwa modele kosztują tyle samo, decyzja między nimi zapada dla każdego żądania i każdego zadania: M3 ze względu na limit wyjścia wynoszący 512 000 tokenów i wejście wideo, LongCat-2.5-Preview ze względu na zniżkę za buforowany prefiks w długich pętlach agentowych, gdy już upewnisz się co do jego jakości. Fuzja modeli to mechanizm, który czyni to dosłownym — etap wyszukiwania i krok syntezy mogą być różnymi modelami w ramach jednego żądania, więc nie musisz wybierać zwycięzcy, zanim masz dowody. A ponieważ przekazujemy ceny katalogowe dostawców bez marży, zmiana stawek dostawcy pojawia się na twoim rachunku tego samego dnia, a nie przy kolejnym odnowieniu umowy, co ma większe znaczenie niż zwykle, gdy jedna z dwóch kart jest wyraźnie promocyjna. Z kolei automatyczny failover obejmuje przypadek, w którym jeden z dostawców ulega degradacji, i ma to największe znaczenie dla modelu, który nie ma historii obsługi, którą można sprawdzić.
Często zadawane
• Czy LongCat-2.5-Preview jest tańszy niż MiniMax M3? Nie. W opublikowanych cennikach stawki za dane wejściowe i wyjściowe są identyczne i wynoszą 0,30 USD oraz 1,20 USD za milion. Jedyna przewaga cenowa dotyczy buforowanych danych wejściowych: 0,006 USD wobec 0,06 USD, a Meituan określa cały swój cennik jako ograniczoną czasowo promocję, nie mówiąc, co będzie później.
• Który ma większą użyteczną wielkość wyjścia? MiniMax M3 zdecydowanie: 512 000 tokenów w porównaniu z 131 072. W przypadku generowania długich treści, ekstrakcji strukturalnej z dużych dokumentów lub czegokolwiek, co pisze więcej niż rozdział, ten pułap jest decydującym parametrem.
• Który z nich mogę zweryfikować? MiniMax M3, a weryfikacja nie wypada dla niego pochlebnie — Coding 58,6 na czterdziestym szóstym miejscu i Intelligence Index 29,2 na sześćdziesiątym miejscu według Artificial Analysis. LongCat-2.5-Preview nie ma żadnej opublikowanej oceny od nikogo. Jeśli w tym tygodniu pojawi się benchmark LongCat-2.5-Preview, traktuj go jako niezweryfikowalny, dopóki nie prześledzisz go do nazwanego ewaluatora.
• Który powinienem wdrożyć na produkcję? Żadnego bez własnego testu. Między tymi dwoma M3 jest wyborem o mniejszej wariancji, ponieważ jego słabości są udokumentowane, a jego modalności wejściowe są potwierdzone; LongCat-2.5-Preview jest tym o większej wariancji, z deklaracją większego kontekstu, znacznie mniejszym limitem wyjściowym, zniżką za cache i zerem publicznych dowodów. Uruchom go za darmo, póki okno jest otwarte, trzymaj oba za jednym kluczem i pozwól, by twoje własne liczby zdecydowały.
