
North Small Translate 1.0: najcichszy jak dotąd duży model Cohere
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-10$0.15 / $0.60 za 1 mln tokenów
- openaiNOWOŚĆOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleNOWOŚĆGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenNOWOŚĆQwen: Qwen3.8 Max (0902)2026-09-0240Inteligencja72Kod
- anthropicNOWOŚĆAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligencja69Kod
North Small Translate 1.0 to 218-miliardowy model tłumaczeniowy typu mixture-of-experts od Cohere i Cohere Labs, który pojawił się tak, jak ukazuje się bardzo niewiele wydań na skalę frontier: z notatką o wydaniu i niczym więcej. Dziennik zmian Cohere datuje ogłoszenie na 9 września 2026 r., ale trzy checkpointy już od 14 sierpnia czekały na Hugging Face za bramką — trzy i pół tygodnia wag bez wpisu na blogu, bez relacji prasowych i bez wątku o premierze. W momencie pisania tego tekstu główne repozytorium miało zero polubień, 26 pobrań w ostatnim miesiącu i jedną nieodpowiedzianą dyskusję społeczności. Model 218B z raportowanym przez dostawcę wynikiem WMT26 na poziomie 83,60, którego prawie nikt nie zauważył, wart jest wyjaśnienia, więc oto, co dokumentacja i repozytorium faktycznie ustalają — w odróżnieniu od tego, czego nie ustalają.
Liczby, pod którymi podpisało się Cohere
Zacznij od specyfikacji, ponieważ są jednoznaczne i stanowią tę część tego wydania, która jest w pełni poznawalna. North Small Translate 1.0 to model typu decoder-only z rzadką mieszaniną ekspertów — o tym samym kształcie, którego Cohere użył dla Command A+ w maju 2026 — z 128 ekspertami, ośmioma aktywowanymi na token, oraz wspólnymi ekspertami uruchamianymi dla każdego tokenu. Router stosuje aktywację sigmoidalną do logitów ekspertów i normalizuje w ramach selekcji top-k. Uwaga występuje naprzemiennie w stosunku 3:1 między warstwami z przesuwnym oknem (okno 4096, RoPE) a globalnymi warstwami uwagi, które nie mają w ogóle żadnych embeddingów pozycyjnych.
• Parametry — łącznie 218B, 25B aktywnych na token
• Kontekst — 16K wejścia i 16K wyjścia
• Języki — angielski plus 49 innych, łącznie 50
• Języki pierwszego poziomu — współczesny standardowy arabski, niemiecki, francuski, japoński, koreański, rosyjski, ukraiński
• Punkty kontrolne — BF16, FP8 i NVFP4 W4A16
• Minimalny sprzęt — BF16: 4×B200 lub 8×H100; FP8: 2×B200 lub 4×H100; W4A16: 1×B200 lub 2×H100
• Licencja — CC BY-NC 4.0, a wykorzystanie komercyjne kierowane do Model Vault firmy Cohere
• Zgłaszana jakość — WMT26 83,60, rosnąca do 84,36 dzięki agentowemu, wieloprzebiegowemu workflowowi tłumaczeniowemu
Dwie z tych pozycji zasługują na więcej niż punkt na liście. Okno kontekstowe wynosi 16K na wyjściu, co jest nietypowe dla modelu tłumaczeniowego i stanowi różnicę między tłumaczeniem akapitu a tłumaczeniem całego dokumentu procedury w jednym przejściu. A wskaźnik agentowy — 84,36 wobec 83,60 — to nie model, lecz opis przepływu pracy od Cohere: wiele przejść, przypuszczalnie z agentem decydującym, co tłumaczyć ponownie. To ten sam pomysł, który Cohere sprzedawało jako „Deep Translation” z Command A Translate w sierpniu 2025 r., i powraca tutaj w większej skali.

Co pokazuje repozytorium, a czego nie pokazuje nota o wydaniu
Nota wydania jest dokumentem marketingowym; repozytorium jest dokumentem inżynieryjnym, a kilka szczegółów tam ma większe znaczenie niż specyfikacje z nagłówka. Obsługa jest wspierana przez vLLM z cohere_melody>=0.9.0, a Cohere zaleca dekodowanie zachłanne, wyraźnie „zgodne z wdrożeniem produkcyjnym” — model tłumaczeniowy, który mówi, żeby wyłączyć próbkowanie, jest modelem nastawionym na determinizm, a nie na twórcze pisanie. Dane wyjściowe są opakowane w znaczniki <|START_TEXT|> i <|END_TEXT|>, a parsowanie oczekuje melody od Cohere. Te znaczniki nie są zarejestrowane jako tokeny specjalne, więc ustawienie skip_special_tokens=True nie usunie ich — mała pułapka, która w naiwnej integracji spowoduje widoczne śmieci ze znaczników.
Istnieje również szablon czatu z domyślną instrukcją systemową, która przedstawia model pod nazwą „North Small Translate” i stwierdza, że został zbudowany przez Cohere. Komunikaty systemowe dla poszczególnych konwersacji są dołączane do tej domyślnej instrukcji, a nie zastępują jej — istnieje osobne pole platform_instruction_override, jeśli chcesz ją zastąpić. To rodzaj infrastruktury, który zdradza, że mamy do czynienia z modelem czatu po treningu dostosowującym, przebranym za zadanie tłumaczenia, a nie z klasycznym enkoderem-dekoderem.
Gdzie plasuje się w ofercie Cohere
Linia rozwojowa to najbardziej użyteczny kontekst do czytania tego wydania i jest udokumentowana. Command A Translate, ogłoszony 28 sierpnia 2025 r., był pierwszym modelem tłumaczenia maszynowego Cohere — 111 mld parametrów, okno 16K podzielone na 8K wejścia i 8K wyjścia, 23 języki oraz wydanie badawcze CC-BY-NC. North Small Translate 1.0 ponad dwukrotnie zwiększa liczbę języków do 50, potraja liczbę aktywnych parametrów do 25 mld, utrzymuje całkowite okno na poziomie 16K, ale pozwala wykorzystać całe okno na wyjście, i zamienia pojedynczy model w stylu gęstym na rzadki MoE o tym samym śladzie, jaki Cohere już stosuje gdzie indziej w linii North.
Uczciwa interpretacja jest taka, że to specjalistyczna pochodna obecnego rdzenia MoE Cohere, dotrenowana pod kątem tłumaczenia, a nie nowa architektura. Karta modelu mówi o tym wprost w jednym zdaniu — został „dotrenowany specjalnie pod kątem jakości tłumaczenia” — i nie ujawnia niczego na temat korpusu treningowego, liczby tokenów ani potoku danych. Raport techniczny Command A Translate szczegółowo opisywał technikę filtrowania danych pod kątem trudności; dla tego modelu nie opublikowano niczego równoważnego.

Co tak naprawdę nie zostało potwierdzone?
To jest miejsce, w którym cicha premiera musi być prowadzona ostrożnie, ponieważ brak szumu działa w obie strony. Poniżej znajdują się rzeczy, o których obecnie nikt poza Cohere nie wie:
• Co mierzy WMT26 83,60. Na karcie modelu ani w informacji o wydaniu nie podano nazwy żadnej metryki, a dla tego modelu nie opublikowano żadnej strony wyników WMT26. „83,60” bez nazwy metryki to liczba, a nie wynik.
• Czy wynik da się odtworzyć. Żadna niezależna grupa nie uruchomiła tego modelu. Wszystkie liczby w tym artykule pochodzą od samego Cohere.
• Czym właściwie jest agentowy wieloprzebiegowy workflow. Liczba 84,36 jest opisana w jednym zdaniu. To twierdzenie na poziomie systemu dołączone do karty modelu, a sam system nie został określony.
• Ile kosztuje licencja komercyjna. Cohere kieruje przedsiębiorstwa do działu sprzedaży i Model Vault. Na stronie dokumentacji nie podano ceny.
• Czy pojawi się wpis na blogu. Cohere ma bloga. Command A Translate dostał pełny wpis. Ten model dostał informację o wydaniu.
Nic z tego nie jest oskarżeniem. To różnica między modelem, który możesz ocenić, a produktem, który możesz kupić, a obecnie North Small Translate 1.0 jest dokładnie tym pierwszym — plus jedna rzecz, z której możesz korzystać za darmo.
Darmowy plan to część, którą możesz faktycznie przetestować już dziś
W przeciwieństwie do czystego udostępnienia wag, to wydanie ma działający interfejs: North Small Translate 1.0 jest dostępny w darmowym planie Cohere przez API Chat V2, a w informacji o wydaniu Cohere napisano, że jest darmowy zarówno dla kluczy próbnych, jak i produkcyjnych, dopóki nie zostaną osiągnięte limity szybkości. To wyjątkowo liberalne okno ewaluacyjne — nie potrzebujesz płatnej umowy, aby przepuścić przez nie prawdziwy ruch. Same wagi to z kolei zestaw FP8 na Hugging Face na licencji CC BY-NC 4.0, więc samodzielne hostowanie do celów komercyjnych nie wchodzi w grę bez umowy Model Vault.
Praktyczny kształt tej decyzji jest więc taki: oceń rozwiązanie przez API bez żadnych kosztów, a zapłać tylko wtedy, gdy zdecydujesz się je wdrożyć. To próba niskiego ryzyka i właśnie do czegoś takiego służy warstwa routingu. Jeśli już wywołujesz tłumaczenie przez OrcaRouter — jeden klucz do katalogu ponad 200 modeli, cena katalogowa dostawcy przekazywana przy 0% marży — pytanie podlegające ocenie nie brzmi „czy migrować”, lecz „czy to bije to, co już wywołuję na własnych dokumentach”, na co możesz odpowiedzieć, przepuszczając ten sam tekst przez jedne i drugie. Dostawca, który obniża cenę, to u nas zmiana wprowadzana na bieżąco tego samego dnia, bo nie nakłada się na to żadna marża pośrednika. A w przypadku modelu z pojedynczym niepowtórzonym benchmarkiem i bez oceny zewnętrznej failover to mechanizm, który pozwala go wypróbować bez stawiania na nim ścieżki produkcyjnej: twój ruch nadal płynie do modelu, który już działa, podczas gdy nowy jest oceniany na prawdziwych danych wejściowych.

Co sprawiłoby, że z notatki o wydaniu stałoby się to wydaniem?
Trzy rzeczy przeniosłyby North Small Translate 1.0 z wpisu w dokumentacji do rangi prawdziwego konkurenta, a wszystkie trzy można zaobserwować z zewnątrz. Po pierwsze, nazwana metryka dla wyniku WMT26 — 83,60 z przypisaną metryką można porównać, a bez metryki nie. Po drugie, pierwsza niezależna reprodukcja, niezależnie od tego, czy pochodzi z samej kampanii ewaluacyjnej WMT26, czy od strony trzeciej przeprowadzającej testy w stylu FLORES na wagach FP8. Po trzecie, faktyczny post premierowy, który sygnalizowałby, że Cohere zamierza to sprzedawać, a nie tylko to opublikować.
Do tego czasu właściwą postawą jest ta, którą uzasadniają dowody: naprawdę interesujący specjalista ds. tłumaczeń 218B MoE z bezpłatną ścieżką oceny, pięćdziesięcioma językami i oknem wyjściowym o długości dokumentu, którego twierdzenia o jakości opierają się wyłącznie na słowie jego producenta. Cohere wypuściło cztery modele zdolne do tłumaczenia w ciągu trzynastu miesięcy, a tylko jeden z nich doczekał się wpisu na blogu. Który z tych dwóch faktów jest bardziej pouczający — to pytanie, nad którym warto się zatrzymać.
