North Small Translate 1.0 のヒーローカードは、モデル名と「Cohereの218B翻訳モデル。リリースノートでのみ文書化されている」という一文を見出しとし、その下に218B total / 25B active MoE、50言語、16K in / 16K outを列挙したカードを置き、横に「no launch post」とタグ付けされたドキュメントのモチーフを添えている。
Guides & Insights

North Small Translate 1.0:Cohereのこれまでで最も静かな大型モデル

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

North Small Translate 1.0は、CohereとCohere Labsによる2180億パラメータのMixture-of-Experts翻訳モデルであり、その登場の仕方は、フロンティア規模のリリースではごくまれなものでした。すなわち、リリースノートだけがあり、ほかには何もなかったのです。Cohereの変更履歴は発表日を2026年9月9日としていますが、3つのチェックポイントはすでに8月14日からHugging Face上でゲートの後ろに置かれていました。つまり、ブログ記事も報道もローンチスレッドもないまま、3週間半にわたって重みが存在していたのです。これを書いている時点で、メインリポジトリはいいね0、過去1か月のダウンロード数26、そして未回答のコミュニティディスカッションが1件だけでした。ベンダー報告のWMT26スコア83.60を持つ218Bモデルがほとんど誰にも気づかれていないのは説明に値します。そこで、ドキュメントとリポジトリが実際に何を確立しているのかを、そうでないものと分けて示します。

Cohereが自らの名を冠した数字

まず仕様から見ていきます。仕様は曖昧さがなく、今回のリリースで完全に知り得る部分だからです。North Small Translate 1.0 は、デコーダーのみのスパースな混合エキスパートモデルであり、2026年5月に Cohere が Command A+ で用いたものと同じ形をしています。エキスパートは128個で、トークンごとに8個が活性化され、さらにすべてのトークンで実行される共有エキスパートがあります。ルーターはエキスパートのロジットにシグモイド活性化を適用し、top-k 選択全体で正規化します。アテンションは、スライディングウィンドウ層(ウィンドウ4,096、RoPE)と、位置埋め込みを一切持たないグローバルアテンション層との間で、3:1の比率で交互に切り替わります。

パラメータ — 合計218B、トークンあたり25Bがアクティブ

コンテキスト — 16K入力と16K出力

言語 — 英語とその他49言語、合計50言語

最優先言語 — 現代標準アラビア語、ドイツ語、フランス語、日本語、韓国語、ロシア語、ウクライナ語

チェックポイント — BF16、FP8、NVFP4 W4A16

最小ハードウェア — BF16: 4×B200または8×H100、FP8: 2×B200または4×H100、W4A16: 1×B200または2×H100

ライセンス — CC BY-NC 4.0、商用利用はCohereのModel Vaultに誘導されます

報告された品質 — WMT26 83.60、エージェント型マルチパス翻訳ワークフローにより84.36に上昇

そのうち2つの行は、単なる箇条書き以上の扱いに値する。コンテキストウィンドウは16K出力であり、これは翻訳モデルとしては異例で、1つの段落を翻訳するのと、手順書全体を一度に翻訳するのとでは大きな違いを生む。そしてエージェント的な数値——84.36 対 83.60——は、Cohereがモデルではなくワークフローを説明しているものだ。複数回のパスがあり、おそらくエージェントが何を再翻訳するかを判断している。それはCohereが2025年8月にCommand A Translateで「Deep Translation」として売り出したのと同じ発想であり、ここではより大規模に再登場している。

Single-model scoreboard for North Small Translate 1.0 with six rows reading Total parameters 218B MoE, Active parameters 25B, Context 16K in / 16K out, Languages 50, License CC BY-NC 4.0, and WMT26 score 83.60 (unaudited), with a footer noting the figures come from Cohere's model card and release note and that the WMT26 metric is unnamed and not independently reproduced.

リポジトリが示していることのうち、リリースノートが示していないもの

リリースノートはマーケティング資料であり、リポジトリのほうはエンジニアリング資料だ。そして、そこに書かれた些細な点のいくつかは、見出しのスペックよりも重要である。サービングは vLLM と cohere_melody>=0.9.0 を通じてサポートされており、Cohere は「本番デプロイに合わせる」ことを理由に貪欲法(greedy decoding)を明示的に推奨している。サンプリングをオフにせよと指示してくる翻訳モデルは、創造的な文章ではなく決定性を目指した翻訳モデルである。出力は <|START_TEXT|><|END_TEXT|> のマーカーで囲まれ、パースには Cohere の melody ライブラリが想定されている。これらのマーカーは特殊トークンとして登録されていないため、skip_special_tokens=True を設定してもそれらは取り除かれない — 素朴な統合では目に見えるタグの残骸を生み出す小さな罠である。

また、モデルを「North Small Translate」という名前で提示し、Cohere によって構築されたと述べるデフォルトのシステム指示を含むチャットテンプレートもあります。会話ごとのシステムメッセージは 追加されます — そのデフォルトに、それを置き換えるのではなく、別の platform_instruction_override スロットがあります。それを置き換える必要がある場合に使います。これは、古典的なエンコーダー・デコーダーではなく、翻訳タスクをまとった事後学習済みチャットモデルであることを示す類の配管です。

コヒアの製品ラインにおける位置づけ

系譜は、このリリースを読むうえで最も有用な文脈であり、文書化されています。2025年8月28日に発表された Command A Translate は、Cohere 初の機械翻訳モデルでした——111B パラメータ、8K 入力と 8K 出力に分割された 16K ウィンドウ、23 言語、そして CC-BY-NC の研究用リリースです。North Small Translate 1.0 は、言語数を 50 へと 2 倍以上に増やし、アクティブパラメータ数を 25B へと 3 倍に増やし、総ウィンドウは 16K のままにしつつその全体を出力に使用できるようにし、単一の dense 寄りモデルを、Cohere が North ラインの他の場所ですでに使用しているのと同じフットプリントを持つ sparse MoE に置き換えます。

正直に読めば、これは新しいアーキテクチャではなく、Cohereの現行MoEコアを翻訳向けにポストトレーニングした専門特化型の派生モデルだ。モデルカードも一行でそう述べている——「翻訳品質に特化してポストトレーニングされた」——そして学習コーパス、トークン数、データパイプラインについては何も開示していない。Command A Translateの技術レポートでは、難易度によるフィルタリングを行うデータ手法が詳細に説明されていたが、このモデルについては同等のものは公開されていない。

Screenshot of Cohere's documentation page for North Small Translate showing the Capabilities panel (Multilingual), the Pricing panel stating the model is free for trial and production keys until rate limits are reached with commercial use via Model Vault, the Specifications panel listing Context Window 16K tokens, Max Output Tokens 16K tokens, Model Size 218B total / 25B active and Suggested Hardware 2 x H100 or 1 x B200, and the API Endpoints panel giving Model ID north-small-translate-1-0 on Chat V2.

何が本当に確認されていないのですか?

ここが、静かなリリースを慎重に扱わなければならないところです。というのも、ノイズがないことは諸刃の剣だからです。以下は、現在Cohereの外部では誰も知らない事柄です。

WMT26 83.60 が測定しているもの。 モデルカードにもリリースノートにも指標名は記載されておらず、このモデルに対する WMT26 の結果ページも公開されていません。指標名のない「83.60」は数字であり、結果ではありません。

スコアが再現されるかどうか。 独立した第三者グループがこのモデルを実行した例はありません。本記事の数値はすべてCohere自身によるものです。

エージェント型マルチパス・ワークフローとは実際に何なのか。84.36 という数値は、わずか一つの節で説明されているだけです。これはモデルカードに付随するシステムレベルの主張であり、そのシステムは明示されていません。

商用ライセンスの費用はいくらか。 Cohereは企業には営業部門とModel Vaultを案内している。ドキュメントページには価格が公開されていない。

ブログ記事が出るかどうか。 Cohereにはブログがあります。Command A Translateには記事が丸ごと出ました。このモデルにはリリースノートが出ました。

それらのどれも非難ではありません。それは、評価できるモデルと購入できる製品との違いであり、現時点で North Small Translate 1.0 はまさに前者です — それに加えて、無料で使えるものが一つあります。

無料プランは、今日実際に試せる部分です

純粋な重みの公開とは異なり、これには実際に稼働する接点があります。North Small Translate 1.0は、Chat V2 APIを通じてCohereの無料枠で提供されており、Cohereのリリースノートによれば、トライアルおよび本番キーの両方で、レート制限に達するまで無料です。これは異例なほど寛容な評価期間です — 実際のトラフィックを流すのに有償契約は必要ありません。一方、重みはHugging Face上のFP8セットで、CC BY-NC 4.0の下にあり、商用目的でのセルフホスティングはModel Vault契約なしではできません。

では、この判断の実用的な形はこうだ。API を通じて無料で評価し、実際にリリースすると決めた場合にのみ支払う。これは低リスクの試用であり、ルーティング層がまさにそのために作られている。すでに OrcaRouter 経由で翻訳を呼び出しているなら——200 を超えるモデルのカタログに 1 つのキーで、プロバイダーの定価をそのまま0% のマークアップで——評価すべき問いは「移行すべきか」ではなく「これは、自分のドキュメントで現在呼び出しているものより優れているか」であり、同じテキストを両方に通せば答えられる。値下げしたベンダーの変更は、当社側では当日に反映される。なぜなら、その上に再販業者のマージンが重なっていないからだ。そして、再現されていないベンチマークが 1 つだけで第三者評価もないモデルにとって、フェイルオーバーは、本番経路をそれに賭けることなく試せる仕組みだ。トラフィックはすでに機能しているモデルへ流れ続け、新しいモデルは実際の入力で評価される。

Screenshot of Cohere's Release Notes page showing the date badge September 9, 2026 above the heading "Announcing Cohere's North Small Translate", followed by the key features list (218 billion total parameters with 25 billion active, free-tier Chat V2 API, FP8 open weights under CC BY-NC 4.0, suggested hardware two H100s or one B200) and the technical details listing model name north-small-translate-1-0, context length 16K and FP8 open-weights format.

これをリリースノートからリリースに変えるには、何が必要だろうか

North Small Translate 1.0 をドキュメント上の項目から真の競合へと押し上げる3つの要素があり、その3つはいずれも外部から観察できる。第一に、WMT26 の数値に対する指標名の明示だ。指標が付いた 83.60 は比較できるが、付いていないものは比較できない。第二に、最初の独立した再現だ。それが WMT26 評価キャンペーン本体から来るものであれ、FP8 重みに対して FLORES 形式のテストを実行する第三者から来るものであれ。第三に、実際のローンチ投稿だ。これは、Cohere がこれを単に公開しただけでなく販売する意図があることを示すだろう。

それまでは、証拠が支持する姿勢こそが正しい。無料の評価経路、50言語、文書長の出力ウィンドウを備えた、真に興味深い218B MoE翻訳スペシャリストであり、その品質に関する主張はすべて開発元の言葉だけに依拠している。Cohereは13か月で翻訳対応モデルを4つ出荷し、そのうちブログ記事になったのは1つだけだ。この2つの事実のどちらがより情報量が多いのか——それこそ、じっくり考える価値のある問いである。