背の高い半透明の柱が、積み重なったトークンカードで満たされて淡い床に立っており、その基部を小さなシャチのシルエットが滑るように通り過ぎ、盾形のパネルが柱に寄りかかっている。
Guides & Insights

OrcaCyber Zero 1.0と15万ドルの準備金:OrcaRouterがOmacom Foundationの名誉企業パトロンに参画

著者

Alistair Wren

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

OrcaRouterは、15万ドル相当のトークンをOmacom Foundationの戦略的トークン準備金に寄付し、同財団にDistinguished Corporate Patronとして参画しました。この準備金はセキュリティ業務に充てられ、まずは同財団のセキュリティチームとカーネルチームに優先的に配分され、一般的な推論には充てられません。これらのチームが最初に活用するモデルは、脆弱性分析、再現、セキュリティ研究のためにポストトレーニングした当社のコーディングモデル、OrcaCyber Zero 1.0で、本日クローズドベータを開始しています。以上が発表内容で、このページの残りではその背景にある理由を説明します。

推論はトラフィックから始まった。この発表前の30日間で、私たちのモデルはHugging Faceで150万ダウンロードを突破し、ルーターを通過するものの形もそれに伴って変わった。

「この要約のための最安モデル」は、届く唯一の問いではなくなった。「ここにある何かが、このクラッシュやこのパッチ、このレポートを読んで、それが実際に何なのかを教えてくれるか」がよくある問いになった。ルーターは、その問いに答えるには不適切な場所であり、それに気づくには良い場所だ。だから、すでに安く、さらに安くなりつつある汎用推論を割り引くのではなく、誤った答えが最も高くつく作業の部分に私たちは対価を払っている。

OrcaRouterが加わったもの、そしてトークンがどこへ行くのか

Distinguished Corporate Patronは、Omacom Foundationの法人向けティアです。パトロネージはサブスクリプションではなく1回の寄付で、その寄付はStrategic Token Reservesに支払われる15万ドル相当のトークンです。Strategic Token Reservesは、Foundation自身のチームが自らの業務のために引き出す単一のプールです。

金額より行き先のほうが重要です。リザーブはクーポンではなく、無料枠や割引コードとして提供されるものでもありません。トークンは、Foundationのエンジニアが実際のタスクをOrcaRouterを通して実行したときに消費されます。それは他のすべてのユーザーが触れるのと同じルーティングレイヤーです。私たちは、際限のないチャットのための資金を引き受けるよりも、特定のエンジニアリング上の問い(このバグは再現するか、このパッチは持ちこたえるか)の背後にあるコンピュートに資金を出したいと考えています。

なぜ寄付は一般的な推論ではなくセキュリティ業務に向けられているのか

汎用推論は、この市場においてすでに解決済みの半分である。有能な汎用モデルは安価に入手でき、そこへのルーティングはほぼコモディティ化している。そして、汎用キャパシティに追加で15万ドルを投じても、チームがすでに得られている以上のものを得られることはほとんどない。そこでの限界トークンの価値は、おおよそそのコストに見合う程度のものである。

セキュリティの仕事は、費用を負担する者にとって重要な3つの点で、異なる振る舞いをする。

• タスクは長い。レポートを読み、再現コードを組み立て、修正を確認するのは単一ターンで完結する作業ではなく、要約とは違ってトークンを消費する。

• それらをうまくこなすモデルは、汎用型ではなく特化型である。

• その作業には検証可能な答えがある。脆弱性は再現するか、しないかのどちらかである。

その最後の特性こそが、その支出を正当化可能にするものです。私たちはセキュリティに関する意見に資金を提供しているのではありません。カーネルチームが目を通し、受け入れるか却下するかを判断できる何かに行き着く試みに資金を提供しているのです。

OrcaCyber Zero 1.0 は何をするためにトレーニングされましたか?

3つの職務、いずれもセキュリティ関連の職務です。脆弱性分析、脆弱性の再現、そしてセキュリティリサーチ。

分析とは読解のタスクだ。報告書、diff、あるいはコンポーネントが与えられたとき、欠陥が何であり、それがどこに潜んでいるのかを見極める。再現とは構築のタスクであり、厳格なシステムプロンプトを添えただけの汎用コーディングモデルとセキュリティモデルを分かつものである。すなわち、その条件を実際に引き起こす入力を生み出すことであって、条件の説明ではない。セキュリティリサーチは自由裁量に委ねられた部分であり、誰かが整ったチケットを渡してくれるわけではなく、まず標的を見つけ出さなければならない。

私たちが得た測定結果は、再現作業をカバーしています。188のオープンソースプロジェクトから抽出されたベンチマークであるCyberGym Level 1では、OrcaCyber Zero 1.0が1,507件の実世界の脆弱性のうち1,478件を初回試行で再現しており、合格率は98.07%です。初回試行という数字は、二度読むべきものです。この測定には二度目の試行はなく、リリースウィンドウにもありません。モデルとは何か、カタログ内でどこに位置するかは、OrcaCyber Zero 1.0ページに記載されています。

A scoreboard graphic labelled CyberGym Level 1, showing the fraction 1,478 / 1,507 beside a circular gauge reading 98.07%.A screenshot of the OrcaCyber Zero 1.0 model page showing the model name at the top and the opening description of what the model is trained for.

境界が実際どこにあるのか:モデルが行う呼び出し

Zero 1.0はコードの欠陥を読み取り、再現する。それは、ほとんどのチームが今その周りに構築している層については何も語らない。モデルにツールが渡された瞬間、興味深い失敗はテキストではなくなり、呼び出しになる。どのツールを選ぶのか、どんな引数を渡すのか、返ってきた結果が次に行うことを変えることを許されるのか。Cをうまく読めるモデルは、エージェントが誤った引数で誤ったエンドポイントを呼び出すよう説得され得るパイプラインを守らない。

それがここでのセキュリティ作業の後半部分であり、私たちのカタログにおける「セキュリティ」という言葉が脆弱性リサーチで始まり、そこで終わるわけではない理由でもあります。内部システムに対してエージェントを動かすチームは、呼び出しレイヤーを攻撃対象領域として扱わなければなりません。それが、ツール呼び出しとMCP呼び出しのためのエージェントファイアウォールが解決するために存在する問題です。カーネルの作業とセキュリティの作業はこの両方の半面を捉えており、リザーブはその両方をカバーしています。

A screenshot of the agent firewall page on orcarouter.ai, showing the page title and the opening paragraph about protecting tool and MCP calls.

クローズドベータは、アクセスを希望するチームにとって何を意味しますか?

アクセスはユースケースごとに許可されるものであり、全員に対して有効化されるわけではない。OrcaCyber Zero 1.0 はクローズドベータで、その範囲は意図的に狭く設定されている。信頼されたセキュリティ研究、脆弱性の分析と再現、そしてレッドチームのワークフローだ。「クローズド」が鍵となる言葉であり、アクセスは一般的なモデルトラフィックではなく、そうした作業に範囲が限定されている。

実際には、最も早く進むリクエストは、対象が添えられているものです。あなたが保守しているコンポーネント、追っている脆弱性の種類、今四半期に実施しているエンゲージメントなどです。参加したいなら、モデルを何に向けるつもりかを示してください。一般的なチャットのリクエストが、実際のテストケースを持つセキュリティチームより先に列に並ぶことはありませんし、そうあるべきでもありません。ベータ版は評価が持ちこたえるにつれて広がります。返ってくるものを判断できる以上に早く開放することはありません。

リザーブがどのように使われるか

リザーブ内のトークンは単一のモデルに割り当てられるわけではなく、その仕組みは寄付の形を説明するものなので、一段落を割く価値がある。リクエストはルーターに到着し、アダプティブ・ルーティングが各リクエストの行き先を決定する。実際には、この振り分けは次のようになる。

• パッチレビュー、クラッシュトリアージ、再現の試み — どこへ向かうのか セキュリティ向けに調整されたルート:OrcaCyber Zero 1.0 vs なぜなら、それは長く、専門的で、答えは検証可能だからです

• リリースノート、変更履歴の要約、テスト名、スクリプトのdocstring — 使う場面 GLM 5.3 Flashのような汎用モデル vs 理由 コストが低く、その作業により適しているから

これが、寄付が単一モデルの無料枠ではなくトークンである理由です。The Foundationのチームは他の全員と同じルーティング判断を受けますが、タスクがそれを要するときにはセキュリティルートを利用でき、要しないときにはその分を課金されません。このように使われるリザーブは、単一モデルに使われるリザーブよりも長持ちし、モデルの選択を、そのタスクをよく知る人に委ねます。

要点

セキュリティの仕事こそ、この資金の正しい使い道であり、その理由は感傷ではない。汎用的な推論は価格が下落し続けるコモディティであり、脆弱性の再現は検証可能な答えがあり、試行あたりのコストが高いタスクである。そして、寄付されたトークンが測定可能な仕事をするのはそこなのだ。カーネルチームはモデルの物言いなど気にしない。気にするのは、再現プログラムが動くかどうかである。

すでに当社を経由してルーティングしている場合、今週あなたのトラフィックに変わる点はありません。変わるのは私たちの側です。私たちがこれまでに作った中で最も重大なものだと考えているモデルに、今、初めての要求の厳しいユーザーがつきました。難しい問題を抱え、もっともらしく聞こえる間違った答えに我慢できないユーザーです。それはどんなローンチ記事よりも優れたテストであり、私たちはむしろそれで評価されたいと考えています。

出典に関する注記:ベンダー報告の数値は、Omacom FoundationのStrategic Token Reservesへの$150,000のトークン寄付、そのリザーブが対象とする範囲、およびOrcaCyber Zero 1.0のクローズドベータ状況とアクセス条件です。当社独自の測定は、188のオープンソースプロジェクトから抽出されたベンチマーク上で当社自身が実施したCyberGym Level 1の結果であり、1,507件の初回試行再現のうち1,478件、合格率98.07%です。プラットフォーム報告は、この発表前の30日間におけるHugging Face上の当社モデルの150万ダウンロードであり、プラットフォーム自身のカウンターから取得したものです。ここでは数値について第三者を引用しておらず、また外部関係者が発見の功績を認められることもありません。2026-09-19に公開、数値は同日に当社自身の記録と照合済み。