「Space Bunny — リファレンスページ」というタイトルの生成ヒーローカードで、サブタイトルは「1つのモデル、2つの名前: space-bunny と space-bunny-alpha」。左側の「Envelope」という見出しのカードには、コンテキスト: 1,000,000 トークン、最大出力: 524,288 トークン、入力: テキスト、画像、動画が並んでいる。右側の「Rate card」という見出しのカードには、「$0 in / $0 out per 1M」という大きな行と、その下に「運営者: 非公開。掲載メタデータ、未監査。」という行が表示されている。下部の帯には「同じモデル — 素の名前は短縮形」と書かれている。OrcaRouter のロゴは右下にある。
Guides & Insights

Space Bunny:ステルスモデルのリファレンスページ(Space Bunny Alphaとしても記載)

著者

Elias Hawthorne

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Space Bunny と Space Bunny Alpha は同じモデルです。まずそこを確定させてください。というのも、この2つの名前は異なる方向へ引っ張り合うからです。素の名前はほとんどの人が入力するもので、バージョン付きの名前はあらゆるリスティングとあらゆる記事が使うものです。2つ目の Space Bunny は存在しません — より小さな兄弟も、Alpha が取って代わる以前のリリースもありません。素の名前は短縮形であり、Alphaは、運営者が名前を明かさない間、この匿名リスティング群が帯びるプレビュー段階のマーカーです。Space Bunny はサードパーティのプラットフォーム上で提供されるステルスプレビューです。100万トークンのコンテキスト、524,288トークンの出力上限、テキスト・画像・動画の入力、そして100万トークンあたりゼロドルという表示価格を備え、プロバイダの素性は非開示です。このページはそのためのリファレンスです — モデル自身の名前で検索した人の到達点であり、それが存在するという2つ目の告知ではありません。

これから続く内容の読み方について、2点ある。エンベロープ見出しの下にあるものはすべて、運営者提供のリスティングメタデータだ。つまり、匿名プロバイダー自身の数値であり、プレビューをホストしているプラットフォーム上で公開され、本日2026年9月28日に再確認したものである。それらは独立に検証されたものではなく、数値が登場する箇所では改めてそう述べる。ベンチマークのセクションは別であり、全体を通じて第三者からの情報源に基づいている。もう一つの注記は、このページがそもそもなぜ存在するかについてだ。リスティングの日付は2026年9月23日、5日前なので、鮮度の問題を巡って言い訳する余地はない——しかし、ここでの根拠はその日付ではない。それは私たち自身が測定したファーストパーティの検索需要だ。9月25日までの28日間で、クエリ「space bunny」に対して1,668インプレッション、238クリック、掲載順位4.8だった。これは人々が何を入力するかについての事実であり、モデルについてのものではない。読者はすでに、私たちがたまたま上位表示していたページへクリックして遷移していた。ただ、そのモデル自体について読者がたどり着けるページが存在しなかっただけだ。その隙間を埋めることこそ、この記事が立脚する条項だ——2026年9月28日に測定された恒常的な需要であり、リスティング日は報告すべき出来事としてではなく、モデルの日付を特定するために用いられる。

名前は、きちんと定まった。

「同一モデル」の根拠は不在であることなので、何を確認したのかを正確に述べておく価値がある。プレビューをホストしているプラットフォームは、このファミリーについて識別子 stealth/space-bunny-alpha/ と表示名「Space Bunny Alpha」の下にちょうど1件だけ登録しており、その隣に素の space-bunny/ という項目は存在しない。モデル自身のフィールドガイド——プラットフォームや開発者とは提携していないと明言している第三者サイト——は、これを「Space Bunny Alpha、space-bunny-alpha とも表記」と紹介し、その掲載日を2026年9月23日としている。このシリーズのコンパニオンリポジトリをホストする Hugging Face の組織は、alpha にちなんで名付けられた bunny リポジトリを1つ保有している。素の「Space Bunny」を別個のモデルとして探しても、同じモデルが短い名前で現れるだけである。

実用上は、この2つの文字列を別名として扱ってください。「Space Bunny」が主となる用語で、クリック時の挙動がより良い方です。space-bunny-alpha/ は、リクエストに記述する識別子です。名前だけが含意しない唯一のものはバージョンです — 文書化された 1.0 はなく、より小さい派生版も、プレビュー以外のリリースもありません。そうでないと示唆するリスティングや投稿は、記録が示していないファミリーをでっち上げているのです。

この接尾辞は実際に意味のある情報を伝えている。モデルはプレビュー段階にあり、その間は名前を明かさないことを選んだプロバイダーによって運用されており、プラットフォームのステルス通知には、プロンプトと出力はそのプロバイダーによって保持され得るがトレーニングには使用されない、と記されている。この条項は注意深く読んでほしい。これは保持に関する表明であって、ゼロ保持の表明ではないからだ。このリスティングに関する当社のローンチ前報道——Space Bunny Alphaリークページ——を読んだことがあるなら、あのページの役割は果たされたことになる。あのページが予想していたものは、いまや単にこのモデルの状態であり、現在の争点はアイデンティティから提供の枠組み、コスト、スループットへと移っている。

リスティングに記載されているとおりの封筒

本日、公開中のリスティング上で再読。オペレーター提供、未再現。

• コンテキストウィンドウ — 1,000,000トークン。このシリーズのこれまでの匿名プレビューと同じ1Mクラス。

• 最大出力 — 524,288トークン。コンテキストウィンドウの半分にあたり、これはどのような価格であっても極めて大きな上限であり、しかもその遠い極端における一貫性を第三者がストレステストしたことのない上限である。

• 入力と出力 — テキスト、画像、動画を入力とし、テキストを出力する。動画入力こそが、この世代の匿名リストを通常のマルチモーダルリリースから最も際立たせる細部である。

• Reasoning — 必須で、オフにすることはできません。5 段階のエフォートレベル(low、medium、high、xhigh、max)があります。本日のライブリスティングでは、プロバイダーのデフォルトが max と表示されており、サードパーティのフィールドガイドも独立して同じデフォルトを記録しています。API 経由で reasoning テキストを非表示にしても計算は無効にならず、引き続き出力バジェットを消費します。

• ツール使用と構造化出力 — tools/ と tool_choice/ が受け入れられるため、関数呼び出しを利用できます。response_format/ は JSON 出力を生成しますが、JSON スキーマによる強制は行いません。これは、この一連のプレビューがこれまでずっと抱えてきたのと同じ注意点です。パイプラインで検証済みのオブジェクトを返す必要がある場合は、ご自身で検証してください。

• 非開示 — プロバイダー名、パラメータ数、アクティブパラメータ、アーキテクチャ、トークナイザーファミリー(「その他」としてのみ記載)、知識カットオフ、量子化、ライセンス、およびリリース可能な重みがそもそも存在するかどうか。コンパニオンリポジトリには、GGUFファイルは「モデルの重みが利用可能になり次第」登場すると書かれている — これは将来のファイルに関する約束であり、現在重みが存在する証拠ではない。

• 稼働中だが、際立って情報が薄い — この掲載情報にはスループット値もレイテンシ値も公表されていない。両フィールドとも空である。単一のサービングプロバイダーを報告しており、ステルスとタグ付けされ、量子化は不明である。

最後の箇条書きこそが、「どれくらい速いのか」に対する正直な答えだ。数値を公表した人の誰もそのエンドポイントを所有しておらず、そのエンドポイントの運営者は何も公表していない。それはこのモデルを避ける理由にはならない。説明の中の形容詞を信じるのではなく、最初の呼び出しで測定する理由なのだ。

A generated single-column scoreboard titled 'Space Bunny — the scoreboard' with six rows: Context window 1,000,000 tokens, Max output 524,288 tokens, Modalities text + image + video in text out, Reasoning mandatory low to max default max, Listed price $0 in / $0 out per 1M, and Independent score: no leaderboard entry. A footer reads 'Envelope and price are operator-supplied listing metadata, unaudited; there is no independent evaluation on a public leaderboard.' The OrcaRouter logo sits bottom-right.

料金表:ゼロ、そしてここでゼロが意味するもの

掲載ページでは、このモデルの価格が入力100万トークンあたり$0、出力100万トークンあたり$0とされている——オペレーター自身の掲載ページを本日確認した限りでは、無料プレビューだ。1リクエストあたりの上限も、レート制限ポリシーも、その項目には公開されていない。

二つの留保があります。第一に、それは本日時点で運営者が提示している価格であり、確約ではありません。ステルスプレビュー価格はリスティングの属性であり、リスティングは予告なく変更されます。第二に、このシリーズでは、$0のプレビューは歴史的に恒久的な階層というより評価用の手段でした——プレビューが終了すると、無料期間は閉じてきました。ゼロドル料金を前提に構築する人は、その数値を恒久的なものではなく現時点のものとして扱うべきであり、必要になる前に、100万あたりのフォールバック費用がいくらになるかを知っておくべきです。

エンドポイントサーフェス

呼び出し元が実際に取得するものは、散文によるドキュメントではなく、リスティングのサポート対象パラメータセットから取得されます。

• チャット補完 — messages/(任意でstream)/、つまり通常のストリーミング生成です。

• サンプリングと制限 — max_tokens、temperature、top_p。推論トークンはmax_tokensの予算から消費されるため、上限を厳しくすると、出力が打ち切られるより先に思考が打ち切られます。

• 推論コントロール — reasoning/ と reasoning_effort/ は5段階のラダー全体にわたり、さらに include_reasoning/ で推論テキストを表示または非表示にします。

• 構造とツール — tools/, tool_choice/(auto はサポートされていますが、特定の関数の強制はサポートされていません)、および response_format/ はスキーマ検証なしの JSON 用です。

それがサーフェスのすべてです。別個のビジョンエンドポイントも、バッチ処理 API も、ファインチューニングの経路も、埋め込みもありません。マルチモーダル入力は同じチャット呼び出しを通じて入り、これは便利であると同時に、大きな動画の添付ファイルが会話内のほかのすべてと同じコンテキスト予算を奪い合うことを意味します。

サードパーティが実際に測定したものは何ですか?

ここでほとんどの検索結果は慎重さを失う。だからまず出典から。クロスモデル比較で通常引用する独立系リーダーボード、Artificial Analysis には、Space Bunny がどちらの名称でも登録されていない — 本日、直接リクエストして確認済み。実在する2件の第三者測定は種類が異なり、どちらも、隣にプロットされているモデルと同一のハーネスで比較されたものではない。

まず1つ目はAI BENCHYで、モデルごとの実行結果を公開している第三者ベンチマークサイトです。Space Bunny Alphaの項目には、high reasoningで10点中7.0、試行合格率62.1%、信頼性10.0、平均応答時間27.38秒、記録コスト$0.000が記されており、そのサイト独自の表では161位に位置づけられています。カテゴリー別では、最も強い結果はデータ抽出とツール呼び出しで、どちらも10点中10.0、最も弱いのはトリビアが3.0、一般知能が4.2です。これらはそのサイトが独自のスイートで出した数値です。読む価値があるのは合格率とカテゴリーのばらつきであり、グローバル順位ではありません。それは他者の順序づけにおける位置にすぎません。

第二のものはモデル自身のフィールドガイドであり、自らの評価結果を公表している。60問のGPQA Diamondサブセットで82.0%、MMLU-Proで75%、Humanity's Last Examの300問サブセットで46.1%、95%信頼区間はおよそ40.4~51.8%である。サイトは、これらが自社独自のサブセット実行であること、そしてその横に並べて示されているモデルは各ベンダーが公表した参考結果であることを明言している——問題数も、ハーネスも、設定も異なる。この但し書きこそが重要な部分であり、こっそり落としてよいものではない。これらの列は直接対決ではなく、Space Bunnyを、隣にプロットされているどのモデルと比べても、労力とハーネスを揃えた比較を行った者は誰もいない。これらの数値をランキングとして提示するページは、情報源自身がやらなかったことをしていることになる。

さらに2つのサードパーティ製の結果は、ベンチマークが見落としている事柄を検証しているという点で、手に入れる価値がある。フィールドガイドは、約20万トークンの単一入力の中に隠された3つの異なるコードが、1回の試行ですべて正しい順序で返されたというロングコンテキストの検証を報告している。これは能力スコアではなく容量のテストであり、100万トークンのコンテキストウィンドウが誘うものの、ほとんど実施されることのない種類の検証だ。また同じベンチマーク上で、Space Bunnyが305,989出力トークンを消費したのに対し、Qwen3.8 Flashは913,989だったというトークン効率の比較も報告している。約3分の2の削減であり、無料枠が閉じた後には、聞こえ以上に重要な意味を持つ。

全体像の中で最も明確な単一の事実は、空白である。Artificial Analysisの項目はなく、アリーナ評価もなく、第三者によって再現されたベンチマークもない。1つのスイートによる7.0/10と、自己公表されたサブセットによる46.1%が1つずつあるだけで、どこにも再現はなく、これは判定ではなく出発点だ。

A generated single-column card titled 'Space Bunny — measured by third parties' with five rows: AI BENCHY (its own suite) 7.0 / 10 at high reasoning, AI BENCHY attempt pass rate 62.1%, Field guide GPQA Diamond subset 82.0% on 60 questions, Field guide MMLU-Pro 75%, Field guide HLE subset 46.1% on 300 questions. Below the rows a bordered strip reads 'No Artificial Analysis entry. No matched-harness comparison against any model shown.' A footer reads 'Third-party figures from AI BENCHY and the model's own field guide; different suites, no replication.' The OrcaRouter logo sits bottom-right.

その背後にいるのは誰か

非開示であり、掲載情報自体がそう明記している。モデルはプレビュー期間中に匿名を選択した第三者プロバイダーによって開発・運用されており、掲載情報をホストするプラットフォームは、自らが開発者、所有者、またはプロバイダーではないと述べている。付随するリポジトリには、ラボ名もライセンスも重みも記載されていない。

公開の推測議論が活発に行われている——プロンプト形式の再構築、トークナイザー系列の探索、サンプル比較——だが、そのどれも確認された正体を生み出してはいない。私たちが仮説を繰り返さないのは、このファミリーの以前の項目が匿名だったときにそうしなかったのと同じ理由からだ。共有されたベンチマークスコアや一致するトークン数は類似性であり、同定ではない。そして、発見の装いをしたコミュニティの推測は、読者にとって正直な空白よりも悪い。記録が実際に示しているのは、このシリーズのこれまでの匿名プレビューはすべて、最終的には名の知られたラボによって我がものと主張されてきたということだ。たいていは数日から数週間のうちに、しばしば価格変更を伴って。それはこうしたプレビューがどう終わるかについての基準率であって、今回のものについての予測ではない——そしてそれが、今日の封筒を仕様ではなくスナップショットとして扱うべき理由である。

未知のモデルを、それに道を賭けることなく評価する

非公開の運営者であっても、モデルのテストを妨げることはない。変わるのは、あなたが答えられる質問だ。その掲載情報自体から、三つのことが導かれる。

• 尊重すべきは保持条項だ。プロンプトと補完結果は、名前も明かさないプロバイダーによって保持され得る。公開ベンチマーク、オープンソースコード、使い捨てのプロトタイプなら問題ない。だが顧客データ、独自ソース、コンプライアンス規制下にあるものは問題外であり、無料という価格がその計算を変えることはない。

• 能力に関するあらゆる主張は、自分自身の数値を得るまでは仮説として扱え。スループット、初回トークン遅延、長い出力の一貫性は、このモデルについて誰も公表していない3つの数値であり、同時に、あるワークロードに適合するかどうかを決める3つの数値でもある。計測には午後を1回使うだけで済む。

• それを経路内で唯一のモデルにしないでください。名前も、ステータスページも、エスカレーション経路もないプロバイダーは、その障害を追跡できないプロバイダーです。

その最後のルールこそ、ルーターがその存在価値を発揮する場面であり、私たちが直接お話しできる部分です。OrcaRouterは単一のAPIで200以上のモデルを、プロバイダーの定価にマークアップなしで提供します — プロバイダー自身が公表する料金をそのまま支払うため、ベンダーの値下げは当日中に当社側でも反映されます — さらにプロバイダー間の自動フェイルオーバーと、実験的なモデルの背後にフォールバックとして実績のあるモデルを宣言できるルーティングDSLを備えています。可用性の質問について、寛大にではなく正確に言えば、Space Bunnyは現在当社のカタログにありません。当社のモデルAPIはどちらの名前でもそのようなルートを返しません。したがって、当社はこのモデルを呼び出す手段ではなく、このページはそれへのルートではありません。私たちが提供するのは、判断を下す間、計測済みのモデルを未計測のモデルの背後に置く手段です — これが、誰も名前を挙げられない事業者による無料プレビューに対する唯一の賢明な姿勢です。

このページを変えるとしたら何ですか

4つのこと、それが届く可能性の高い順に。名前の明かされたオーナー、このシリーズではライセンス、パラメータ数、価格を伴ってきた。セカンドパーティによるベンチマークの再現、これは単一のスイートに縛られない最初の品質証拠となるだろう。公開されたスループットとレイテンシ、購入者が最も埋めてもらいたいと望む2つの空欄。そして料金表の変更、現在のモデルにとって最も決定的な唯一の特性。

それまでは、正直な要約は短い。Space Bunnyは、運営元非公開の、無料で100万トークン対応、動画対応の推論プレビューだ。第三者による7.0/10の実行結果が1件、自己公表のサブセット評価が1セット、独立したリーダーボードへの掲載はなく、スループットの数値もまったくない。その素の名前とアルファ名は同じモデルだ。それ以外はすべて、リスティングの日付入りスナップショットであり、どのスナップショットが最新かを確認する場所がこのページだ。

A generated two-column infographic titled 'Space Bunny — documented vs not documented'. The left card, headed 'Documented on the listing', lists Context 1,000,000 tokens, Max output 524,288 tokens, Inputs text image video, Reasoning mandatory five effort levels, Tools and JSON output accepted, Price $0 per 1M in and out. The right card, headed 'Not documented', lists Provider undisclosed, Parameter count none, Tokenizer filed as Other, Throughput no figure published, Latency no figure published, Weights not available. A footer reads 'Left column is operator-supplied listing metadata, unaudited, read 2026-09-28.' The OrcaRouter logo sits bottom-right.