
OpenAIの第2のループモデル:DevDayの「禁断の軸」リークが実際に主張していること
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 177 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1323 tok/s
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
この記事が扱う主張の出典はただ一つ、X上の単一の投稿だけだ。9月24日、アカウント@scaling01は、ベンダーが「水門を開き、DevDayでGPT-6 Astraに続く2つ目のループ型言語モデルを公開する」と書き、リカレント深度を「禁じられた軸」と表現し、それが「もはや禁じられていない」と指摘した。話はそれだけだ——モデル名も、モデルIDも、価格も、サンフランシスコでの9月29日のDevDay基調講演以外の日付もなく、ベンダーからの発言も一切ない。この主張が読者の時間を割く価値があるのは、ツイートのためではなく、その下にある出荷済みの事実のためだ。GPT-6 Astraは、ベンダーが9月3日にリリースしたもので、報道がループ型のリカレント深度アーキテクチャと結びつけた、主要ラボ発の初の製品モデルである。GPT-6 SolとGPT-6 Lunaは9月22日に、100万トークンあたり入力2ドル/出力10ドル、入力0.10ドル/出力0.50ドルで出荷され、そのフラッグシップを価格の階段に変えた。2つ目のループ型モデルとなれば、ベンダーはリカレント深度を一度きりの賭けではなく常設のアーキテクチャとして扱っていることになる——単一のリリースよりも大きな主張であり、はるかに検証が難しいものだ。
これは現時点で判明していることをまとめた記事です。投稿者や匿名の報道に帰属する情報はすべてその旨を明記しており、ここに記された内容は公式発表として受け取るべきものではありません。
なぜ「禁断の軸」という表現がそのツイートで最も興味深い部分なのか
この言い回しは投稿者自身のもので、専門用語ではないが、現実の何かを指している。トランスフォーマーのスケーリングには3つの明白な軸がある。パラメータ、データ、学習計算量だ。再帰による深さは4つ目で、これは奇妙な軸である。N個の別個のブロックを積み重ねる代わりに、ループ型モデルは同じ小さなブロックのスタックをR回再利用する。そのため実効的な深さはおよそ層数×ループ回数になる一方、パラメータ数は一定のままにとどまる。Google DeepMindは次の論文でその理論を提示した:潜在思考による推論:ループ型トランスフォーマーの力について、そして広く引用される潜在推論によるテスト時計算のスケーリング:再帰的深さアプローチが実用性を主張した。
それはただで手に入る深さではない。ループ型言語モデルにおける等深さスケーリングの研究では、再帰等価指数がおよそ0.46とされている。つまり、ループを1回余分に回すと、本物の新しいブロックを1つ追加した場合に得られたはずの約46%分が手に入るということだ。あなたは深さを割引で買っており、その代価をメモリではなく逐次計算で払っている。メモリ律速である場合や、小さいモデルを大きいモデルのように振る舞わせたい場合、これは有利な取引だ。そしてそれは、どのファミリーの安価なティアもまさに求めている取引である。
では、なぜ「禁じられている」のか。ループの内側で行われる計算は、出力されるトークンではなく隠れ状態の中で起きるからだ。思考の連鎖(chain-of-thought)モニタリング——モデルが考えている間に書き出す内容を読むこと——は、推論モデルが登場して以来、業界における主要な保証手段であり、7月のHugging Faceエージェント事件を調査担当者にとってそもそも読み解けるものにしたのは、まさにこの手段だった。作業のより多くを潜在空間で行うモデルは、その手段に読ませるものを減らしてしまう。これがフロンティアでループを用いることに対する2年来の反論であり、この手法がオープンウェイトで広まった理由でもある——ByteDance SeedのOuro(1.4Bと2.6B)、そしてNanbeige4.2-3Bは22層のスタックを2回通し——一方で、安全性への公約を公表しているラボはこれを避けてきた。AlibabaのMeSHとSpiralFormerの論文は、同じ問題に効率の側から挑んだ。
OpenAIが実際に述べたこと、そして述べていないこと
この議論の発端となった報道はThe Informationの9月1日と2日の記事だ。Astraがrecurrent depth(別名opaque recurrence)と呼ばれる技術を使っているという内容である。同誌は情報源が確かで実績もある媒体だが、それでも公式文書ではなく報道であることに変わりはない。OpenAIはループ型設計を裏付けるアーキテクチャ論文を一度も発表しておらず、Sebastian Raschkaの広く読まれたAstraの解説も、ループ構造は公開された発言から推測されたものだと明言している。彼の再構成では、Astraは22ブロックを2回実行して実質44ブロック適用となり、2ループが最適で、それ以上では学習が不安定になるという。
OpenAI自身の関係者が語ったことは、報道や反発が示唆していたよりも限定的で慎重なものだった。主任科学者のヤクブ・パチョツキは9月2日、Astraを含むフロンティアモデルの計算グラフの深さはGPT-4の2倍以内に収まっている——一部の見出しが示唆したような極端な再帰ではなく、限られた量のループである——と投稿し、自ら「混乱した報道」と呼ぶものに反論する一方、思考連鎖(chain-of-thought)の監視が脆弱で悪い方向に向かっていることも認めた。Astraのシステムカードには、推論トレースの監視可能性がGPT-5.6 Solより一段下がっていると記されていると報じられており、これは紛れもない認めであり、どのアーキテクチャが原因だったかには依存しない。
安全性をめぐる反応は大きかった。Redwood ResearchのBuck Shlegerisは、非常に懸念していると述べ、再帰を大規模化すると「CoTの監視可能性を完全に破壊しかねない」と警告した。Ryan GreenblattとZvi Mowshowitzも、異なる語調で同じ主張を展開した。最も有用な反論はRaschkaから出た。OpenAIはo1世代以降、アーキテクチャにかかわらず生の推論トレースを公開してこなかったし、より強いモデルがより短い思考連鎖を出力することは、それ自体では隠れた推論チャネルの証拠にはならない。
その2つの段落を合わせると、あのツイートが賭けている情勢が見えてくる。「Astraはループ済み」は、OpenAIが確認を拒んでいる信頼できる報道だ。「2つ目のループモデルが9月29日に出荷される」は、1件の投稿にすぎない。
9月のOpenAIリーク5件、そしてこれがどこに位置するか
9月にはOpenAIに関するリーク報道が密集して現れたが、それらについて有益なのは、すべてが同じ種類の証拠というわけではないという点だ。
• 9月3日 — 文字列 gpt-6-astra と gpt-6-astra-aeon が Codex Desktop 内の Statsig フィーチャーフラグに現れ、@notjazii がスクリーンショットを撮影し、@kimmonismus が拡散した。Aeon エージェントの話はそこから生まれた。5週間が経った今でも、Aeon には製品ページも価格もドキュメントもベンチマークもなく、解決可能なモデルIDも存在しない。
• 9月21日 — NVIDIAのマージ記録に「GPT-6 Sol medium」という文字列が出現した。
• 9月22日 — gpt-6-sol、gpt-6-luna、gpt-6-astra-minor 用の3つの Azure レジストリパスが、中国の開発者フォーラム locdd.com から、実際に有効な Microsoft URL として投稿された。翌日、公開プレイグラウンド設定エンドポイントを取得したところ、その中に3つの新しい名前はなかった。代わりにレジストリには gpt-6-astra と、より古い GPT-5.6 世代のエントリが含まれていた。
・9月22日 — GPT-6 Sol と GPT-6 Luna がリリースされた。価格、モデルID、SDKリリースノート、Bedrockでの掲載、GitHub Copilotのピッカー項目、Perplexityのデフォルトが、すべて1日以内に続いた。
このパターンは微妙ではない。実際に出荷されるサーフェス——SDKリリースノート、クラウドレジストリ、デスクトップの機能フラグ——の中にアーティファクトを伴うリークの種類は、製品になり続けた。名前だけだったリークの種類はそうならなかった。今日の主張、OpenAIがDevDayで発表した2つ目のループ型言語モデルは、アーティファクトを一切伴っていない。文字列も、フラグも、レジストリパスも、価格行も、モデルIDもない。だからといって、それが間違っていることにはならない。それは外部からはチェックできないということであり、別の、より正直な説明だ。
それを取り巻くDevDayのラインナップは実在し、異例なほど詳細に記録されている
正確に日付を特定できるのは、そのイベントです。DevDay 2026 は 9月29日火曜日、サンフランシスコのフォートメイソンで開催されることが確定しており、サム・アルトマンによる基調講演と無料のライブ配信も行われます — OpenAI がこの日程を発表したのは4月のことでした。
その中で何が期待されているかは、いつも以上に露骨にほのめかされてきた。アルトマンは9月15日、OpenAIが「今週大きな出荷があり、その後DevDayではship x 6」と投稿し、翌日の夕方に前半を撤回した。「今週ローンチすることを楽しみにしていた本命は来週になるが、待つ価値はあると思う!」と。プロダクトリードのティボ・ソティオーは、その週をDevDay級だと位置づけていたが、9月19日にリリースは依然として火曜日に予定されていると述べ、9月22日についに実現した——SolとLuna、さらに有料アカウント向けの、貯めておけるCodex使用量リセットだ。「ship x 6」をDevDay前後に出荷される6つのものの数として読むなら、2つ目のループモデルはこの表現の通常の意味に無理なく当てはまる。誇張として読むなら、まったく当てはまらない。いずれにせよ、それは創業者の投稿であって、ロードマップではない。
周辺的なリークは、モデル名を挙げることなく同じ方向を指し示している。Codex Cloud のビルドが、Tailscale とプロキシの統合を備えたデスクトップ版 ChatGPT ビルド 9922 の中に見つかり、オンボーディングフローでは開発者向けプラン階層 — Free、Prototype、Accelerate、最後のものは $50 — が基調講演の数日前に表示されていた。どちらもループしたモデルではない。どちらも、研究よりもプラットフォームに重きを置く DevDay と整合している。
もし本物なら、どのモデルですか?
誰も身元を報告していないため、以下は推測であり、そのように読むべきものです。
「OpenAIの2番目のループモデル」への最短経路は、Astraの後継機である。アルトマンは、より能力の高いモデルが「まもなく」登場すると述べている。そして、再帰的深さを基盤としてそのようなモデルを構築する最も安価な方法は、アーキテクチャを維持し、ループ予算を引き上げることだ——重みを増やすのではなく、トークンあたりの再帰を増やすのである。その解釈は、「洪水の門」という表現を最もよく説明する。なぜなら、同じアーキテクチャの2番目のフラッグシップは、最初のものが機能したという宣言だからだ。
第2の読み方は、既存のGPT-6ラインナップ内の新しい階層だ。命名文法はすでにgpt-6-astra-minor、gpt-6-sol、gpt-6-lunaという文字列を生み出しており、異なる深さ予算のループされた兄弟分が存在することは、今や100万出力トークンあたり$0.10から$50までをカバーするファミリーと完全に整合する。より安価なループモデルは、この中で読者が最も財布に響くと感じるバージョンだろう。
第三の解釈——ループ型のオープンウェイト公開——は、最も裏付けが弱い。それはこのフレーズを何よりもよく説明するだろうし、それが並ぶことになるオープンなループ型の文献はすでにOuroとNanbeige4.2-3Bに存在する。しかし、OpenAIはこの世代についてその方向の発表を何もしていない。そして、ある言葉に合わせて製品をでっち上げるのは、リーク報道が誤る典型的なやり方だ。

9月29日より前にこれを確認可能にするには、何が必要でしょうか。
直近3件のリークを解決したサーフェスを、この順序で監視してください:
• OpenAIのAPIで解決できるモデルID、またはその料金ページに新しく追加された行。
• openai-go または openai-node SDK の、新しいモデル識別子を記載したリリースノート——まさにそれが、Sol と Luna が自らの登場をリークした方法だ。SDK v3.65.0 が発表ページの公開より数時間早くモデル識別子を出荷していたのである。
• Bedrock または Azure のリスティング、あるいはデスクトップビルドにおける新しい Statsig フラグ文字列。
• システムカードに記載されるアーキテクチャに関する一文。これが最も重要で、最後に届くものになるだろう。なぜなら、OpenAIはAstraのループ設計をこれまで確認したことがないからだ。
最初の3つ以外は名前であり、名前はこのサイクル全体を通じて最も信頼できない成果物だった。

たとえそのツイートが間違っていると判明しても、なぜそれが重要なのか
再帰的深さが例外ではなく標準になれば、二つのことが変わる。
第一は保証です。次世代モデルが推論のより多くを隠れ状態で行うようになれば、モデルが書いた思考の連鎖を読むことに依存するあらゆる評価はシグナルを失います——それには第三者による安全性評価も含まれ、OpenAI自身の監視だけにとどまりません。これは保証要件を持つあらゆる人にとって調達上の入力情報であり、ベンチマーク表には現れません。
2つ目は価格ラダーの形状だ。ループ処理はパラメータを逐次計算と引き換えにするため、コストをメモリから時間へ移す。つまり、ホストは安くなる可能性があり、トークンあたりは遅くなる可能性がある。GPT-6ラインはすでにそのトレードオフを明示的に価格に織り込んでいる——100万トークンあたり入力$10/出力$50のGPT-6 Astraは深さモデルであり、GPT-6 Solは$2 / $10で、高速なモデルであり、GPT-6 Lunaは$0.10 / $0.50で、大量処理モデルだ。3つともOrcaRouterにてOpenAIの定価で提供中であり、マークアップはない。したがって、4つ目のループ型モデルが9月29日に登場すれば、こちら側の料金表は提供開始日にはベンダーの料金表そのものとなり、ベンダーの値下げは向こうで有効になった同じ日にここでも有効になる。
このようなリークの実用的な用途は予測ではなく、準備だ。5日後にリリースされるかもしれず、独立したベンチマークもないモデルは、まさに自動フェイルオーバーが存在するケースだ。ルートを新しいモデルに向け、その背後に GPT-6 Astra または GPT-6 Sol を維持しておけば、最初の一週間が失敗しても、本番経路ではなくトラフィックの一部を失うだけで済む。これは、深さ重視のモデルをテストするのにも理にかなった方法でもある — ルーティングDSL が、置き換える対象となるモデル群の隣でそれを 1 回の呼び出しにまとめ、モデル融合は同じプロンプトに対してそれらのモデル群をパネルとして実行する。これはどんなローンチ記事よりも、新しいアーキテクチャを素早く見極める手段になる。
今夜、実際に何が真実なのか
Xのある投稿は、OpenAIの2つ目のループ型言語モデルが9月29日に登場すると述べている。モデルIDも価格も名称も、二次情報源も、成果物もない。その背後には、9月3日に投入されたフラッグシップがあり、報道ではループ型とされているがOpenAIはループ型だと一度も認めていないこと、GPT-5.6 Solと比べて推論トレースの監視可能性が低下したことを認めていること、ループはGPT-4の計算グラフ深度の2倍以内に収まっていると述べる首席科学者がいること、そして9月22日に投入された安価なティアが、このアーキテクチャの問いを学術的なものではなく商業的に重要にしたことがある。
それは、厚い物語に寄りかかった薄い主張であり、イベントの5日前にリークが出るときのいつもの形だ。火曜日にフォートメイソンで2つ目のループ型モデルが現れるなら、興味深い細部はベンチマークの数値ではない——システムカードが監視可能性に関する但し書きを繰り返すかどうかだ。その一文こそが、「もはや禁じられていない」がスローガンなのかポリシーなのかを教えてくれる。

この記事で比較したモデル3
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
