
GPT-6はAstraの後継:OpenAIの次期フラッグシップ、登場は「もうすぐ」と報じられる
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451知能78コーディング
GPT-6 Astra、OpenAIの新しい旗艦モデルは、9月5日金曜日に一般提供が開始された。翌週の火曜日までには、後継モデルをめぐる話は噂であることをやめ、公式のデモンストレーションとなっていた。9月8日、OpenAIは、未発表・未命名の次世代モデル(同社が「GPT-6 Astraよりも大幅に高性能」と表現するモデル)が、88時間の実行で約1万の並列エージェントを駆動させ、数学における7つのクレイ・ミレニアム賞問題の1つである3次元ナビエ–ストークス方程式の有限時間爆発の証明とされるものを生成したと発表した。OpenAIが「もうすぐ」という憶測の背後にあるモデルを、方向性ではなく動作するシステムとして公に説明したのは今回が初めてである。これはリリースではない。モデル名も、リリース日も、API識別子もなく、証明自体も独立に検証されていない。本稿は、今週最大のAIに関する主張が、次期フラッグシップについて何を伝え、何を伝えていないかについて、現時点で判明していることをまとめた記事である。
その主張が掲載された週は、すでに今年で最も混雑した週だった。Anthropicは9月1日、Claude Fable 5.1と、そのゲート付きのサイバーセキュリティ・生物学用姉妹モデルであるClaude Mythos 5.1をリリースした。OpenAIは9月3日、GPT-6 Astraを、100万トークンあたり入力10ドル/出力50ドル、約105万トークンのコンテキスト、128Kの出力上限、そしてOpenAIの自社Preparedness Frameworkのもとで同社のいかなるモデルも獲得したことのない初の「Critical」サイバーセキュリティ評価つきで発表した。9月5日までに標準モデルは、有料ChatGPTプランとAPIで一般提供が始まった。独立系のスコアボードは発表資料ほど芳しくない。Claude Fable 5.1はArtificial Analysis Intelligence Indexで66とトップだが、GPT-6 Astraは61で、そのトラッカーによると約8位、自社の前モデルGPT-5.6 Solと並び、MetaのMuse Spark 1.3(62)の後塵を拝している。
そのギャップこそが「すでに時代遅れ」という噂の背景であり、本当の問いは、OpenAIがもっと大きなものを用意しているかどうか——社内の人間たちはそう言い続けている——ではなく、それがどれほど目前に迫っているか、そして近いうちにフラッグシップが切り替わった場合、あなたがつい先ほど下したかもしれない決断に何が起きるのか、ということになる。
サムが実際に言ったこと
まず一次情報源に立ち返るべきだ。パラフレーズはそこから乖離しているからだ。9月3日に報じられた、チャペルヒルで開催されたG20イノベーションサミットでのAxiosのインタビューで、オルトマン氏はOpenAIに「はるかに、はるかに、はるかに高性能なモデルが間もなく登場する」と述べ、「次世代モデルは誰にとっても衝撃的なものになるだろう」と警告し、今後のリリースペースは「アライメントと安全性においてどれだけ早く進歩できるかによって決まる」と説明した。それが「very soon」の背後にある文である。これはCEOからの現実の、記録に残るシグナルだ——だが、正確に読む必要がある。オルトマン氏はGPT-6 Astraの後継モデルが数日後に迫っているとは言っておらず、モデル名も挙げず、日付も示さなかった。彼はより高性能なモデルが、安全性を基準にしたスケジュールで、まもなく登場すると言ったのだ。そしてOpenAIウォッチャーの@kimmonismus氏は、その後、その指示対象を確認できたと述べている。9月5日、同氏は、インタビューの完全なトランスクリプトから、「より高性能なモデル」という発言がAstra自体ではなくGPT-6 Astraを超えるモデルを指していること、そしてOpenAIが「すでにまもなくリリースする予定の、より高性能なモデルを用意している」ことが公式に確認されたと述べた。これは、オープンな場でのOpenAIの声明というよりも、情報源による私的な確認の説明として扱うべきだ——しかし、それは下のビデオクリップや、同研究所の研究者自身が語っている方向性とは一致している。これらは計画への示唆が異なる別個の主張であり、両者を混同することこそ、リークが誤報に変わる仕組みである。
あまり注目されていない証拠のほうがより強力だ。なぜなら、オルトマン自身がAstraと、その後に来るものとの間に線を引いているからだ。9月5日に流れたクリップ——@cgtwtsというアカウントが投稿し、@kimmonismusが上記の投稿に埋め込んだもの——には、オルトマンがこう語る様子が映っている。「GPT-6 Astraはしばらく前にトレーニングを終えている。私たちが最近一時停止について話したモデルは、ええと、将来のモデルだ。しかしAstraでは、確かにサイバークリティカルに該当した」。このクリップが正確にどのインタビューから来たのかという問題は置いておこう。重要なのは内容だ。カメラの前でOpenAIのCEOは、重要となる3つのことを述べている。Astraは「しばらく前に」トレーニングを終えており、いまだ試行錯誤を続けるモデルではないこと。OpenAIが「最近一時停止について話した」モデルはAstraではなく「将来のモデル」だったこと。そして、サイバークリティカルという判定はAstraに関するもので、それにもかかわらずAstraは出荷されたことだ。これにより、Astraの展開を遅らせた8月の安全性一時停止の意味合いは変わる。CEO自身の説明に基づけば、OpenAIが8月中旬に停止したのは、皆が見守っていた主力モデルだけでなく、その後継モデルの作業も含まれていたのだ。
研究者たちは、口に出さない本音をあえて口に出している
この時期に関する主張は、Altmanだけに基づいているわけではない。OpenAIに所属する研究者たちは、発表初週から公の場で、Astraは目的地ではなく中間点であると業界に伝えてきた。研究者のroon氏は、「Astraができることの表面すらまだ削っていない」と書き、さらにこう続けた。「数週間のうちに何らかの形で時代遅れになるだろうと思う」。もう一人の研究者、Zuxin Liu氏は、「RSIの強い勢いを感じている」と述べた——RSIとは再帰的自己改良、つまりOpenAIが現在のモデルを使って次のモデルを構築するループのことだ。これらは研究所内部の人間による公の投稿であり、公式発表ではない。事実ではなくインサイダーシグナルとして重みづけされるべきものだ。しかし、Altmanの「将来のモデル」発言と合わせて読むと、そこで描かれているのは自然なリズムを待っていない研究所である:もしAstraが後継モデルを訓練するために使われているなら、後継モデルの登場は、GPT-5.6 Sol(7月9日)とGPT-6 Astra(9月3日)の間の8週間のギャップが示唆するよりもはるかに速いはずだ。
その同じ週、同社の公式見解はさらに一歩前進した。グレッグ・ブロックマンが発表時に示した「AGI時代へようこそ」という枠組み、アルトマンが8月下旬にTIME誌に対して「OpenAIは2026年末までに、自身がAGIと呼ぶシステムを実現しているかもしれない」と述べた発言、そして最高研究責任者マーク・チェンが示した「80%まで来ている」という数字は、いずれもAstraをより速い一連の展開の中の一段階として提示している組織を表している。そのどれもが発売日を示すものではない。それらすべては「もうすぐ」という解釈と方向的に一致している。
9月8日の証明の主張
9月8日、この物語はある種の成果物を手にしたが、それはリークではなかった。OpenAIは、社内の未公開の次世代モデル(これもまた名前も日付も明かされていない)が、最大10,000のエージェントが並行して作業する自律的な88時間の実行を通じて、三次元ナビエ–ストークス方程式が有限時間特異性を発展させ得るという証明とされるものを生み出したと発表した。すなわち、滑らかな流体が、渦が収縮して回転を速め、速度が非有界になる一方で全エネルギーが有限のままとなるように進化するというものだ。この問題は100万ドルの懸賞金がかけられたミレニアム懸賞問題7つのうちの1つであり、7つのうち解かれたのはポアンカレ予想の1つだけである。OpenAIによれば、この取り組みは9月1日に始まり、計算リソースに数百万ドルを費やし、賞金獲得のための挑戦ではなく能力の実証として位置づけられている。同社は100万ドルを受け取らないと述べている。この段落のすべての要素はOpenAIによる発表であり、そのいずれも独立に再現されておらず、モデル名もリリース日も明かされていない。
その主張は、検証ギャップの中で捉える必要がある。発表時点では、数学コミュニティは証明を検証しておらず、OpenAIがそもそも完全な論文を公開したのかについても、報道によって見解が分かれている。クレイ数学研究所の所長マーティン・ブリッドソンは、この懸賞問題は数学界の目から見れば依然として未解決だと指摘した。この問題は古典的には外力のない方程式に対して設定されているのに対し、OpenAIが報告した結果は外力付きの変種に関するものだからだ。また、フィールズ賞受賞者のティモシー・ガワーズを含む数学者たちは、この主張にはコミュニティによる精査が必要だと述べた。これは、検証可能な数学が本来どう機能すべきかというあり方と際立った対照をなす。NYUの数学者トリスタン・バックマスターと、Anthropicの数学者レベント・アルペゲは、その前日の9月7日に、機械検証可能なLean形式化とともにそれぞれの関連結果を公開していたが、OpenAIの発表はプレス向け電話会見で行われた。
9月8日には、その主張にどの程度の重みを与えるかに影響する出所をめぐる争いも持ち上がった。バックマスターとアルポゲは、AnthropicのClaudeとOpenAIのCodex、GPT-6 Astraモデルを組み合わせて使い、密接に関連する有限時間爆発問題に約1年間取り組んでいた。バックマスターによると、OpenAIは9月6日に彼に連絡し、自社モデルが彼らと驚くほど似た道筋で証明を生成したと伝えたという。さらにバックマスターは、OpenAIのセバスチャン・ビュベックが、アルポゲのAnthropic雇用を理由に共同発表からアルポゲを外すよう圧力をかけ、キャリアを脅かすと受け取れる発言をしたと主張している。OpenAIはこの説明を否定しており、ビュベックは「虚偽で扇動的だ」と述べた。OpenAIはまた、研究者もエージェントも2人の研究が公開される前に目にしたことはないとし、自社製品の匿名化データが自社モデルに影響を与えた可能性を排除できないことだけは認めている。これらは私的な会話に関する対立する主張だ。中立的に要約すれば、2つのグループが数日の差で関連する結果に到達し、その論争は今や、OpenAIが明かしていない何かをめぐる雰囲気の一部となっている。
噂好きがそれを何と呼ぶか
この物語がすべりやすいのは名前の部分であり、現状を明確にしておく価値がある。このブログのAstraローンチ解説では、次に来るものの周辺で飛び交う2つのコードネームをすでに説明した。「Doug」は、SemiAnalysisが8月7日に機関投資家向けクライアントへ「はるかに大規模な」OpenAIモデルであり「現在進行形で開発中」だと伝えたもので、匿名Xアカウント「Chris GPT」は、これがOpenAI史上最大の事前学習ランとなり、Claude Fable 5を「原始的」に見せるだろうと主張した。もう1つは「Bel」で、匿名Xアカウント「@synthwavedd」が8月25日に、総パラメータ数10兆超の完了した事前学習ランとして報告し、Dougの後継とされる。この2つをめぐる報道は一貫しておらず、BelがちょうどGPT-6 AstraとしてリリースされたばかりのGPT-6世代の基盤だと解釈する向きもあれば、その後継モデルだと解釈する向きもある。そしてそのすべては、OpenAIに実名の情報源を持たない匿名アカウントに由来している。
今週変わったのは、オルトマン自身の言葉が、{{1}}「後継者としてのBel」{{/1}}という読みと同じ方向を指すようになったことだ。オルトマンCEOの説明によれば、OpenAIは安全性審査のために{{2}}「将来のモデル」{{/2}}をすでに保留している。だとすれば、完成した事前学習ランがアライメント作業を待ってパイプラインに控えているという考えは、もはや単なる匿名投稿ではなく、OpenAI自身が述べてきたことと一致する。コードネームは製品名としてではなく、ハンドルとして扱うべきだ。OpenAIの命名はこれまでも噂を先取りしてきた。このブログが夏の間、仮称{{3}}GPT-6.7{{/3}}として追跡してきたモデルは、{{4}}GPT-6 Astra{{/4}}としてリリースされた。{{5}}DouとBel{{/5}}にも、同じ懐疑と、同じ忍耐がふさわしい。重要なのはどのハンドルが定着するかではなく、実際の識別子がまだ現れていないことだ。そして、それが具体的に注視すべき点である。
懐疑論の根拠
上記の引用文から、迅速さを求める論拠はそれ自体で明らかだ。それに反対する論拠も同等の重みに値する。なぜなら、それはOpenAIの関係者が語ったことではなく、OpenAIが実際に行ったことに基づいているからだ。
まず、展開はまだ落ち着いていない。GPT-6 Astraの標準モデルは9月5日にようやく一般提供が開始されたばかりであり、上位ティアであるGPT-6-Astra-Proは同じ週にPro、Business、Enterpriseプランへ展開が進んでいる最中だった。OpenAIはその週、報道が「混乱した展開」と表現した事態への対応に追われており、Altmanがローンチが意図したほどスムーズではなかったことを認める発表が2日目に行われる事態にもなっていた。そんな最中に後継モデルを送り出すのは、OpenAIの基準からしても異例のことだっただろう。
{{1}}第二に、リリース間隔のデータは「数日」説に反している。{{/1}} {{2}}OpenAIが2026年に示してきた旗艦モデルのリズムはおよそ2か月だ。7月9日のGPT-5.6 Sol、9月3日のGPT-6 Astraがその例である。{{/2}} {{3}}Astraの1週間後に後継モデルが登場すれば、そのペースは一桁速く、OpenAIがこの1か月間発信してきた安全性重視のリリース間隔というメッセージと矛盾する。Astraのリリースが8月から延期されたのは「Critical」の調査結果が理由であり、Altman氏はリリースが現在、AI整合性と安全性の進捗に左右されると述べている。{{/3}} {{4}}8月中旬に自社最大のフロンティア開発を安全性のために中断し、9月中旬に後継モデルをリリースするラボは、その調査結果を非常に迅速に解決したか、あるいは本当に重要なものを実際には中断していなかったかのどちらかだ。{{/4}}
Third, and most concretely: this week's artifact is a claim, not a product. Every prior leak cycle this blog has tracked left a verifiable object behind — {{1}}the gpt-6-astra identifier surfaced in Codex client code before launch{{/1}}, and {{2}}a scrubbed 'gpt-nathree' PR signature leaked from OpenAI's own repositories{{/2}}. The September 8 Navier-Stokes announcement is a different kind of object: OpenAI says its unreleased next-generation model ran roughly 10,000 agents for 88 hours and produced a proof, but the proof is not auditable as released, coverage is split on whether the full write-up is even public, and OpenAI frames the whole exercise as a capability demonstration rather than progress toward a ship date. A claim you cannot check is closer to the CEO's word than to an identifier — {{3}}it tells you the successor exists and is already being run{{/3}}, and {{4}}it tells you almost nothing about when you can call it{{/4}}.
ここに、3つの点すべてを同時に成立させる解釈がある:Astraは「しばらく前」に完成し、安全性審査を受けながら待機していた;後継モデルこそが8月に実際に一時停止されたモデルであり;その停止は能力ではなくコントロールに関するものだった。もしそれが実際の順序ならば、後継モデルは「今まさに構築されている」のではなく、すでに構築済みであり、変数はOpenAIがどれだけ早く安全性の作業を終えられるかである。9月8日の開示はその解釈と整合する:OpenAIは次世代モデルが9月1日にナビエ–ストークス方程式への取り組みを開始したと述べているが、これはモデルをまだ組み立てている研究室の行動ではなく、すでに見つけられる最も困難な問題でモデルを試している研究室の行動である。まさにそれが「すぐに」がもっともらしく、「数ヶ月ではなく数週間」が正しい読み方となる状況だ。また、何も確実ではない状況でもある——かつてAstraを遅らせたのと同じ安全性ゲートが次世代モデルをも再び遅らせ得るし、能力のデモは製品の決定ではない。

後継者が変えなければならないこと
モデル自体については何も分かっていないため、それが何のために作られたのかを推論する唯一の誠実な方法は、今回リリースされたものの抜け落ちを読み取ることだ。これらは計画の前提となる事実ではなく、注視すべき仮説である。
・独立系インデックスの格差。GPT-6 Astraの発表資料は主要な数値を主張しているが、Artificial AnalysisのIntelligence Indexでは、GPT-6 Astraは61に対し、Claude Fable 5.1は66と上回っている。その格差をリセットする後継機——単にベンダーのベンチマークで再確認するのではなく——こそが、リフレッシュと真の前進との違いを生む。
• 価格とコンテキストのライン。GPT-6 Astra は約105万のコンテキストで $10 / $50 で発売された。OpenAI は今年すでに一度 GPT-5.6 ファミリーの価格を引き下げている。そして、より低い標準価格、より大きなコンテキスト、あるいはより安価な持続的推論のコスト構造を伴って登場する後継モデルは、どのベンチマークの差分よりも導入の計算を変えるだろう。モデルカードを見るように価格表を見よ。
• コンピューター操作の限界。GPT-6 Astraの発表時の売りは、長期的自律性——「コンピュータ上でできることは何でも」——であり、ベンダーが報告したOSWorld 2.0のスコア(部分点72.6%)は、すでに競合他社が攻撃している数字だ。自律性の主張が独立したテストで耐えうることを示す後継機は、指標の上昇よりもはるかに重要になるだろう。
• 安全ドア。これは最もOpenAIに固有の変数である。Astraは最先端のサイバーセキュリティ機能をトラステッド・アクセス・プログラムに限定して出荷した。そしてアルトマンは現在、動画で、停止されていた「将来のモデル」が本物であると述べている。後継機が同じようにCriticalしきい値をクリアするのか、制限付きで出荷されるのか、それともより長いレビューを引き起こすのかを注視する必要がある。それぞれの結果は、それがどの程度実現に近いかについて異なる意味合いを持つ。
• 名称。それはAstraファミリーに留まるのか、GPT-7に移行するのか、それともまったく新しいファミリー名で登場するのか。OpenAIは、ローンチの数日前になっても、Astra自体を「GPT-6」として出荷するかどうかを決めかねていた。重要なのは噂ではなく、実際に出荷される名称こそが戦略を示すバロメーターだ。
待っている間にできること
今日呼び出し可能なものから始めよう。なぜなら、それらのどれもが主張や噂によって変わることはないからだ。GPT-6 Astraは実在し、ベンチマークが取れており、OpenAI自身のAPIおよびChatGPTプランで利用可能だ。Claude Fable 5.1は実在し、ベンチマークが取れており、現在独立系インデックスで首位に立っている。GPT-5.6 Solは、長いコンテキストを扱う作業において、価格性能比でOpenAIの選択肢であり続けている。今週に入るまで、後継機に関連するすべての数字はCEOの曖昧な発言か匿名の投稿にすぎなかった。今やそのうちの一つは、プレスコールで行われ、ラボ外部の誰にも検証されていない、OpenAI自身の能力主張である。どちらも仕様書ではない。名前すら付けられておらず、その最も公的な成果が検証不可能なモデルを中心に本番パスを再設計することは、エンジニアリングの装いをした憶測にすぎないだろう。
有用な仕事とは、次期リリースが登場したときに、その採用を安価にできるようにすることです。そして、そこでこそルーティング層は、単に手数料を受け取るだけでなく、存在価値を発揮します。GPT-5.6 Sol は本日より OrcaRouter 上で、OpenAI 自身の価格である100万トークンあたり $4 / $20 で利用可能です。1.05Mトークンのコンテキストは、プロバイダ公表価格のまま、マークアップなし、再交渉なしで引き渡されます。その後継モデルが実際にプロバイダのカタログに登場する場合も、同じルールが適用されます。すでに利用しているキーと、すでに呼び出しているエンドポイントを通じて、ベンダー自身の価格で、当日中に呼び出し可能になります。フェイルオーバーパターンが真価を発揮するのも、まさにそのときです。本番での振る舞いが未検証の新しいフラッグシップモデルは、ルーティングルールの典型例です。検証済みのモデルに本番を固定し、新モデルにシャドウトラフィックの一部を流し、それがプライマリスロットを獲得するかどうかは、ローンチブログではなく実際のリクエストに判断させます。OrcaRouter では、これはルーティング文字列の編集であって、マイグレーションではありません。「もうすぐ」と見誤った場合のコストを吸収することこそ、ルーティングが存在する理由なのです。

何を見るべきか
• 識別子だ。パターンは一貫している:OpenAIがローンチを発表する前に、gpt-6-astraの識別子がCodexクライアントコード内に流出し、削除された"gpt-nathree"コミット署名がOpenAIのリポジトリから流出した。後継が本当に近いときは、公式発表の前に、サードパーティのクライアント、クラウドのモデルリスト、またはOpenAI自身のAPI変更履歴に文字列が現れると期待すべきだ。それこそが、本物のシグナルとCEOのタイムラインとの違いだ。
• 命名。Astra ファミリー、GPT-7、または新しいファミリー名——最初に登場するのがどれかによって、OpenAI がこれを、先頃リリースしたばかりのフラッグシップのリフレッシュと見なすのか、それとも世代のリセットと見なすのかが分かるだろう。
• 安全ドア。一時停止された「将来モデル」が最も情報量の多い変数です。それがCritical閾値をすぐに通過し、ゲート付きで出荷されれば、「もうすぐ」という解釈は正しい。もしそれがより長いレビューを引き起こすなら、8月の一時停止は単なるコントロールではなかった——そしてスケジュールもそれに伴ってずれ込む。
• 独立した数値。後継モデルが実際に出荷されたとき、最初のArtificial AnalysisおよびLMArenaの測定結果は、どんな発表時のスコアボードよりも重要になるでしょう。また、各ベンダーの数値は、独立した団体がそれを再現するまでは、そのように(ベンダーによる数値として)ラベル付けされるべきです。GPT-6 Astra自身のローンチはまさに教訓です。マーケティングはあることを言い、指標は別のことを示しました。
• 価格表。OpenAIは今年すでにGPT-5.6の価格を一度引き下げている。より低い希望小売価格で登場する後継モデルは、フロンティア経済全体をリセットすることになるだろう — そして、パススルールーター上では、その変更はベンダーが公開した当日に反映されるだろう。
• 証明が検証可能になるかどうか。OpenAIはナビエ–ストークス問題の実行を能力のデモンストレーションとして位置づけており、デモンストレーションには証明を公開する義務は伴わない。もし論文や形式化が最終的にコミュニティによる監査のために公開されれば、それはOpenAIが次期モデルをどう使おうとしているかに関する一つのシグナルとなる。もし主張がプレス向け説明会の場だけに留まるなら、それは別のシグナルだ。どちらもリリース時期を動かすものではないが、この違いこそが現時点で後継モデルの実際の用途を読み取るための最も明確な手がかりである。

よくある質問
OpenAIはGPT-6 Astraの後継を確認しましたか?
製品としてはまだありません。サム・オルトマン氏はAxiosに対し、OpenAIには「はるかに、はるかに、はるかに高性能なモデルが近日中に登場する」と語った。また、9月8日には、OpenAIは未発表・未命名の次世代モデル——「GPT-6 Astraよりも大幅に高性能」——が、同社が主張するナビエ・ストークス方程式の証明を生み出したと公に説明した。OpenAIがまだ行っていないのは、モデルの命名、価格設定、リリース日の決定、APIでの識別子の公開である。後継モデルの存在は現在OpenAI自身が表明しているが、その利用可能性はまだ示されていない。
後継は何と呼ばれるのか — GPT-6.7、Doug、それともBel?
None of those is a product name. GPT-6.7 was the working name this blog tracked through the summer for the generation that shipped as GPT-6 Astra. Doug and Bel are separately reported pre-training runs with inconsistent lineage across accounts — some read Bel as the base of the GPT-6 generation, others as the model after it. Expect the real name only when an identifier or an announcement appears.
ナビエ–ストークス方程式の証明は、検証済みの結果ですか?
いいえ。これは9月8日のプレス会見で発表されたOpenAIの主張であり、実験室外の誰も検証していません。数学コミュニティは論文を査読しておらず、そもそも論文が公開されたかどうかについても報道によって見解が分かれています。また、クレイ研究所の所長マーティン・ブリッドソンは、賞金問題は未解決のままであると指摘しました。この問題は古典的には外力なしの方程式に対して設定されている一方、OpenAIが報告した結果は外力ありの変種に関するものです。OpenAIはそもそも100万ドルの賞金を請求しないと述べています。これと対照的なのが、トリスタン・バックマスターとレベント・アルペゲによる関連する9月7日の結果で、こちらは機械検証可能なLeanによる形式化が付属していました。数学的主張は、誰かが検証できるようになるまで数学的結果ではありません。
GPT-6 Astra での開発は控えるべきでしょうか?
単一の答えはありません。既存のモデルはベンチマーク済みですが、後継モデルはまだ存在しないからです。長期的なエージェント構築が、数週間後にリセットされるかもしれないフラッグシップに依存している場合、理にかなった防御策は、検証済みのモデルを呼び続け、書き換えなしで切り替えられる能力を維持することです。これはまさに、フェイルオーバーを備えたルーティング層の役割です。リークではなく公式発表に基づいて、トラフィックを移行させましょう。
正直な要約とは、時計が付いた主張である。広くフォローされているOpenAIウォッチャーは、GPT-6 Astraの後継機が「もうすぐ」だと述べている。サム・アルトマンはAxiosに対し、はるかに高性能なモデルが安全性を重視したペースで登場すると語った。OpenAIウォッチャーの@kimmonismus氏によれば、完全なトランスクリプトから確認できたというその解釈は、GPT-6 Astra自体ではなく、その先のモデルを指し示している。またアルトマンはビデオで、OpenAIが一時停止したモデルは将来のものだと述べた。OpenAI自身の研究者たちは、GPT-6 Astraが数週間以内に時代遅れになると公に語っている。そして9月8日、同社は未発表の次世代モデルが「GPT-6 Astraよりも大幅に高性能」であり、そのモデルがナビエ–ストークス方程式の証明の主張を生み出したと自ら発表した。そのどれも発表ではなく、いずれもモデル名を挙げることも日付を設定することもなく、証明はまだ検証済みの結果ではない。この記事にある具体的な期待はすべて、来週の今頃には間違っている可能性がある。争いのない事実は、GPT-6 Astraが存在し機能していること、Claude Fable 5.1が独立したインデックスでその上に位置していること、そして新しいフラッグシップを必要としない作業には、OrcaRouter経由で$4/$20のGPT-5.6 Solという、より安価なOpenAIの経路が引き続き利用可能であることだ。この種の主張が正当化する唯一の姿勢は、コストがかからないもの、つまり自分が呼んでいるものを呼び続け、次のリリースを迂回する選択肢を開いたままにし、発表と監査だけを唯一のスケジュールとして扱うことだ。
この記事で比較したモデル3
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
