
OpenAI Astra:GPT-6ではないこのモデルについて判明しているすべてのこと
- qwenNEWQwen: Qwen3.8 Max2026-08-03$2.00 / $6.00 100万トークンあたり · 56 tok/s
- deepseekNEWDeepSeek: DeepSeek V4 Flash 07312026-07-3150知能69コーディング
- qwenNEWQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり · 200 tok/s
- orcaNEWOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicNEWAnthropic: Claude Opus 52026-07-2461知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2150知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1651知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1557知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0951知能71コーディング
- openaiOpenAI: GPT-5.6 Terra2026-07-0955知能77コーディング
- openaiOpenAI: GPT-5.6 Sol2026-07-0959知能77コーディング
- grokxAI: Grok 4.52026-07-0854知能72コーディング
- tencentTencent: Hy32026-07-0641知能59コーディング
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232知能42コーディング
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226知能39コーディング
- anthropicAnthropic: Claude Sonnet 52026-06-3053知能72コーディング
- klingKling: Kling 3.0 Turbo2026-06-1757知能52コーディング57数学
- z-aiZ.ai: GLM 5.22026-06-1651知能69コーディング60数学
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242知能61コーディング61数学
今日ダウンロードできるものはモデルではない。Leanコードの10ファイルだ。2026年8月1日、OpenAIは数学に関する研究記事を公開し、その中に次期フロンティアシステムの名称の初めての確認が埋め込まれていた。その名はAstraだ。モデルカードも、料金ページも、APIエンドポイントも、日付も存在しない。実際に呼び出せる現在のフラッグシップは依然としてGPT-5.6 Solで、入力トークン100万件あたり5ドル、出力トークン100万件あたり30ドル。これは7月9日以来まったく変わっていない。
GPT-6について検索したなら、簡潔に言うとこうだ:OpenAIはその名前のモデルを発表したことはなく、本日時点でも、AstraがGPT-6としてリリースされるのか、GPT-5.7のようなGPT-5のポイントリリースとしてなのか、それともSol、Terra、Lunaと並ぶ第4のティアとしてなのかは決定していない。その命名の曖昧さは、マスコミへの遠慮からではない。これは現在進行中の社内の問いであり、報じたのはThe Informationで、7月31日のことであり、その後も解決されていない。
以下は、この件に関するほとんどの報道が混同している三つの事柄を区別するものである:OpenAI自身が述べたこと、信頼できる報道が付け加えたこと、そして出典が付いていないまま流布していること。その証明は、実際にコンパイルできる成果物である。10兆パラメータという数字は、誰かがインターネット上で打ち込んだ数字にすぎない。これらは、まったく異なる重みを与えられるべきである。
OpenAIが実際に言ったこと——そして、言わなかったことのずっと長いリスト
この発表は製品発表として届いたわけではなかった。論文として届いたのだ。OpenAIの投稿は、「次期主要モデルであるAstraの内部版」によって生み出された結果について述べており、その枠組みでは少なくとも10年間、主要な成果に進展が見られなかった問題群にわたるものだった。Astraは、長期間にわたる作業のために構築されたシステムとして特徴づけられた。すなわち、一度のパスで回答するのではなく、複数のエージェントが一つの大きな問題の異なる部分を長期間にわたって調整しながら取り組むシステムである。
それは公式の技術的説明のほぼ全体に相当する。それと照らし合わせると、欠落のリストは際立っている:
• OpenAIによって確認済み — 名称がAstraであること、「次期メジャーモデル」であること、内部バージョンが10件の結果を生成したこと、マルチエージェント・長期視野の設計意図、249ページの原稿、公開リポジトリ上のLean 4証明書、GPT-5.6 Solレートで見積もられたトークンコスト。
• OpenAIは公表していない — 公開日、価格、コンテキストウィンドウ、パラメータ数、ベンチマークスコア、モデルカード、ChatGPTで利用できるのかAPIのみなのか、実行されたエージェントの数、実行期間、使用ハードウェア、プロンプト、成功率、最終的な製品名。
信頼できる報道が少しだけ補足してくれる。The Informationは、サム・オルトマンが7月下旬にワシントンで政策立案者たちにAstraをデモンストレーションしたと報じている。その報道によると、この説明会には上院議員のラファエル・ワーノック、バーニー・モレノ、マーク・ウォーナーが出席し、スコット・ベッセント財務長官とハワード・ラトニック商務長官も同席していたという。このモデルファミリーはすでにテスト段階にあり、「Astra」という名称自体はまだ暫定的なラベルだと説明されている。
OpenAIの外部の誰も、このモデルを一切実行したことがない。世に出回っている能力に関する主張はすべて、公開された10件の証明か、一般には公開されなかったデモのいずれかに遡る。
10の証明:異常なほど検証しやすいが、いまだ未解決

ここが、今回の発表が典型的なベンチマークの数値発表よりも実質的に勝っている点であり、その理由を正確に述べる価値があります。OpenAIはスコアを公表して「信じてください」と求めたのではありません。Apache 2.0のもと、openai/ten-proofsリポジトリに機械検証可能な成果物を公開しました——各結果につきLeanファイルが1つ、Lean 4.32.0に固定され、mathlibへの依存関係を持ち、独立した検証のためのComparatorChallengesディレクトリも併置されています。このリポジトリは8月1日に単一コミットとして公開され、その後、数百のスターと数十のフォークを集めています。
リポジトリの命名通り、その10件の結果は異常に広い分野にわたっている:
• 群論 — 非sofic群の構成であり、1999年以来未解決だった問題に否定的に答えるものである。Soficityは、数学者が扱うほとんどすべての群が満たす性質である。はたしてすべての可算離散群がそれを満たさなければならないのか、という問いは27年間未解決のままだった。
• 作用素環 — 1980年にフィールズ賞受賞者アラン・コンヌによって提起されたコンヌ剛性予想に関する反例。
• 高次元幾何学 — 1978年以来初めてのものと報告された球充填法の改良 — さらに、Ehrhartの体積不等式の鋭い形。
• 符号理論 — 2元符号と球面符号の新しい限界。
• 複雑性 — パーマネントに対する算術回路の下界、およびエンタングルされたゲームに対する指数関数的並列反復結果。
• 格子暗号 — 最近ベクトル問題に対する固定多項式の困難性。
• 極値組合せ論 — 多色三角形ラムゼー数の増大スケール、および極値グラフ理論における反例。カタログ化されたいくつかのエルデシュ問題に関する研究を含む。
数学者たちの反応は、否定的というよりも関心を持って迎えるものだった。エルデシュ問題データベースを管理するトーマス・ブルームは、この結果を大ニュースと呼び、5月の単位距離予想の反例よりも上位に評価した。OpenAIのノアム・ブラウンは、内部者として有益な現実的な見解を示した。「残念ながら、ミレニアム懸賞問題はまだない」
Leanの証明書が確定させるもの、そして未解決のまま残すもの
型チェックが通るLeanの証明は、構築上正しい。OpenAIの評価方法論、ベースラインの選択、あるいは自社結果の解釈を信頼する必要はない——ファイルをコンパイルできるからだ。「94.1%を達成した」が証拠の標準単位である業界にとって、これは反証可能性における意味のある向上である。
また、これは見出しが示唆するよりも狭いものであり、具体的には4つの点がある。Leanは形式的な文の証明が健全であることを検査する。形式的な文が本文が主張する定理であるかどうかは検査しない。エンコードされた定義が、その分野でその言葉が意味するものと一致しているかどうかは検査しない。形式的な端点を見出しの結果に橋渡しする非形式的な還元についても検査しない。さらに、新規性、つまり結果が新しいのか、それとも別名ですでに知られているのかについては何も述べない。
それら4つはすべて人間の判断が関わる問題であり、発表時点ではいずれも査読を経ていません。原稿は専門家への相談に言及していますが、謝辞はすべての主張を承認するものではありません。公開されたリポジトリの部分的なビルドの1つでは、9,007件のジョブのうち8,820件がコンパイルされました。これは、完了した監査というよりは、検証途中の大規模な実際の形式化の姿です。現時点での正直な状況は、数学の正典における10件の確定済み項目ではなく、10件の真剣で形式的にコード化された研究上の主張です。
2つ目の、より静かな限界があります。発見プロセスはOpenAIの外部の誰にも再現できません。証明は公開されていますが、検索システム、プロンプト、チェックポイント、実行環境は公開されていません。目的地を検証することはできても、旅をやり直すことはできません。
2,000ドルという金額と、その金額が聞こえほどには物を買えない理由

最も広く伝わった数字はコストだった。OpenAIは、10のソリューションに費やしたトークンコストを、GPT-5.6 Solレートで換算して約2,000ドルと見積もった。その表現を最も一般的に解釈すると、10年来の未解決問題1件あたり約200ドルになる。一部の報道は同じ文を「2,000ドル未満/問題」と読んでおり、10倍の差がある。OpenAIの投稿は簡潔すぎるため、両方の解釈がそのまま誌面に残り、同社がそれを明確にした形跡はない。
合計の数値を見て計算してみましょう。Solは入力トークン100万個につき5ドル、出力トークン100万個につき30ドルを請求し、推論トークンは出力として請求されます。支出がすべて出力だった場合、2,000ドルで最大約6,700万の出力トークンを購入できます — 問題あたり約670万トークンです。これは大量の思考であり、途方もない量というわけでもありません。これは、資金が潤沢な研究グループが一つの難しい問題にすでに費やせるような予算です。
見出しよりも重要な3つの注意点がある:
• それは反実仮想の価格であり、実際の価格ではありません。 Astraは未リリースで、価格は未定です。$2,000は、それらのトークンが仮に別のモデルのレートでかかる金額を示しています。長時間のマルチエージェント実行向けに構築されたフロンティアシステムには、Solのように価格設定される明白な理由はなく、それ以上に価格設定される理由しかありません。
• 数えているのは成功したケースだけです。成功率は公表されていません。Astraがどれだけの問題に取り組んで解けなかったのか、またその試みにどれほどのコストがかかったのかは不明です。成功率なしで公表された成功あたりのコストは結果あたりのコストとはならず、その差はどちらの方向にも一桁の違いになる可能性があります。
• トークンは安い部分です。人間は問題を枠組みし、原稿を準備し、形式化を推進しました。その労働は2,000ドルには含まれていません。
今日価格を決められるのはベースラインだけです。OrcaRouterはプロバイダーのリスト価格をマークアップ0%でそのまま通過させるため、GPT-5.6 SolはOpenAIのAPIと同じく、当社のAPIでも$5/$30です。つまり、ご自身のワークロードで計算を検証したい場合、発表に記載されたレートが実際に支払うレートになります。まだ誰も価格を決められないのはAstra自体であり、そうでないと言うベンダーは推測しているにすぎません。
リリース日はリークではなく、30日間のタイマーによって管理されている

「GPT-6はいつ?」という報道の大半は、噂の算数にすぎない。もっと具体的な制約が目前にあるのに、それがこの疑問に結びつけられることはほとんどなかった。
2026年6月2日に署名された大統領令は、連邦政府機関に対し、フロンティア開発者が公開リリースの最大30日前にモデルを政府の審査に提出する自主的な審査プロセスを立ち上げるよう指示した。この枠組みは8月1日に正式に発効する予定であり、これはAstraの投稿が公開されたのと同じ日だった。報道によれば、Astraがこのプロセスを通過する最初のモデルになると見込まれている。
「Voluntary(自主的)」という言葉は、この文の中でそれなりの役割を担っている。実際のところ、政権はこれまでも公開のタイミングに圧力をかけてきた。そしてOpenAI自身の最近の行動は、そのリハーサルのように見える:GPT-5.6は6月26日から約20の審査済み組織に限定され、7月9日に広くアクセスできるようになるまで、約2週間の段階的展開が行われた。
これら2つの事実を重ね合わせると、予測ではなく大まかな下限が得られる。Astraが30日間のプレリリースレビューを通過し、その後GPT-5.6のパターンを繰り返すなら、広く利用可能になるのは提出から約6週間後となる。そして、提出日こそが正確には分からない点だ。これが、8月という確信的な日付を割り引くべき理由である。ゲート段階は公表された期間を伴うプロセスであり、時計はまだ目に見えて動き始めていないからだ。
予測市場はまさにその方向に動いてきた。2026年8月5日時点で、Polymarketの「GPT-6 released by」ラダーは、8月7日1%、8月14日3%、8月21日13%、8月31日25%、9月30日68%、12月31日89%という水準で、出来高は約100万ドル近くに達している。これは群衆による集約的な推測として捉え、情報源としては扱わないこと。ただし、群衆がその重点を第4四半期に移している点には注意すべきだ。
これまでの実績を思い出すことも役立つ。過去12か月間の「GPT-6が来週発表される」という主張はすべて誤りだった。未確認のリークでは、2026年4月14日が発表日とされたが、実際に9日後にリリースされたのはGPT-5.5だった。
噂を検証
それぞれが実際にどれほどの重みを持つかで並べ替え:
• 命名は未定(GPT-6 / GPT-5.7 / 別クラス)。出典はThe Information。この話の中で最も信頼できる非OpenAIの主張であり、期待値をリセットすべきもの——数学論文を通じて発表されたシステムは、世代ジャンプとして銘打たれない可能性が十分にある。
• 「Zinc」と「Magnesium」というコードネームがDesign Arenaで目撃された。コミュニティによる目撃情報で、エントリーは無効化されたと報告されているが、OpenAIは未確認。つまり、GPT-5.xのポイントリリースの登場はより先になるかもしれない。Astra(それは誰のGPT-6への期待も満たさず、ニュースサイクルを吸収することになるだろう)
• 規模はGPT-5.6 Solの約2倍。価格はGPT-5.6と同程度。流布している噂。元となったリーカーはモデルをテストしていないことを認めている。もっともらしく聞こえるが、完全に裏付けのない情報である。
• 150万トークンのコンテキストウィンドウ。情報源が明記されないリークまとめに登場している。Solはすでに1,050,000トークンを提供している点は注目に値する。つまり、これは飛躍ではなく増分に過ぎない——だからこそ、見出し級の「リーク」として疑ってかかる理由になる。
• およそ10兆のパラメータ。 追跡できる限り、どこにも出典はありません。この物語全体で最も繰り返され、最も裏付けのない数字です。
• 方向性を定義づけるものとしてのメモリーとパーソナライゼーション。2025年8月のインタビューでのアルトマン自身の公の発言に基づくものだ——本物ではあるが、1年前の話であり、Astraに特化した内容ではなく、ポストGPT-5の方向性全般に関するものだ。
今から出荷されるまでの間に実際にやるべきこと
間違った動きは、モデルカードのないモデルに合わせてアーキテクチャを再設計することだ。正しい動きは、長期的なマルチエージェントシステムが変えるであろう問題がどれかを見極めることだ。なぜなら、OpenAIが何をリリースしようとも、それらの部分は今日のスタックの中で十分に構築されていないからだ。
そのうちの3つは、今すぐGPT-5.6 Solに対して構築する価値がある:
• コスト上限は、呼び出し単位ではなくタスク単位です。単一のジョブが何時間も実行され、600万〜700万もの出力トークンを消費する場合、リクエストごとの制限では保護できなくなります。タスク全体が引き継ぐ予算と、強制停止の仕組みが必要です。
• チェックポイントと再開可能性。 ワンショット呼び出しは、戻るか失敗するかのどちらかです。何も永続化されずに90分目で停止する数時間におよぶエージェント実行は、ほとんどのコードベースがこれまで処理する必要がなかった、高コストな障害の一種です。
• 参照回答のない問題に対する、信頼できる評価。10の証明が興味深いのは、部分的にはLeanがオラクルを提供するからだ。実運用では、ほとんど何もオラクルを提供しない。良い6時間の実行ともっともらしく見える悪い実行を区別できないなら、計算資源を増やしても役に立たない。
切り替えの質問について:AstraはOrcaRouterでは利用できません。そもそもどこでも利用できないからです。私たちが言えるのは、バージョンの頻繁な入れ替わり問題は、こちら側でほぼ解決されているということです。1つのキーで200以上のモデルを利用できるので、これがGPT-6、GPT-5.7、あるいは4番目のGPT-5.6ティアとしてリリースされるにしても、採用するのは移行ではなくモデル文字列の変更で済みます——追加の契約も、新しいSDKも不要です。そして、特に未実証のフロンティアモデルに関しては、自動フェイルオーバーがあるかないかで、実際のワークロードで評価することと、ラボの外では誰もストレステストしていないシステムに本番パスを賭けることの違いが生まれます。トラフィックの一部をそこにルーティングし、Solをフォールバックとして下に置いておけば、結果がわかります。
答える価値のある質問
AstraはGPT-6と同じものですか?
必ずしもそうとは限らない。それがこの物語における最も重大な未知数だ。OpenAIは次期主要モデルとしてAstraを確認しているが、リリース名はまだ決定していない。報道では、GPT-6、GPT-5.7、そして別のクラスがSol、Terra、Lunaと並んで、すべて候補に挙がっている。GPT-6という名前のモデルが登場しない可能性も十分にあり、人々が待ち望んでいた性能の飛躍が、誰も注目していなかった名前で実現する可能性もある。
今日、何らかの形でAstraにアクセスできますか?
いいえ — ChatGPTでもなく、API経由でもなく、ルーターやリセラー経由でもありません。公に存在するのは、論文、推論のウォークスルー、そしてLeanリポジトリだけです。Astraへのアクセスを提供すると主張するサービスがあるなら、それは他の何かを転売しているか、嘘をついているかのどちらかです。現時点でこのリリースに関して実際に有用なことは、自分で証明をコンパイルすることだけです。
アストラは本当に人間の数学者が解けなかった問題を解決したのか?
それは、少なくとも10年間未解決だった命題に対する形式的検証済みの証明を生み出した。これは真に珍しい成果であり、検証は業界標準を一歩上回る。しかし「Leanで検証済み」は「査読済み」ではない。そして、それぞれの形式的命題がその最重要問題を捉えているかという枠組みの問いは、まさにLeanが答えられない部分だ。草稿を読んだ専門家たちの評価は好意的だが、査読を経たものは一つもない。評価は今後数ヶ月で、どちらの方向にも固まっていくだろう。
2,000ドルという数字は、最先端研究が今や安価であることを意味するのでしょうか?
つまり、勝利したトークン実行は安価だった——別のモデルの価格で、失敗例と人間を除いたうえでの話だ。その3つの除外項目はそれぞれ大きなものになり得る。正直に読むなら、成功した自動証明探索の限界費用が注目に値する水準まで低下したということだ。10個の未解決問題が今やノートパソコン1台分の価格になるという意味ではない。
これを本当に解決するものは何だろう
3つの具体的な事柄があり、そのいずれも噂ではなく、すべてが起きたときに検証可能です。
モデルカードと価格ページ。それが、Astraが研究の成果物ではなくなり、計画の対象となる瞬間であり、そして命名の問題が解決する瞬間でもある。
Leanリポジトリの独立した再構築であり、型チェックだけでなく、定義と非形式的な還元を監査する専門家によるものです。ComparatorChallengesディレクトリは、OpenAIがこれを期待していることを示唆しています。正式なステートメントがその精査に耐えれば、結果ははるかに否定しにくくなります。もし10件のうち1件でも不一致が表面化すれば、セット内のすべての主張が再読されることになります。
連邦審査の時計が動き始めた証拠だ。30日間のプレリリース期間中、その提出物がリリース日を示す最も早期の信頼できるシグナルとなる——アリーナのリーダーボードにある無効エントリーのスクリーンショットをまた一枚見るよりも、はるかに有益だ。
それまでは、正確な言明は極めて限定的であり、それを守り通す価値がある。OpenAIの次期フラッグシップには、名前と、10個の機械的に検証可能な証明と、ワシントンでのデモがあるだけで、それ以外には何もない。誰かに日付を伝える者は推測しているにすぎず、誰かにパラメータ数を伝える者は捏造している。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
