
GPT-6 Astraの価格設定:3つの異なる価格がすべて正しい理由と、タスクに実際にかかるコスト
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451知能78コーディング
まず結論から: GPT-6 Astraの料金は100万入力トークンあたり10.00ドル、100万キャッシュ入力トークンあたり1.00ドル、100万出力トークンあたり50.00ドルは、OpenAIの標準ティアでの料金です。これはOpenAI自身の定価であり、OpenAI自身の料金ページを2026年9月16日時点で確認して読み取ったものです — そして、この日付が重要なのは、このモデルは時期によって価格が異なっており、読者がそうした別の数字を今も見つけ続けているからです。 GPT-6 Astra自体は2026年9月3日にリリースされ、このページの13日前にあたります。これはローンチ記事でも発表記事でもありません。現在は一般提供されており、今週時点では一般展開されているモデルのリファレンスページです。 GPT-5.6 Solは、以下ではAstraがその上に価格設定されるベースラインとして登場しており、主題ではありません。
料金表に1ページ丸ごと必要になるのは、出回っている数字が食い違っているからだ。このモデルの価格を検索すると、OpenAIの$10/$50、$5/$25のバッチ料金、Azureの見積もりが$10/$50と$11/$55の両方、そして少なくとも1つのエンドポイントでは$20/$100という掲載が見つかる。それらのどれもタイプミスではないし、どれも定価がこっそり変更されたものでもない。それらは異なるサービスレベルと異なる再販業者であり、それらを見分けることが、予算と当てずっぽうの違いになる。
すべての行にラベルと日付が付けられた料金表
このセクションの内容はすべて、2026年9月16日時点でOpenAI自身のAPI価格およびモデルのドキュメントから読み取ったものです。数値が他者に由来する場合は、その文でその旨を明示しています。
• 標準、入力トークン272,000以下のリクエスト — 入力100万トークンあたり$10.00、キャッシュ済み入力100万トークンあたり$1.00、キャッシュ書き込み100万トークンあたり$12.50、出力100万トークンあたり$50.00(OpenAI自身の価格表、2026-09-16閲覧)。
• キャッシュ書き込みの行は実在するのに、多くの人が見落としている — プレフィックスを初めて送信するとき、それは1Mあたり$12.50の書き込みであり、$1.00の読み取りではない。キャッシュ書き込みは標準入力料金の1.25倍で課金される。
• Standard、272,000入力トークンを超えるリクエスト — 100万トークンあたり入力$20.00、キャッシュ済み入力$2.00、キャッシュ書き込み$25.00、出力$75.00。このラインを超えたトークン分だけでなく、リクエスト全体の料金が再計算されます(OpenAI自身の価格表、2026-09-16閲覧)。
• バッチおよび Flex — 標準の半額:100万トークンあたり入力 $5.00、キャッシュ済み入力 $0.50、キャッシュ書き込み $6.25、出力 $25.00(OpenAI 自身の価格表、2026-09-16 時点)。入力が 272K を超える場合、バッチ料金は $10.00 / $1.00 / $12.50 / $37.50 です。
• 高速モード — ダブルスタンダード:入力 $20.00、キャッシュ入力 $2.00、キャッシュ書き込み $25.00、出力 $100.00(100万トークンあたり)(OpenAI 自身の料金表、2026-09-16 閲覧)。
• 請求額を左右するモデル仕様 — コンテキストウィンドウ 1,050,000トークン、最大入力 922,000、最大出力 128,000、ナレッジカットオフ 2026-04-30、推論トークン対応:あり、推論エフォート値:low / medium / high / xhigh / max(OpenAI自身のモデルドキュメント、2026-09-16閲覧)。
一文でまとめた版が欲しいなら、標準ティアでは、入力トークンが272K未満に収まるリクエストは入力100万トークンあたり10ドル、出力100万トークンあたり50ドルで、キャッシュ読み取りは入力レートの10分の1であり、この記事のそれ以外はすべて、より遅い処理を受け入れることによる割引か、しきい値を超えることによる追加料金のどちらかです。
なぜ別の数字が表示されるのか、そしてどちらがどちらなのか
5つの異なる事柄が、$10/$50ではない見積もりを生み出します。そのうち4つはドキュメントに結び付けられます。1つは結び付けられませんが、推測するのではなく、その旨を明言します。
$5/$25はバッチ階層であり、それはOpenAI自身の価格です。 これは再販業者の割引でも、交渉されたエンタープライズ料金でもありません。OpenAIの価格ページではバッチ処理が標準料金の半額と記載されており、Astraのバッチ行は入力$5.00、出力$25.00となっています。ある情報源が$5/$25を別のモデルかのように提示しているなら、それは同じモデル、同じ重みで、より遅いキュー上にあるものです。バッチは一晩かけての評価実行には正しい選択であり、インタラクティブな用途には間違った選択です。
$11/$55はまさにリスト価格に対する10%の上乗せであり、OpenAIはレジデンシーエンドポイントについて10%の上乗せを文書で明示している。 OpenAIの価格ページには、2026年3月5日以降にリリースされたモデルについては、レジデンシーエンドポイントに10%の上乗せが課されると記載されている。GPT-6 Astraは2026年9月3日にリリースされたので、これに該当する。リスト価格に1.1を掛けると、1セントの単位まで正確に$11.00と$55.00になる。これは、より高額なAzure風の見積もりがどこから来るのかについての有力な説明だ——リセラーがマージンをでっち上げているのではなく、レジデンシーに紐づいたエンドポイントが文書化された上乗せをそのまま適用しているのだ。ただし、この主張の限界については正確を期すべきだ。上乗せはOpenAIによって文書化されており、計算も完全に一致するが、我々が目にした特定のAzureの掲載情報自体は、それがレジデンシーエンドポイントであるとは述べていない。確定した説明ではなく、有力な説明として扱うべきである。
$20/$100は、このモデルに対するOpenAIのFastモード料金です。これは、いかにも偽の数字に見えて、最も偽物ではないものです。Fastモードではすべての料金行が2倍になり、Astraの標準のFast行は100万トークンあたり入力$20.00、出力$100.00です。$20/$100を提示しているエンドポイントは、別のサービスレベル——優先処理——を提示しているのであって、別の定価を提示しているのでも別のモデルなのでもありません。Astraの名前の隣にこの数字が表示されるなら、尋ねるべきはどのベンダーかではなく、どの処理階層かです。
定価を下回る価格は存在するが、それは他社のマージンである。 サードパーティのゲートウェイや再販業者はAstraを定価以下で宣伝している。あるゲートウェイはOpenAIの料金より約20%低い価格を公に提示している。それはその運営者による商業的判断であり、OpenAIによる価格変更ではない——そしてそれはその運営者が適用するデータ処理と信頼性に関する条件を伴う。我々は彼らを名指ししたり、彼らの割引をこのモデルの価格に関する証拠として数えたりするつもりはない。なぜならそれはOpenAIの料金表ではなく、彼らのビジネスに関する証拠だからである。
確認できなかったこと ルーターの一覧で、モデルが gpt-6-astra と表示され、バッチ階層が $5/$25、そして ~openai/gpt-astra-latest という形の可変エイリアスが示されているのを確認しました。バッチの数値は OpenAI の自社ページと照合して一致します。エイリアスはゲートウェイの構成物です。OpenAI のモデルドキュメントでは、snapshots の下にエントリがちょうど 1 つだけ記載されており、それは日付なしの gpt-6-astra で、日付付きの形式も -latest エイリアスもありません。ベンダーが公開したかのように、ゲートウェイのエイリアスをコンフィグに入れないでください。別途、個別価格の「Astra Pro」「Astra-Medium」あるいは同様の階層について、OpenAI のドキュメントは見つかりませんでした。「Pro」は ChatGPT のプラン名には現れますが、API の料金表にはありません。また、ルーターの一覧はベンダーのドキュメントではありません。階層を確認する必要があるなら、OpenAI の自社ページで確認してください。

OpenAIの料金表の他の項目と並べたAstra
価格は、同じカード上の代替案と並べて初めて意味を持ちます。これらはすべてOpenAI自身の標準料金で、すべて2026年9月16日時点のもので、すべて100万トークンあたり、すべて272K入力以下です。
• GPT-6 Astra — 入力 $10.00 / キャッシュ $1.00 / 書き込み $12.50 / 出力 $50.00。
• GPT-5.6 Sol — 入力 $4.00 / キャッシュ $0.40 / 書き込み $5.00 / 出力 $20.00。
• GPT-5.6 Terra — 入力 $2.00 / キャッシュ $0.20 / 書き込み $2.50 / 出力 $12.00
• GPT-5.6 Luna — 入力 $0.20 / キャッシュ $0.02 / 書き込み $0.25 / 出力 $1.20。
• ロングコンテキスト版 — Astra $20.00 / $2.00 / $25.00 / $75.00; Sol $8.00 / $0.80 / $10.00 / $30.00; Terra $4.00 / $0.40 / $5.00 / $18.00; Luna $0.40 / $0.04 / $0.50 / $1.80.
あの表の下ではプロモーションが実施されていて、それがみんなが議論する倍率を決めている。 OpenAIの価格ページには、GPT-5.6 Solのプロモーション価格が少なくとも2026年11月21日までは利用可能だと記載されている。今日実際に適用されているプロモーション料金と比べると、Astraはどの項目でもSolの2.5倍 — 入力で2.5倍、キャッシュ入力で2.5倍、出力で2.5倍だ。Solの非プロモーション料金である入力$5.00、出力$30.00と比べると、Astraは入力で2倍、出力で約1.67倍になる。どちらの倍率も算術的には正しく、同じ日の同じ2つのモデルについて述べている。違いは完全に、分母としてどのSol料金を使うかという点にあり、「AstraはSolの2.5倍なのか?」という問いに対する正直な答えはこうだ。イエス、2026年11月21日まで、あるいはOpenAIがプロモーションを終了するとき、そのどちらか早い方まで。
私たちがこの点を詳しく述べるのは、このブログも含め、このモデルに関する報道で最もよくある誤りだからです。1つのSolレートを黙って選びながら、それを明示しないトークンあたりの倍率は、Astraに関する事実ではありません。それは、その文がいつ書かれたかに関する事実です。

タスクごとのコスト、トークンごとのコストではない
OpenAI自身の説明では、このモデルのトークン価格を比較するのは誤った比較です。なぜならAstraは、より少ないトークンとより少ない再試行で長期的な作業を完了するように設計されているからです。その主張は、ただ繰り返すのではなく、実際に計算してみるだけの真剣な検討に値します。そこで、自分のワークロードに合わせて前提を変更できるよう、前提を先に明示した計算例を挙げます。
ワークロード:200回の呼び出しからなるエージェント実行で、一晩の移行処理のような形です。各呼び出しは10,000個の入力トークンを持ち、そのうち8,000個がキャッシュ読み取り、2,000個が新規で、500個の出力トークンを生成します。実行全体では、400,000個の新規入力トークン、1,600,000個のキャッシュ済み入力トークン、100,000個の出力トークンに加え、プレフィックスをシードするための10,000トークンのキャッシュ書き込みが1回あります。Standard階層で、1リクエストあたり272K未満なので、長コンテキストの割増は適用されません。
• GPT-6 Astra — 新規 0.4M x $10.00 = $4.00、キャッシュ済み 1.6M x $1.00 = $1.60、書き込み 0.01M x $12.50 = $0.13、出力 0.1M x $50.00 = $5.00。合計 $10.73。
• GPT-5.6 Solのプロモーション料金 — 新規 $1.60、キャッシュ $0.64、書き込み $0.05、出力 $2.00。合計 $4.29。
• GPT-5.6 Solの非プロモーション料金 — 新規 $2.00、キャッシュ $0.80、書き込み $0.06、出力 $3.00。 合計 $5.86。
• GPT-5.6 Terra — 新規 $0.80、キャッシュ $0.32、書き込み $0.03、出力 $1.20。 合計 $2.35。
• GPT-5.6 Luna — 新規 $0.08、キャッシュ $0.03、書き込み $0.00、出力 $0.12。合計 $0.23。
同じトークン数で比べると、Astra は Luna の約46倍、Terra の約4.6倍になる。Luna を買って Astra 並みの仕事をさせる人はいないし、その脚注こそ、これら2モデル間のトークンあたりコスト比較が芝居にすぎない理由のすべてだ。決定的なのは Sol との比較なので、重要な数字はこれだ。
損益分岐点は40%です。Solのプロモーション料金では、Astraはどの料金項目でもちょうどSolの2.5倍なので、Astraは同じタスクでSolのトークンの最大40%を消費しても同じ請求額に収まります。しかも比率が一律なので、新規入力、キャッシュ済み入力、出力のどの組み合わせでもこれが当てはまります。AstraがSolのトークンの3分の1を使うなら安くなり、半分を使うなら高くなります。Solのプロモーション適用外料金と比べると、このキャッシュ多用の組み合わせでは損益分岐点は約55%まで緩和されます。なぜならAstraの出力倍率は1.67倍に下がり、入力倍率は2倍に下がるからです。
その単一の数値こそが有用であり、ベンダーの主張と独立した測定が一致しなくなるのはそこだ。OpenAIは、Terminal-Bench 4.0について、Astraが57.9%、GPT-5.6 Solが37.3%で、タスクあたりの推定APIコストが約9%低いと報告している——ベンダー報告による。Artificial Analysisは、2026年9月9日に公表された独立評価で、自社のCoding Agent Indexにおいて、AstraがタスクあたりSolの約3分の1のトークンを使用していると測定し、それでも最大エフォート時のAstraはタスクあたり$7.09——Sol(max)より約15%高い——で、スコアは7ポイント高いことが分かった。同じ評価は、自社のIntelligence Indexで、エフォートレベル全体にわたりAstraをタスクあたり$0.82から$3.26の間に位置づけ、最大エフォート時のSolより約60%高価だった。
その両方が同時に真であり得るし、その間の隔たりこそが正直な見出しだ。トークン節約は現実であり、しかも大きい――3分の1は、40%の損益分岐点を超えるまさにそういう類の数字だ――しかし、出力トークンで測った節約は、長いエージェントセッションを支配するキャッシュ読み取りと新規入力の項目を縮めはしない。AstraがタスクあたりでSolより安いかどうかは、あなたの構成次第であり、ワークロード間で方向は反転する。Astraは単に安い、あるいは単に2.5倍高いと言う人は、請求書の一行をあたかも総額であるかのように引用しているだけだ。
このモデルで実際に請求額を左右するのは何ですか
三つの点が際立っており、その三つはいずれも、Astraが想定されている使われ方に固有のものです。
推論トークンは出力トークンです。 これらは100万あたり$50.00で課金され、可視出力と同じです。OpenAIのモデルページには、サポートされるエフォート値としてlow、medium、high、xhigh、maxが記載されており、無効化設定はありません — 下限は旧モデルより高くなっています。独立系のIntelligence Index測定では、lowとmaxエフォートの差はタスクあたり$0.82~$3.26で、同一の作業で4倍でした。エフォートレベルはあなたが制御できる最大の単一コストレバーであり、グローバルではなく呼び出しごとに設定する価値があります。
リトライはあらゆるものを倍増させる。 失敗して再実行するエージェントは、プレフィックス全体のコストをもう一度支払うことになる。これがOpenAIの「リトライ削減」という主張の背後にある仕組みであり、トークンあたりの計算がどちらの方向にも誤解を招く理由でもある。トークンあたり2.5倍のコストがかかっても1回で完了するモデルは、3回必要とするより安価なモデルを上回りうる。Astraを何かと比較評価するなら、トークンあたりのドルではなく、1ドルあたりの完了タスク数を測定すべきだ。
ロングコンテキストは設計上のモードであり、割増料金がかかります。 ウィンドウは1,050,000トークンです。1回のリクエストで入力トークンが272,000を超えると、超過分だけでなく、リクエスト全体が100万トークンあたり入力$20.00、出力$75.00で再計算されます。280,000トークンのリクエストは、入力が約4%多いだけで、270,000トークンのリクエストのほぼ2倍のコストになります。長期的な作業向けに作られたモデルでは、これが気づかないうちに予算を吹き飛ばす最も簡単な方法であり、長期的なタスクを272K未満のリクエストに分割する方が、モデルが全体を処理できるにもかかわらず、通常は全体を送るより安上がりである理由でもあります。
その相殺要因はキャッシュであり、長いエージェントセッションが実際にコストを節約できるのはまさにそこだ。キャッシュされた読み取りは新規の$10.00に対して$1.00で、90%の削減になり、長いセッションでは同じプレフィックスを何十回も再送信する。$12.50のキャッシュ書き込みは一度だけ支払えばよい。上記の計算例では、すべての呼び出しが8,000トークンのプレフィックスをキャッシュなしで再送信しなければならなかったとしたら、Astraの請求額は$10.73から約$25.00に増えただろう — キャッシュは予算に対して、他のどの単一項目よりも大きな働きをしている。
複数に関する記録
このブログのいくつかのページ、たとえばGPT-6 Astra 対 GPT-5.6 Sol:2.5倍の価格はそれだけの価値があるのか?やGPT-6 Astra の需要で新規の $200 ChatGPT Pro 登録が一時停止では、Astra が GPT-5.6 Sol のトークン価格の 2.5 倍で掲載されていると述べています。この数字は、入力 $4.00、出力 $20.00 という Sol のプロモーション料金を基準に算出されたもので、これは OpenAI の価格ページに現在掲載されている料金で、少なくとも 2026 年 11 月 21 日まで利用可能なプロモーションとして説明されています。
つまり、その倍率が正しくなくなったわけではない — 以前のページにはなかった有効期限が付いたのだ。Solの非プロモーション料金である入力$5.00、出力$30.00に対して、Astraは入力が2倍、出力が約1.67倍であり、2.5倍ではない。2.5倍と書かれているページは、プロモーション期間について述べているものとして読むべきだ。比較の方向性は変わらないが、プロモーションが終了した瞬間に差の大きさは5分の1から3分の1だけ縮小する。2026年11月21日以降の予算を立てる人は、Solの分母として$5.00と$30.00を、Astraの倍率として2x / 1.67xを使うべきだ。私たちはそれらのページの議論を繰り返しているのではない — そこでのベンチマークと信頼性に関する推論はそれ自体で成り立っている — それらが計算の基準にしていた分母を訂正しているだけだ。
{{1}}「無料」{{/1}}という疑問に、曖昧さなしに答える
このモデルには無料枠がなく、無料のAPI経路もありません。FreeおよびGoのChatGPTユーザーはGPT-6 Astraをまったく利用できません。Plus加入者はChatGPT WorkとCodexを通じてのみ利用でき、通常のチャットでは使えません。APIは最初のトークンから、入力100万トークンあたり$10.00で課金され、その数値を下げる最も安価で正当な方法は、100万あたり$5.00のバッチ階層で、能力ではなくレイテンシを犠牲にします。無料のGPT-6 Astra APIアクセスを宣伝している人は、何かを再販しています — 通常は、独自のデータ条件を持つサードパーティゲートウェイ上のトライアルクレジットプールです。それは必ずしも悪い取引ではありませんが、無料ではなく、OpenAIでもありません。
API ではなくサブスクリプションを前提にキャパシティプランニングを行っているなら、知っておく価値がある。2026年9月10日、OpenAI は Astra への需要を理由に、200ドルの ChatGPT Pro プランへの新規登録とアップグレードを一時停止した。100ドルのプラン、Plus、Go、API、および Business と Enterprise のアカウントは引き続き利用可能だった。消費者向けは利用制限を受けたが、API とエンタープライズのアクセスは制限されなかった。あなたの計画が消費者向けサブスクリプションの利用枠に依存しているなら、まさにそれがモデル化すべきリスクだ。
それをルーティングすること、そしてルーターが解決しないもの
Astra は、OrcaRouter を通じてopenai/gpt-6-astraとして利用できるモデルのひとつで、ベンダーが課すのと同じ入力 $10.00/出力 $50.00、そして弊社のモデルページに記載の 272K 超の段階制が適用されます。弊社はプロバイダーの定価を 0% のマークアップでそのまま通しており、これはほとんどのモデル以上にこのモデルで重要なことです。この記事に載っている数字は、このモデルの提供期間中にすでに一度動いており、パススルー価格は、誰かが表を更新しようと思い出したときではなく、ベンダーが動かしたその日に動きます。

ここでルーティングを選ぶ率直な理由は、価格ではありません。値引きを売り込むものなどないからです。理由は、上記のコスト計算がワークロード次第であり、実際に動かしてみるまで、40%の損益分岐点のどちら側に着地するか分からないという点にあります。AstraをSol、Terra、Lunaと並んで単一のエンドポイントの背後に置けば、自社のトラフィックで1ドルあたりの完了タスク数を測定でき、2つ目の契約やコード変更なしにモデルを切り替えられます。ルーティングDSLを使えば、本番パスを1つのモデルに固定するのではなく、複数のモデルにまたがる呼び出しを構成でき、自動フェイルオーバーは、このモデルがすでに2度示したケース——それに対する需要がキャパシティを上回りうるというケース——をカバーします。
トレードオフも同じく現実であり、名指しする価値があります。ルーターはリクエスト経路における1ホップであり、長期的な自律作業を売りとするモデルでは、その1ホップは障害領域に加わるもう一つの要素です。それに対する許容度がゼロなら、ベンダーに直接問い合わせてください。この記事のいくつかの事柄は、直接の関係においてのみ存在します。OpenAIが対象となるAPI顧客にサポート対象エンドポイントで提供するZero Data Retentionオプションは、OpenAIの承認を条件とします。またエンタープライズ有効化は——ローンチ時点ではデフォルトでオフであり、管理者が適用される料金表に基づいてオンにするものですが——あなたとOpenAIとの間の合意であり、ルーターが付与できるものではありません。OpenAIはまた、このモデルのFastモードはEUデータレジデンシーでは利用できないと文書化しているため、レジデンシーと速度を同時に必要とするなら、その制約はルートではなくモデルに付随します。そして、ルーターの0%のマークアップは割引ではありません。当社は直接利用するより安いのではなく、同じ価格で、保守すべき統合が少ないだけです。
何を見るべきか
日付が1つ、数字が1つ。日付は2026年11月21日――Solのプロモーション価格がもはや保証されなくなる日であり、もしそれが失効すれば、Solに対するAstraの倍率は、入力で2.5倍から2倍、出力で1.67倍に下がり、出回っているあらゆるタスクあたりコストの比較は、Astraについて何一つ変わらないまま、Astraにとって5分の1から3分の1ほど有利になる。数字のほうは、あなた自身の損益分岐点だ。代表的な長期的タスクを1つ、両方のモデルで実行し、完了したタスク数と総額を数えれば、このページを含め、公表されているどんなものよりも役に立つ答えが得られる。
AstraをSol、Terra、Lunaと並ぶ単一のエンドポイントの背後に置くことで、自社のトラフィック上で1ドルあたりに完了できるタスクを測定でき、2つ目の契約やコード変更なしにモデルを切り替えられます。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
