「GPT-6 Astra Ultrafast」という見出し、サブタイトル「6倍のレート、あらゆるラインで」、そして「価格設定済みで一般提供中」と「高速レーンはセカンドモデルではない」と記された2つのバッジを備えた、Ultrafast ティア向けに生成されたタイトルカード。
Guides & Insights

GPT-6 Astra Ultrafast 6倍速:公表された料金表が実際にあなたに課すコスト

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

GPT-6 Astra Ultrafastは、2026年9月29日にウェイトリストではなくなりました。現在は公開価格付きの購入可能なサービス階層であり、その価格はすべての項目で標準のちょうど6倍です。基盤となるモデル——同社のフラッグシップであるGPT-6 Astraは2026年9月3日に提供開始——は変わっていません。DevDayで変わったのは、その上の高速レーンが一般提供されたことであり、同社のAPIドキュメントには、Ultrafastが「GPT-6 Astra向けに広く利用可能で、GPT-5.6 Sol向けにはプレビューアクセス」と明記されています。この階層を初めて予算項目に記載できるようになり、そこに記す数字は、100万入力トークンあたり60.00ドル、100万出力トークンあたり300.00ドルです。これは2026年9月30日時点の同社自身の料金ページから読み取ったものです。

そうなると、これはローンチ時の報道が答えた問いとは別の問いになる。今週興味深いのは、そのティアが存在することではない——プレビューが2026年8月13日に発表され、もう徹底的に報じ尽くされたからだ。興味深いのは、価格のなかったティアに今や価格が付いたという事実であり、そこから導かれる計算は、具体的かつ定量化可能な形で、芳しくない。6倍というのは、肩をすくめて受け流せるプレミアムではない。より少ないターン数で取り戻さなければならないプレミアムであり、それが可能かどうかは、モデルの性質ではなく、あなたのワークロードの性質によって決まる。

どの回線にも複数の保留がある。そして、それが最初に理解すべきことだ。

2026年9月30日にOpenAIの料金ページを見ると、GPT-6 AstraのUltrafast列は、一部の行だけに割増がかかるのではなく、Standard列の一律6倍になっている。これが重要なのは、リクエストの形を変えて最適化することで、それを回避することはできないという意味だからだ。

• GPT-6 Astra、Standardサービス、最大272,000入力トークンのリクエスト — 入力 $10.00、キャッシュ済み入力 $1.00、キャッシュ書き込み $12.50、出力 $50.00(100万トークンあたり)

• GPT-6 Astra Ultrafast、同一しきい値 — 入力 $60.00、キャッシュ入力 $6.00、キャッシュ書き込み $75.00、出力 $300.00(100万トークンあたり)。4項目すべてでちょうど6倍。

• 入力トークンが272,000を超えると、リクエスト全体の価格が再設定されます — Standardは$20.00 / $2.00 / $25.00 / $75.00に、Ultrafastは$120.00 / $12.00 / $150.00 / $450.00に移行します。依然として6倍です。OpenAIがGPT-6 Astraについて文書化しているロングコンテキストのルールでは、しきい値を超えるとリクエスト全体に対して入力とキャッシュのレートが2倍、出力が1.5倍となり、これは両方のティアにまったく同じように適用されます。

• 同じカード上の他のティア — BatchとFlexはStandardの50%、FastモードはStandardの2倍です。つまり、この1つのモデルの倍率のはしごは0.5x、1x、2x、6xで、最後の2つの間には段がありません。

Ultrafast には Batch に相当するものはありません。Batch と Flex は、スタンダードレーンでより緩いスケジューリングと引き換えに購入する割引です。ファストレーンには、低速で安価な版は存在しません。速度を求めるなら、送信するすべてのトークンと返ってくるすべてのトークンに対して 6x を支払うことになり、キャッシュ済み入力と新規入力をどう混ぜてもその比率が改善されることはありません。

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens for short-context requests, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, alongside gpt-5.6-sol at $4.00 / $0.40 / $5.00 / $20.00 short-context and $8.00 / $0.80 / $10.00 long-context, with the page's notes that data-residency endpoints carry a 10% uplift for models released on or after March 5, 2026, that FedRAMP carries a further 10%, that Priority processing was renamed Fast mode on July 30, 2026, and that GPT-5.6 Sol's promotional pricing is available at least through November 21, 2026.

1回の通話にかかる実際のコスト

具体的なリクエストを2つ挙げると、この抽象化は格段に理解しやすくなります。どちらもOpenAIが公開している100万トークンあたりの料金を用いたもので、計算自体は当方によるものです。

20,000入力トークンと2,000トークンの応答を伴う単発呼び出しは、Standardでは0.30ドルの請求になる — 20,000トークンが100万トークンあたり10ドルで0.20ドル、さらに2,000トークンが100万トークンあたり50ドルで0.10ドル。同じ呼び出しはUltrafastでは1.80ドルの請求になる。宣伝どおり、ちょうど6倍。

さて、実際にエージェントループを表すケースです。200,000トークンの会話で、190,000トークンがキャッシュ済みプレフィックス、新規はわずか10,000トークンで、1,000トークンのステップを生成します。Standardでは、キャッシュ読み取りに$0.19、新規入力に$0.10、出力に$0.05、つまり1ステップあたり$0.34を請求します。Ultrafastでは$1.14、$0.60、$0.30、つまり1ステップあたり$2.04です。これもまた6倍ですが、この内訳が何をもたらしたかを見てください。キャッシュはこのモデルで単一の最も効果的なコストレバーであり、それでもStandardレーンではちょうど6倍安いままです。したがって、キャッシュを多用するエージェントは高速ティアから比例的に何も得られず、割増料金も和らぎません。

帰結こそが、内面化する価値のある部分だ。倍率が一定なので、損益分岐点はあなたのトークン構成とはまったく関係ない。完全にターン数の問題だ。Ultrafast がワークロードで元を取れるのは、それを実行することで課金対象のターン数がおよそ6分の1に減るときだけだ — リトライループを1回のパスに畳み込むか、短い確認呼び出しの連続を、より高速な1回のインタラクティブセッションに置き換えるかによって。ワークロードが以前と同じターン数しか発行せず、ただ早くなるだけなら、あなたはちょうど6倍のレイテンシを買っているだけで、それ以外の何ものでもない。

レート制限と地理的条件は、公表されていない上限である

価格の外側には2つの制約があり、料金表を読んでいるときには見落としやすいものです。

第一はスループットです。GPT-6 Astra の Ultrafast はすべての API ユーザーが利用できますが、当初は低いレート制限となります。OpenAI のドキュメントでは、ティア1から3までは毎分50万トークン、ティア4は100万、ティア5は500万と記載されています。スピードを売りにしたティアにとって、これは現実的な上限です——20万トークンのエージェントコンテキストを毎分50万トークンで処理すると、低いティアでは毎分2.5リクエストになります。OpenAI 自身のガイダンスも、別の側面から同じ問題を指摘しており、リクエストごとのネットワークオーバーヘッドがそのティアが対価を払っているレイテンシを食いつぶしうるまさにその理由から、WebSockets を強く推奨しています。

2つ目はレジデンシーです。Ultrafast がサポートするのは、米国のデータレジデンシーとグローバル処理のみです。EU やその他の非米国リージョンの処理エンドポイントはサポートしていません。GPT-6 Astra のために EU レジデンシーエンドポイントに依存するデプロイを行う場合、このティアはいくら支払っても利用できません。これは設定上の選択ではなく、厳格な境界です。また、レジデンシーエンドポイントでは、2026年3月5日以降にリリースされたモデルに10%の割増料金が適用されますが、GPT-6 Astra はこれに該当します。

スピードの見出しは14倍から8倍に下がりました

これは慎重に述べる価値がある。なぜなら、ほとんどの報道で出回っている数字は古いからだ。OpenAIのUltrafastドキュメントページには、本日公開されている時点で、「当社最速のAPIサービスティアであり、Standardモード比最大8倍の速度」という一文が記載されている。2026年8月13日のGPT-5.6 Solのプレビュー発表では、「Standard処理比最大14倍高速」、そしてCerebrasハードウェア上で毎秒最大750出力トークンが約束されていた。

それらは同じ主張ではなく、その違いは撤回というよりむしろ論点のすり替えだ。14倍という数値は限定プレビューにおける GPT-5.6 Sol で測定されたもので、8倍という数値は、現在のこのティアについて OpenAI が公表しているものであり、GPT-6 Astra がその広く利用可能なモデルとなっている。Astra で14倍を前提に予算を組む人は、OpenAI が Astra について公表していない数値を前提に予算を組んでいることになる。誠実な読み方はこうだ。どちらの数値もベンダーが報告する出力スループットの上限であり、どちらもあなたのワークロードに対するレイテンシ保証ではなく、エンドツーエンドの時間には依然として入力処理、ツール呼び出し、そしてあなた自身のオーケストレーションが含まれる。計画用の数値としては8倍を採用し、それより良いものは、当てにするのではなく自分のトラフィックで検証するボーナスとして扱うべきだ。

これを月曜日にどうするか

算術から導かれる決定ルールは、マーケティングが示唆するよりも限定的であり、誰かがエステート全体でUltrafastを有効化しようと提案する前に、書き留めておく価値がある。

レイテンシー制約のあるワークロードではオンにし、かつ対話型で、人間が待っている場合に使う。インシデントのトリアージ、ライブサポートのエスカレーション、アナリストが一度の作業中に反復する研究ループ——これらは、答えが4分後にではなく今届くことの価値がトークン価格に比例しないケースであり、少数のターンで6倍の請求になっても、待っている人のコストよりは取るに足らないほど小さいケースだ。OpenAI自身がプレビュー発表で挙げた例は、まさにこの形だった:障害が進行する中でログを読み、夜通しの研究ループを1回の作業セッションに圧縮する。

スループット律速またはバッチ型のワークロードでは、オフのままにしておこう。夜間の再インデックス、一括分類パス、定期レポート、バックフィル——これらはいずれもウォールクロック遅延など気にせず、すべてトークン数に支配され、しかもどれにも Batch と Flex の同じ料金表にそのまま載っている 0.5 倍のオプションがある。早く終わらせるためにバッチ料金の 12 倍を払うのは、この表で最も明らかな金の無駄遣いだ。

厄介な中間領域はエージェント型コーディングループであり、そこでターン数の算術が決め手になる。速度が本当にリトライをなくすなら——タイムアウトと戦わないおかげで、モデルが複数ファイル変更の初回パスで成功する頻度が高まるなら——Ultrafast はトークンあたり6倍でも、完了タスクあたりでは安くなりうる。これは一般的な主張ではなく、あなた自身のトレースに関する測定可能な主張であり、測定は安価だ。両ティアで完了タスクあたりの課金ターン数を数え、レートを掛ければよい。比率が6に近くないなら、高速ティアはレイテンシの購入であり、そう正当化されるべきだ。

その階層には価格が付けられている。その周辺のルートは同じ問いではない。

これをどう運用するかについて、実務的な補足を1つ。標準サービスのGPT-6 Astraは、OrcaRouter上でopenai/gpt-6-astraとしてプロバイダー自身のレートで稼働しています。入力$10.00/出力$50.00(100万トークンあたり)、272Kのロングコンテキストでは$20.00/$75.00に段階が上がり、マークアップ0%で提供されます。つまりプロバイダーの定価がそのまま通過するため、ベンダー側の価格改定は、次の契約更新時ではなくOpenAIの料金表に反映された当日に、そのまま請求に反映されます。同じキーで200を超えるモデルにアクセスできるため、標準ティアは安価なティアや競合他社のモデルと同じクライアントの背後に、二つ目の連携を追加することなく置けます。

私たちが提供していないのは、Ultrafastティアです。これは個別にルーティング可能なモデルではなく、OpenAIアカウント上のサービスティアのフラグであり、service_tier: "ultrafast"を{{4}}gpt-6-astra{{/4}}へのリクエストで設定しますgpt-6-astra — そして、OpenAIから上記の料金でお客様ご自身のアカウントに請求されます。有効にすると、それはお客様の直接のOpenAI統合内に存在することになり、OrcaRouterは、それと併せてルーティングする標準ティアのトラフィックにこそふさわしい場所です。私たちが持っていない機能をほのめかすよりも、そう率直に述べるほうが役に立ちます。

A screenshot of the OrcaRouter model page for GPT-6 Astra, model id openai/gpt-6-astra, showing a 1M-token context window, 128K maximum output, text, image and file input, text output, public benchmarks attributed to OpenAI dated 2026-09-04, input price $10.00 and output price $50.00 per 1M tokens, p50 time to first token 4.69 s, a 10.00 s figure, and 155.1M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

決定ルールを1段落で

6倍なのはティアの価格であって、モデルの価格ではない。重み、1,050,000トークンのコンテキストウィンドウ、128,000トークンの出力上限、そして回答はすべて、標準のGPT-6 Astraと同一だ。あなたが買っているのは最大8倍高速な出力スループットであり、その料金表はどの項目も6倍で、初期の低いレート制限と、EUを完全に除外する米国居住制限が課される。このトレードオフは、回答を待つ人間にとっては明らかに正しく、半額レーンが利用可能なスケジュール済みバッチジョブにとっては明らかに間違っており、速度がターンを削減するかどうかで答えが変わるエージェントループにとっては、本当に判断がつかない。コミットする前に自分のトレースでターン数を測定し、残りは定価でルーティングせよ。

A screenshot of OpenAI's Ultrafast documentation page, showing the sentence 'Our fastest API service tier, with up to 8x faster speeds than Standard mode.', the sentence 'It is broadly available for GPT-6 Astra, with preview access for GPT-5.6 Sol.', the recommendation to use WebSockets because per-request network overhead can reduce the latency gains, the note that Ultrafast for GPT-6 Astra is available to all API users at low rate limits with higher limits or Sol preview access available through an OpenAI account team, and a Python code sample setting service_tier to 'ultrafast' with model 'gpt-6-astra'.

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新