GPT-5 Codex vs GPT-5.4 Mini 比較:ベンチマーク・料金・速度(2026年8月)

OrcaRouter 上で GPT-5 Codex(openai)と GPT-5.4 Mini(openai)を直接比較——価格、コンテキストウィンドウ、レイテンシ、スループット、benchmark 品質を並べて示し、ワークロードに最適なモデルを選べます。

結論

価格面では GPT-5.4 Mini の方が安価で——入力 tokens で GPT-5 Codex より約 40% 低いです。 レイテンシに敏感なワークロードでは、GPT-5 Codex の方が最初の token を早く返します。 benchmark 品質では、GPT-5.4 Mini が総合指数で先行します。 コストを最小化するなら GPT-5.4 Mini を、応答速度が最も重要なら GPT-5 Codex を選んでください。

無料で開始 · 1 つのキーで両モデル · プロバイダー原価、トークン手数料ゼロ

GPT-5 Codex と GPT-5.4 Mini はいずれも同じ OrcaRouter エンドポイント経由でプロバイダー原価・token 加算ゼロで利用できるため、両者の切り替えは 1 行の変更で済み、以下の数値がそのまま実際の支払額になります。

詳しい分析を読む

この比較はライブ料金、公表されている context window、そして OrcaRouter 自身が測定した latency と throughput を取得しており、ベンダーの宣伝用 benchmark に頼るのではなく、あなた固有のワークロードに対してコストとパフォーマンスを比較検討できます。適切な選択はほぼ常にトラフィックの形——プロンプト長、生成するテキスト量、ユーザーがどれだけ latency に敏感か、そして推論の難しさ——に左右されるため、以下のセクションでは 1 つの次元ずつこの判断を分解し、具体的な推奨で締めくくります。二つのモデルのいずれかで指標が欠けている場合、その行は推測せずに省いてあるので、ここでのすべての主張は実際の数値に裏づけられています。

ひと目で比較

  • 入力 $/100万$0.75GPT-5.4 Mini 40%
  • p50 レイテンシ1000 msGPT-5 Codex 71%
  • 品質8.0GPT-5.4 Mini 14%

モデル比較

GPT-5 Codex と GPT-5.4 Mini の価格、コンテキスト、レイテンシ、スループット、品質。
指標GPT-5 CodexGPT-5.4 Mini結論
入力 $/100万$1.25$0.75入力 tokens では、GPT-5.4 Mini は GPT-5 Codex より 40% 安価です。
出力 $/100万$10.00$4.50出力 tokens では、GPT-5.4 Mini は GPT-5 Codex より 55% 安価です。
コンテキスト400K400KGPT-5 Codex と GPT-5.4 Mini は同じコンテキストウィンドウを持ちます。
p50 レイテンシ1000 ms3457 ms中央値で、GPT-5 Codex は GPT-5.4 Mini より 71% 速く応答します。
スループット191 tok/s
品質7.08.0総合品質指数で、GPT-5.4 Mini は GPT-5 Codex より 14% 高いスコアです。

価格面では GPT-5.4 Mini の方が安価で——入力 tokens で GPT-5 Codex より約 40% 低いです。 レイテンシに敏感なワークロードでは、GPT-5 Codex の方が最初の token を早く返します。 benchmark 品質では、GPT-5.4 Mini が総合指数で先行します。 コストを最小化するなら GPT-5.4 Mini を、応答速度が最も重要なら GPT-5 Codex を選んでください。

両モデルを 1 つの API キーで。どちらから始めても、文字列を 1 つ変えるだけで切り替えられます。

API キーを取得

GPT-5 Codex と GPT-5.4 Mini を 1 つの API キーで使う

どちらか一方を選ぶ必要はありません。両モデルとも OrcaRouter の同じ OpenAI 互換エンドポイントで提供され、上流プロバイダーの料金そのままでトークン手数料はゼロです。切り替えはモデル名の変更だけ — 2 つ目のアカウントも SDK も別の認証情報も不要です。

だからこそ、上のトレードオフを本番で扱えます。重視する指標で優れているモデルに大半のトラフィックを流し、もう一方は本当に必要なリクエストに温存し、数値が変われば配分を変えればよいのです。

curl
# 1 つのキー、1 つのエンドポイント、両方のモデル。
curl https://api.orcarouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $ORCAROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-5-codex",
    "messages": [{"role":"user","content":"..."}]
  }'

# 文字列を 1 つ変えるだけでモデルを切り替えられます。
#     "model": "openai/gpt-5.4-mini"

実測:GPT-5 Codex vs GPT-5.4 Mini バトルモード

バトルモード — 両方を並べて試すライブ
プレイグラウンドで開く
OpenAI: GPT-5 Codex
$1.25 /M · p50 1000ms
OpenAI: GPT-5.4 Mini
$0.75 /M · p50 3457ms

料金とコスト分析

入力 token では GPT-5 Codex が 100 万あたり $1.25、GPT-5.4 Mini が $0.75、出力では 100 万あたり $10.00 対 $4.50 です。

詳しい分析を読む

請求額はたいてい出力 token で決まります。長い応答を生成するチャットや agent のワークロードは出力レートに支配されるため、入力では安く見えるモデルでも、エンドツーエンドではより高くつくことがあります。価格だけで選ぶ前に、実際の入力対出力の比率を見積もってください。検索が多く回答が短いプロンプトと、プロンプトが短く生成が長いケースは、この表の正反対に位置します。実用的な見積もり方法は、代表的なプロンプトのサンプルを取り、平均の入力・出力 token を数え、それぞれを両モデルの各レートに掛けることです。あなたの実際のミックスで blended(混合)コストが低いモデルこそ、超えるべき基準です。ここでの両価格は生のプロバイダーレート——OrcaRouter は一切加算しません——なので比較は同一基準であり、計算した節約はそのまま手元に残る節約です。

GPT-5 Codex は最大 400K token の context を受け付け、GPT-5.4 Mini は 400K を受け付けます。context window は、単一リクエストで送信できるソース素材——ドキュメント、コード、これまでの会話——の量の上限を定めます。

詳しい分析を読む

ウィンドウが大きいほど長い入力のチャンク分割や検索の配管を省けますが、送信した分はすべて入力 token レートで課金されるため、大きなウィンドウは割引ではなく能力です。ページ上の最大の数値ではなく、ワークロードが現実的に生み出す最長の単一リクエストにウィンドウを合わせてください。また、どのモデルでも非常に長い context の終盤では品質が低下しうることを念頭に置いてください。大きなウィンドウは、あらゆるリクエストを上限まで詰め込む免罪符ではなく、たまに来る長い入力への余裕として扱うのが最善です。

どちらの料金もプロバイダーの原価です。OrcaRouter は上乗せしないので、計算した節約額がそのまま手元に残ります。

無料で始める

トークン単価の比較

入力 $/100万
GPT-5 Codex$1.25
GPT-5.4 Mini$0.75
出力 $/100万
GPT-5 Codex$10.00
GPT-5.4 Mini$4.50

100万 tokens あたり

速度とレイテンシ

latency と throughput は、本番環境でのモデルの体感を左右します。中央値(p50)の応答 latency は、典型的なリクエストが最初の token を受け取るまでの待ち時間であり、throughput(1 秒あたりの token 数)は開始後に応答がストリーミングされる速さを決めます。

詳しい分析を読む

対話型チャットや agent ループでは、ユーザーが最初の token を待っているため低い p50 latency が最も重要です。バッチ生成や長文出力では、応答が長いため throughput が全体の所要時間を支配します。上の 7 日間トレンドチャートは、各モデルの latency が安定しているか変動しているかを示し、単一の宣伝数値では隠れてしまう点を明らかにします——平均は優秀でもテールがばらつくモデルは、厳格な p95 SLA を満たせないことがあります。製品に latency の予算があるなら、中央値と曲線の形の両方を読み、エンドツーエンドの latency にはネットワークのホップや、モデルの周りで行う検索・ツール呼び出しも含まれることを忘れないでください。

過去7日間で、GPT-5 Codex の方が中央値応答レイテンシが低く保たれています。

GPT-5 Codex
GPT-5.4 Mini

ベンチマークと品質

benchmark スコアは能力を近似しますが、自分のプロンプトでのテストの代わりにはなりません。ここに表示される総合品質指数は複数の公開評価を集約したもので、パーセンタイルは各モデルがカタログ内の比較可能な全モデルの中でどこに位置するかを示します——有用な絞り込みの目安であり、あなたのタスクでの保証ではありません。

詳しい分析を読む

汎用知能指数で先行するモデルでも、あなたの領域(コーディング、抽出、多言語、長 context 推論)では劣ることがあります。benchmark で候補を絞り込んだうえで、代表的なトラフィックの一部で両モデルを実際に走らせてください。トップラインの数値ではなく、あなたのユースケースに合う具体的な指数に注目してください。コーディング中心の製品はコーディング指数を、リサーチアシスタントは推論指数を重視すべきです。benchmark はモデルが更新されると古くなるため、自分の評価セットで確認する出発点の仮説として扱ってください。

GPT-5 Codex
38.9
AA Coding
比較対象モデルの 41% を上回る
126 中 74 位
37.0
AA Intelligence
比較対象モデルの 52% を上回る
128 中 62 位
98.7
AA Math
比較対象モデルの 95% を上回る
81 中 4 位
GPT-5.4 Mini
56.1
AA Coding
比較対象モデルの 68% を上回る
126 中 37 位
40.9
AA Intelligence
比較対象モデルの 64% を上回る
128 中 45 位
49.5
AA Math
比較対象モデルの 25% を上回る
81 中 61 位

どちらを選ぶべきか

コストが決定的な制約なら、実際の入力対出力の比率で安いモデルから始め、品質が届かない場合にのみ上位へ移してください。応答性が優先なら——ユーザー向けチャット、agent、誰かが待っているあらゆる場面——わずかな価格差よりも p50 latency と throughput を重視してください。

詳しい分析を読む

最も負荷の高い推論、コーディング、長 context の作業に取り組むなら、benchmark と context window の勝者を主役にし、割に合う場面では高いレートを受け入れてください。両モデルは同じ API の背後にあるため、低リスクな手は、実トラフィックの一部を両者に振り分け、自分のプロンプトでコスト・latency・回答品質を比較してから決めることです。よくあるパターンは階層化(tier)です。簡単で大量のリクエストの大半を安いか速いモデルに送り、より強力なモデルは本当に必要なリクエストのために取っておくことで、コストのごく一部で品質の恩恵の大半を得られます。どれを選んでも、切り替えは可逆に保ってください——数値や要件が変わった瞬間にトラフィックを元に戻せます。

あるいは選ばないという手も — 1 つのキーと 1 つのエンドポイントで、リクエストごとに振り分けられます。

両方を使う

おすすめ用途

  • コスト重視・大量処理GPT-5.4 Mini
  • 低遅延のチャットとエージェントGPT-5 Codex
  • 高難度の推論とコーディングGPT-5.4 Mini

GPT-5 Codex vs GPT-5.4 Mini よくある質問

GPT-5 Codex と GPT-5.4 Mini ではどちらが安いですか?
入力 tokens では GPT-5.4 Mini の方が安く、100万あたり $0.75、一方は100万あたり $1.25 です。
出力 token では GPT-5 Codex と GPT-5.4 Mini のどちらが安いですか?
GPT-5.4 Mini の方が出力料金が安く、100 万あたり $4.50 に対し、もう一方は 100 万あたり $10.00 です。生成が多いワークロードでは通常、出力料金が入力よりも重要なので、それに応じて比較検討してください。
GPT-5 Codex と GPT-5.4 Mini ではどちらが速いですか?
OrcaRouter のライブ測定では、GPT-5 Codex の方が中央値(p50)応答レイテンシが低いです。
benchmark では GPT-5 Codex と GPT-5.4 Mini のどちらのスコアが高いですか?
GPT-5.4 Mini が上に示した総合品質指数で先行していますが、benchmark の先行が特定領域に必ず引き継がれるわけではありません——標準化する前に自分のプロンプトで検証してください。
GPT-5 Codex と GPT-5.4 Mini のどちらを使うべきですか?
コスト、コンテキストウィンドウ、レイテンシ、benchmark 品質という優先度に応じて GPT-5 Codex と GPT-5.4 Mini を選んでください。上の表は各項目でどのモデルが勝つかを示しています。ワークロードで最も重要な項目に勝者を合わせてください。
GPT-5 Codex と GPT-5.4 Mini は OrcaRouter でどのように課金されますか?
いずれも上流プロバイダーのレートで token 加算ゼロで課金されます——プロバイダーに直接支払うのと同じ token 単価を、1 つの OrcaRouter API キーとエンドポイント経由で支払います。
GPT-5 Codex と GPT-5.4 Mini を同じコードで呼び出せますか?
はい。いずれも OrcaRouter の OpenAI-compatible API で公開されているため、モデル名を変えるだけで両者を切り替えられます——SDK の入れ替えも、別の認証情報も不要です。

GPT-5 Codex か GPT-5.4 Mini から始める

1 つのキー。両方のモデル。40 以上のプロバイダー。

プロバイダー原価で請求、トークン手数料はゼロ。無料で始めて、文字列 1 つでモデルを切り替え、決定はいつでも巻き戻せます。

無料アカウントを作成