テキストのみのGPT-4oモデルをプレビュー。128Kコンテキスト、16K出力、OrcaRouter API経由でアクセス、100万トークンあたり$2.50/$10。
このモデルはOpenAIによるプレビューリリースであり、テキストのみの入力に制限されています。OrcaRouterのAPI経由でアクセスする場合、識別子は openai/gpt-4o-search-preview-2025-03-11 となります。このモデルは128,000トークンのコンテキストウィンドウを提供し、レスポンスあたり最大16,384トークンを生成可能です。入力モダリティはテキストに限…
テキスト専用のGPT-4oプレビューは、多岐にわたるドメインで自然言語の理解と生成に優れています。文書の要約、質問応答、創作執筆、翻訳、コード生成が可能です。大きなコンテキストウィンドウにより、非常に長い文章でも一貫性を維持できるため、書物分析や大規模なログの処理などのタスクに適しています。チャット形式のシステム、ユーザー、アシスタントメッセージをサポートします。このモデルのゼロショットおよび少数ショット推論能力は、GPT-4クラスのモデルに典型的であり、広範な微調整を必要とせずに複雑な指示を処理できます。
タスクにGPT-4oの完全な推論能力が必要ない場合は、OrcaRouterからより小規模または安価なモデル(例:openai/gpt-4o-mini や gpt-3.5-turbo)の使用を検討してください。安価なモデルに適したタスクの例としては、単純な分類、短いコンテンツ生成、限られたコンテキストでの基本的なQ&Aなどがあります。プレビューモデルのコストは、大量かつ低複雑性のリクエストには正当化されない場合があります。さらに、マルチモーダル入力が必要な場合、このモデルは画像や音声を処理できません。その場合は別のモデル(例:標準のGPT-4oやGPT-4V)が必要になります。常に品質とトークンあたりのコストのトレードオフを評価してください。
このモデルは「search-preview」バリアントとして識別されていますが、公開されている仕様には特定のツール使用やウェブ検索機能の詳細は記載されていません。テキスト専用であり、標準的な言語モデルとして動作します。ユーザーは組み込みの検索や取得機能を想定すべきではありません。拡張生成のためには、取得拡張生成(RAG)パイプラインを別途実装し、取得したドキュメントをモデルのコンテキストウィンドウに提供することができます。OrcaRouterはツール使用のミドルウェアを追加せず、モデルはトレーニングと提供されたプロンプトにのみ基づいて応答します。将来のバージョンではこの動作が変更される可能性がありますが、プレビューの時点ではツール統合は文書化されていません。
プレビュー版として、このモデルは安定版リリースと比較して予期しない動作や信頼性の低下を示す可能性があります。テキストのみ対応のため、マルチモーダルリクエストはすべて拒否されます。最大出力16,384トークンは十分な量ですが、非常に長い生成では切り捨てられる場合があります。モデルの知識カットオフ日やトレーニングデータは指定されておらず、ごく最近の出来事を認識できない可能性があります。モデルが更新または削除される可能性があるため、本番環境での使用は推奨されません。また、プレビュー版であるため、安定版モデルよりレイテンシが高くなる可能性があります。大規模に展開する前に必ず十分にテストしてください。
この特定のプレビューバージョンに関する具体的なベンチマークスコアは提供されていません。GPT-4oのバリアントとして、一般的な言語タスクでは標準のGPT-4oと同様のパフォーマンスが期待されますが、正確な数値は開示されていません。ユーザーは公開データセットを使用して独自の評価を実行できます。大きなコンテキストウィンドウにより、長文書のベンチマークでは有利ですが、プレビュー版であるため、スコアはプロダクションモデルと異なる可能性があります。権威ある数値については、GPT-4oのOpenAI公式ベンチマークレポートを参照してください。OrcaRouterはモデルの出力やパフォーマンスを変更しません。
このプレビューモデルのレイテンシとスループットの数値は公開されていません。プレビュー版であるため、実験的なインフラストラクチャにより、安定版のGPT-4oよりも遅くなる可能性があります。応答時間は、入力長、出力長、および同時リクエスト数に依存します。OrcaRouterは通常のAPIルーティングを超える追加のレイテンシを発生させません。開発者は、典型的なペイロードでサンプルリクエストを実行することで速度を推定できます。安定したパフォーマンスが必要な本番アプリケーションでは、プレビューの特定機能が必要でない限り、安定版のgpt-4oモデルの使用を検討してください。
GPT-4クラスのモデルは、数学、論理、常識推論を含む様々な領域での強力な推論で知られています。このプレビューはそれらの能力を受け継ぐと期待されています。大きなコンテキストにより、以前の部分を見失うことなく、多くのステップにわたる複雑な連鎖思考推論が可能になります。ただし、この正確なバージョンに関する具体的な推論ベンチマークは提供されていません。ユーザーは自身のドメイン固有のタスクで性能を検証する必要があります。このモデルは以前のGPTバージョンと比較して指示追従が改善されている可能性がありますが、繰り返しになりますが、独立した検証が推奨されます。
プレビュー版であることに加え、このモデルはマルチモーダルに対応していません。画像、音声、動画を直接処理することはできません。ナレッジカットオフ日は不明なため、トレーニング後のイベントに関する情報が不足している可能性があります。16,384トークンの出力制限は十分なものの、1回の生成で非常に長いテキストを生成することはできません。長い出力が必要な場合は、反復的なプロンプト入力や分割が必要です。また、プレビュー版では特定のセンシティブなトピックに対してエラー率や拒否率が高くなる可能性があります。英語以外の言語でのパフォーマンスは異なる場合があります。デプロイ前に必ず代表的なデータでテストしてください。
このモデルの料金は、入力トークン100万個あたり2.50ドル、出力トークン100万個あたり10.00ドルです。これらはOpenAIのプロバイダー料金であり、OrcaRouterはマークアップを追加しません。例えば、1万トークンのプロンプトを処理し、1,000トークンを生成する場合、入力にかかる費用は約0.025ドル、出力は0.01ドルで、合計0.035ドルとなります。コストはトークン使用量に比例して増加します。APIゲートウェイとしてOrcaRouterを使用しても追加料金は発生しません。予期せぬ料金が発生しないよう、使用状況を必ず監視してください。タスクにフル機能が必要ない場合は、より安価なモデルと比較検討してください。
OrcaRouterは現在、このモデルに対してボリュームディスカウントやトークンキャッシングを提供していません。すべての請求は、プロバイダーレートに基づく実際のトークン使用量による従量課金制です。OrcaRouterによるプロンプトやレスポンスのキャッシングは行われず、各リクエストは独立して処理されます。非常に高いスループットが必要な場合は、カスタム契約の可能性についてOrcaRouterにお問い合わせください。コスト最適化のためには、短いプロンプトの使用、コンテキストの効率的な再利用、または呼び出しのバッチ処理をご検討ください。このモデルはキャッシュ機構を備えていないため、キャッシュヒットに対する割引料金は提供されません。
$2.50/$10 per million tokensのこのプレビューは、標準のGPT-4oと同程度の価格設定ですが、若干異なる場合があります。より安価な代替案としては、openai/gpt-4o-mini(約$0.15/$0.60 per million)やgpt-3.5-turbo(約$0.50/$1.50)があります。品質が多少劣っても構わないタスクでは、これらのモデルで大幅なコスト削減が可能です。プレビューモデルのコストは、OrcaRouterカタログの中でも高めの部類です。テスト目的のみで使用する場合、リクエスト数によっては中程度のコストが発生する可能性があります。予想されるトークン使用量を常に評価し、より大きなモデルを使用した場合の品質向上と比較してください。
このモデルを使用するには、APIクライアントのベースURLを https://api.orcarouter.ai/v1 に設定し、モデルIDとして openai/gpt-4o-search-preview-2025-03-11 を指定してください。OrcaRouterが発行したAPIキーを使用する必要があります。APIは完全にOpenAI互換であるため、OpenAIのchat completionsエンドポイント向けに作成された既存のコードは最小限の変更で動作します。curlを使用した呼び出し例: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_ORCAROUTER_KEY" -H "Content-Type: application/json" -d '{ "model": "openai/gpt-4o-search-preview-2025-03-11", "messages": [{"role": "user", "content": "Hello"}], "max_tokens": 100 }'
OpenAIがサポートするすべての標準的なチャット補完パラメータを使用できます:'messages'、'max_tokens'、'temperature'、'top_p'、'frequency_penalty'、'presence_penalty'、'stop'、'n'。このモデルは128,000トークンのコンテキストウィンドウをサポートしているため、'max_tokens'は最大16,384まで設定できます。'temperature'はランダム性を制御し、値の範囲は0から2です。リアルタイム応答のためには'stream'がサポートされています。OrcaRouterは追加のパラメータを導入しません。リクエストがトークン制限に準拠していることを確認してください。コンテキストウィンドウ(応答を含む)より長い入力は切り捨てられるか、エラーが返されます。
移行は簡単です。OpenAIのベースURL(https://api.openai.com/v1)をOrcaRouterのベースURL(https://api.orcarouter.ai/v1)に置き換えてください。APIキーをOrcaRouterのキーに変更します。モデルフィールドをopenai/gpt-4o-search-preview-2025-03-11に更新してください。それ以外のコード変更は不要です。別のOpenAIモデルを使用していた場合も、同じコード構造を引き続き利用できます。OrcaRouterはすべての標準パラメータを透過的に渡します。移行後は、レスポンスが一貫していることを確認してください。なお、請求はOrcaRouterが処理するため、そちらでアカウントを作成する必要があります。
OrcaRouterは、このプレビューモデルに関する具体的なレート制限を公開していません。可用性はOpenAIのインフラストラクチャとOrcaRouterのゲートウェイ容量に依存します。本番アプリケーションでは、モデルのプレビュー状態と潜在的な不安定性を考慮してください。OrcaRouterは、悪用を防ぐために合理的な利用制限を課す場合があります。ベストエフォート型のサービスを期待できますが、SLAは提供されません。スループットを保証する必要がある場合は、専用オプションについてOrcaRouterにお問い合わせください。また、モデルは予告なく削除または置き換えられる可能性があるため、フォールバックモデルを計画してください。
標準のGPT-4oモデル(openai/gpt-4o)はマルチモーダル対応の安定版リリースであり、一方で本プレビュー版はテキストのみ対応で、早期テストを目的としています。プレビュー版には、標準バージョンにはまだ含まれていない今後の機能が含まれる可能性がありますが、信頼性が低下する場合もあります。価格は同程度です。標準モデルの方がより広い入力サポート(画像、音声)を備えています。プレビュー版の機能が不要であれば、標準のGPT-4oの方が安全な選択です。両モデルとも同じAPIインターフェースでOrcaRouter上で利用可能なため、切り替えは容易です。
Gpt-4o-mini は、シンプルなタスク向けに最適化された、より小型で低コストのモデルです。入力トークン100万あたり約0.15ドル、出力トークン100万あたり約0.60ドル(おおよその価格)です。このプレビューモデルは、入力で約16倍、出力で約16倍高価です。プレビューモデルはより大きなコンテキスト(128K vs. 128K?実際にはgpt-4o-miniも128Kですが、変動する可能性があります。このモデルは128Kであることがわかっています。公開情報によるとgpt-4o-miniのコンテキストも128Kですが、断言はできません。「同等のコンテキストウィンドウ」と表現しますが、価格差に注意してください。)を提供します。このモデルは複雑な推論に優れており、gpt-4o-miniは多くの標準タスクに十分対応できます。品質要件と予算に基づいて選択してください。
Claudeモデル(例:Claude 3.5 Sonnet)は大きなコンテキストウィンドウと強力な推論を提供しますが、APIはOpenAIと直接互換性がありません。OrcaRouterは複数のプロバイダーに対して統一されたインターフェースを提供しますが、このプレビューはOpenAI専用です。Claudeモデルは安全性や長文テキスト生成などの分野で異なる料金設定や強みを持つ可能性があります。直接比較するには、ご自身のユースケースでテストする必要があります。OrcaRouterを使用するとプロバイダー間の切り替えが可能ですが、このプレビューモデルはOpenAIルート経由でのみ利用可能です。ベンチマーク比較は提供されていません。
OpenAI 互換——今お使いの SDK のまま
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview-2025-03-11",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| 入力 / 1M tokens | $2.50 |
| 出力 / 1M tokens | $10.00 |
| 通貨 | USD |
表示価格に基づく概算
見積もりのみ — 実際のトークン数はプロバイダーのトークナイザーに依存します。
GET /api/public/models/openai/gpt-4o-search-preview-2025-03-11開く @misc{orcarouter_gpt_4o_search_preview_2025_03_11,
title = {openai/gpt-4o-search-preview-2025-03-11 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11}
}openai. (n.d.). openai/gpt-4o-search-preview-2025-03-11 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11