GPT-4o-mini

openai/gpt-4o-mini
ビジョンツールJSON
提供 OpenAI · 2024-07-18

GPT-4o miniは、[GPT-4 Omni](/models/openai/gpt-4o)に続くOpenAIの最新モデルで、テキストと画像の両方の入力に対応し、テキスト出力を行います。彼らの最も先進的な小型モデルとして、何倍も手頃な価格になっています…

エンドポイント:/v1/chat/completions/v1/responses
コンテキスト128K トークン
最大出力16.4K
入力text + image + file
出力text
p50 TTFT4.23 s
入力$0.15/ 100万 tokens
出力$0.60/ 100万 tokens
p50 TTFT4.23 s7日
p95 TTFT10.00 s7日
トラフィック9.6Mtokens / 7日

GPT-4o-mini は、OpenAI の GPT-4o モデルの小型で高速なバリエーションであり、マルチモーダル機能を維持しつつ、低い計算コスト向けに最適化されています。テキスト、画像、アップロードされたファイルを入力として処理し、テキスト出力を生成できます。このモデルは OpenAI によってホストされており、OrcaRouter の OpenAI 互換 API を通じて、ベース URL…

GPT-4o-miniとは何ですか?

GPT-4o-miniは誰が使用すべきですか?

モデルアーキテクチャはGPT-4oとどう違いますか?

どのような入力モダリティがサポートされていますか?

コードサンプル

あらゆる SDK から呼び出し

OpenAI 互換——今お使いの SDK のまま

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

対応パラメータ

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

料金

入力 / 1M tokens$0.150
出力 / 1M tokens$0.600
キャッシュ読み取り / 1M$0.075
通貨USD

料金計算ツール

月間トークン数10MM
入力の割合70%%
月額見積もり $2.85 · プロンプトキャッシュ利用時 $2.59

表示価格に基づく概算

トークン・コスト見積もり

入力トークン: 8リクエストあたりのコスト: $0.000301

見積もりのみ — 実際のトークン数はプロバイダーのトークナイザーに依存します。

パフォーマンス

p50 TTFT
4.23 s
出力速度
870 tok/s
p95 TTFT
10.00 s
エラー率
0.30%

公開ベンチマーク

11.4
AA Coding
比較対象モデルの 7% を上回る
123 中 114 位
6.9
AA Intelligence
比較対象モデルの 3% を上回る
125 中 119 位
14.7
AA Math
比較対象モデルの 2% を上回る
81 中 78 位
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
ソース: artificialanalysis.ai

比較

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
入力 $/100万$0.15$21.00$60.00$5.00
出力 $/100万$0.60$168.00$270.00$30.00
コンテキスト128K400K1.1M
品質2/1010/1010/1010/10
並べて比較並べて比較並べて比較並べて比較

よくある質問

OrcaRouterを通じてGPT-4o-miniを使用するコストはいくらですか?
入力トークンは1Mあたり$0.15、出力トークンは1Mあたり$0.60で、OpenAIの料金と完全に一致し、マークアップはゼロです。
GPT-4o-miniのコンテキストウィンドウは何ですか?
コンテキストウィンドウは128,000トークンで、最大出力は16,384トークンです。
GPT-4o-miniの主な強みは何ですか?
それは、幅広いタスクに対して、マルチモーダル入力(テキスト、画像、ファイル)、大きなコンテキストウィンドウ、高速推論、低コストを組み合わせています。
GPT-4o-miniはGPT-4oと比較してどうですか?
GPT-4o-miniはトークン価格で約94%安価ですが、複雑な推論や創造的生成においては精度が低い可能性があります。MATH-500では、GPT-4oのより高いスコアに対し、78.9を記録しています。
OrcaRouter は私のプロンプトをログに記録したり保存したりしますか?
OrcaRouterは、あなたのプロンプトをログに記録したり保存したりしません。すべてのデータはOpenAIに渡されます。OpenAIのデータ使用ポリシーを参照して、その取り扱いを確認してください。
OrcaRouterのAPIを介してGPT-4o-miniを呼び出すにはどうすればよいですか?
OpenAI互換のエンドポイント https://api.orcarouter.ai/v1 をモデルID "openai/gpt-4o-mini" で使用してください。あなたのOrcaRouter APIキーを含めてください。
GPT-4o-miniは、同じリクエスト内でテキストと画像の両方を処理できますか?
はい、128Kトークンコンテキスト内でテキスト、画像、ファイルを同時に受け付けます。
GPT-4o-miniの速度/レイテンシはどのくらいですか?
レイテンシは一般的に低く—中程度のプロンプトでは最初のトークンが通常1秒未満—、コンテキストの長さやAPIの負荷によって変動します。ストリーミングにより、知覚されるレイテンシが低減します。

このバッジを埋め込む

OpenAI: GPT-4o-mini$0.15/M in4232ms p50OrcaRouter 経由
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OrcaRouter の OpenAI: GPT-4o-mini" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

モデルカードをデータで取得

GET /api/public/models/openai/gpt-4o-mini開く