GPT-4o-mini

openai/gpt-4o-mini
视觉工具JSON
来自 OpenAI · 2024-07-18

GPT-4o mini 是 OpenAI 继 [GPT-4 Omni](/models/openai/gpt-4o) 之后的最新模型,支持文本和图像输入,输出文本。作为其最先进的小型模型,它的性价比要高得多……

上下文128K tokens
最大输出16.4K
输入模态text + image + file
输出模态text
p50 首字节1.83 s
输入$0.15/ 百万 tokens
输出$0.60/ 百万 tokens
p50 首字节1.83 s7 天
p95 首字节10.00 s7 天
流量7.7Mtokens / 7 天

GPT-4o-mini 是 OpenAI GPT-4o 模型的一个更小、更快的变体,专为降低计算成本而优化,同时保留多模态能力。它可以处理文本、图像和上传的文件作为输入,生成文本输出。该模型由 OpenAI 托管,可通过 OrcaRouter 兼容 OpenAI 的 API 访问,基础 URL 为 https://api.orcarouter.ai/v1,使用模型标识符…

什么是GPT-4o-mini?

谁应该使用GPT-4o-mini?

模型架构与GPT-4o有何不同?

支持哪些输入模式?

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

价格

输入 / 1M tokens$0.150
输出 / 1M tokens$0.600
缓存读取 / 1M$0.075
货币USD

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $2.85 · 启用提示缓存后 $2.59

基于标价的估算

Token 与费用估算器

输入 Token: 6每次请求费用: $0.000301

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
1.83 s
输出速度
417 tok/s
p95 首字节
10.00 s
错误率
0.11%

公共基准测试

11.4
AA Coding
优于所参与对比模型中的 7%
第 111 / 共 120
6.9
AA Intelligence
优于所参与对比模型中的 3%
第 116 / 共 122
14.7
AA Math
优于所参与对比模型中的 2%
第 78 / 共 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
来源: artificialanalysis.ai

对比一览

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
输入 $/百万$0.15$21.00$60.00$5.00
输出 $/百万$0.60$168.00$270.00$30.00
上下文128K400K1.1M
质量2/1010/1010/1010/10
并排对比并排对比并排对比并排对比

更多 OpenAI 模型

常见问题

通过OrcaRouter使用GPT-4o-mini的成本是多少?
输入tokens每百万$0.15,输出tokens每百万$0.60,与OpenAI费率完全一致,零加价。
GPT-4o-mini的上下文窗口是多少?
上下文窗口为128,000个令牌,最大输出为16,384个令牌。
GPT-4o-mini的主要优势是什么?
它结合了多模态输入(文本、图像、文件)、大上下文窗口、快速推理和低成本,适用于广泛的任务。
GPT-4o-mini 与 GPT-4o 相比如何?
GPT-4o-mini在token定价上大约便宜94%,但在复杂推理和创意生成方面可能准确度较低。在MATH-500上,它得分为78.9,而GPT-4o的得分更高。
OrcaRouter 是否会记录或存储我的提示?
OrcaRouter不会记录或存储您的提示词;所有数据直接传递给OpenAI。其处理方式请参考OpenAI的数据使用政策。
如何通过OrcaRouter的API调用GPT-4o-mini?
使用位于 https://api.orcarouter.ai/v1 的 OpenAI 兼容端点,模型 ID 为 "openai/gpt-4o-mini"。包括您的 OrcaRouter API 密钥。
GPT-4o-mini 能否在同一请求中同时处理文本和图像?
是的,它支持在128K token上下文中同时接收文本、图像和文件。
GPT-4o-mini的速度/延迟是多少?
延迟通常较低——对于中等提示,首个令牌通常在一秒以下——但随上下文长度和API负载而变化。流式传输可减少感知延迟。

嵌入此徽章

OpenAI: GPT-4o-mini$0.15/M in1831ms p50通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini 在 OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

以数据形式获取模型卡

GET /api/public/models/openai/gpt-4o-mini打开