openai/gpt-4.1-mini-2025-04-14

openai/gpt-4.1-mini-2025-04-14
视觉工具JSON
来自 openai

OpenAI GPT-4.1 Mini:成本高效的推理,具备1M上下文、图像输入和出色的MATH-500得分

上下文1.05M tokens
最大输出32.8K
输入模态image + text + file
输出模态text
p50 首字节2.00 s
输入$0.40/ 百万 tokens
输出$1.60/ 百万 tokens
p50 首字节2.00 s7 天
p95 首字节3.57 s7 天
流量7.4Ktokens / 7 天

该模型是OpenAI GPT-4.1系列的缩小版本,具体发布于2025年4月14日。其设计旨在以远低于全尺寸GPT-4.1模型的成本,提供强大的推理和指令跟随性能。该模型接受文本、图像和文件作为输入,具备多模态能力。用户可通过OrcaRouter的兼容OpenAI API进行访问,该API将请求路由至OpenAI的基础设施,且不提供商家的每token定价加价。

什么是openai/gpt-4.1-mini-2025-04-14?

谁应该使用这个模型?

它支持哪些输入方式?

什么是上下文窗口和最大输出长度?

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4.1-mini-2025-04-14",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

价格

输入 / 1M tokens$0.400
输出 / 1M tokens$1.60
缓存读取 / 1M$0.100
货币USD

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $7.60 · 启用提示缓存后 $6.55

基于标价的估算

Token 与费用估算器

输入 Token: 6每次请求费用: $0.000802

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
2.00 s
输出速度
25.9 tok/s
p95 首字节
3.57 s
错误率
0%

公共基准测试

20.2
AA Coding
优于所参与对比模型中的 18%
第 100 / 共 123
14.8
AA Intelligence
优于所参与对比模型中的 16%
第 104 / 共 125
46.3
AA Math
优于所参与对比模型中的 22%
第 62 / 共 81
AIME
43.0
AIME 2025
46.3
GPQA Diamond
66.4
Humanity's Last Exam
4.6
IFBench
38.3
LiveCodeBench
48.3
Long-Context Recall
42.3
MATH-500
92.5
MMLU-Pro
78.1
SciCode
40.4
tau_banking
5.2
TerminalBench Hard
7.6
terminalbench_v2_1
10.1
τ²-Bench
52.9
来源: artificialanalysis.ai

对比一览

openai/gpt-4.1-mini-2025-04-14GPT-5.2 ProGPT-5.4 ProGPT-5.5
输入 $/百万$0.40$21.00$60.00$5.00
输出 $/百万$1.60$168.00$270.00$30.00
上下文1.0M400K1.1M
质量4/1010/1010/1010/10
并排对比并排对比并排对比并排对比

更多 openai 模型

常见问题

在OrcaRouter上,openai/gpt-4.1-mini-2025-04-14 的每token成本是多少?
OrcaRouter 按提供商费率计费,零加价:每100万输入令牌0.40美元,每100万输出令牌1.60美元。
上下文窗口大小是多少?
上下文窗口为1,047,576个令牌(约100万个令牌)。每次请求最大输出为32,768个令牌。
它的主要优势是什么?
它结合了低成本、大上下文窗口、多模态输入(文本、图像、文件)以及坚实的推理性能,MATH-500评分高达92.5,展现了强大的综合实力。
它与GPT-4o相比如何?
GPT-4o 是一款功能更强大的旗舰模型,支持音频功能,但 GPT-4.1 mini 通常更便宜且速度更快。虽然没有提供直接的基准测试对比,但 mini 专为高效的生产环境而设计。
OrcaRouter 是否为该模型处理数据隐私?
OrcaRouter 将请求路由到 OpenAI 的基础设施。数据处理遵循 OpenAI 的政策以及 OrcaRouter 自身的条款。您应审阅两家提供商的隐私和数据使用协议。
如何使用OpenAI Python客户端调用这个模型?
将 openai.api_base 设置为 'https://api.orcarouter.ai/v1',设置您的 OrcaRouter API 密钥,并使用 openai.ChatCompletion.create(model='openai/gpt-4.1-mini-2025-04-14', messages=[...])。
这个模型可以用于图像理解吗?
是的,它支持图像输入(通过URL或base64)用于图像描述、视觉问答和OCR等任务。文件也可以作为图像或文本上传。
这个模型的真正局限性是什么?
它在非常复杂的推理上可能无法完全匹配GPT-4.1,其知识仅限于训练截止日期(2025年4月)。在没有人类监督的情况下,它不适合用于安全关键型应用。
是否有任何缓存折扣?
在OrcaRouter上未提及此模型的特定缓存折扣。计费按照规定的费率按token计费。

嵌入此徽章

openai/gpt-4.1-mini-2025-04-14$0.40/M in2000ms p50通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4.1-mini-2025-04-14" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4.1-mini-2025-04-14.svg" alt="openai/gpt-4.1-mini-2025-04-14 在 OrcaRouter" /> </a>
Markdown [![openai/gpt-4.1-mini-2025-04-14](https://www.orcarouter.ai/embed/openai/gpt-4.1-mini-2025-04-14.svg)](https://www.orcarouter.ai/models/openai/gpt-4.1-mini-2025-04-14)

以数据形式获取模型卡

GET /api/public/models/openai/gpt-4.1-mini-2025-04-14打开