GPT-4o (2024-08-06)

openai/gpt-4o-2024-08-06
视觉工具JSON
来自 OpenAI · 2024-08-06

2024-08-06版本的GPT-4o在结构化输出方面提供了更佳的性能,并能够在respone_format中提供JSON模式。点击[此处](https://openai.com/index/introducing-structured-outputs-in-the-api/)了解更多。GPT-4o(“o”代表“omni”)是……

上下文128K tokens
最大输出16.4K
输入模态text + image + file
输出模态text
p50 首字节2.00 s
输入$2.50/ 百万 tokens
输出$10.00/ 百万 tokens
p50 首字节2.00 s7 天
p95 首字节7.61 s7 天
流量207.0Ktokens / 7 天

GPT-4o (2024-08-06) 是 OpenAI 的 GPT-4o 模型的一个版本,于 2024 年 8 月发布。它是一个多模态大语言模型,能够处理文本、图像和文件输入。该模型通过 OrcaRouter 兼容 OpenAI 的 API 进行访问,该 API 为多个提供商提供单一端点。凭借 128,000 个 token 的上下文窗口和最多 16,384 个 token…

什么是GPT-4o (2024-08-06)?

这个模型是为谁设计的?

它支持哪些输入方式?

关键规格一览

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-2024-08-06",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

价格

输入 / 1M tokens$2.50
输出 / 1M tokens$10.00
缓存读取 / 1M$1.25
货币USD

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $47.50 · 启用提示缓存后 $43.13

基于标价的估算

Token 与费用估算器

输入 Token: 6每次请求费用: $0.005015

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
2.00 s
输出速度
477 tok/s
p95 首字节
7.61 s
错误率
0%

公共基准测试

16.6
AA Coding
优于所参与对比模型中的 12%
第 108 / 共 123
9.6
AA Intelligence
优于所参与对比模型中的 10%
第 110 / 共 125
AIME
11.7
GPQA Diamond
52.1
Humanity's Last Exam
2.9
IFBench
36.0
LiveCodeBench
31.7
Long-Context Recall
35.0
MATH-500
79.5
SciCode
33.1
TerminalBench Hard
8.3
τ²-Bench
28.9
来源: artificialanalysis.ai

对比一览

GPT-4o (2024-08-06)GPT-5.2 ProGPT-5.4 ProGPT-5.5
输入 $/百万$2.50$21.00$60.00$5.00
输出 $/百万$10.00$168.00$270.00$30.00
上下文128K400K1.1M
质量3/1010/1010/1010/10
并排对比并排对比并排对比并排对比

更多 OpenAI 模型

常见问题

在OrcaRouter上,GPT-4o(2024-08-06)的每token成本是多少?
定价为每100万输入代币2.50美元,每100万输出代币10.00美元,按OpenAI的提供商费率计费,OrcaRouter不加价。图片和文件输入按OpenAI政策额外收取代币费用。
什么是上下文窗口和最大输出令牌数?
上下文窗口为128,000个token。最大输出为16,384个token。这使得可以处理长文档或长对话,并生成内容丰富的回复。
这个模型的主要优势是什么?
它提供强大的数学推理能力(在MATH-500上获得79.5分)、多模态输入(文本、图像、文件)、大上下文窗口以及OpenAI的高质量生成。它非常适合复杂的推理和视觉任务。
这个模型与像 GPT-4o mini 这样更便宜的模型相比如何?
GPT-4o (2024-08-06) 价格更高,但在推理和多模态任务上通常能力更强。GPT-4o mini 更便宜(每 1M 代币 $0.15/$0.60),足以处理简单任务。请根据任务复杂度和预算进行选择。
适用哪些数据处理政策?
您的数据将被发送至OpenAI进行处理。OrcaRouter不会存储提示词。OpenAI的数据使用政策适用。使用OrcaRouter的多提供商路由功能,将请求引导至符合您合规要求的提供商。
我可以将这个模型与OpenAI Python客户端一起使用吗?
是的,通过将基础 URL 设置为 https://api.orcarouter.ai/v1 并使用模型 ID "openai/gpt-4o-2024-08-06"。您现有的用于 ChatCompletion、streaming 和 function calling 的代码无需更改即可正常工作。
如何通过API发送图像输入?
在消息的 content 数组中,使用带 detail 参数的 "image_url" 格式,将图像作为 base64 编码字符串或 URL 包含进去。模型会解析图像进行分析。这遵循 OpenAI 的多模态 API 格式。
每次请求可以生成的最大输出量是多少?
最大输出为16,384个tokens。使用max_tokens参数控制响应长度。请注意,较长的输出会增加成本和延迟。
这个模型可以用于流式传输吗?
是的,当使用与OpenAI兼容的API时,你可以设置stream=True来逐步接收响应。这在OrcaRouter的端点上有效。
这个模型可以免费使用或试用吗?
该模型按提供商费率计费。OrcaRouter 可能提供免费套餐或试用积分——请查看其网站以了解当前优惠。超出任何免费积分的用量将按标准的每 token 费用收取。

嵌入此徽章

OpenAI: GPT-4o (2024-08-06)$2.50/M in2000ms p50通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg" alt="OpenAI: GPT-4o (2024-08-06) 在 OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o (2024-08-06)](https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06)

以数据形式获取模型卡

GET /api/public/models/openai/gpt-4o-2024-08-06打开