GPT-4o(“o”代表“omni”)是OpenAI最新的AI模型,支持文本和图像输入并输出文本。它在保持[GPT-4 Turbo](/models/openai/gpt-4-turbo)智能水平的同时,速度是其两倍...
GPT-4o 是 OpenAI 推出的一款多模态大型语言模型。它接受文本、图像和文件输入,并输出文本。该模型专为需要处理长内容(最多 128,000 个 token)且需要强大推理能力(包括数学问题求解)的用户设计。它非常适合构建融合文本和图像应用的开发者,例如文档分析、视觉问答或代码审查。在 OrcaRouter 上,你可以按提供商费率零加价访问 GPT-4o——每 100 万输入 token…
GPT-4o在多模态推理、长上下文处理和数学问题求解方面表现出色。其128k令牌的上下文窗口使其能够保留并引用大量信息,适用于文档分析、跨项目的代码生成以及复杂的多轮对话等任务。该模型在MATH-500基准测试中得分为75.9,显示出强大的数学问题解决能力。此外,它能够接收图像和文件输入,意味着它可以结合文本对视觉内容(如图表、图形或照片)进行推理。在OrcaRouter上,您可以利用这些优势,且无需支付OpenAI标价之外的任何加价。
GPT-4o 在处理需要文本和视觉双重理解的任务时非常高效。例如:回答教科书中的图表相关问题、从扫描发票中提取数据、根据线框图生成代码,或总结带有图表的长篇研究论文。其大上下文也使其适用于分析整个代码库或长对话记录。数学推理是另一项强项,其在MATH-500上得分为75.9。在OrcaRouter上,这些用例实现起来十分直接——您发送一个标准的、与OpenAI兼容的请求,并附带适当的内容类型,模型就会返回文本响应。
如果你的任务不需要多模态输入或大上下文,使用更便宜的模型可能更具成本效益。例如,对于适合较小上下文的简单文本分类、摘要或翻译任务,像GPT-3.5 Turbo(输入每100万标记0.50美元,输出每100万标记1.50美元)这样的模型要便宜得多。GPT-4o的输入成本为每100万标记2.50美元,是GPT-3.5 Turbo的五倍。如果你在处理大量纯文本数据而不需要多模态推理,较小的模型可以降低成本。OrcaRouter提供多种模型,因此你可以选择最佳的性价比平衡。
GPT-4o 被设计为接受图像和文件作为输入,使其能够执行视觉问答、图像描述和文档理解等任务。虽然可用事实中未提供具体的多模态基准分数,但该模型的架构支持对文本和图像进行联合推理。例如,它可以统计图像中的物体数量或解读图表。该模型仅输出文本,不输出图像。在 OrcaRouter 上,多模态请求使用与 OpenAI API 相同的参数发送:在 messages 数组中包含 image_url 或文件内容部分。模型处理视觉数据,并根据组合输入返回文本响应。
GPT-4o 在 MATH-500 基准测试中获得了 75.9 分。MATH-500 是 MATH 数据集的一个子集,包含 500 道覆盖代数、几何、微积分等多个主题的具有挑战性的数学问题。75.9 分意味着该模型能够正确解答大约 76% 的问题,这展现了较强的数学推理能力,但尚未达到完美。相比之下,许多较小模型在类似基准测试中得分低于 50。该分数反映了模型在多步推理和数学符号处理方面的能力。在 OrcaRouter 上,你可以使用 GPT-4o 完成数学相关任务,如辅导、备考或验证计算。
与所有大型语言模型一样,GPT-4o 存在局限性。对于训练数据有限或需要最新知识(其训练截止日期未在事实中提供,但作为 OpenAI 模型,它有一个知识截止日期)的主题,它可能会产生不正确或幻觉性的回答。它对提示措辞敏感,可能在模糊指令下表现不佳。尽管其 MATH-500 评分很高,但在复杂数学证明上并非万无一失。该模型能处理图像,但无法生成图像。此外,大上下文窗口(128k tokens)可能导致 token 消耗增加,若不谨慎管理会抬高成本。在 OrcaRouter 上,您可以通过调整 temperature 和 top_p 等参数来缓解部分问题。
关于GPT-4o的具体延迟数据未在事实中提供。总体而言,GPT-4o是一个大型模型,与GPT-3.5 Turbo或Llama 3.1 8B等较小模型相比,延迟会更高。不过,它很可能针对比原始GPT-4更快的推理进行了优化。通过OrcaRouter,您获得的响应时间将与直接使用OpenAI类似,因为该平台在路由请求时不进行额外处理。对于速度至关重要的实时应用,建议将更快、更经济的模型用于简单任务,而将GPT-4o保留给能够受益于其能力的复杂查询。
在 OrcaRouter 上,GPT-4o 的定价完全遵循 OpenAI 的官方费率:每 100 万输入令牌收费 2.50 美元,每 100 万输出令牌收费 10.00 美元。OrcaRouter 不添加任何加价。计费基于四舍五入到最接近整数的令牌数量。输入令牌包括您发送的文本、图像和文件,但图像通常由模型按固定比例进行令牌化(例如,每张图像消耗一定数量的令牌)。输出令牌是模型生成的文本。您只需为实际使用的部分付费,没有月费或最低消费要求。这种透明的定价方式使您能够精确预算 AI 工作负载的成本。
主要的权衡在于成本与能力之间。GPT-4o 每百万 token 的输入成本为 $2.50,输出成本为 $10。更便宜的模型如 GPT-3.5 Turbo(输入 $0.50,输出 $1.50)或 Llama 3.1 8B 对于简单或大批量任务更为经济。然而,GPT-4o 提供多模态输入和更大的上下文窗口。如果您的应用需要理解图像或处理超长文档,尽管成本更高,GPT-4o 可能是必要的。对于输入较短的纯文本任务,使用更便宜的模型可以节省资金。在 OrcaRouter 上,您只需更改模型 ID 即可在不同模型间切换,从而为每个请求优化成本。
不。OrcaRouter 以提供商原价提供 GPT-4o,零加价。价格为每 100 万输入 token 2.50 美元,每 100 万输出 token 10.00 美元。无隐藏费用、追加销售或额外收费。OrcaRouter 直接将成本从 OpenAI 传递过来。此政策适用于平台上列出的所有模型。基础 URL 为 https://api.orcarouter.ai/v1,模型 ID 为 "openai/gpt-4o"。您可随时通过查看用量仪表板验证定价。无需分层定价或承诺——仅按消耗的 token 付费。
要使用OrcaRouter调用GPT-4o,请向基础URL `https://api.orcarouter.ai/v1/chat/completions` 发送HTTP POST请求。将模型参数设置为`"openai/gpt-4o"`。请求必须包含API密钥(在Authorization头部提供你的OrcaRouter API密钥)。请求体遵循标准OpenAI聊天补全格式:一个包含角色/内容对的messages数组,可选的参数如temperature、max_tokens、top_p等。对于多模态输入,需包含类型为`"text"`或`"image_url"`(或file)的内容部分。响应是包含模型补全结果的JSON对象。curl命令示例: ``` curl https://api.orcarouter.ai/v1/chat/completions \ -H "Authorization: Bearer YOUR_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model":"openai/gpt-4o","messages":[{"role":"user","content":[{"type":"text","text":"这张图片里有什么?"},{"type":"image_url","image_url":{"url":"https://example.com/image.jpg"}}]}]}' ```
通过 OrcaRouter 调用 GPT-4o 时,可以使用与 OpenAI API 相同的参数。常用参数包括: - temperature(浮点数,0-2):控制随机性。较低的值(如 0.2)会使输出更确定。 - max_tokens(整数,默认 16384):响应中的最大 token 数。 - top_p(浮点数,0-1):核采样参数。 - frequency_penalty 和 presence_penalty:减少重复。 - stop(字符串或数组):停止序列。 - stream(布尔值):启用流式响应(true/false)。 - seed(整数):用于确定性采样。 你还可以使用可选的 "user" 字段来跟踪单个用户。该模型支持函数调用和工具使用,尽管未在事实中明确列出。在 OrcaRouter 上,所有标准参数均被接受。
迁移非常简单,因为 OrcaRouter 提供了与 OpenAI 兼容的端点。步骤: 1. 从 OrcaRouter 获取 API 密钥(在其网站上注册)。 2. 将基础 URL 从 https://api.openai.com/v1 更改为 https://api.orcarouter.ai/v1。 3. 将模型 ID 从 "gpt-4o" 更改为 "openai/gpt-4o"。 4. 使用相同的请求体格式。除了端点和模型名称外,无需更改代码。 5. 更新 Authorization 头部,使用您的 OrcaRouter API 密钥。 建议先使用单个请求进行测试。OrcaRouter 支持相同的流式和非流式模式。模型的行为没有区别,因为它使用的是相同的底层 OpenAI 模型。您现有的提示和参数将完全相同地工作。
OrcaRouter API 的基本URL是 https://api.orcarouter.ai/v1。用于GPT-4o的具体模型ID是"openai/gpt-4o"。必须在请求的"model"参数中传递这个确切的字符串。例如,在聊天补全端点调用中,设置"model": "openai/gpt-4o"。OrcaRouter支持此模型用于流式和非流式补全。如果您使用的是配置为指向自定义基本URL的OpenAI SDK或库,只需将基本URL设置为 https://api.orcarouter.ai/v1 并提供您的OrcaRouter API密钥。模型ID前缀"openai/"将其与OrcaRouter上其他提供商的模型区分开来。
GPT-4o 是 GPT-4 Turbo 的多模态升级版本。两个模型均拥有 128k 的上下文窗口。然而,GPT-4o 新增了原生图像和文件输入支持,而 GPT-4 Turbo 主要仅支持文本(其视觉功能仅限于独立版本提供)。GPT-4o 的最大输出也更高,达到 16,384 个令牌,相比之下 GPT-4 Turbo 通常为 4,096 或 8,192 个令牌。定价方面有所不同:GPT-4 Turbo 每 100 万输入令牌收费 10.00 美元,每 100 万输出令牌收费 30.00 美元;而 GPT-4o 显著更便宜(输入 2.50 美元 / 输出 10.00 美元)。GPT-4o 的 MATH-500 得分为 75.9,普遍高于 GPT-4 Turbo 已报告的基准测试成绩,不过事实中并未提供 Turbo 的确切分数。在 OrcaRouter 上,两个模型均以零加价提供。
GPT-3.5 Turbo 是一款更便宜、更快的模型,专为简单任务优化。其上下文窗口为 16,384 个 token,远小于 GPT-4o 的 128k。GPT-3.5 不支持图像输入——仅支持文本。其定价为每 100 万输入 token 0.50 美元,每 100 万输出 token 1.50 美元,相比 GPT-4o,输入成本约低 5 倍,输出成本约低 6.6 倍。在 MATH-500 基准测试中,GPT-3.5 Turbo 的得分通常低得多(未提供具体数字)。GPT-4o 更适合复杂推理、长文档和多模态任务。对于高并发的简单交互,请使用 GPT-3.5 Turbo。在 OrcaRouter 上,您只需更改模型 ID 即可轻松切换。
Claude 3.5 Sonnet是Anthropic公司的一款竞品模型。它也拥有200k上下文窗口(大于GPT-4o的128k),并支持图像输入。Claude 3.5 Sonnet的定价通常为每百万输入token 3.00美元,每百万输出token 15.00美元,这使得GPT-4o在输入方面更便宜,但在输出方面更贵?实际上GPT-4o输入为2.50美元 vs 3.00美元,所以更便宜;输出为10美元 vs 15美元,也更便宜。在基准测试中,Claude 3.5 Sonnet在数学和推理方面取得了相似的表现,但具体分数有所不同。两个模型在多模态任务上都很强。选择哪个可能取决于具体的性能特征或生态系统偏好。在OrcaRouter上,两者都通过相同的API格式访问,但使用不同的模型ID(例如"anthropic/claude-3.5-sonnet")。
Llama 3.1 405B 是 Meta 推出的开放权重模型,拥有 4050 亿参数。它支持 128k 上下文窗口和文本输入,但其多模态能力尚不明确(可能无法原生支持图像)。Llama 3.1 405B 可通过 OrcaRouter 以更低的价格获取,通常输入和输出每 100 万 token 各约 1.00 美元(此为近似值,并非事实数据)。其在 MATH-500 上的基准得分未给出,但很可能低于 GPT-4o 的 75.9。GPT-4o 是专有模型,具有更好的开箱即用多模态推理能力,在复杂任务上可能拥有更高的准确性。对于希望使用开放模型或需要自行部署的用户来说,Llama 3.1 405B 是一个不错的选择。在 OrcaRouter 上,您可以并排比较这两个模型。
兼容 OpenAI——沿用你现有的 SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokensnparallel_tool_callspredictionpresence_penaltyresponse_formatseedservice_tierstopstreamstructured_outputstemperaturetool_choicetoolstop_logprobstop_pweb_search_options| 输入 / 1M tokens | $2.50 |
| 输出 / 1M tokens | $10.00 |
| 缓存读取 / 1M | $1.25 |
| 货币 | USD |
基于标价的估算
仅为估算——实际 Token 数取决于提供商的分词器。
@misc{orcarouter_gpt_4o,
title = {GPT-4o API},
author = {OpenAI},
year = {2024},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o}
}OpenAI. (2024). GPT-4o API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o