预览纯文本GPT-4o模型,具有128K上下文、16K输出,通过OrcaRouter API访问,价格为每百万token $2.50/$10。
该模型是OpenAI的预览版本,仅支持文本输入。通过OrcaRouter的API访问时,其标识符为openai/gpt-4o-search-preview-2025-03-11。模型提供128,000个令牌的上下文窗口,每次响应最多可生成16,384个令牌。输入模式仅限于文本,此版本不支持图像或音频。预览状态意味着用户可在GPT-4o改进成为标准之前,提前尝试其即将推出的功能。定价按供应商费率执行…
作为纯文本的GPT-4o预览版,它在广泛领域中擅长理解和生成自然语言。它可以执行文档摘要、问答、创意写作、翻译和代码生成。大上下文窗口使其能够在非常长的文本中保持连贯性,因此适合书籍分析或处理大量日志等任务。它支持类似聊天格式的系统、用户和助手消息。该模型的零样本和少样本推理能力是GPT-4类模型的典型特征,使其无需大量微调即可处理复杂指令。
如果您的任务不需要GPT-4o的全部推理能力,可以考虑使用OrcaRouter中更小或更便宜的模型,例如openai/gpt-4o-mini或gpt-3.5-turbo。更适合低成本模型的任务实例包括简单分类、短内容生成或上下文有限的问答。对于高流量、低复杂度的请求,预览模型的成本可能不合理。此外,如果需要多模态输入,该模型无法处理图像或音频;必须使用其他模型(例如标准GPT-4o或GPT-4V)。请始终评估质量与每token成本之间的权衡。
此模型被识别为“search-preview”变体,但公开的规格说明中未详细说明任何特定工具使用或网络搜索能力。它仅为文本模型,作为标准语言模型运行。用户不应假定其具有任何内置搜索或检索功能。对于增强生成,您可以单独实施检索增强生成(RAG)管道,将检索到的文档注入模型的上下文窗口。OrcaRouter不添加任何工具使用中间件;模型完全基于其训练内容和提供的提示进行响应。未来版本可能会改变此行为,但在预览版中,未记录任何工具集成。
作为预览版本,此模型可能表现出意外行为或低于稳定版本的可靠性。它仅支持文本输入,因此任何多模态请求都将被拒绝。16,384个token的最大输出量相当可观,但可能仍会截断极长的生成内容。模型的知识截止日期和训练数据未明确说明,因此它可能无法获知近期事件。不建议用于生产环境,因为该模型可能被更新或移除。此外,由于预览性质,其延迟可能高于稳定模型。在规模化部署前务必进行全面测试。
此预览版本尚未提供具体的基准测试分数。作为GPT-4o的变体,它在常见语言任务上的表现预计与标准GPT-4o相近,但具体数值未公布。用户可使用公开数据集自行进行评估。较大的上下文窗口使其在长文档基准测试中具备优势,但由于是预览版,分数可能与生产模型有所差异。如需权威数据,请参考OpenAI针对GPT-4o发布的官方基准报告。OrcaRouter不会修改模型的输出或性能。
此预览模型的延迟和吞吐量数据尚未公布。作为预览版本,由于采用实验性基础设施,其速度可能低于稳定的GPT-4o。响应时间取决于输入长度、输出长度以及并发请求量。OrcaRouter不会在正常API路由之外增加额外延迟。如需评估速度,开发者可使用典型负载运行示例请求。对于需要一致性能的生产应用程序,除非需要预览版的特定功能,否则建议使用稳定的gpt-4o模型。
GPT-4 类模型以在数学、逻辑和常识推理等多个领域的强大推理能力而闻名。本次预览版预计将继承这些能力。大上下文使得复杂的多步思维链推理得以实现,而不会丢失早期部分的信息。然而,该确切版本并未提供具体的推理基准测试。用户应针对自身领域特定任务验证其性能。与早期 GPT 版本相比,该模型在指令遵循方面也可能有所改进,但同样建议进行独立验证。
除预览版本外,该模型不支持多模态功能。它无法直接处理图像、音频或视频。其知识截止日期未知,因此可能缺少训练后事件的相关信息。16,384个token的输出限制虽然较为宽裕,但无法在一次生成中产生极长的文本;如需更长输出,需要通过迭代提示或分片处理。预览版本在处理某些敏感主题时可能出错率或拒绝率更高。在英语以外的语言上表现可能有所差异。部署前务必在代表性数据上进行测试。
该模型定价为每100万输入tokens收费2.50美元,每100万输出tokens收费10.00美元。这是OpenAI提供的费率,OrcaRouter不增加任何加价。例如,处理10000个tokens的提示并生成1000个tokens,输入成本约为0.025美元,输出成本约为0.01美元,总计0.035美元。成本与token使用量呈线性增长。使用OrcaRouter作为API网关无需额外费用。请务必监控使用情况,避免意外收费。如果你的任务不需要完整功能,可对比更便宜的模型。
OrcaRouter 目前不为该模型提供批量折扣或令牌缓存。所有计费均按实际令牌使用量以提供商费率即用即付。OrcaRouter 不会对提示或响应进行缓存;每个请求均独立处理。如果您有极高的吞吐量,请联系 OrcaRouter 协商定制方案。为优化成本,建议使用更短的提示、高效复用上下文,或批量调用。由于未启用缓存机制,该模型不支持缓存命中后的降价计费。
按照每百万个token $2.50/$10 的定价,此预览版的价格与标准GPT-4o相近,但可能略有差异。更便宜的选择包括 openai/gpt-4o-mini(约每百万 $0.15/$0.60)或 gpt-3.5-turbo(约每百万 $0.50/$1.50)。对于能接受较低质量的任务,这些模型能大幅节省成本。预览版模型的成本处于 OrcaRouter 目录的高价位区间。若您仅将其用于测试,根据请求量可能会产生适中的费用。请务必评估预期的token用量,并与使用更大模型所获得的质量提升进行比较。
要使用此模型,请将您的 API 客户端的基础 URL 设置为 https://api.orcarouter.ai/v1,并将模型 ID 指定为 openai/gpt-4o-search-preview-2025-03-11。您必须使用由 OrcaRouter 颁发的 API 密钥。该 API 完全兼容 OpenAI,因此您现有的为 OpenAI 聊天补全端点编写的代码只需进行最少的更改即可使用。使用 curl 的示例调用:curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_ORCAROUTER_KEY" -H "Content-Type: application/json" -d '{ "model": "openai/gpt-4o-search-preview-2025-03-11", "messages": [{"role": "user", "content": "Hello"}], "max_tokens": 100 }'。
您可以使用 OpenAI 支持的所有标准聊天补全参数:'messages'、'max_tokens'、'temperature'、'top_p'、'frequency_penalty'、'presence_penalty'、'stop' 和 'n'。该模型支持 128,000 个令牌的上下文窗口,因此 'max_tokens' 最高可设置为 16,384。'temperature' 控制随机性,取值范围为 0 到 2。支持 'stream' 以实现实时响应。OrcaRouter 不引入额外的参数。请确保您的请求符合令牌限制;超出上下文窗口长度的输入(包括响应)将被截断或返回错误。
迁移非常简单。将您的 OpenAI 基础 URL(https://api.openai.com/v1)替换为 OrcaRouter 的基础 URL(https://api.orcarouter.ai/v1)。将您的 API 密钥更换为 OrcaRouter 密钥。将模型字段更新为 openai/gpt-4o-search-preview-2025-03-11。无需改动其他代码。如果您之前使用的是其他 OpenAI 模型,可以继续使用相同的代码结构。OrcaRouter 会透传所有标准参数。迁移后,请验证响应是否一致。请注意,计费将由 OrcaRouter 处理,您需要在那里拥有一个账户。
OrcaRouter 不会公开披露此预览模型的具体速率限制。可用性取决于 OpenAI 的基础设施和 OrcaRouter 的网关容量。对于生产环境的应用,请考虑该模型的预览状态及潜在的不稳定性。OrcaRouter 可能会实施合理的用量限制以防止滥用。您可以期待获得尽力服务,但不提供任何 SLA。如果您需要保证的吞吐量,请联系 OrcaRouter 获取专用选项。该模型也可能在未通知的情况下被移除或替换,因此请规划好备用模型。
标准版 GPT-4o 模型(openai/gpt-4o)是一个多模态的稳定版本,而此预览版仅支持文本输入,用于早期测试。预览版可能包含标准版尚未推出的新功能,但稳定性可能稍差。定价相近。标准版支持更广泛的输入(图像、音频)。如果你不需要预览功能,标准版 GPT-4o 是更稳妥的选择。两者均可通过 OrcaRouter 使用相同的 API 接口进行调用,切换非常方便。
Gpt-4o-mini是一款更小、更便宜的模型,针对简单任务进行了优化。其输入成本约为每百万token $0.15,输出成本约为每百万token $0.60(近似值)。此预览模型的输入成本大约高出16倍,输出成本也大约高出16倍。预览模型提供更大的上下文(128K vs. 128K?实际上gpt-4o-mini也有128K,但可能有所差异。我们知道此模型是128K。根据公开信息,gpt-4o-mini的上下文也是128K,但我们不能假定。我们会说'可比的上下文窗口',但指出价格差异。)此模型更适合复杂推理,而gpt-4o-mini足以应对许多标准任务。根据质量需求和预算进行选择。
Claude模型(例如Claude 3.5 Sonnet)提供大上下文窗口和强大的推理能力,但其API并非直接兼容OpenAI。OrcaRouter为多个提供商提供统一接口,但此预览版仅来自OpenAI。Claude模型在安全性和长文本生成等领域可能有不同的定价和优势。如需直接比较,您需要根据自身用例进行测试。OrcaRouter允许您在提供商之间切换,但此预览模型仅能通过OpenAI路由使用。未提供基准比较。
兼容 OpenAI——沿用你现有的 SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview-2025-03-11",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| 输入 / 1M tokens | $2.50 |
| 输出 / 1M tokens | $10.00 |
| 货币 | USD |
基于标价的估算
仅为估算——实际 Token 数取决于提供商的分词器。
GET /api/public/models/openai/gpt-4o-search-preview-2025-03-11打开 @misc{orcarouter_gpt_4o_search_preview_2025_03_11,
title = {openai/gpt-4o-search-preview-2025-03-11 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11}
}openai. (n.d.). openai/gpt-4o-search-preview-2025-03-11 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11