GPT-4o Search Preview 是一款专为 Chat Completions 中的网页搜索而设计的专业模型。它经过训练,能够理解并执行网页搜索查询。
GPT-4o Search Preview 是 OpenAI 提供的一款纯文本模型,属于 GPT-4o 系列的一部分。用户可通过 OrcaRouter 的 API 访问,基础 URL 为 https://api.orcarouter.ai/v1,模型标识符为 "openai/gpt-4o-search-preview"。该模型支持 128,000 个 token 的上下文窗口,每次请求最多输出…
该模型非常适合需要对长文本序列进行推理的任务,例如摘要生成、从大型文档中进行问答,以及在扩展对话中生成连贯的回复。鉴于其搜索预览标签,它可能能够有效处理搜索结果聚合和上下文检索。其大上下文窗口使您能够在单个提示中分析整个报告、书籍或代码库。
主要限制在于缺乏多模态支持。它无法处理图像、音频或视频输入,这限制了其在视觉问答或语音转录等应用中的使用。此外,没有公开的官方基准分数或延迟数据,因此难以比较特定任务上的性能表现。该模型可能未针对文本推理之外的任务进行优化。
对于上下文需求较小的任务(例如简单的分类、短文本生成),像GPT-3.5 Turbo这样更便宜且更快的模型可能更具成本效益。如果需要多模态输入,可考虑标准的GPT-4o模型。对于极高吞吐量的纯文本工作负载,需评估OrcaRouter的零加成定价与其他供应商相比,是否能在每token成本上带来合理优势。
不。GPT-4o搜索预览仅接受文本输入,不支持图像、音频或视频。这是它与标准多模态GPT-4o模型的主要区别。需要视觉或听觉理解功能的用户应选择其他模型。
OpenAI 尚未针对 GPT-4o Search Preview 变体发布任何具体的基准测试分数。作为 GPT-4o 系列的一部分,它可能在语言理解任务上与 GPT-4o 共享性能特征,但未提供官方数据。建议用户在代表性数据集上进行自己的评估,以确定其适用性。
GPT-4o Search Preview 的延迟和吞吐量数据未公开记录。作为 GPT-4o 的一个变体,其响应时间可能与标准 GPT-4o 模型相近,但实际性能取决于请求并发量、令牌数量以及 OrcaRouter 基础设施等因素。用户应使用自己的实际工作负载进行基准测试。
除了缺乏多模态支持外,该模型尚未发布基准测试分数和延迟保证。其“搜索预览”名称暗示针对搜索相关任务进行了优化,但优化的具体程度未明确说明。用户不应假设它在非搜索任务上的表现会优于标准GPT-4o。此外,与其他GPT-4o变体相比,也无法保证更低的价格或更高的效率。
定价为每100万输入令牌2.50美元,每100万输出令牌10.00美元。OrcaRouter按提供商费率收取费用,无任何加价。不收取额外费用。令牌使用量按输入和输出分别计费。这些费率与OpenAI平台上的标准GPT-4o定价一致。
与其他许多模型相比,GPT-4o Search Preview 的每 token 费率处于高端水平,这是高能力模型的典型特征。例如,GPT-3.5 Turbo 就明显便宜得多。OrcaRouter 的零加价政策确保用户支付与 OpenAI 直接计费相同的费用,且无需承担任何额外开销。这对于需要大上下文窗口且对成本敏感的应用场景来说可能非常有利。
OrcaRouter 并未公开宣传任何针对 GPT-4o Search Preview 的缓存折扣或令牌节省计划。用户根据消耗的输入和输出令牌总数进行计费。为控制成本,建议优化提示长度并限制输出令牌。批处理可能提高效率,但现有文档中未提及。
该模型通过OrcaRouter的OpenAI兼容API进行访问。将基础URL设置为https://api.orcarouter.ai/v1,并在请求中包含模型ID "openai/gpt-4o-search-preview"。使用标准的OpenAI客户端库(例如Python openai包)和您的OrcaRouter API密钥。示例:openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...])。
由于该API兼容OpenAI,因此支持标准参数:model、messages、max_tokens、temperature、top_p、frequency_penalty、presence_penalty、stop、stream等。max_tokens参数不得超过16,384个token的输出限制。该模型不支持多模态输入,因此消息中只能包含文本内容。
要从另一个GPT-4o变体(例如“gpt-4o”或“gpt-4o-mini”)切换,只需在API调用中将模型ID更改为“openai/gpt-4o-search-preview”。确保您的请求仅包含文本内容,因为此变体不支持图像或音频。根据需要调整max_tokens参数。无需其他代码更改。
身份验证通过API密钥处理。您需要一个OrcaRouter API密钥,该密钥在请求头中传递(通常格式为"Authorization: Bearer <your_key>")。请从OrcaRouter平台获取密钥。所有通过网关访问的模型均使用相同的身份验证方式。
GPT-4o Search Preview 仅支持文本,而标准 GPT-4o 支持文本、图像和音频。搜索预览变体可能对与搜索相关的查询进行了底层优化,但这些优化并未公开详细说明。价格相同:输入 $2.50/M,输出 $10/M。两者均使用 128k 上下文窗口和 16k 最大输出。主要权衡在于模态支持与潜在的专门化搜索性能之间。
GPT-4 Turbo(128k上下文,文本+图像)是GPT-4o的前身。GPT-4o Search Preview更新,属于GPT-4o系列,相较于GPT-4 Turbo通常提供更强的推理能力和效率。但GPT-4 Turbo的多模态支持仅限于图像,而GPT-4o是完全多模态的。Search Preview取消了这一优势。GPT-4 Turbo的定价通常为输入$10/M、输出$30/M,因此Search Preview更便宜(按给定费率计算)。请注意,此处未提供GPT-4 Turbo的具体定价,此信息为通用知识。
其他以搜索为中心的模型(例如,专用的检索增强生成系统)可能提供内置的网络搜索或文件检索功能。GPT-4o Search Preview 不包含自身的搜索功能;它是一个可以处理提示中提供的搜索结果的語言模型。如果需要外部检索,请将此模型与搜索 API 结合使用。其较大的上下文窗口使其适合在单个请求中聚合大量搜索结果。
主要的权衡在于模态支持与潜在的搜索任务优化之间。你获得较大的上下文窗口和零加价定价,但失去了处理图像或音频的能力。在已知的基准测试中,性能可能等同于GPT-4o,但尚无具体分数。对于受益于128k上下文的纯文本任务,该模型是GPT-4o系列中经济实惠的选择。
兼容 OpenAI——沿用你现有的 SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| 输入 / 1M tokens | $2.50 |
| 输出 / 1M tokens | $10.00 |
| 货币 | USD |
基于标价的估算
仅为估算——实际 Token 数取决于提供商的分词器。
@misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview