GPT-4o Search Preview 是一個專門用於 Chat Completions 中網路搜尋的模型。它經過訓練,能夠理解和執行網路搜尋查詢。
GPT-4o Search Preview 是 OpenAI 推出的純文字模型,屬於 GPT-4o 系列的一部分。可透過 OrcaRouter 的 API 存取,基礎網址為 https://api.orcarouter.ai/v1,模型識別碼為「openai/gpt-4o-search-preview」。該模型支援 128,000 Token 的上下文視窗,每次請求最多可輸出 16,384 個…
該模型非常適合需要對長文本序列進行推理的任務,例如摘要、大型文檔問答,以及在擴展對話中生成連貫的回應。鑑於其搜索預覽標籤,它可能有效地處理搜索結果聚合和上下文檢索。其大上下文窗口可讓您在單次提示中分析整個報告、書籍或程式碼庫。
主要限制是缺乏多模態支持。它無法處理圖像、音頻或視頻輸入,這限制了它在視覺問答或語音轉錄等應用中的使用。此外,沒有官方的基準測試分數或延遲數據,這使得難以比較特定任務的表現。該模型可能未針對文本推理之外的任務進行優化。
對於上下文需求較小的任務(例如簡單分類、短文生成),使用較便宜且速度較快的模型如 GPT-3.5 Turbo 可能更具成本效益。如需多模態輸入,則可考慮標準的 GPT-4o 模型。至於極高文字量的工作負載,請評估 OrcaRouter 的零加成定價相較其他供應商是否值得每個 token 的成本。
不。GPT-4o Search Preview 僅接受文字輸入,不支援圖片、音訊或影片。這是它與標準多模態 GPT-4o 模型的主要區別。需要視覺或聽覺理解的用戶應選擇其他模型。
OpenAI 尚未公布專門針對 GPT-4o Search Preview 變體的基準測試分數。由於它是 GPT-4o 系列的一部分,可能在語言理解任務上與 GPT-4o 共享性能特徵,但官方未提供任何具體數字。建議用戶在代表性資料集上自行評估以確定適用性。
GPT-4o Search Preview 的延遲和吞吐量數據並未公開記錄。作為 GPT-4o 的一個變體,它可能具有與標準 GPT-4o 模型相似的回應時間,但實際性能取決於請求並發數、Token 數量以及 OrcaRouter 基礎架構等因素。使用者應使用自己的工作量進行基準測試。
除了缺乏多模態支援外,該模型也未公開基準評分與延遲保證。其「搜尋預覽」的標示暗示了針對搜尋相關任務的優化,但優化的具體程度並未說明。使用者不應假設它在非搜尋任務上能勝過標準版的 GPT-4o。此外,相較於其他 GPT-4o 變體,該模型也無法保證更低的定價或更高的效率。
定價為每1百萬輸入tokens $2.50,每1百萬輸出tokens $10.00。OrcaRouter 以零加價直接收取供應商費率,不收取任何額外費用。Token 用量按輸入和輸出分別計費。這些費率與 OpenAI 在其平台上標準的 GPT-4o 定價一致。
相比許多其他模型,GPT-4o Search Preview 定位為高單價的每 token 費率,這是高能力模型的典型特點。例如,GPT-3.5 Turbo 就便宜得多。OrcaRouter 的零加成政策確保用戶支付與直接 OpenAI 計費相同的價格,且沒有任何額外開銷。這對於需要大上下文窗口且成本敏感的應用來說可能是有利的。
OrcaRouter 並未公開針對 GPT-4o Search Preview 提供任何快取折扣或代幣節省方案。使用者係依據所消耗的輸入與輸出代幣總數計費。為控制成本,建議最佳化提示詞長度並限制輸出代幣數量。批次處理或許能提升效率,但在現有文件中並未提及。
模型是透過OrcaRouter的OpenAI相容API進行存取。將基礎URL設定為https://api.orcarouter.ai/v1,並在請求中包含模型ID "openai/gpt-4o-search-preview"。使用標準的OpenAI客戶端函式庫(例如Python openai套件)搭配您的OrcaRouter API金鑰。範例:openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...])。
由於此 API 與 OpenAI 相容,因此可使用的標準參數包括:model、messages、max_tokens、temperature、top_p、frequency_penalty、presence_penalty、stop、stream 及其他。max_tokens 參數不得超過 16,384 個 token 的輸出限制。此模型不支援多模態輸入,因此 messages 應僅包含文字內容。
要從另一個 GPT-4o 變體(例如 "gpt-4o" 或 "gpt-4o-mini")切換,只需將 API 呼叫中的模型 ID 更改為 "openai/gpt-4o-search-preview"。請確保您的請求僅包含文字內容,因為此變體不接受圖片或音訊。如有需要,請調整 max_tokens 參數。無需其他程式碼變更。
身份驗證通過API金鑰處理。您需要一個OrcaRouter API金鑰,該金鑰在請求標頭中傳遞(通常為"Authorization: Bearer <your_key>")。請從OrcaRouter平台獲取金鑰。對於通過閘道器可訪問的所有模型,均使用相同的身份驗證。
GPT-4o Search Preview 僅支援文字,而標準 GPT-4o 則支援文字、圖片和音訊。搜尋預覽版本可能對搜尋相關查詢有底層最佳化,但這些細節並未公開。定價相同:每百萬輸入 $2.50,每百萬輸出 $10。兩者皆使用 128k 上下文視窗和 16k 最大輸出。主要的取捨在於模態支援與可能更專門化的搜尋效能。
GPT-4 Turbo(128k 上下文,文字+圖片)是 GPT-4o 的前身。GPT-4o Search Preview 是較新的模型,屬於 GPT-4o 系列,相較於 GPT-4 Turbo,整體上提供更佳的推理能力和效率。不過,GPT-4 Turbo 的多模態支援僅限於圖片,而 GPT-4o 則是完全多模態。Search Preview 消除了這個優勢。GPT-4 Turbo 的定價通常為每百萬輸入 tokens $10 美元,每百萬輸出 tokens $30 美元,這使得 Search Preview 更便宜(若採用給定的費率)。請注意,此處未提供 GPT-4 Turbo 的定價;這屬於一般常識。
其他以搜尋為重點的模型(例如專用的檢索增強生成系統)可能提供內建的網路搜尋或檔案檢索功能。GPT-4o Search Preview 本身不包含搜尋功能;它是一個語言模型,可以處理提示中提供的搜尋結果。如果您需要外部檢索,請將此模型與搜尋 API 結合使用。其大型上下文視窗使其適合在單一請求中彙整多個搜尋結果。
主要的取捨在於模態支援與潛在的搜尋任務最佳化之間。你獲得了較大的上下文視窗和零加價定價,但失去了處理圖像或音訊的能力。根據已知基準測試,效能可能等同於GPT-4o,但沒有具體分數可用。對於受益於128k上下文的純文字任務,此模型是GPT-4o系列中具成本效益的選擇。
相容 OpenAI——沿用你現有的 SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| 輸入 / 1M tokens | $2.50 |
| 輸出 / 1M tokens | $10.00 |
| 貨幣 | USD |
基於標價的估算
僅為估算——實際 Token 數取決於供應商的分詞器。
@misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview