預覽純文字GPT-4o模型,具備128K上下文、16K輸出,通過OrcaRouter API存取,費用為每百萬tokens $2.50/$10。
此模型是 OpenAI 的預覽版本,僅限文字輸入。透過 OrcaRouter 的 API 存取時,其識別碼為 openai/gpt-4o-search-preview-2025-03-11。該模型提供 128,000 個 token 的上下文視窗,每次回應最多可生成 16,384 個 token。輸入模式僅限於文字;此版本不支援圖片或音訊。預覽狀態意味著它可用於在 GPT-4o…
作為一個純文字型的GPT-4o預覽版本,它在廣泛領域中擅長理解和生成自然語言。它能執行文件摘要、問答、創意寫作、翻譯和程式碼生成。其大型上下文視窗使其能夠在很長的段落中保持連貫性,適合進行書籍分析或處理大量日誌等任務。它支援聊天格式中的系統、使用者和助理訊息。該模型具備GPT-4類別模型典型的零樣本和少樣本推理能力,使其無需大量微調即可處理複雜指令。
如果你的任務不需要GPT-4o的完整推理能力,請考慮使用OrcaRouter中較小或較便宜的模型,例如openai/gpt-4o-mini或gpt-3.5-turbo。更適合便宜模型的任務範例包括簡單分類、短內容生成,或有限情境下的基礎問答。對於高流量、低複雜度的請求,預覽模型的成本可能不合理。此外,如果需要多模態輸入,此模型無法處理圖片或音訊;必須使用另一個模型(例如標準GPT-4o或GPT-4V)。務必評估每個token的品質與成本之間的權衡。
此模型被標示為「search-preview」變體,但在公開的規格說明中並未詳述任何特定的工具使用或網路搜尋能力。它僅支援文字輸入,並以標準語言模型的方式運作。使用者不應假設其具備任何內建的搜尋或檢索功能。如需擴增生成,您可以另行實作檢索增強生成(RAG)管道,將檢索到的文件送入模型的上下文視窗。OrcaRouter 不會加入任何工具使用中介層;模型僅根據其訓練內容與提供的提示來回應。未來版本可能改變此行為,但截至預覽版為止,並無記載任何工具整合。
作為預覽版,此模型可能表現出異常行為或較低可靠性,相比穩定版本。它僅支援純文字,因此任何多模態請求都會被拒絕。16,384 個令牌的最大輸出雖然可觀,但仍可能截斷非常長的生成內容。模型的知識截止日期與訓練資料並未指定;它可能無法得知近期事件。不建議用於生產環境,因為此模型可能被更新或移除。此外,由於其預覽性質,延遲可能高於穩定模型。在大規模部署前,請務必充分測試。
此特定預覽版本未提供具體的基準測試分數。作為 GPT-4o 的變體,預期其在常見語言任務上的表現與標準 GPT-4o 相近,但確切數字並未公開。使用者可使用公開資料集自行進行評估。長上下文視窗使其在長文檔基準測試中佔有優勢,但由於此為預覽版本,分數可能與正式版本模型有所差異。如需權威數據,請參閱 OpenAI 針對 GPT-4o 發布的官方基準測試報告。OrcaRouter 不會修改模型的輸出或效能。
此預覽模型的延遲和吞吐量數據尚未公佈。作為預覽版本,由於實驗性基礎設施,其速度可能比穩定的GPT-4o慢。回應時間取決於輸入長度、輸出長度和並發需求。OrcaRouter不會在正常的API路由之外增加額外延遲。若要估算速度,開發者可以使用典型負載運行樣本請求。對於需要一致效能的生產應用,除非需要預覽版的特定功能,否則建議改用穩定的gpt-4o模型。
GPT-4 類模型以其在數學、邏輯及常識推理等各領域的強大推理能力而聞名。此預覽版本預計將繼承這些能力。大上下文使其能夠在長步驟的複雜鏈式思考推理中不會遺漏先前部分。然而,此特定版本並未提供具體的推理基準。使用者應在其領域特定任務上自行驗證效能。與早期 GPT 版本相比,該模型可能展現更佳的指令遵循能力,但仍建議進行獨立驗證。
除了是預覽版之外,此模型不支援多模態功能,無法直接處理圖片、音訊或影片。其知識截止日期未知,因此可能缺乏訓練後事件的資訊。雖然16,384個代幣的輸出上限相當充裕,但無法在一次生成中產出極長文本;若要產生更長內容,需透過迭代提示或分段處理。預覽版在處理某些敏感話題時,錯誤率或拒絕率可能較高。非英語語言的表現也可能有所差異。部署前務必使用具代表性的資料進行測試。
該模型定價為輸入每100萬個Token $2.50,輸出每100萬個Token $10.00。這些是OpenAI的提供商費率;OrcaRouter不增加任何加價。例如,處理一個10,000個Token的提示並生成1,000個Token,輸入成本約為$0.025,輸出成本約為$0.01,總計$0.035。成本隨Token使用量線性增長。使用OrcaRouter作為API閘道器無需支付任何額外費用。請務必監控使用量以避免意外費用。若您的任務不需要完整功能,請與較便宜的模型進行比較。
OrcaRouter 目前不提供此模型的批量折扣或令牌快取功能。所有計費均按實際令牌用量依供應商費率即付即用。OrcaRouter 不會對提示或回應進行快取;每個請求皆獨立處理。若您的吞吐量極高,請聯絡 OrcaRouter 商討可能的客製化安排。為優化成本,請考慮使用較短提示、有效重複利用上下文,或批次處理請求。由於此處無快取機制,模型不支援針對快取命中降低定價。
以每百萬個token $2.50/$10的價格,此預覽版定價與標準的GPT-4o相似,但可能略有不同。較便宜的替代方案包括openai/gpt-4o-mini(約每百萬個$0.15/$0.60)或gpt-3.5-turbo(約$0.50/$1.50)。對於可以容忍較低品質的任務,這些模型能顯著節省成本。此預覽模型的成本在OrcaRouter目錄中屬於較高的一端。如果您僅將其用於測試,根據請求量,可能會產生中等程度的費用。務必評估預期的token用量,並與使用較大模型所帶來的品質提升進行比較。
若要使用此模型,請將您 API 用戶端的基礎 URL 設為 https://api.orcarouter.ai/v1,並指定模型 ID 為 openai/gpt-4o-search-preview-2025-03-11。您必須使用由 OrcaRouter 發行的 API 金鑰。該 API 完全相容 OpenAI,因此為 OpenAI 聊天完成端點編寫的現有程式碼只需極少改動即可正常運作。使用 curl 的呼叫範例:curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_ORCAROUTER_KEY" -H "Content-Type: application/json" -d '{ "model": "openai/gpt-4o-search-preview-2025-03-11", "messages": [{"role": "user", "content": "Hello"}], "max_tokens": 100 }'
您可以使用OpenAI支援的所有標準聊天完成參數:'messages'、'max_tokens'、'temperature'、'top_p'、'frequency_penalty'、'presence_penalty'、'stop'和'n'。該模型支援128,000個token的上下文視窗,因此'max_tokens'最高可設定為16,384。'temperature'控制隨機性;數值範圍為0到2。支援'stream'以實現即時回應。OrcaRouter不會引入額外參數。請確保您的請求符合token限制;輸入長度超過上下文視窗(包括回應)時,將被截斷或回傳錯誤。
遷移過程相當簡單。將你的 OpenAI 基礎 URL(https://api.openai.com/v1)替換為 OrcaRouter 的基礎 URL(https://api.orcarouter.ai/v1)。將你的 API 金鑰更換為 OrcaRouter 的金鑰。將模型欄位更新為 openai/gpt-4o-search-preview-2025-03-11。無需修改其他程式碼。如果你原本使用的是不同的 OpenAI 模型,你可以繼續使用相同的程式碼結構。OrcaRouter 會傳遞所有標準參數。遷移完成後,請驗證回應是否一致。請注意,帳單將由 OrcaRouter 處理,並且你需要在該平台擁有一個帳戶。
OrcaRouter 並未公開此預覽模型的具體速率限制。可用性取決於 OpenAI 的基礎設施與 OrcaRouter 的閘道容量。對於正式生產環境,請考量此模型的預覽狀態及潛在不穩定性。OrcaRouter 可能會實施合理的使用限制以防止濫用。您可以期待盡力而為的服務,但不提供任何 SLA。若需要保證吞吐量,請聯絡 OrcaRouter 以獲取專用方案。此模型亦可能隨時被移除或替換而不另行通知,因此請規劃備用模型。
標準 GPT-4o 模型(openai/gpt-4o)是一個多模態的穩定版本,而這個預覽版本僅支援文字輸入,專為早期測試設計。預覽版本可能包含尚未加入標準版本的即將推出功能,但也有可能較不可靠。定價相似。標準模型支援更廣泛的輸入(圖像、音訊)。如果您不需要預覽功能,標準 GPT-4o 是更安全的選擇。兩者均可透過 OrcaRouter 使用相同的 API 介面,讓切換變得容易。
Gpt-4o-mini 是較小、較便宜的模型,專為簡單任務最佳化。其成本約為每百萬輸入代幣 0.15 美元,每百萬輸出代幣 0.60 美元(約略值)。此預覽模型在輸入方面約貴 16 倍,在輸出方面也約貴 16 倍。預覽模型提供更大的上下文(128K 對 128K?實際上 gpt-4o-mini 也有 128K,但可能有所不同。我們知道此模型為 128K。根據公開資訊,Gpt-4o-mini 的上下文也是 128K,但我們無法假設。我們會說「可比較的上下文視窗」,但請注意價格差異。)此模型更適合複雜推理,而 gpt-4o-mini 對許多標準任務已足夠。請根據品質需求和預算來選擇。
Claude 模型(例如 Claude 3.5 Sonnet)提供大型上下文視窗和強大的推理能力,但其 API 並非直接與 OpenAI 相容。OrcaRouter 為多個供應商提供統一介面,但此預覽版僅來自 OpenAI。Claude 模型在安全性和長篇文字生成等領域可能具有不同的定價和優勢。若要進行直接比較,您需要在自己的使用案例中進行測試。OrcaRouter 允許您在供應商之間切換,但此預覽模型僅可透過 OpenAI 路由使用。未提供基準比較。
相容 OpenAI——沿用你現有的 SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview-2025-03-11",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| 輸入 / 1M tokens | $2.50 |
| 輸出 / 1M tokens | $10.00 |
| 貨幣 | USD |
基於標價的估算
僅為估算——實際 Token 數取決於供應商的分詞器。
GET /api/public/models/openai/gpt-4o-search-preview-2025-03-11開啟 @misc{orcarouter_gpt_4o_search_preview_2025_03_11,
title = {openai/gpt-4o-search-preview-2025-03-11 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11}
}openai. (n.d.). openai/gpt-4o-search-preview-2025-03-11 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11