GPT-4o(「o」代表「omni」)是 OpenAI 最新的人工智慧模型,同時支援文字與圖像輸入,並可輸出文字。它保持了 [GPT-4 Turbo](/models/openai/gpt-4-turbo) 的智慧水準,同時是兩倍...
GPT-4o 是 OpenAI 開發的多模態大型語言模型。它接受文字、圖片和檔案輸入,並輸出文字。此模型專為需要處理長篇內容(最多 128,000 個 tokens)且需要強大推理能力(包括數學問題求解)的使用者設計。它非常適合建構結合文字與圖片的應用程式(如文件分析、視覺問答或程式碼審查)的開發者。在 OrcaRouter 上,您以供應商價格的零加成存取 GPT-4o——每 100 萬輸入…
GPT-4o 在多模態推理、長上下文處理以及數學問題解決方面表現出色。其 128k token 的上下文容量讓它能保留並參考大量資訊,適用於文件分析、跨專案的程式碼生成,以及複雜的多輪對話等任務。該模型在 MATH-500 基準測試中獲得 75.9 分,顯示出強大的數學問題解決能力。此外,它能接受圖像與檔案輸入,因此可結合文字對圖表、曲線圖或照片等視覺內容進行推理。在 OrcaRouter 上,您可享有這些優勢,而且無需支付任何高於 OpenAI 公開定價的加價。
GPT-4o 對於同時需要文字與視覺理解的任務極為有效。範例包括:回答教科書中圖表的問題、從掃描發票中提取資料、根據線框圖生成程式碼,或總結帶有圖表的長篇研究論文。其龐大的上下文長度也使其適合分析整個程式碼庫或長篇對話記錄。數學推理是另一項強項,其在 MATH-500 上獲得 75.9 分即為證明。在 OrcaRouter 上,這些使用案例的實現非常直接——你只需發送標準的 OpenAI 相容請求,包含適當的內容類型,模型便會回傳文字回應。
如果你的任務不需要多模態輸入或大範圍上下文,使用較便宜的模型可能更具成本效益。例如,針對適合較小上下文的簡單文本分類、摘要或翻譯任務,像 GPT-3.5 Turbo(輸入每 100 萬 tokens 定價 $0.50,輸出每 100 萬 tokens 定價 $1.50)這類模型會便宜許多。GPT-4o 的輸入成本為每 100 萬 tokens $2.50,比 GPT-3.5 Turbo 貴了五倍。若你處理的是大量純文本資料,無需多模態推理,使用較小模型即可降低成本。OrcaRouter 提供多種模型,讓你選擇最佳的價格效能平衡。
GPT-4o 的設計可接受圖像和檔案作為輸入,使其能夠執行視覺問答、圖像描述和文件理解等任務。儘管現有事實中未提供具體的多模態基準分數,但該模型的架構支援文字與圖像的聯合推理。例如,它能夠計算圖像中的物體數量或解讀圖表。模型僅輸出文字,不輸出圖像。在 OrcaRouter 上,多模態請求使用與 OpenAI API 相同的參數傳送:在 messages 陣列中加入 image_url 或檔案內容部分。模型處理視覺資料後,根據組合輸入回傳文字回應。
GPT-4o在MATH-500基準測試中獲得75.9分。MATH-500是MATH資料集的一個子集,包含500道涵蓋代數、幾何和微積分等各種主題的具挑戰性數學問題。75.9分意味著該模型正確解決了約76%的問題。這顯示出強大的數學推理能力,儘管並非完美。相比之下,許多較小的模型在同類基準測試中得分低於50。這個分數反映了模型執行多步驟推理和處理數學符號的能力。在OrcaRouter上,您可以使用GPT-4o進行數學相關任務,例如輔導、考試準備或驗算。
如同所有大型語言模型,GPT-4o 有其限制。它可能會產生不正確或幻覺式的答案,尤其是在訓練資料有限或需要非常近期知識的主題上(其訓練截止日期在事實中未提供,但作為 OpenAI 的模型,它有知識截止日期)。它對提示詞的措辭敏感,且可能難以處理模糊的指令。儘管它在 MATH-500 上表現優異,但在複雜的數學證明上並非萬無一失。該模型能處理圖像,但無法生成圖像。此外,大上下文視窗(128k tokens)可能導致 token 使用量增加,若未謹慎管理,會提高成本。在 OrcaRouter 上,您可以透過調整溫度(temperature)和 top_p 等參數來緩解部分問題。
事實中並未提供GPT-4o的具體延遲數據。一般來說,GPT-4o屬於大型模型,與GPT-3.5 Turbo或Llama 3.1 8B等較小模型相比,其延遲會更高。不過,它很可能針對比原始GPT-4更快的推論進行了優化。透過OrcaRouter,您可預期獲得與直接使用OpenAI相似的回應時間,因為該平台在路由請求時不會增加額外處理。對於對速度要求嚴格的即時應用,建議在處理簡單任務時使用更快、更便宜的模型,而將GPT-4o保留給能發揮其能力的複雜查詢。
在OrcaRouter上,GPT-4o的定價完全按照OpenAI公布的費率:每100萬個輸入代幣2.50美元,每100萬個輸出代幣10.00美元。OrcaRouter不加收任何加價。帳單根據取整至最接近整數的代幣數量計算。輸入代幣包含您發送的文字、圖片和檔案,不過圖片通常由模型按固定費率進行代幣化(例如,每張圖片消耗一定數量的代幣)。輸出代幣則是指模型生成的文字。您只需為實際使用量付費,沒有月費或最低消費要求。這種透明的定價方式讓您能夠準確預估AI工作負載的預算。
主要的取捨在於成本與能力之間。GPT-4o 每百萬 token 的輸入成本為 $2.50,輸出成本為 $10。較便宜的模型如 GPT-3.5 Turbo(輸入 $0.50,輸出 $1.50)或 Llama 3.1 8B 對於簡單或高批量任務更為經濟。然而,GPT-4o 提供多模態輸入和更大的上下文視窗。如果你的應用需要理解圖像或處理非常長的文件,儘管成本較高,GPT-4o 可能是必要的。對於僅限文字的短輸入任務,較便宜的模型可以節省開支。在 OrcaRouter 上,你可以通過簡單更改模型 ID 來切換模型,從而為每個請求優化成本。
不。OrcaRouter 以供應商完全相同的價格計費 GPT-4o,零加成。輸入代幣每 1M 收費 $2.50,輸出代幣每 1M 收費 $10.00。沒有任何隱藏費用、追加銷售或額外收費。OrcaRouter 直接從 OpenAI 傳遞成本。此政策適用於平台上列出的所有模型。基礎 URL 是 https://api.orcarouter.ai/v1,模型 ID 是 "openai/gpt-4o"。您可以隨時透過查閱使用儀表板來驗證定價。沒有分級定價或承諾要求——僅按消耗的代幣付費。
若要透過 OrcaRouter 使用 GPT-4o,請將 HTTP POST 請求發送至基礎 URL https://api.orcarouter.ai/v1/chat/completions。將 model 參數設為 "openai/gpt-4o"。您的請求必須包含 API 金鑰(在 Authorization 標頭中提供您的 OrcaRouter API 金鑰)。請求主體遵循標準的 OpenAI 聊天補全格式:一個包含 role/content 配對的 messages 陣列,以及 temperature、max_tokens、top_p 等可選參數。對於多模態輸入,請包含 type 為 "text" 或 "image_url"(或 file)的 content parts。回應是一個包含模型補全結果的 JSON 物件。範例 curl 指令:curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model":"openai/gpt-4o","messages":[{"role":"user","content":[{"type":"text","text":"這張圖片裡有什麼?"},{"type":"image_url","image_url":{"url":"https://example.com/image.jpg"}}]}]}'
通過 OrcaRouter 調用 GPT-4o 時,你可以使用與 OpenAI API 相同的參數。常用參數包括: - temperature(浮點數,0-2):控制隨機性。較低的值如 0.2 會使輸出更具確定性。 - max_tokens(整數,預設 16384):回應中的最大 token 數量。 - top_p(浮點數,0-1):核取樣參數。 - frequency_penalty 和 presence_penalty:減少重複。 - stop(字串或陣列):停止序列。 - stream(布林值):啟用串流回應(true/false)。 - seed(整數):用於確定性取樣。 你還可以使用可選的 "user" 欄位來追蹤個別使用者。該模型支援函數呼叫與工具使用,儘管事實中未明確列出。在 OrcaRouter 上,所有標準參數皆可接受。
遷移過程非常簡單,因為 OrcaRouter 提供了與 OpenAI 相容的端點。步驟如下: 1. 從 OrcaRouter 獲取 API 金鑰(在他們的網站上註冊)。 2. 將基礎 URL 從 https://api.openai.com/v1 更改為 https://api.orcarouter.ai/v1。 3. 將模型 ID 從 "gpt-4o" 更改為 "openai/gpt-4o"。 4. 使用相同的請求體格式。除了端點和模型名稱之外,無需更改任何程式碼。 5. 更新 Authorization 標頭為使用你的 OrcaRouter API 金鑰。 建議先以單一請求進行測試。OrcaRouter 使用相同的串流和非串流模式。模型行為沒有任何差異,因為它使用的是相同的底層 OpenAI 模型。你現有的提示詞和參數將完全一致地運作。
OrcaRouter API 的基本 URL 為 https://api.orcarouter.ai/v1。GPT-4o 使用的特定模型 ID 為 "openai/gpt-4o"。此精確字串必須在請求的 "model" 參數中傳入。例如,在聊天補全端點呼叫中,你需設定 "model": "openai/gpt-4o"。OrcaRouter 支援此模型的串流與非串流補全。如果你使用的 OpenAI SDK 或函式庫已設定指向自訂基本 URL,只需將基本 URL 設為 https://api.orcarouter.ai/v1 並提供你的 OrcaRouter API 金鑰即可。模型 ID 前綴 "openai/" 用於區分 OrcaRouter 上其他提供者的模型。
GPT-4o 是 GPT-4 Turbo 的多模態後繼模型。兩款模型均具備 128k 的上下文窗口。然而,GPT-4o 新增了原生圖片和檔案輸入支援,而 GPT-4 Turbo 主要僅限於文字(視覺功能僅在單獨版本中提供)。GPT-4o 的最大輸出也更高,達到 16,384 個 tokens,相較之下 GPT-4 Turbo 通常為 4,096 或 8,192。定價方面有所不同:GPT-4 Turbo 每 1M 輸入收費 $10.00 美元,每 1M 輸出收費 $30.00 美元,這使得 GPT-4o 明顯更便宜($2.50/$10.00)。GPT-4o 的 MATH-500 分數為 75.9,普遍高於 GPT-4 Turbo 所報告的基準測試結果,但確切的 Turbo 分數未在事實中提供。在 OrcaRouter 上,兩款模型均以零加價提供。
GPT-3.5 Turbo 是一款更便宜、更快的模型,專為簡單任務最佳化。其上下文窗口為16,384個token,遠小於GPT-4o的128k。GPT-3.5不支援圖像輸入——僅限文字。其定價為每100萬輸入token $0.50,每100萬輸出token $1.50,輸入成本約為GPT-4o的5倍便宜,輸出成本則約為6.6倍便宜。在MATH-500基準測試中,GPT-3.5 Turbo的分數通常低很多(未提供確切數字)。GPT-4o更適合複雜推理、長文件及多模態任務。對於大量、簡單的互動,請使用GPT-3.5 Turbo。在OrcaRouter上,您只需變更模型ID即可輕鬆在兩者之間切換。
Claude 3.5 Sonnet 是 Anthropic 推出的競爭模型。它也擁有 200k 的上下文窗口(大於 GPT-4o 的 128k)並支援圖片輸入。Claude 3.5 Sonnet 的定價通常為每 1M 輸入 $3.00、每 1M 輸出 $15.00,這使得 GPT-4o 在輸入端較便宜,但在輸出端較貴?實際上 GPT-4o 的輸入為 $2.50 vs $3.00,所以更便宜;輸出 $10 vs $15,也更便宜。在基準測試上,Claude 3.5 Sonnet 在數學和推理方面表現類似,但具體分數有所差異。兩個模型在多模態任務上都表現強勁。兩者之間的選擇可能取決於特定的性能特徵或生態系統偏好。在 OrcaRouter 上,兩者都可通过相同的 API 格式訪問,只需使用不同的模型 ID(例如 "anthropic/claude-3.5-sonnet")。
Llama 3.1 405B 是 Meta 推出的開放權重模型,擁有 4050 億個參數。它支援 128k 上下文窗口及文字輸入,但其多模態能力較不明確(可能不原生支援圖片)。Llama 3.1 405B 可透過 OrcaRouter 以較低價格取得,通常每 100 萬輸入 Token 約 1.00 美元,每 100 萬輸出 Token 約 1.00 美元(約略值,未在事實中提供)。其在 MATH-500 上的基準評分未給出,但可能低於 GPT-4o 的 75.9。GPT-4o 為專有模型,提供更佳的開箱即用多模態推理能力,且在複雜任務上可能具有更高準確度。對於想要開放模型或需要自托管的用戶來說,Llama 3.1 405B 是不錯的選擇。在 OrcaRouter 上,你可以並排比較這兩種模型。
相容 OpenAI——沿用你現有的 SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokensnparallel_tool_callspredictionpresence_penaltyresponse_formatseedservice_tierstopstreamstructured_outputstemperaturetool_choicetoolstop_logprobstop_pweb_search_options| 輸入 / 1M tokens | $2.50 |
| 輸出 / 1M tokens | $10.00 |
| 快取讀取 / 1M | $1.25 |
| 貨幣 | USD |
基於標價的估算
僅為估算——實際 Token 數取決於供應商的分詞器。
@misc{orcarouter_gpt_4o,
title = {GPT-4o API},
author = {OpenAI},
year = {2024},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o}
}OpenAI. (2024). GPT-4o API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o