GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
工具JSON
來自 OpenAI · 2023-08-28

此模型提供的上下文長度為 gpt-3.5-turbo 的四倍,使其能夠在單次請求中支援約 20 頁的文字,但成本較高。訓練資料:截至...

上下文16.4K tokens
最大輸出4.1K
輸入模態text
輸出模態text
p50 首字節2.00 s
輸入$3.00/ 百萬 tokens
輸出$4.00/ 百萬 tokens
p50 首字節2.00 s7 天
p95 首字節3.63 s7 天
流量16.8Ktokens / 7 天

GPT-3.5 Turbo 16k 是 OpenAI 的 GPT-3.5 Turbo 模型的擴展上下文版本,最初發布以支援需要處理較大文字量而無需分割的任務。其 16,385 個 token(約 12,000 個單詞)的上下文視窗容量,使其能夠在單次推理呼叫中處理整篇文章、逐字稿或程式碼庫,同時仍可輸出最多 4,096 個 token。該模型僅限文字,無法原生處理圖片、音訊或其他模態。可透過…

什麼是GPT-3.5 Turbo 16k?

這個模型是為誰設計的?

主要規格是什麼?

OrcaRouter 如何提供存取?

程式碼範例

用任意 SDK 呼叫

相容 OpenAI——沿用你現有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支援的參數

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

價格

輸入 / 1M tokens$3.00
輸出 / 1M tokens$4.00
貨幣USD

費用計算器

每月 token 數10MM
輸入占比70%%
預計每月 $33.00

基於標價的估算

Token 與費用估算器

輸入 Token: 6每次請求費用: $0.002018

僅為估算——實際 Token 數取決於供應商的分詞器。

效能

p50 首字節
2.00 s
輸出速度
238 tok/s
p95 首字節
3.63 s
錯誤率
0%

公開基準測試

10.7
AA Coding
優於所參與比較模型中的 2%
第 118 / 共 123
3.6
AA Intelligence
優於所參與比較模型中的 0%
第 122 / 共 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
來源: artificialanalysis.ai

比較一覽

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
輸入 $/百萬$3.00$21.00$60.00$5.00
輸出 $/百萬$4.00$168.00$270.00$30.00
上下文16K400K1.1M
品質2/1010/1010/1010/10
並排比較並排比較並排比較並排比較

更多 OpenAI 模型

常見問題

在 OrcaRouter 上使用 GPT-3.5 Turbo 16k 的成本是多少?
費用為每1M輸入代幣$3.00,每1M輸出代幣$4.00,按OpenAI提供商的確切費率計費,無任何加價。沒有額外的平台費用。
上下文窗口大小是多少?
該模型支援16,385個token的上下文視窗,最大輸出為4,096個token。僅處理文字輸入。
這個模型相較於GPT-3.5 Turbo 4k有哪些優勢?
主要優勢在於其16k上下文長度,讓您可以在單一請求中處理較長的文件或對話而不需分割。在基準測試上的表現也稍好一些:MMLU‑Pro為46.2,而4k變體的標準MMLU約為43。
它與GPT-4相比如何?
GPT-3.5 Turbo 16k 在推理、事實準確性和細微任務上的能力遠不及 GPT-4。GPT‑4 在 MMLU 上得分超過 80,並能更好地處理複雜邏輯,但成本高出 10-20 倍且速度較慢。當需要較長上下文但不需進階推理時,可使用 GPT-3.5 Turbo 16k。
當我使用此模型時,OrcaRouter 如何處理我的數據?
OrcaRouter 作為代理:它將您的 API 請求轉發給 OpenAI 並返回回應。除了暫時性的請求處理外,它不會儲存或記錄提示內容。有關詳細的資料處理方式,請參閱 OrcaRouter 的隱私政策及 OpenAI 的資料使用條款。
如何使用與 OpenAI 兼容的 API 呼叫此模型?
設定您的基礎 URL 為 https://api.orcarouter.ai/v1,並使用模型 ID "openai/gpt-3.5-turbo-16k"。所有其他聊天完成參數(messages、temperature、max_tokens 等)與 OpenAI API 完全相同。
如果我超過 16,384 個 token 的限制怎麼辦?
OrcaRouter會返回一個錯誤,指出組合的提示與完成令牌超出了模型的上下文窗口。您需要縮短輸入、減少max_tokens,或將請求拆分為多次調用。
我可以使用串流與此模型嗎?
是的,請在您的請求中將 stream 參數設為 true。OrcaRouter 將會以資料事件的形式串流回傳 token,遵循與 OpenAI 串流 API 相同的格式。
是否有任何最低消費或承諾?
不。您只需為使用的代幣付費。沒有訂閱費、最低月消費承諾或批量折扣。定價嚴格按使用量付費。

嵌入此徽章

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50透過 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k 於 OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

以資料形式取得模型卡

GET /api/public/models/openai/gpt-3.5-turbo-16k開啟