GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
工具JSON
来自 OpenAI · 2023-08-28

该模型的上下文长度是gpt-3.5-turbo的四倍,单次请求可支持约20页文本,但成本更高。训练数据:截至...

上下文16.4K tokens
最大输出4.1K
输入模态text
输出模态text
p50 首字节2.00 s
输入$3.00/ 百万 tokens
输出$4.00/ 百万 tokens
p50 首字节2.00 s7 天
p95 首字节3.63 s7 天
流量16.8Ktokens / 7 天

GPT-3.5 Turbo 16k 是 OpenAI 的 GPT-3.5 Turbo 模型的一个扩展上下文版本,最初发布用于支持需要处理更大文本量而无需分段的任务。其上下文窗口容量为 16,385 个令牌(约 12,000 个单词),使其能够在单次推理调用中处理整篇文章、转录内容或代码库,同时仍可输出最多 4,096 个令牌。该模型仅支持文本,即本身不处理图像、音频或其他模态。通过…

什么是GPT-3.5 Turbo 16k?

这个模型是为谁设计的?

关键规格是什么?

OrcaRouter 如何提供访问?

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

价格

输入 / 1M tokens$3.00
输出 / 1M tokens$4.00
货币USD

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $33.00

基于标价的估算

Token 与费用估算器

输入 Token: 6每次请求费用: $0.002018

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
2.00 s
输出速度
238 tok/s
p95 首字节
3.63 s
错误率
0%

公共基准测试

10.7
AA Coding
优于所参与对比模型中的 2%
第 118 / 共 123
3.6
AA Intelligence
优于所参与对比模型中的 0%
第 122 / 共 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
来源: artificialanalysis.ai

对比一览

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
输入 $/百万$3.00$21.00$60.00$5.00
输出 $/百万$4.00$168.00$270.00$30.00
上下文16K400K1.1M
质量2/1010/1010/1010/10
并排对比并排对比并排对比并排对比

更多 OpenAI 模型

常见问题

GPT-3.5 Turbo 16k在OrcaRouter上的费用是多少?
成本为每100万输入代币3.00美元,每100万输出代币4.00美元,按OpenAI提供商的确切费率计费,零加价。无额外平台费用。
上下文窗口大小是多少?
该模型支持16,385个令牌的上下文窗口,最大输出为4,096个令牌。它仅处理文本输入。
与GPT-3.5 Turbo 4k相比,这个模型有哪些优势?
其主要优势在于16k上下文长度,允许你在单次请求中处理更长的文档或对话,无需拆分。基准测试表现也略胜一筹:MMLU‑Pro得分为46.2,而4k变体在标准MMLU上约为43分。
它与GPT-4相比如何?
GPT-3.5 Turbo 16k 在推理、事实准确性和精细任务方面的能力远弱于 GPT-4。GPT‑4 在 MMLU 上的得分超过 80,且能更好地处理复杂逻辑,但成本高出 10‑20 倍,速度也更慢。当需要长上下文但无需高级推理时,可使用 GPT-3.5 Turbo 16k。
当我在使用这个模型时,OrcaRouter 会如何处理我的数据?
OrcaRouter充当代理角色:它将您的API请求转发至OpenAI,并返回响应结果。除短暂请求处理外,它不会存储或记录提示内容。有关详细数据处理,请参阅OrcaRouter的隐私政策及OpenAI的数据使用条款。
如何使用兼容OpenAI的API调用此模型?
将您的基础URL设置为 https://api.orcarouter.ai/v1,并使用模型ID "openai/gpt-3.5-turbo-16k"。所有其他聊天完成参数(messages、temperature、max_tokens等)与OpenAI API完全相同。
如果我超过了16,384 token的限制会怎样?
OrcaRouter将返回一个错误,指示组合的提示和完成令牌超过了模型的上下文窗口。你需要缩短输入、减少max_tokens,或将请求拆分为多次调用。
这个模型支持流式传输吗?
是的,在你的请求中将 stream 参数设置为 true。OrcaRouter 将以数据事件的形式流式返回令牌,遵循与 OpenAI 流式 API 相同的格式。
是否有最低消费或承诺?
不。你只需为使用的令牌(token)付费。没有订阅费、最低月度承诺或批量折扣。定价严格按需付费。

嵌入此徽章

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k 在 OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

以数据形式获取模型卡

GET /api/public/models/openai/gpt-3.5-turbo-16k打开