GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
FerramentasJSON
por OpenAI · 2023-08-28

Este modelo oferece quatro vezes o comprimento de contexto do gpt-3.5-turbo, permitindo que ele suporte aproximadamente 20 páginas de texto em uma única solicitação a um custo mais alto. Dados de treinamento: até...

ctx16.4K tokens
Saída máx.4.1K
Entradatext
Saídatext
p50 TTFT2.00 s
ENTRADA$3.00/ 1M tokens
SAÍDA$4.00/ 1M tokens
p50 TTFT2.00 s7 d
p95 TTFT3.63 s7 d
TRÁFEGO16.8Ktokens / 7 d

O GPT-3.5 Turbo 16k é uma versão de contexto estendido do modelo GPT-3.5 Turbo da OpenAI, originalmente lançado para suportar tarefas que exigem processamento de grandes quantidades de texto sem…

O que é GPT-3.5 Turbo 16k?

Para quem é este modelo?

Quais são as principais especificações?

Como o OrcaRouter fornece acesso?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Preços

Entrada / 1M tokens$3.00
Saída / 1M tokens$4.00
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $33.00

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.002045

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
2.00 s
Velocidade de saída
238 tok/s
p95 TTFT
3.63 s
Taxa de erro
0%

Benchmarks públicos

10.7
AA Coding
Melhor que 2% dos modelos comparados
nº 118 de 123
3.6
AA Intelligence
Melhor que 0% dos modelos comparados
nº 122 de 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Fonte: artificialanalysis.ai

Comparativo

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$3.00$21.00$60.00$5.00
Saída $/M$4.00$168.00$270.00$30.00
Contexto16K400K1.1M
Qualidade2/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Qual é o custo do GPT-3.5 Turbo 16k no OrcaRouter?
O custo é $3.00 por 1M tokens de entrada e $4.00 por 1M tokens de saída, cobrados exatamente pela taxa do provedor OpenAI sem nenhum acréscimo. Não há taxas adicionais de plataforma.
Qual é o tamanho da janela de contexto?
O modelo suporta uma janela de contexto de 16.385 tokens e uma saída máxima de 4.096 tokens. Ele lida apenas com entrada de texto.
Quais são os pontos fortes deste modelo em comparação com o GPT-3.5 Turbo 4k?
A principal vantagem é seu contexto de 16k, permitindo processar documentos ou conversas mais longos em uma única solicitação sem dividir. O desempenho em benchmarks também é ligeiramente melhor: 46,2 no MMLU‑Pro contra cerca de 43 no MMLU padrão para a variante de 4k.
Como ele se compara ao GPT-4?
O GPT-3.5 Turbo 16k é muito menos capaz em raciocínio, precisão factual e tarefas matizadas. O GPT‑4 pontua >80 no MMLU e lida melhor com lógica complexa, mas é 10‑20x mais caro e mais lento. Use o GPT-3.5 Turbo 16k quando um contexto estendido for necessário, mas o raciocínio avançado não for.
Como o OrcaRouter lida com meus dados quando uso este modelo?
OrcaRouter atua como um proxy: ele encaminha sua solicitação de API para a OpenAI e retorna a resposta. Ele não armazena nem registra o conteúdo dos prompts além do processamento transitório da solicitação. Para obter detalhes sobre o tratamento de dados, consulte a política de privacidade do OrcaRouter e os termos de uso de dados da OpenAI.
Como faço para chamar este modelo usando uma API compatível com OpenAI?
Defina sua URL base para https://api.orcarouter.ai/v1 e use o ID do modelo "openai/gpt-3.5-turbo-16k". Todos os outros parâmetros de conclusão de chat (mensagens, temperatura, max_tokens, etc.) funcionam de forma idêntica à API da OpenAI.
E se eu exceder o limite de 16,384 tokens?
OrcaRouter retornará um erro indicando que os tokens combinados de prompt e conclusão excedem a janela de contexto do modelo. Você precisa encurtar a entrada, reduzir max_tokens ou dividir a solicitação em várias chamadas.
Posso usar streaming com este modelo?
Sim, defina o parâmetro stream como true na sua solicitação. O OrcaRouter transmitirá tokens de volta como eventos de dados, seguindo o mesmo formato da API de streaming da OpenAI.
Há algum valor mínimo de gasto ou compromisso?
Não. Você paga apenas pelos tokens usados. Não há taxas de assinatura, compromissos mínimos mensais ou descontos por volume. O preço é estritamente conforme o uso.

Incorporar este selo

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k no OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Ficha do modelo como dados

GET /api/public/models/openai/gpt-3.5-turbo-16kAbrir
Legível por máquina:/llms.txt/llms-full.txt