GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
HerramientasJSON
por OpenAI · 2023-08-28

Este modelo ofrece cuatro veces la longitud de contexto de gpt-3.5-turbo, lo que le permite soportar aproximadamente 20 páginas de texto en una sola solicitud a un costo más alto. Datos de entrenamiento: up...

ctx16.4K tokens
Salida máx.4.1K
Entradatext
Salidatext
p50 TTFT2.00 s
ENTRADA$3.00/ 1M tokens
SALIDA$4.00/ 1M tokens
p50 TTFT2.00 s7 d
p95 TTFT3.63 s7 d
TRÁFICO16.8Ktokens / 7 d

GPT-3.5 Turbo 16k es una versión de contexto extendido del modelo GPT-3.5 Turbo de OpenAI, lanzada originalmente para admitir tareas que requieren procesar grandes cantidades de texto sin dividir. Su…

¿Qué es GPT-3.5 Turbo 16k?

¿Para quién es este modelo?

¿Cuáles son las especificaciones clave?

¿Cómo proporciona OrcaRouter acceso?

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Precios

Entrada / 1M tokens$3.00
Salida / 1M tokens$4.00
MonedaUSD

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $33.00

Estimación según precio de lista

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.002054

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
2.00 s
Velocidad de salida
238 tok/s
p95 TTFT
3.63 s
Tasa de error
0%

Pruebas de referencia públicas

10.7
AA Coding
Mejor que el 2 % de los modelos comparados
n.º 118 de 123
3.6
AA Intelligence
Mejor que el 0 % de los modelos comparados
n.º 122 de 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Fuente: artificialanalysis.ai

Comparativa

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$3.00$21.00$60.00$5.00
Salida $/M$4.00$168.00$270.00$30.00
Contexto16K400K1.1M
Calidad2/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuál es el costo de GPT-3.5 Turbo 16k en OrcaRouter?
El costo es de $3.00 por cada 1M de tokens de entrada y $4.00 por cada 1M de tokens de salida, facturado exactamente a la tarifa del proveedor OpenAI sin margen adicional. No hay cargos adicionales de plataforma.
¿Cuál es el tamaño de la ventana de contexto?
El modelo admite una ventana de contexto de 16,385 tokens y una salida máxima de 4,096 tokens. Solo maneja entrada de texto.
¿Cuáles son las fortalezas de este modelo en comparación con GPT-3.5 Turbo 4k?
La principal fortaleza es su contexto de 16k, que permite procesar documentos o conversaciones más largos en una sola solicitud sin dividirlos. El rendimiento en los benchmarks también es ligeramente mejor: 46.2 en MMLU‑Pro frente a aproximadamente 43 en MMLU estándar para la variante de 4k.
¿Cómo se compara con GPT-4?
GPT-3.5 Turbo 16k es mucho menos capaz en razonamiento, precisión factual y tareas matizadas. GPT‑4 obtiene más de 80 en MMLU y maneja mejor la lógica compleja, pero es de 10 a 20 veces más caro y lento. Utilice GPT-3.5 Turbo 16k cuando se necesite un contexto ampliado pero no sea necesario un razonamiento avanzado.
¿Cómo maneja OrcaRouter mis datos cuando uso este modelo?
OrcaRouter actúa como un proxy: reenvía tu solicitud de API a OpenAI y devuelve la respuesta. No almacena ni registra el contenido de los prompts más allá del manejo transitorio de la solicitud. Para obtener información detallada sobre el manejo de datos, consulta la política de privacidad de OrcaRouter y los términos de uso de datos de OpenAI.
¿Cómo llamo a este modelo usando una API compatible con OpenAI?
Establezca su URL base en https://api.orcarouter.ai/v1 y use el ID del modelo "openai/gpt-3.5-turbo-16k". Todos los demás parámetros de finalización de chat (mensajes, temperatura, max_tokens, etc.) funcionan de manera idéntica a la API de OpenAI.
¿Qué pasa si excedo el límite de 16,384 tokens?
OrcaRouter devolverá un error indicando que los tokens combinados de prompt y completion exceden la ventana de contexto del modelo. Debe acortar la entrada, reducir max_tokens o dividir la solicitud en varias llamadas.
¿Puedo usar streaming con este modelo?
Sí, establece el parámetro stream en true en tu solicitud. OrcaRouter transmitirá los tokens como eventos de datos, siguiendo el mismo formato que la API de streaming de OpenAI.
¿Hay algún gasto mínimo o compromiso?
No. Solo pagas por los tokens utilizados. No hay tarifas de suscripción, compromisos mínimos mensuales ni descuentos por volumen. El precio es estrictamente de pago por uso.

Insertar esta insignia

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k en OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Ficha del modelo como datos

GET /api/public/models/openai/gpt-3.5-turbo-16kAbrir
Legible por máquina:/llms.txt/llms-full.txt