openai/gpt-3.5-turbo-0125

openai/gpt-3.5-turbo-0125
HerramientasJSON
por openai

Modelo de texto rentable de OpenAI con una puntuación de 46.2 en MMLU-Pro, accedido a través de la API de OrcaRouter.

Salida máx.4.1K
Entradatext
p50 TTFT3.64 s
ENTRADA$0.50/ 1M tokens
SALIDA$1.50/ 1M tokens
p50 TTFT3.64 s7 d
p95 TTFT3.64 s7 d
TRÁFICO5.8Ktokens / 7 d

openai/gpt-3.5-turbo-0125 es un modelo de generación de texto desarrollado por OpenAI y disponible a través de la API de OrcaRouter. Forma parte de la familia GPT-3.5-Turbo, optimizado para tareas…

¿Qué es openai/gpt-3.5-turbo-0125?

¿Quién debería usar este modelo?

¿Cómo entrega OrcaRouter este modelo?

¿Cuáles son las características de entrada/salida?

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-0125",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • parallel_tool_calls

Precios

Entrada / 1M tokens$0.500
Salida / 1M tokens$1.50
MonedaUSD

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $8.00

Estimación según precio de lista

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.000759

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
3.64 s
Velocidad de salida
Recopilando…
p95 TTFT
3.64 s
Tasa de error
0%

Pruebas de referencia públicas

10.7
AA Coding
Mejor que el 2 % de los modelos comparados
n.º 118 de 123
3.6
AA Intelligence
Mejor que el 0 % de los modelos comparados
n.º 122 de 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Fuente: artificialanalysis.ai

Comparativa

openai/gpt-3.5-turbo-0125GPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$0.50$21.00$60.00$5.00
Salida $/M$1.50$168.00$270.00$30.00
Contexto400K1.1M
Calidad2/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuál es el costo de usar openai/gpt-3.5-turbo-0125 en OrcaRouter?
El precio es exactamente la tarifa directa de OpenAI sin margen: $0.50 por 1 millón de tokens de entrada y $1.50 por 1 millón de tokens de salida. No hay tarifas adicionales.
¿Cuál es el tamaño de la ventana de contexto?
El modelo admite un contexto total de 16,385 tokens (entrada + salida), con la salida limitada a 4096 tokens por generación. Esta es información pública ampliamente conocida para esta versión del modelo.
¿Cuáles son las principales fortalezas de este modelo?
Ofrece un buen equilibrio entre velocidad, coste y calidad para tareas de texto. Obtiene una puntuación de 46.2 en MMLU-Pro y maneja de manera fiable el seguimiento de instrucciones, el chat y las salidas estructuradas.
¿Cómo se compara con GPT-4?
GPT-4 lo supera en razonamiento complejo, pero cuesta significativamente más por token. Use GPT-3.5-Turbo-0125 para aplicaciones sensibles al costo o de alto volumen donde no se requiere una precisión cercana a la de GPT-4.
¿OrcaRouter registra o almacena mis datos?
OrcaRouter procesa solicitudes a la API de OpenAI. No registra ni almacena indicaciones ni respuestas más allá de lo necesario para facturación y seguridad operativa. Revise la política de privacidad de OpenAI para conocer su manejo de datos.
¿Cómo llamo a este modelo usando una API compatible con OpenAI?
Establezca la URL base en https://api.orcarouter.ai/v1, el modelo en 'openai/gpt-3.5-turbo-0125', y use su clave API de OrcaRouter en el encabezado Authorization. El formato estándar de completaciones de chat funciona.
¿Puedo transmitir respuestas en streaming?
Sí. Establece el parámetro 'stream' en true en tu solicitud. Las respuestas se enviarán como eventos enviados por el servidor (server-sent events) con deltas de tokens, que coinciden con el formato de streaming de OpenAI.
¿Cuál es la longitud máxima de salida?
El modelo puede generar hasta 4096 tokens en una sola respuesta. Usa el parámetro 'max_tokens' para controlar esto, pero no puede exceder 4096.
¿Es este modelo adecuado para tareas multilingües?
Funciona en muchos idiomas, pero rinde mejor en inglés. La precisión puede disminuir para idiomas con pocos recursos o expresiones idiomáticas complejas.

Insertar esta insignia

openai/gpt-3.5-turbo-0125$0.50/M in3644ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg" alt="openai/gpt-3.5-turbo-0125 en OrcaRouter" /> </a>
Markdown [![openai/gpt-3.5-turbo-0125](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125)

Ficha del modelo como datos

GET /api/public/models/openai/gpt-3.5-turbo-0125Abrir
Legible por máquina:/llms.txt/llms-full.txt