GPT-4o-mini

openai/gpt-4o-mini
VisiónHerramientasJSON
por OpenAI · 2024-07-18

GPT-4o mini es el modelo más nuevo de OpenAI después de [GPT-4 Omni](/models/openai/gpt-4o), que admite tanto entradas de texto como de imagen con salidas de texto. Como su modelo pequeño más avanzado, es muchas veces más asequible...

ctx128K tokens
Salida máx.16.4K
Entradatext + image + file
Salidatext
p50 TTFT4.23 s
ENTRADA$0.15/ 1M tokens
SALIDA$0.60/ 1M tokens
p50 TTFT4.23 s7 d
p95 TTFT10.00 s7 d
TRÁFICO9.6Mtokens / 7 d

GPT-4o-mini es una variante más pequeña y rápida del modelo GPT-4o de OpenAI, optimizada para un menor costo computacional, pero que conserva capacidades multimodales. Puede procesar texto, imágenes…

¿Qué es GPT-4o-mini?

¿Quién debería usar GPT-4o-mini?

¿En qué se diferencia la arquitectura del modelo de GPT-4o?

¿Qué modalidades de entrada están soportadas?

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Precios

Entrada / 1M tokens$0.150
Salida / 1M tokens$0.600
Lectura caché / 1M$0.075
MonedaUSD

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $2.85 · Con caché de prompts $2.59

Estimación según precio de lista

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.000303

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
4.23 s
Velocidad de salida
870 tok/s
p95 TTFT
10.00 s
Tasa de error
0.30%

Pruebas de referencia públicas

11.4
AA Coding
Mejor que el 7 % de los modelos comparados
n.º 114 de 123
6.9
AA Intelligence
Mejor que el 3 % de los modelos comparados
n.º 119 de 125
14.7
AA Math
Mejor que el 2 % de los modelos comparados
n.º 78 de 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Fuente: artificialanalysis.ai

Comparativa

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$0.15$21.00$60.00$5.00
Salida $/M$0.60$168.00$270.00$30.00
Contexto128K400K1.1M
Calidad2/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuál es el costo de usar GPT-4o-mini a través de OrcaRouter?
Los tokens de entrada cuestan $0.15 por 1M, los tokens de salida cuestan $0.60 por 1M, igualando exactamente las tarifas de OpenAI con cero margen de beneficio.
¿Cuál es la ventana de contexto de GPT-4o-mini?
La ventana de contexto es 128,000 tokens, y la salida máxima es 16,384 tokens.
¿Cuáles son las principales fortalezas de GPT-4o-mini?
Combina entrada multimodal (texto, imágenes, archivos), una ventana de contexto amplia, inferencia rápida y bajo costo para una amplia gama de tareas.
¿Cómo se compara GPT-4o-mini con GPT-4o?
GPT-4o-mini es aproximadamente un 94% más barato en el precio de los tokens, pero puede ser menos preciso en razonamiento complejo y generación creativa. En MATH-500, obtiene una puntuación de 78.9 frente a la puntuación más alta de GPT-4o.
¿Registra o almacena OrcaRouter mis indicaciones?
OrcaRouter no registra ni almacena tus indicaciones; todos los datos pasan directamente a OpenAI. Consulta la política de uso de datos de OpenAI para conocer su manejo.
¿Cómo llamo a GPT-4o-mini a través de la API de OrcaRouter?
Usa el endpoint compatible con OpenAI en https://api.orcarouter.ai/v1 con el id de modelo "openai/gpt-4o-mini". Incluye tu clave de API de OrcaRouter.
¿Puede GPT-4o-mini procesar tanto texto como imágenes en la misma solicitud?
Sí, acepta texto, imágenes y archivos simultáneamente dentro del contexto de 128K tokens.
¿Cuál es la velocidad/latencia de GPT-4o-mini?
La latencia es generalmente baja—el primer token suele estar por debajo de un segundo para indicaciones moderadas—pero varía según la longitud del contexto y la carga de la API. El streaming reduce la latencia percibida.

Insertar esta insignia

OpenAI: GPT-4o-mini$0.15/M in4232ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini en OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

Ficha del modelo como datos

GET /api/public/models/openai/gpt-4o-miniAbrir
Legible por máquina:/llms.txt/llms-full.txt