openai/gpt-4.1-mini-2025-04-14

openai/gpt-4.1-mini-2025-04-14
VisiónHerramientasJSON
por openai

OpenAI GPT-4.1 Mini: razonamiento eficiente en costos con contexto de 1M, entrada de imágenes, y un puntaje alto en MATH-500

ctx1.05M tokens
Salida máx.32.8K
Entradaimage + text + file
Salidatext
p50 TTFT2.00 s
ENTRADA$0.40/ 1M tokens
SALIDA$1.60/ 1M tokens
p50 TTFT2.00 s7 d
p95 TTFT3.57 s7 d
TRÁFICO7.4Ktokens / 7 d

Este modelo es una versión reducida de la familia GPT-4.1 de OpenAI, lanzada específicamente el 14 de abril de 2025. Está diseñado para ofrecer un sólido rendimiento en razonamiento y seguimiento de…

¿Qué es openai/gpt-4.1-mini-2025-04-14?

¿Quién debería usar este modelo?

¿Qué modalidades de entrada admite?

¿Cuál es la ventana de contexto y la longitud máxima de salida?

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4.1-mini-2025-04-14",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Precios

Entrada / 1M tokens$0.400
Salida / 1M tokens$1.60
Lectura caché / 1M$0.100
MonedaUSD

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $7.60 · Con caché de prompts $6.55

Estimación según precio de lista

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.000807

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
2.00 s
Velocidad de salida
25.9 tok/s
p95 TTFT
3.57 s
Tasa de error
0%

Pruebas de referencia públicas

20.2
AA Coding
Mejor que el 18 % de los modelos comparados
n.º 100 de 123
14.8
AA Intelligence
Mejor que el 16 % de los modelos comparados
n.º 104 de 125
46.3
AA Math
Mejor que el 22 % de los modelos comparados
n.º 62 de 81
AIME
43.0
AIME 2025
46.3
GPQA Diamond
66.4
Humanity's Last Exam
4.6
IFBench
38.3
LiveCodeBench
48.3
Long-Context Recall
42.3
MATH-500
92.5
MMLU-Pro
78.1
SciCode
40.4
tau_banking
5.2
TerminalBench Hard
7.6
terminalbench_v2_1
10.1
τ²-Bench
52.9
Fuente: artificialanalysis.ai

Comparativa

openai/gpt-4.1-mini-2025-04-14GPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$0.40$21.00$60.00$5.00
Salida $/M$1.60$168.00$270.00$30.00
Contexto1.0M400K1.1M
Calidad4/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuál es el costo por token de openai/gpt-4.1-mini-2025-04-14 en OrcaRouter?
OrcaRouter factura a la tarifa del proveedor sin margen adicional: $0.40 por 1 millón de tokens de entrada y $1.60 por 1 millón de tokens de salida.
¿Cuál es el tamaño de la ventana de contexto?
La ventana de contexto es de 1,047,576 tokens (aproximadamente 1 millón de tokens). La salida máxima es de 32,768 tokens por solicitud.
¿Cuáles son sus principales fortalezas?
Ofrece una sólida combinación de bajo costo, amplia ventana de contexto, entrada multimodal (texto, imagen, archivo) y un rendimiento de razonamiento sólido, como lo demuestra la puntuación MATH-500 de 92.5.
¿Cómo se compara con GPT-4o?
GPT-4o es un modelo insignia más capaz con soporte de audio, pero GPT-4.1 mini suele ser más económico y rápido. No se proporciona una comparación directa de benchmarks, pero el mini está diseñado para un uso eficiente en producción.
¿OrcaRouter maneja la privacidad de datos para este modelo?
OrcaRouter enruta solicitudes a la infraestructura de OpenAI. El manejo de datos sigue las políticas de OpenAI y los términos propios de OrcaRouter. Debe revisar los acuerdos de privacidad y uso de datos de ambos proveedores.
¿Cómo llamo a este modelo usando el cliente Python de OpenAI?
Establece openai.api_base a 'https://api.orcarouter.ai/v1', configura tu clave API de OrcaRouter, y utiliza openai.ChatCompletion.create(model='openai/gpt-4.1-mini-2025-04-14', messages=[...]).
¿Puedo usar este modelo para comprensión de imágenes?
Sí, admite entradas de imágenes (a través de URLs o base64) para tareas como subtitulado, respuesta a preguntas visuales y OCR. Los archivos también se pueden cargar como imágenes o texto.
¿Cuáles son las limitaciones honestas de este modelo?
Puede que no iguale al GPT-4.1 completo en razonamientos muy complejos, y su conocimiento se limita a la fecha de corte del entrenamiento (abril de 2025). No es adecuado para aplicaciones críticas de seguridad sin supervisión humana.
¿Hay algún descuento por caché?
No se mencionan descuentos específicos por caché para este modelo en OrcaRouter. La facturación es por token según las tarifas indicadas.

Insertar esta insignia

openai/gpt-4.1-mini-2025-04-14$0.40/M in2000ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4.1-mini-2025-04-14" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4.1-mini-2025-04-14.svg" alt="openai/gpt-4.1-mini-2025-04-14 en OrcaRouter" /> </a>
Markdown [![openai/gpt-4.1-mini-2025-04-14](https://www.orcarouter.ai/embed/openai/gpt-4.1-mini-2025-04-14.svg)](https://www.orcarouter.ai/models/openai/gpt-4.1-mini-2025-04-14)

Ficha del modelo como datos

GET /api/public/models/openai/gpt-4.1-mini-2025-04-14Abrir
Legible por máquina:/llms.txt/llms-full.txt