GPT-4o-mini Search Preview

openai/gpt-4o-mini-search-preview
JSON
por OpenAI · 2025-03-12

GPT-4o mini Search Preview es un modelo especializado para la búsqueda web en Chat Completions. Está entrenado para entender y ejecutar consultas de búsqueda web.

ctx128K tokens
Salida máx.16.4K
Entradatext
Salidatext
p50 TTFT2.00 s
ENTRADA$0.15/ 1M tokens
SALIDA$0.60/ 1M tokens
p50 TTFT2.00 s7 d
p95 TTFT3.48 s7 d
TRÁFICO17tokens / 7 d

GPT-4o-mini Search Preview es una variante del modelo GPT-4o-mini de OpenAI que incluye capacidades de búsqueda web integradas. Está diseñado para proporcionar respuestas que incorporan información…

¿Qué es GPT-4o-mini Search Preview?

¿Quién debería usar este modelo?

Especificaciones clave

¿Cómo funciona la vista previa de búsqueda?

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini-search-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • max_tokens
  • response_format
  • stream
  • structured_outputs
  • web_search_options

Precios

Entrada / 1M tokens$0.150
Salida / 1M tokens$0.600
MonedaUSD

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $2.85

Estimación según precio de lista

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.000303

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
2.00 s
Velocidad de salida
Recopilando…
p95 TTFT
3.48 s
Tasa de error
0%

Pruebas de referencia públicas

Fuente: Design Arena

Comparativa

GPT-4o-mini Search PreviewGPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$0.15$21.00$60.00$5.00
Salida $/M$0.60$168.00$270.00$30.00
Contexto128K400K1.1M
Calidad2/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuál es el costo de usar GPT-4o-mini Search Preview en OrcaRouter?
El precio es de $0.15 por millón de tokens de entrada y $0.60 por millón de tokens de salida, facturado a la tarifa del proveedor sin margen adicional. Pagas exactamente lo que cobra OpenAI, sin cargos adicionales.
¿Cuál es la ventana de contexto y la longitud máxima de salida?
La ventana de contexto es de 128,000 tokens. La longitud máxima de salida es de 16,384 tokens. El modelo solo acepta entradas de texto.
¿Cuáles son las principales fortalezas de GPT-4o-mini Search Preview?
Sus fortalezas incluyen búsqueda web integrada para información actualizada, ventana de contexto grande, inferencia rápida en comparación con GPT-4o y bajo costo. Es ideal para aplicaciones que necesitan datos actuales sin APIs de búsqueda separadas.
¿Cómo se compara con el GPT-4o-mini base?
Ambos tienen precios y especificaciones idénticas, excepto que la variante Search Preview puede realizar búsquedas en la web. El modelo base depende únicamente de sus datos de entrenamiento. Elija Search Preview si necesita información en vivo; de lo contrario, el modelo base ofrece un rendimiento similar al mismo precio.
¿OrcaRouter se entrena con mis datos?
OrcaRouter no utiliza los datos de los clientes para el entrenamiento. El manejo de datos sigue las políticas de OpenAI y OrcaRouter. Normalmente, los datos no se utilizan para mejorar los modelos a menos que se haya optado explícitamente. Consulte la política de privacidad de OrcaRouter para obtener más detalles.
¿Cómo llamo al modelo a través de la API de OrcaRouter?
Use la URL base https://api.orcarouter.ai/v1 con un cliente compatible con OpenAI. Establezca el parámetro model en "openai/gpt-4o-mini-search-preview". Incluya su clave API de OrcaRouter en el encabezado Authorization. Todos los parámetros estándar de finalización de chat son compatibles.
¿Qué tipos de consultas activan la vista previa de búsqueda?
El modelo decide automáticamente cuándo buscar en la web, típicamente para preguntas sobre eventos recientes, datos actuales o información que probablemente haya cambiado desde su fecha de corte de entrenamiento. También puedes indicarle explícitamente que busque temas específicos.
¿Hay alguna latencia adicional para la vista previa de búsqueda?
Sí, la recuperación web añade algo de latencia en comparación con el GPT-4o-mini base. Los tiempos de respuesta típicos son de unos segundos. Puede usar streaming para mostrar respuestas parciales.

Insertar esta insignia

OpenAI: GPT-4o-mini Search Preview$0.15/M in2000ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg" alt="OpenAI: GPT-4o-mini Search Preview en OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini Search Preview](https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview)

Ficha del modelo como datos

GET /api/public/models/openai/gpt-4o-mini-search-previewAbrir
Legible por máquina:/llms.txt/llms-full.txt