GPT-4o Search Preview es un modelo especializado para búsqueda web en Chat Completions. Está entrenado para comprender y ejecutar consultas de búsqueda web.
GPT-4o Search Preview es un modelo solo de texto de OpenAI, ofrecido como parte de la familia GPT-4o. Es accesible a través de la API de OrcaRouter en la URL base https://api.orcarouter.ai/v1 bajo el…
El modelo es muy adecuado para tareas que requieren razonamiento sobre secuencias de texto largas, como resumen, respuesta a preguntas a partir de documentos grandes y generación de respuestas coherentes en diálogos extensos. Dada su etiqueta de vista previa de búsqueda, es probable que maneje la agregación de resultados de búsqueda y la recuperación contextual de manera efectiva. Su gran ventana de contexto permite analizar informes completos, libros o bases de código en una sola instrucción.
La principal limitación es la falta de soporte multimodal. No puede procesar entradas de imágenes, audio o video, lo que restringe su uso en aplicaciones como preguntas y respuestas visuales o transcripción de voz. Además, no hay puntuaciones oficiales de referencia ni cifras de latencia disponibles, lo que dificulta comparar el rendimiento en tareas específicas. El modelo puede no estar optimizado para tareas que no sean de razonamiento basado en texto.
Para tareas con requisitos de contexto pequeños (por ejemplo, clasificación simple, generación de texto corto), un modelo más barato y rápido como GPT-3.5 Turbo puede ser más rentable. Si se necesitan entradas multimodales, considere el modelo estándar GPT-4o. Para cargas de trabajo de solo texto de volumen extremadamente alto, evalúe si el precio sin margen en OrcaRouter justifica el costo por token en comparación con otros proveedores.
No. GPT-4o Search Preview solo acepta entradas de texto. No admite imágenes, audio ni video. Esta es una diferencia clave con respecto al modelo GPT-4o estándar, que es multimodal. Los usuarios que requieran comprensión visual o auditiva deben seleccionar un modelo diferente.
OpenAI no ha publicado puntuaciones de referencia específicas para la variante GPT-4o Search Preview. Como parte de la familia GPT-4o, puede compartir características de rendimiento con GPT-4o en tareas de comprensión del lenguaje, pero no se proporcionan cifras oficiales. Se recomienda a los usuarios que realicen sus propias evaluaciones en conjuntos de datos representativos para determinar la idoneidad.
Las cifras de latencia y rendimiento no están documentadas públicamente para GPT-4o Search Preview. Como variante de GPT-4o, es probable que tenga tiempos de respuesta similares al modelo estándar GPT-4o, pero el rendimiento real depende de factores como la concurrencia de solicitudes, el recuento de tokens y la infraestructura de OrcaRouter. Los usuarios deben realizar evaluaciones comparativas utilizando su propia carga de trabajo.
Más allá de la falta de soporte multimodal, el modelo carece de puntuaciones de referencia publicadas y garantías de latencia. Su designación de vista previa de búsqueda implica optimización para tareas relacionadas con la búsqueda, pero no se especifica el alcance de esta optimización. Los usuarios no deben asumir que superará al GPT-4o estándar en tareas que no sean de búsqueda. Además, no hay garantía de precios más bajos o mayor eficiencia en comparación con otras variantes de GPT-4o.
El precio es de $2.50 por 1 millón de tokens de entrada y $10.00 por 1 millón de tokens de salida. OrcaRouter cobra exactamente la tarifa del proveedor con cero margen. No se aplican cargos adicionales. El uso de tokens se factura por separado para entrada y salida. Estas tarifas son consistentes con el precio estándar de GPT-4o de OpenAI en su plataforma.
En comparación con muchos otros modelos, GPT-4o Search Preview se encuentra en una tarifa premium por token, típica de los modelos de alta capacidad. Por ejemplo, GPT-3.5 Turbo es significativamente más barato. La política de margen cero en OrcaRouter garantiza que los usuarios paguen lo mismo que la facturación directa de OpenAI, pero sin ningún costo adicional. Esto puede ser ventajoso para aplicaciones sensibles al costo donde se requiere una ventana de contexto grande.
OrcaRouter no publicita descuentos por almacenamiento en caché ni programas de ahorro de tokens específicamente para GPT-4o Search Preview. Los usuarios facturan según el número total de tokens de entrada y salida consumidos. Para gestionar los costos, considere optimizar las longitudes de las indicaciones y limitar los tokens de salida. El procesamiento por lotes puede mejorar la eficiencia, pero no se menciona en la documentación disponible.
Se accede al modelo a través de la API compatible con OpenAI de OrcaRouter. Establezca la URL base en https://api.orcarouter.ai/v1 e incluya el ID del modelo "openai/gpt-4o-search-preview" en su solicitud. Use las bibliotecas cliente estándar de OpenAI (por ejemplo, el paquete openai de Python) con su clave API de OrcaRouter. Ejemplo: openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...]).
Puesto que la API es compatible con OpenAI, están disponibles parámetros estándar: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, y otros. El parámetro max_tokens no debe superar el límite de salida de 16,384 tokens. El modelo no es compatible con entradas multimodales, por lo que los mensajes solo deben contener contenido de texto.
Para cambiar de otra variante de GPT-4o (por ejemplo, "gpt-4o" o "gpt-4o-mini"), simplemente cambie el ID del modelo en su llamada a la API a "openai/gpt-4o-search-preview". Asegúrese de que sus solicitudes contengan solo contenido de texto, ya que esta variante no acepta imágenes ni audio. Ajuste el parámetro max_tokens si es necesario. No se requieren otros cambios de código.
La autenticación se realiza mediante claves de API. Necesitas una clave de API de OrcaRouter, que se pasa en el encabezado de la solicitud (generalmente como "Authorization: Bearer <your_key>"). Obtén una clave desde la plataforma OrcaRouter. La misma autenticación se utiliza para todos los modelos accesibles a través de la puerta de enlace.
GPT-4o Search Preview es solo texto, mientras que el GPT-4o estándar admite texto, imágenes y audio. La variante de vista previa de búsqueda puede tener optimizaciones subyacentes para consultas relacionadas con la búsqueda, pero no se detallan públicamente. El precio es idéntico: $2.50/M de entrada y $10/M de salida. Ambos usan un contexto de 128k y una salida máxima de 16k. La principal compensación es el soporte de modalidad frente a un rendimiento de búsqueda potencialmente especializado.
GPT-4 Turbo (contexto de 128k, texto+imagen) es un predecesor de GPT-4o. GPT-4o Search Preview es más reciente y forma parte de la familia GPT-4o, que generalmente ofrece mejor razonamiento y eficiencia en comparación con GPT-4 Turbo. Sin embargo, el soporte multimodal en GPT-4 Turbo se limita a imágenes, mientras que GPT-4o es completamente multimodal. Search Preview elimina esa ventaja. El precio de GPT-4 Turbo suele ser de $10/M por entrada y $30/M por salida, lo que hace que Search Preview sea más barato (si se usan las tarifas indicadas). Tenga en cuenta que aquí no se proporciona el precio de GPT-4 Turbo; esto es conocimiento general.
Otros modelos centrados en la búsqueda (por ejemplo, sistemas dedicados de generación aumentada por recuperación) pueden ofrecer búsqueda web integrada o recuperación de archivos. GPT-4o Search Preview no incluye su propia funcionalidad de búsqueda; es un modelo de lenguaje que puede procesar los resultados de búsqueda proporcionados en el prompt. Si necesitas recuperación externa, combina este modelo con una API de búsqueda. Su amplia ventana de contexto lo hace adecuado para agregar muchos resultados de búsqueda en una sola solicitud.
La principal desventaja es entre el soporte de modalidad y la posible optimización de tareas de búsqueda. Obtienes una gran ventana de contexto y precios sin margen de beneficio, pero pierdes la capacidad de procesar imágenes o audio. En benchmarks conocidos, el rendimiento puede ser equivalente a GPT-4o, pero no hay puntuaciones específicas disponibles. Para tareas de solo texto que se benefician de un contexto de 128k, este modelo es una opción rentable dentro de la familia GPT-4o.
Compatible con OpenAI: conserva tu SDK actual
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Entrada / 1M tokens | $2.50 |
| Salida / 1M tokens | $10.00 |
| Moneda | USD |
Estimación según precio de lista
Solo una estimación: el número real de tokens depende del tokenizador del proveedor.
GET /api/public/models/openai/gpt-4o-search-previewAbrir @misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview