GPT-4o Search Preview est un modèle spécialisé pour la recherche web dans Chat Completions. Il est entraîné à comprendre et exécuter des requêtes de recherche web.
GPT-4o Search Preview est un modèle textuel d'OpenAI, proposé dans le cadre de la famille GPT-4o. Il est accessible via l'API d'OrcaRouter à l'URL de base https://api.orcarouter.ai/v1 sous…
Le modèle est bien adapté aux tâches qui nécessitent un raisonnement sur de longues séquences de texte, telles que le résumé, la réponse à des questions à partir de grands documents, et la génération de réponses cohérentes dans des dialogues prolongés. Compte tenu de son étiquette d'aperçu de recherche, il traite probablement efficacement l'agrégation des résultats de recherche et la récupération contextuelle. Sa grande fenêtre de contexte permet d'analyser des rapports entiers, des livres ou des bases de code en une seule invite.
La principale limitation est l'absence de support multimodal. Il ne peut pas traiter les entrées d'images, d'audio ou de vidéo, ce qui restreint son utilisation dans des applications comme la réponse à des questions visuelles ou la transcription vocale. De plus, aucun score de référence officiel ni chiffre de latence n'est disponible, ce qui rend difficile la comparaison des performances sur des tâches spécifiques. Le modèle peut ne pas être optimisé pour des tâches autres que le raisonnement textuel.
Pour les tâches avec de faibles exigences de contexte (par exemple, classification simple, génération de texte court), un modèle moins cher et plus rapide tel que GPT-3.5 Turbo peut être plus rentable. Si des entrées multimodales sont nécessaires, envisagez le modèle standard GPT-4o. Pour les charges de travail textuelles à très haut volume, évaluez si la tarification sans marge sur OrcaRouter justifie le coût par token par rapport à d'autres fournisseurs.
Non. GPT-4o Search Preview accepte uniquement les entrées textuelles. Il ne prend pas en charge les images, l'audio ou la vidéo. C'est une différence clé par rapport au modèle standard GPT-4o, qui est multimodal. Les utilisateurs ayant besoin d'une compréhension visuelle ou auditive doivent sélectionner un autre modèle.
OpenAI n'a publié aucun score de référence spécifiquement pour la variante GPT-4o Search Preview. Comme elle fait partie de la famille GPT-4o, elle peut partager les caractéristiques de performance avec GPT-4o sur les tâches de compréhension du langage, mais aucun chiffre officiel n'est fourni. Il est conseillé aux utilisateurs de mener leurs propres évaluations sur des ensembles de données représentatifs pour déterminer l'adéquation.
Les chiffres de latence et de débit ne sont pas documentés publiquement pour GPT-4o Search Preview. En tant que variante de GPT-4o, il est probable qu'il ait des temps de réponse similaires au modèle GPT-4o standard, mais les performances réelles dépendent de facteurs tels que la simultanéité des requêtes, le nombre de tokens et l'infrastructure OrcaRouter. Les utilisateurs doivent évaluer les performances en utilisant leur propre charge de travail.
Au-delà de l’absence de support multimodal, le modèle ne publie pas de scores de référence ni de garanties de latence. Sa désignation « aperçu de recherche » implique une optimisation pour les tâches liées à la recherche, mais l’étendue de cette optimisation n’est pas spécifiée. Les utilisateurs ne doivent pas supposer qu’il surpassera le GPT-4o standard sur des tâches non liées à la recherche. De plus, il n’y a aucune garantie de prix inférieur ou d’efficacité améliorée par rapport aux autres variantes de GPT-4o.
La tarification est de 2,50 $ par million de tokens d'entrée et de 10,00 $ par million de tokens de sortie. OrcaRouter facture exactement le tarif du fournisseur, sans aucune marge. Aucuns frais supplémentaires ne sont appliqués. L'utilisation des tokens est facturée séparément pour l'entrée et la sortie. Ces tarifs sont conformes à la tarification standard de GPT-4o d'OpenAI sur leur plateforme.
Comparé à de nombreux autres modèles, GPT-4o Search Preview est positionné à un tarif premium par jeton, typique des modèles à haute capacité. Par exemple, GPT-3.5 Turbo est nettement moins cher. La politique de marge zéro sur OrcaRouter garantit que les utilisateurs paient le même prix que la facturation directe d'OpenAI, mais sans aucun frais supplémentaire. Cela peut être avantageux pour les applications sensibles aux coûts où une large fenêtre de contexte est nécessaire.
OrcaRouter ne fait pas de publicité officielle pour des remises de mise en cache ou des programmes d'économies de jetons spécifiques à GPT-4o Search Preview. Les utilisateurs sont facturés en fonction du nombre total de jetons d'entrée et de sortie consommés. Pour gérer les coûts, il est conseillé d'optimiser la longueur des invites et de limiter les jetons de sortie. Le traitement par lots peut améliorer l'efficacité, mais n'est pas mentionné dans la documentation disponible.
Le modèle est accessible via l'API compatible OpenAI d'OrcaRouter. Définissez l'URL de base sur https://api.orcarouter.ai/v1 et incluez l'ID du modèle "openai/gpt-4o-search-preview" dans votre requête. Utilisez les bibliothèques client OpenAI standard (par exemple, le package Python openai) avec votre clé API OrcaRouter. Exemple : openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...]).
Étant donné que l’API est compatible avec OpenAI, les paramètres standard sont disponibles : model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, et d’autres. Le paramètre max_tokens ne doit pas dépasser la limite de sortie de 16 384 tokens. Le modèle ne prend pas en charge les entrées multimodales, donc les messages doivent uniquement contenir du contenu textuel.
Pour passer d'une autre variante de GPT-4o (par exemple, "gpt-4o" ou "gpt-4o-mini"), modifiez simplement l'ID du modèle dans votre appel API en "openai/gpt-4o-search-preview". Assurez-vous que vos requêtes ne contiennent que du texte, car cette variante n'accepte ni images ni audio. Ajustez le paramètre max_tokens si nécessaire. Aucune autre modification de code n'est requise.
L'authentification est gérée via des clés API. Vous avez besoin d'une clé API OrcaRouter, qui est passée dans l'en-tête de la requête (généralement sous la forme "Authorization: Bearer <your_key>"). Obtenez une clé depuis la plateforme OrcaRouter. La même authentification est utilisée pour tous les modèles accessibles via la passerelle.
GPT-4o Search Preview est uniquement textuel, tandis que GPT-4o standard prend en charge le texte, les images et l'audio. La variante de prévisualisation de recherche peut avoir des optimisations sous-jacentes pour les requêtes liées à la recherche, mais celles-ci ne sont pas détaillées publiquement. Le prix est identique : $2.50/M en entrée et $10/M en sortie. Les deux utilisent une fenêtre de contexte de 128k et une sortie maximale de 16k. Le principal compromis est le support de la modalité par rapport à une performance de recherche potentiellement spécialisée.
GPT-4 Turbo (contexte 128k, texte+image) est un prédécesseur de GPT-4o. GPT-4o Search Preview est plus récent et fait partie de la famille GPT-4o, qui offre généralement un raisonnement et une efficacité améliorés par rapport à GPT-4 Turbo. Cependant, la prise en charge multimodale de GPT-4 Turbo se limite aux images, tandis que GPT-4o est entièrement multimodal. Search Preview supprime cet avantage. La tarification de GPT-4 Turbo est généralement de 10 $/M en entrée et 30 $/M en sortie, ce qui rend Search Preview moins cher (si l'on utilise les tarifs donnés). Notez que la tarification de GPT-4 Turbo n'est pas fournie ici ; il s'agit d'une connaissance générale.
D'autres modèles axés sur la recherche (par exemple, les systèmes dédiés de génération augmentée par récupération) peuvent offrir une recherche web intégrée ou une récupération de fichiers. GPT-4o Search Preview n'inclut pas sa propre fonctionnalité de recherche ; c'est un modèle de langage capable de traiter les résultats de recherche fournis dans l'invite. Si vous avez besoin d'une récupération externe, combinez ce modèle avec une API de recherche. Sa grande fenêtre contextuelle le rend adapté pour agréger de nombreux résultats de recherche en une seule requête.
Le principal compromis se situe entre le support des modalités et l'optimisation potentielle des tâches de recherche. Vous bénéficiez d'une grande fenêtre de contexte et d'une tarification sans marge, mais vous perdez la capacité de traiter des images ou de l'audio. Sur les benchmarks connus, les performances peuvent être équivalentes à GPT-4o, mais aucun score spécifique n'est disponible. Pour les tâches purement textuelles qui tirent parti d'un contexte de 128k, ce modèle constitue un choix économique au sein de la famille GPT-4o.
Compatible OpenAI — gardez votre SDK actuel
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Entrée / 1M tokens | $2.50 |
| Sortie / 1M tokens | $10.00 |
| Devise | USD |
Estimation basée sur le tarif public
Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.
GET /api/public/models/openai/gpt-4o-search-previewOuvrir @misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview