GPT-4o-mini Search Preview

openai/gpt-4o-mini-search-preview
JSON
par OpenAI · 2025-03-12

GPT-4o mini Search Preview est un modèle spécialisé pour la recherche web dans Chat Completions. Il est entraîné à comprendre et exécuter des requêtes de recherche web.

Points de terminaison:/v1/chat/completions
ctx128K tokens
Sortie max16.4K
Entréetext
Sortietext
ENTRÉE$0.15/ 1M tokens
SORTIE$0.60/ 1M tokens
p50 TTFTCollecte…
TTFT p95Collecte…
TRAFICCollecte…

GPT-4o-mini Search Preview est une variante du modèle GPT-4o-mini d'OpenAI qui intègre des capacités de recherche web intégrées. Il est conçu pour fournir des réponses intégrant des informations en…

Qu'est-ce que GPT-4o-mini Search Preview ?

Qui devrait utiliser ce modèle ?

Spécifications clés

Comment fonctionne l'aperçu de la recherche ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini-search-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • max_tokens
  • response_format
  • stream
  • structured_outputs
  • web_search_options

Tarifs

Entrée / 1M tokens$0.150
Sortie / 1M tokens$0.600
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $2.85

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000303

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
Collecte…
Vitesse de sortie
Collecte…
TTFT p95
Collecte…
Taux d'erreur
Collecte…

Benchmarks publics

Comparatif

GPT-4o-mini Search PreviewGPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrée $/M$0.15$21.00$60.00$5.00
Sortie $/M$0.60$168.00$270.00$30.00
Contexte128K400K1.1M
Qualité2/1010/1010/1010/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût pour utiliser GPT-4o-mini Search Preview sur OrcaRouter?
La tarification est de 0,15 $ par million de jetons d'entrée et de 0,60 $ par million de jetons de sortie, facturée au tarif du fournisseur sans aucune majoration. Vous payez exactement ce qu'OpenAI facture, sans frais supplémentaires.
Qu'est-ce que la fenêtre de contexte et la longueur maximale de sortie ?
La fenêtre de contexte est de 128 000 jetons. La longueur maximale de sortie est de 16 384 jetons. Le modèle accepte uniquement des entrées textuelles.
Quels sont les principaux atouts de GPT-4o-mini Search Preview ?
Ses atouts incluent une recherche web intégrée pour des informations à jour, une grande fenêtre de contexte, une inférence rapide par rapport à GPT-4o, et un faible coût. Il est idéal pour les applications nécessitant des données actuelles sans API de recherche distincte.
Comment se compare-t-il au GPT-4o-mini de base ?
Les deux ont des prix et des spécifications identiques, à l'exception du fait que la variante Search Preview peut effectuer des recherches sur le Web. Le modèle de base ne s'appuie que sur ses données d'entraînement. Choisissez Search Preview si vous avez besoin d'informations en direct ; sinon, le modèle de base offre des performances similaires au même prix.
OrcaRouter s'entraîne-t-il sur mes données ?
OrcaRouter n'utilise pas les données des clients pour l'entraînement. La gestion des données suit les politiques d'OpenAI et d'OrcaRouter. En général, les données ne sont pas utilisées pour améliorer les modèles, sauf si l'utilisateur a explicitement donné son consentement. Reportez-vous à la politique de confidentialité d'OrcaRouter pour plus de détails.
Comment appeler le modèle via l'API d'OrcaRouter ?
Utilisez l'URL de base https://api.orcarouter.ai/v1 avec un client compatible OpenAI. Définissez le paramètre de modèle sur "openai/gpt-4o-mini-search-preview". Incluez votre clé API OrcaRouter dans l'en-tête Authorization. Tous les paramètres standard de complétion de chat sont pris en charge.
Quels types de requêtes déclenchent l'aperçu de recherche ?
Le modèle décide automatiquement quand rechercher sur le web, généralement pour des questions concernant des événements récents, des données actuelles ou des informations susceptibles d'avoir changé depuis sa date limite d'entraînement. Vous pouvez également lui demander explicitement de rechercher des sujets spécifiques.
Y a-t-il une latence supplémentaire pour l’aperçu de la recherche ?
Oui, la récupération web ajoute un peu de latence par rapport au GPT-4o-mini de base. Les temps de réponse typiques sont de quelques secondes. Vous pouvez utiliser le streaming pour afficher des réponses partielles.

Intégrer ce badge

OpenAI: GPT-4o-mini Search Preview$0.15/M invia OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg" alt="OpenAI: GPT-4o-mini Search Preview sur OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini Search Preview](https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview)

Fiche du modèle en données

GET /api/public/models/openai/gpt-4o-mini-search-previewOuvrir
Lisible par machine:/llms.txt/llms-full.txt