GPT-4o-mini Search Preview

openai/gpt-4o-mini-search-preview
JSON
di OpenAI · 2025-03-12

GPT-4o mini Search Preview è un modello specializzato per la ricerca web in Chat Completions. È addestrato per comprendere ed eseguire query di ricerca web.

ctx128K token
Output max16.4K
Inputtext
Outputtext
INGRESSO$0.15/ 1M token
USCITA$0.60/ 1M token
p50 TTFTRaccolta…
p95 TTFTRaccolta…
TRAFFICORaccolta…

GPT-4o-mini Search Preview è una variante del modello GPT-4o-mini di OpenAI che include funzionalità di ricerca web integrate. È progettato per fornire risposte che incorporano informazioni in tempo…

Che cos'è GPT-4o-mini Search Preview?

Chi dovrebbe usare questo modello?

Specifiche principali

Come funziona l'anteprima di ricerca?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini-search-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • max_tokens
  • response_format
  • stream
  • structured_outputs
  • web_search_options

Prezzi

Input / 1M token$0.150
Output / 1M token$0.600
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $2.85

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.000303

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
Raccolta…
Velocità di output
Raccolta…
p95 TTFT
Raccolta…
Tasso di errore
Raccolta…

Benchmark pubblici

Fonte: Design Arena

A confronto

GPT-4o-mini Search PreviewGPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$0.15$21.00$60.00$5.00
Output $/M$0.60$168.00$270.00$30.00
Contesto128K400K1.1M
Qualità2/1010/1010/1010/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Qual è il costo per utilizzare GPT-4o-mini Search Preview su OrcaRouter?
Il prezzo è di $0,15 per milione di token in input e $0,60 per milione di token in output, fatturato alla tariffa del provider senza alcun margine. Paghi esattamente quello che OpenAI addebita, senza costi aggiuntivi.
Quali sono la finestra di contesto e la lunghezza massima di output?
La finestra di contesto è di 128,000 tokens. La lunghezza massima dell'output è di 16,384 tokens. Il modello accetta solo input di testo.
Quali sono i principali punti di forza di GPT-4o-mini Search Preview?
I suoi punti di forza includono la ricerca web integrata per informazioni aggiornate, un'ampia finestra di contesto, inferenza rapida rispetto a GPT-4o e basso costo. È ideale per applicazioni che necessitano di dati aggiornati senza API di ricerca separate.
Come si confronta con il GPT-4o-mini base?
Entrambi hanno prezzi e specifiche identiche, tranne per il fatto che la variante Search Preview può effettuare ricerche sul web. Il modello base si basa solo sui propri dati di addestramento. Scegli Search Preview se hai bisogno di informazioni in tempo reale; altrimenti, il modello base offre prestazioni simili allo stesso prezzo.
OrcaRouter si addestra sui miei dati?
OrcaRouter non utilizza i dati dei clienti per l'addestramento. La gestione dei dati segue le politiche di OpenAI e OrcaRouter. Di solito, i dati non vengono utilizzati per migliorare i modelli a meno che non si sia esplicitamente scelto di farlo. Fare riferimento alla politica sulla privacy di OrcaRouter per i dettagli specifici.
Come posso chiamare il modello tramite l'API di OrcaRouter?
Utilizza l'URL di base https://api.orcarouter.ai/v1 con un client compatibile con OpenAI. Imposta il parametro model su "openai/gpt-4o-mini-search-preview". Includi la tua chiave API di OrcaRouter nell'header Authorization. Tutti i parametri standard di completamento chat sono supportati.
Quali tipi di query attivano l'anteprima di ricerca?
Il modello decide automaticamente quando cercare sul web, tipicamente per domande su eventi recenti, dati attuali o informazioni probabilmente cambiate dopo la data limite del suo addestramento. Puoi anche richiedergli esplicitamente di cercare argomenti specifici.
C'è qualche latenza aggiuntiva per search preview?
Sì, il recupero web aggiunge un po' di latenza rispetto al GPT-4o-mini base. I tempi di risposta tipici sono di pochi secondi. Puoi utilizzare lo streaming per mostrare risposte parziali.

Incorpora questo badge

OpenAI: GPT-4o-mini Search Preview$0.15/M intramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg" alt="OpenAI: GPT-4o-mini Search Preview su OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini Search Preview](https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview)

Scheda del modello come dati

GET /api/public/models/openai/gpt-4o-mini-search-previewApri
Leggibile dalle macchine:/llms.txt/llms-full.txt