GPT-4o Search Preview è un modello specializzato per la ricerca web in Chat Completions. È addestrato per comprendere ed eseguire query di ricerca web.
GPT-4o Search Preview è un modello solo testo di OpenAI, offerto come parte della famiglia GPT-4o. È accessibile tramite l'API di OrcaRouter all'URL di base https://api.orcarouter.ai/v1 con…
Il modello è adatto per attività che richiedono ragionamento su sequenze di testo lunghe, come riassunto, risposta a domande da documenti di grandi dimensioni e generazione di risposte coerenti in dialoghi estesi. Data la sua etichetta di anteprima di ricerca, è probabile che gestisca efficacemente l'aggregazione dei risultati di ricerca e il recupero contestuale. La sua ampia finestra di contesto consente l'analisi di interi rapporti, libri o codebase in un unico prompt.
Il limite principale è la mancanza di supporto multimodale. Non può elaborare input di immagini, audio o video, il che ne limita l'uso in applicazioni come il visual question-answering o la trascrizione vocale. Inoltre, non sono disponibili punteggi ufficiali di benchmark o dati sulla latenza, rendendo difficile confrontare le prestazioni su compiti specifici. Il modello potrebbe non essere ottimizzato per attività al di fuori del ragionamento basato su testo.
Per attività con requisiti di contesto ridotti (ad esempio, classificazione semplice, generazione di testo breve), un modello più economico e veloce come GPT-3.5 Turbo potrebbe essere più conveniente. Se sono necessari input multimodali, considera il modello standard GPT-4o. Per carichi di lavoro testuali ad altissimo volume, valuta se i prezzi senza ricarico su OrcaRouter giustificano il costo per token rispetto ad altri fornitori.
No. GPT-4o Search Preview accetta solo input di testo. Non supporta immagini, audio o video. Questo è un elemento chiave di differenziazione rispetto al modello standard GPT-4o, che è multimodale. Gli utenti che necessitano di comprensione visiva o uditiva dovrebbero selezionare un modello diverso.
OpenAI non ha pubblicato alcun punteggio di benchmark specifico per la variante GPT-4o Search Preview. Poiché fa parte della famiglia GPT-4o, potrebbe condividere caratteristiche di prestazioni con GPT-4o in compiti di comprensione linguistica, ma non vengono forniti numeri ufficiali. Si consiglia agli utenti di condurre proprie valutazioni su dataset rappresentativi per determinarne l'idoneità.
I dati di latenza e throughput non sono documentati pubblicamente per GPT-4o Search Preview. Essendo una variante di GPT-4o, è probabile che abbia tempi di risposta simili al modello GPT-4o standard, ma le prestazioni effettive dipendono da fattori come la concorrenza delle richieste, il numero di token e l'infrastruttura OrcaRouter. Gli utenti dovrebbero effettuare benchmark utilizzando il proprio carico di lavoro.
Oltre all'assenza di supporto multimodale, il modello non pubblica punteggi di benchmark né garanzie di latenza. La sua designazione "search preview" implica un'ottimizzazione per compiti legati alla ricerca, ma l'entità di tale ottimizzazione non è specificata. Gli utenti non dovrebbero presumere che superi il GPT-4o standard in compiti non di ricerca. Inoltre, non vi è alcuna garanzia di prezzi inferiori o efficienza migliorata rispetto ad altre varianti di GPT-4o.
Il prezzo è di $2.50 per 1 milione di token in input e $10.00 per 1 milione di token in output. OrcaRouter addebita esattamente la tariffa del fornitore con margine zero. Nessuna tariffa aggiuntiva viene applicata. L'utilizzo dei token viene fatturato separatamente per input e output. Queste tariffe sono in linea con i prezzi standard di GPT-4o di OpenAI sulla loro piattaforma.
Rispetto a molti altri modelli, GPT-4o Search Preview ha un costo per token premium, tipico dei modelli ad alte capacità. Ad esempio, GPT-3.5 Turbo è significativamente più economico. La politica di zero margini su OrcaRouter garantisce che gli utenti paghino esattamente come nella fatturazione diretta di OpenAI, senza alcun costo aggiuntivo. Questo può essere vantaggioso per applicazioni sensibili ai costi in cui è necessaria una finestra di contesto ampia.
OrcaRouter non pubblicizza pubblicamente sconti di caching o programmi di risparmio di token specifici per GPT-4o Search Preview. Gli utenti vengono fatturati in base al numero totale di token di input e output consumati. Per gestire i costi, considera di ottimizzare le lunghezze dei prompt e limitare i token di output. L'elaborazione in batch potrebbe migliorare l'efficienza, ma non è menzionata nella documentazione disponibile.
Il modello è accessibile tramite l'API compatibile con OpenAI di OrcaRouter. Imposta l'URL di base su https://api.orcarouter.ai/v1 e includi l'ID del modello "openai/gpt-4o-search-preview" nella tua richiesta. Utilizza le librerie client standard di OpenAI (ad esempio, il pacchetto Python openai) con la tua chiave API di OrcaRouter. Esempio: openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...]).
Dal momento che l'API è compatibile con OpenAI, sono disponibili parametri standard: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream e altri. Il parametro max_tokens non deve superare il limite di output di 16.384 token. Il modello non supporta input multimodali, quindi i messaggi dovrebbero contenere solo contenuto testuale.
Per passare da un'altra variante di GPT-4o (ad esempio "gpt-4o" o "gpt-4o-mini"), basta cambiare l'ID del modello nella tua chiamata API in "openai/gpt-4o-search-preview". Assicurati che le tue richieste contengano solo contenuto testuale, poiché questa variante non accetta immagini o audio. Regola il parametro max_tokens se necessario. Non sono richieste altre modifiche al codice.
L'autenticazione è gestita tramite chiavi API. È necessaria una chiave API OrcaRouter, che viene passata nell'intestazione della richiesta (tipicamente come "Authorization: Bearer <your_key>"). Ottieni una chiave dalla piattaforma OrcaRouter. La stessa autenticazione viene utilizzata per tutti i modelli accessibili tramite il gateway.
GPT-4o Search Preview è solo testo, mentre la versione standard di GPT-4o supporta testo, immagini e audio. La variante con anteprima di ricerca potrebbe avere ottimizzazioni sottostanti per le query relative alla ricerca, ma non sono dettagliate pubblicamente. Il prezzo è identico: $2.50/M per input e $10/M per output. Entrambi utilizzano una finestra di contesto da 128k e un output massimo di 16k. Il principale compromesso è tra il supporto delle modalità e una potenziale performance specializzata nella ricerca.
GPT-4 Turbo (contesto 128k, testo+immagine) è un predecessore di GPT-4o. GPT-4o Search Preview è più recente e fa parte della famiglia GPT-4o, che in generale offre un ragionamento e un'efficienza migliori rispetto a GPT-4 Turbo. Tuttavia, il supporto multimodale in GPT-4 Turbo è limitato alle immagini, mentre GPT-4o è completamente multimodale. Search Preview elimina quel vantaggio. I prezzi per GPT-4 Turbo sono tipicamente $10/M di input e $30/M di output, rendendo Search Preview più economico (se si utilizzano le tariffe indicate). Nota che il prezzo di GPT-4 Turbo non è fornito qui; questa è conoscenza generale.
Altri modelli focalizzati sulla ricerca (ad esempio, sistemi dedicati di generazione aumentata da recupero) possono offrire funzionalità integrate di ricerca web o recupero di file. GPT-4o Search Preview non include una propria funzionalità di ricerca; è un modello linguistico in grado di elaborare i risultati di ricerca forniti nel prompt. Se hai bisogno di un recupero esterno, combina questo modello con un'API di ricerca. La sua ampia finestra di contesto lo rende adatto per aggregare molti risultati di ricerca in una singola richiesta.
Il compromesso principale riguarda il supporto delle modalità e la potenziale ottimizzazione per le attività di ricerca. Si ottiene un'ampia finestra di contesto e prezzi senza markup, ma si perde la capacità di elaborare immagini o audio. Nei benchmark noti, le prestazioni potrebbero essere equivalenti a GPT-4o, ma non sono disponibili punteggi specifici. Per attività esclusivamente testuali che beneficiano di un contesto di 128k, questo modello rappresenta una scelta conveniente all'interno della famiglia GPT-4o.
Compatibile con OpenAI: mantieni il tuo SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Input / 1M token | $2.50 |
| Output / 1M token | $10.00 |
| Valuta | USD |
Stima basata sul prezzo di listino
Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.
GET /api/public/models/openai/gpt-4o-search-previewApri @misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview