Modello GPT-4o solo testo in anteprima con contesto di 128K, output di 16K, accessibile tramite API OrcaRouter a $2.50/$10 per M token.
Questo modello è una versione di anteprima di OpenAI, limitata a input solo testuali. Porta l'identificatore openai/gpt-4o-search-preview-2025-03-11 quando viene accesso tramite l'API di OrcaRouter.…
In qualità di anteprima testuale di GPT-4o, eccelle nella comprensione e generazione del linguaggio naturale in un'ampia gamma di domini. È in grado di eseguire riassunti di documenti, rispondere a domande, scrivere testi creativi, tradurre e generare codice. L'ampia finestra di contesto gli consente di mantenere coerenza su passaggi molto lunghi, rendendolo adatto ad attività come l'analisi di libri o l'elaborazione di registri estesi. Supporta messaggi di sistema, utente e assistente in un formato simile a una chat. Le capacità di ragionamento zero-shot e few-shot sono tipiche dei modelli della classe GPT-4, consentendogli di gestire istruzioni complesse senza un esteso addestramento specifico.
Se il tuo compito non richiede la piena potenza di ragionamento di GPT-4o, considera di utilizzare un modello più piccolo o più economico di OrcaRouter, come openai/gpt-4o-mini o gpt-3.5-turbo. Esempi di attività più adatte a modelli più economici includono classificazione semplice, generazione di contenuti in formato breve o domande e risposte di base con contesto limitato. Il costo del modello in anteprima potrebbe essere ingiustificato per richieste ad alto volume e bassa complessità. Inoltre, se è richiesto input multimodale, questo modello non può gestire immagini o audio; sarebbe necessario un altro modello (ad esempio, GPT-4o standard o GPT-4V). Valuta sempre il compromesso tra qualità e costo per token.
Questo modello è identificato come variante 'search-preview', ma nessuna capacità specifica di utilizzo di strumenti o di ricerca web è dettagliata nelle specifiche disponibili pubblicamente. È solo testo e opera come un modello linguistico standard. Gli utenti non dovrebbero presumere alcuna funzionalità di ricerca o recupero integrata. Per la generazione aumentata, puoi implementare pipeline di retrieval-augmented generation (RAG) separatamente, alimentando i documenti recuperati nella finestra di contesto del modello. OrcaRouter non aggiunge middleware per l'uso di strumenti; il modello risponde esclusivamente in base al suo addestramento e al prompt fornito. Le versioni future potrebbero modificare questo comportamento, ma al momento dell'anteprima, non è documentata alcuna integrazione di strumenti.
Come anteprima, questo modello potrebbe mostrare comportamenti inaspettati o una minore affidabilità rispetto alle versioni stabili. È solo testuale, quindi qualsiasi richiesta multimodale verrà rifiutata. L'output massimo di 16.384 token è sostanziale, ma potrebbe comunque troncare generazioni molto lunghe. La data di cutoff delle conoscenze e i dati di addestramento del modello non sono specificati; potrebbe non essere a conoscenza di eventi molto recenti. L'uso in produzione è sconsigliato perché il modello potrebbe essere aggiornato o rimosso. Inoltre, la latenza potrebbe essere più alta rispetto ai modelli stabili a causa della sua natura di anteprima. Testare sempre accuratamente prima di distribuire su larga scala.
Non sono stati forniti punteggi di benchmark specifici per questa particolare versione di anteprima. Essendo una variante di GPT-4o, ci si aspetta che si comporti in modo simile al GPT-4o standard nelle comuni attività linguistiche, ma i numeri esatti non sono stati divulgati. Gli utenti possono eseguire le proprie valutazioni utilizzando dataset pubblici. La finestra di contesto ampia le conferisce un vantaggio nei benchmark su documenti lunghi, ma poiché si tratta di un'anteprima, i punteggi potrebbero differire dal modello di produzione. Per numeri autorevoli, fare riferimento ai report ufficiali di benchmark di OpenAI per GPT-4o. OrcaRouter non modifica gli output o le prestazioni del modello.
I dati di latenza e throughput per questo modello preview non sono stati pubblicati. Essendo un preview, potrebbe essere più lento del GPT-4o stabile a causa dell'infrastruttura sperimentale. I tempi di risposta dipendono dalla lunghezza dell'input, dalla lunghezza dell'output e dalla domanda concorrente. OrcaRouter non impone latenza aggiuntiva oltre il normale routing API. Per stimare la velocità, gli sviluppatori possono eseguire richieste di esempio con payload tipici. Per applicazioni in produzione che richiedono prestazioni costanti, considera invece di utilizzare il modello stabile gpt-4o, a meno che non siano necessarie le funzionalità specifiche del preview.
I modelli della classe GPT-4 sono noti per il loro forte ragionamento in vari domini, tra cui matematica, logica e inferenza di senso comune. Si prevede che questa anteprima erediti tali capacità. Il grande contesto consente un complesso ragionamento a catena di pensiero su molti passaggi senza perdere traccia delle parti precedenti. Tuttavia, non vengono forniti benchmark di ragionamento specifici per questa versione esatta. Gli utenti dovrebbero validare le prestazioni sui propri compiti specifici del dominio. Il modello potrebbe anche mostrare un migliore seguimento delle istruzioni rispetto alle versioni precedenti di GPT, ma ancora una volta, si consiglia una verifica indipendente.
Oltre ad essere un'anteprima, il modello non ha supporto multimodale. Non può elaborare direttamente immagini, audio o video. La sua data di cutoff delle conoscenze è sconosciuta, quindi potrebbe non avere informazioni sugli eventi successivi all'addestramento. Il limite di output di 16.384 token, sebbene generoso, non può produrre testi estremamente lunghi in una singola generazione; per output più lunghi, è necessario un prompting iterativo o la suddivisione. L'anteprima potrebbe anche avere tassi di errore o di rifiuto più elevati per alcuni argomenti sensibili. Le prestazioni su lingue diverse dall'inglese possono variare. Testare sempre su dati rappresentativi prima del deployment.
Il modello ha un prezzo di $2.50 per 1 milione di token per l'input e $10.00 per 1 milione di token per l'output. Queste sono le tariffe del provider OpenAI; OrcaRouter non aggiunge margine. Ad esempio, elaborare un prompt di 10.000 token e generare 1.000 token costerebbe circa $0.025 per l'input e $0.01 per l'output, per un totale di $0.035. I costi scalano linearmente con l'uso dei token. Non ci sono commissioni aggiuntive per l'utilizzo di OrcaRouter come gateway API. Assicurati di monitorare l'utilizzo per evitare addebiti imprevisti. Confronta con modelli più economici se il tuo compito non richiede tutte le capacità.
OrcaRouter attualmente non offre sconti sul volume o caching dei token per questo modello. Tutta la fatturazione è pay-as-you-go basata sull'effettivo utilizzo dei token alla tariffa del provider. Il caching di prompt o risposte non viene eseguito da OrcaRouter; ogni richiesta viene elaborata indipendentemente. Se hai una produttività molto elevata, contatta OrcaRouter per possibili accordi personalizzati. Per ottimizzare i costi, considera l'utilizzo di prompt più brevi, il riutilizzo efficiente del contesto o il raggruppamento delle chiamate. Il modello non supporta prezzi ridotti per hit in cache poiché non esiste alcun meccanismo di caching.
A $2.50/$10 per milione di token, questa anteprima ha un prezzo simile al GPT-4o standard ma potrebbe differire leggermente. Alternative più economiche includono openai/gpt-4o-mini (circa $0.15/$0.60 per milione) o gpt-3.5-turbo (approssimativamente $0.50/$1.50). Per attività che possono tollerare una qualità inferiore, questi modelli offrono risparmi significativi. Il costo del modello in anteprima è all'estremità superiore del catalogo OrcaRouter. Se lo utilizzi esclusivamente per test, potresti sostenere costi moderati a seconda del volume di richieste. Valuta sempre l'uso previsto di token e confrontalo con il guadagno di qualità derivante dall'utilizzo di un modello più grande.
Per utilizzare questo modello, imposta l'URL di base del tuo client API su https://api.orcarouter.ai/v1 e specifica l'ID del modello come openai/gpt-4o-search-preview-2025-03-11. Devi utilizzare una chiave API rilasciata da OrcaRouter. L'API è completamente compatibile con OpenAI, quindi il codice esistente scritto per l'endpoint di completamento chat di OpenAI funzionerà con modifiche minime. Esempio di chiamata con curl: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_ORCAROUTER_KEY" -H "Content-Type: application/json" -d '{ "model": "openai/gpt-4o-search-preview-2025-03-11", "messages": [{"role": "user", "content": "Hello"}], "max_tokens": 100 }'.
È possibile utilizzare tutti i parametri standard di completamento delle chat supportati da OpenAI: 'messages', 'max_tokens', 'temperature', 'top_p', 'frequency_penalty', 'presence_penalty', 'stop' e 'n'. Il modello supporta una finestra di contesto di 128.000 token, quindi 'max_tokens' può essere impostato fino a 16.384. 'temperature' controlla la casualità; i valori vanno da 0 a 2. 'stream' è supportato per la risposta in tempo reale. OrcaRouter non introduce parametri aggiuntivi. Assicurati che le tue richieste rispettino i limiti di token; gli input più lunghi della finestra di contesto (inclusa la risposta) verranno troncati o restituiranno un errore.
Migrare è semplice. Sostituisci il tuo URL di base OpenAI (https://api.openai.com/v1) con l'URL di base di OrcaRouter (https://api.orcarouter.ai/v1). Cambia la tua chiave API con una chiave di OrcaRouter. Aggiorna il campo model a openai/gpt-4o-search-preview-2025-03-11. Non sono necessarie altre modifiche al codice. Se stavi usando un modello OpenAI diverso, puoi continuare a utilizzare la stessa struttura del codice. OrcaRouter trasmette tutti i parametri standard. Dopo la migrazione, verifica che le risposte siano coerenti. Nota che la fatturazione sarà gestita da OrcaRouter e avrai bisogno di un account lì.
OrcaRouter non divulga pubblicamente limiti di frequenza specifici per questo modello in anteprima. La disponibilità dipende dall'infrastruttura di OpenAI e dalla capacità del gateway di OrcaRouter. Per le applicazioni in produzione, considera lo stato di anteprima del modello e la potenziale instabilità. OrcaRouter potrebbe imporre limiti di utilizzo ragionevoli per prevenire abusi. Puoi aspettarti un servizio con il massimo impegno possibile, ma non viene fornito alcun SLA. Se hai bisogno di una velocità effettiva garantita, contatta OrcaRouter per opzioni dedicate. Il modello potrebbe anche essere rimosso o sostituito senza preavviso, quindi pianifica modelli di riserva.
Il modello standard GPT-4o (openai/gpt-4o) è multimodale e una release stabile, mentre questa anteprima è solo testuale e destinata a test preliminari. L'anteprima potrebbe includere funzionalità future non ancora presenti nella versione standard, ma potrebbe anche essere meno affidabile. I prezzi sono simili. Il modello standard supporta un input più ampio (immagini, audio). Se non hai bisogno delle funzionalità dell'anteprima, il GPT-4o standard è la scelta più sicura. Entrambi sono disponibili su OrcaRouter con la stessa interfaccia API, rendendo il passaggio facile.
Gpt-4o-mini è un modello più piccolo ed economico, ottimizzato per attività semplici. Costa circa $0.15 per milione di token di input e $0.60 per milione di token di output (approssimativamente). Questo modello preview è circa 16 volte più costoso per l'input e 16 volte più costoso per l'output. Il modello preview offre un contesto più ampio (128K vs. 128K? In realtà anche gpt-4o-mini ha 128K, ma potrebbe variare. Sappiamo che questo modello è 128K. Il contesto di Gpt-4o-mini è anch'esso 128K secondo le informazioni pubbliche, ma non possiamo darlo per scontato. Diremo 'finestra di contesto comparabile' ma notiamo la differenza di prezzo.) Questo modello è migliore per ragionamenti complessi, mentre gpt-4o-mini è sufficiente per molti compiti standard. Scegli in base alle esigenze di qualità e al budget.
I modelli Claude (ad esempio, Claude 3.5 Sonnet) offrono ampie finestre di contesto e un ragionamento robusto, ma la loro API non è direttamente compatibile con OpenAI. OrcaRouter fornisce un'interfaccia unificata per più provider, ma questa anteprima è esclusivamente di OpenAI. I modelli Claude possono avere prezzi e punti di forza diversi in aree come la sicurezza e la generazione di testi lunghi. Per un confronto diretto, dovresti testare sui tuoi casi d'uso. OrcaRouter ti consente di passare da un provider all'altro, ma questo modello in anteprima è disponibile solo tramite la via di OpenAI. Non vengono forniti confronti di benchmark.
Compatibile con OpenAI: mantieni il tuo SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview-2025-03-11",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Input / 1M token | $2.50 |
| Output / 1M token | $10.00 |
| Valuta | USD |
Stima basata sul prezzo di listino
Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.
GET /api/public/models/openai/gpt-4o-search-preview-2025-03-11Apri @misc{orcarouter_gpt_4o_search_preview_2025_03_11,
title = {openai/gpt-4o-search-preview-2025-03-11 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11}
}openai. (n.d.). openai/gpt-4o-search-preview-2025-03-11 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11