GPT-4o mini Search Preview är en specialiserad modell för webbsökning i Chat Completions. Den är tränad för att förstå och utföra webbsökningsfrågor.
GPT-4o-mini Search Preview är en variant av OpenAI:s GPT-4o-mini-modell som innehåller inbyggda webbsökningsfunktioner. Den är utformad för att ge svar som innehåller realtidsinformation från…
Modellen kombinerar allmän språkförståelse och generering med live-webbsökning. Den kan svara på frågor om aktuella händelser, hämta data från specifika webbplatser och sammanställa information från flera onlinekällor. Den behåller typiska GPT-4o-mini-funktioner: textsammanfattning, översättning, kodgenerering, logiskt resonemang och kreativt skrivande. Sökförhandsvisningen lägger till möjligheten att få tillgång till aktuella nyheter, aktiekurser, väder, produktdetaljer och annan tidskänslig data. Men eftersom modellen är anpassad för hastighet och effektivitet kan dess resonemangsdjup vara lägre än för den fullständiga GPT-4o-modellen.
Modellen utmärker sig i scenarier där svar beror på föränderlig eller aktuell information. Exempel inkluderar kundtjänstagenter i realtid som behöver kontrollera orderstatus eller returpolicyer, innehållsverktyg som genererar sammanfattningar av trendiga ämnen och forskningsassistenter som sammanställer fakta från flera onlinekällor. Den är också användbar för att verifiera påståenden mot aktuell data, som att kontrollera ett företags senaste tillkännagivande eller ett sportresultat. På grund av sin relativt låga kostnad och snabba svarstider är den lämplig för applikationer med höga förfrågningsvolymer där web grounding är en nyckelfunktion.
Om din applikation inte kräver webbsökning eller aktuell information, överväg att använda basversionen av GPT-4o-mini utan sökförhandsgranskning. Basmodellen är ännu billigare (samma prissättning per token, men utan overhead för sökning) och kan vara snabbare för rent konversationella uppgifter. För mycket enkla frågor som inte kräver bred världskunskap kan mindre modeller som GPT-4o-mini (bas) eller till och med äldre modeller som GPT-3.5 Turbo räcka. Utvärdera om sökförhandsgranskningsfunktionen motiverar kostnaden för ditt specifika användningsfall.
Sökförhandsvisningen utlöses automatiskt av modellen när den anser att frågan behöver extern information. Du behöver inte konfigurera sök-API:er eller skicka in sökresultat manuellt. Du kan dock påverka modellens beteende genom att instruera den att explicit använda webbsökning, eller genom att ange källor. Modellen respekterar standardiserade säkerhets- och innehållsfilter som tillämpas av OpenAI. Observera att webbsökning kan medföra fördröjning jämfört med basmodellen, eftersom modellen väntar på sökresultat innan den genererar det slutliga svaret.
Specifika benchmarkresultat för GPT-4o-mini Search Preview har inte offentliggjorts som en separat variant. Baserat på den underliggande GPT-4o-mini förväntas modellen prestera väl på standard NLP-benchmark som MMLU, HellaSwag och GSM8K, men troligen med lägre noggrannhet än den fullständiga GPT-4o. Sökfunktionen kan förbättra prestandan för uppgifter som kräver aktuell kunskap (exempelvis frågor om senaste händelser), men förändrar inte modellens grundläggande resonemangsförmåga. För faktagranskning är modellen beroende av kvaliteten och aktualiteten hos de webbsidor den hämtar.
GPT-4o-mini Search Preview är utformad för låg latens jämfört med GPT-4o. Basversionen GPT-4o-mini är känd för snabb inferens, och sökförhandsvisningen lägger till extra tid för webbhämtning. Total svarstid beror på faktorer som nätverkslatens, antalet hämtade sökresultat och längden på kontexten. Vid typisk användning genereras svar inom några sekunder. För applikationer som kräver absolut minimal latens skulle basversionen GPT-4o-mini (utan sökning) vara snabbare. OrcaRouters API stöder streaming för att börja visa tokens när de genereras.
Styrkor: Modellen tillhandahåller aktuell information utan separat sökintegration, har ett stort kontextfönster (128k tokens) och är kostnadseffektiv för högvolymanvändning. Begränsningar: Den accepterar endast text; den kan ibland hämta ofullständigt eller irrelevant webbinnehåll; dess resonemang är mindre djupt än GPT-4o; och förhandsgranskningen av sökning kan öka latensen. Dessutom kan modellen inte alltid citera källor explicit, så användare bör verifiera kritisk information. Den är inte utformad för uppgifter som multimodal förståelse, avancerad matematik eller komplex kedja-av-tanke resonemang där GPT-4o presterar bättre.
OrcaRouter debiterar GPT-4o-mini Search Preview till leverantörens pris utan påslag: $0,15 per miljon inmatningstokens och $0,60 per miljon utmatningstokens. Det innebär att du betalar exakt vad OpenAI tar ut, utan extra avgifter. Prissättningen är per token, där kontexttoken räknas som inmatning och genererade token som utmatning. Modellen använder Openais standardtokeniseringsschema. Det tillkommer inga extra kostnader för själva sökförhandsgranskningsfunktionen; kostnaden är densamma som för basversionen GPT-4o-mini, trots den extra webbinhämtningen.
Jämfört med GPT-4o (som kostar 2,50 USD per miljon inmatningstoken och 10 USD per miljon utmatningstoken) är GPT-4o-mini Search Preview betydligt billigare—ungefär 16 gånger mindre för inmatning och 16,6 gånger mindre för utmatning. Detta gör det till en stark kandidat för applikationer där kostnad per fråga spelar roll, särskilt när du behöver webbsökning. Däremot kostar basversionen GPT-4o-mini (utan sökförhandsvisning) samma per token men saknar sökning. Om sökning inte behövs kan du spara den lilla extra latensen, men kostnaden per token är identisk.
OrcaRouter kan stödja cachelagring av sökresultat eller modellsvar beroende på konfigurationen. Om aktiverat kan upprepade frågor om samma information serveras från cachen, vilket minskar både latens och tokenanvändning. Dock varierar cachelagringspolicyn. För den senaste informationen utför modellen vanligtvis en ny webbsökning för varje begäran. För att minimera kostnader, överväg att använda bas-GPT-4o-mini om dina frågor inte kräver webdata. Övervaka alltid din tokenanvändning via OrcaRouters instrumentpanel för att förstå dina utgifter.
OrcaRouter för vidare OpenAI:s exakta prissättning utan att lägga till någon marginal. Fakturering baseras på tokenantal som rapporterats av leverantören. Det finns inga anslutningsavgifter, månadsminimum eller extra avgifter för API-gatewayen. Du betalar endast för de tokens du använder till de angivna priserna. För GPT-4o-mini Search Preview innebär det $0.15 per miljon inmatningstokens och $0.60 per miljon utdatatokens. Se till att ditt konto är inställt med OrcaRouter för att få tillgång till modellen till dessa priser.
För att använda modellen, skicka en POST-begäran till https://api.orcarouter.ai/v1/chat/completions med fältet "model" inställt på "openai/gpt-4o-mini-search-preview". Denna slutpunkt är OpenAI-kompatibel, så du kan använda alla OpenAI SDK:er eller klienter genom att ändra bas-URL och API-nyckel. Exempel på curl: curl https://api.orcarouter.ai/v1/chat/completions \ -H "Authorization: Bearer YOUR_ORCAROUTER_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "openai/gpt-4o-mini-search-preview", "messages": [{"role": "user", "content": "What is the current weather in London?"}] }' Sökförhandsvisningen utlöses automatiskt.
API:t stöder alla standard OpenAI chat completion-parametrar: temperature (0-2, standard 1), top_p, n, stream, stop, max_tokens (upp till 16384), presence_penalty, frequency_penalty och logit_bias. Modellen respekterar dessa parametrar. För sökförhandsvisning behövs inga ytterligare parametrar; modellen bestämmer när den ska söka. Du kan dock uppmana den att uttryckligen begära en webbsökning (t.ex. "Sök på webben efter senaste nyheterna om...") för att uppmuntra hämtning. Observera att modellen fortfarande kan välja att inte söka om den anser att intern kunskap är tillräcklig.
Om du redan använder OpenAIs API är migreringen till OrcaRouter enkel: ändra bas-URL från https://api.openai.com/v1 till https://api.orcarouter.ai/v1, och ersätt din API-nyckel med en från OrcaRouter. Modell-ID blir "openai/gpt-4o-mini-search-preview". Alla andra request-bodyar och svarformat förblir identiska. Du kan använda valfritt OpenAI-klientbibliotek (Python, Node.js, etc.) utan modifiering. OrcaRouter stöder också streaming, funktionsanrop och andra avancerade funktioner som är kompatibla med OpenAIs API.
För att strömma svar, ange "stream": true i din förfrågan. OrcaRouter returnerar data som server-sända händelser, identiskt med OpenAIs strömningsformat. Varje händelse innehåller en delta av svaret. Strömning är särskilt användbart för användarvända applikationer för att visa tokens när de genereras. För sökförhandsgranskningsfrågor kan modellen först indikera att den söker innan den levererar det slutgiltiga svaret. Strömmen kommer att inkludera dessa interims-tokens. Se till att din klient kan hantera partiella uppdateringar på ett smidigt sätt.
GPT-4o-mini Search Preview är en mindre, snabbare och billigare variant av GPT-4o med utökade webbsökningsfunktioner. Medan GPT-4o har överlägset resonemang, en större kunskapsbas (fram till sin träningsgräns) och multimodalt stöd (bilder, ljud), är denna modell endast textbaserad och förlitar sig på webbsökning för att övervinna sin begränsade träningskunskap. För uppgifter som kräver djupgående analys eller komplex matematik är GPT-4o bättre. För kostnadskänsliga applikationer som behöver färsk information är GPT-4o-mini Search Preview ett starkt alternativ. Priset är ungefär 16 gånger lägre.
Basmodellen GPT-4o-mini innehåller ingen webbsökning; den förlitar sig enbart på sin träningsdata, som har ett slutdatum i slutet av 2023. GPT-4o-mini Search Preview lägger till möjligheten att hämta aktuell information från internet. Båda modellerna har samma kontextfönster (128k tokens), maximal utmatning (16384) och prissättning per token. Sökförhandsgranskningsvarianten kan ha något högre latens på grund av webbhämtning. Om din applikation inte behöver live-data är basmodellen funktionellt identisk och kan vara snabbare. Båda modellerna nås via OrcaRouter med olika modell-ID:n.
Andra sökaktiverade modeller inkluderar Gemini med Google Search grounding, eller modeller som använder plugin-baserad webbhämtning. GPT-4o-mini Search Preview erbjuder inbyggd integration utan externa plugins. Den är generellt billigare än större sökaktiverade modeller (som GPT-4 med webbläsning). Den kan dock vara mindre omfattande i sökresultat jämfört med dedikerade sök-API:er. För webbkunskap med hög noggrannhet, överväg att komplettera med ett faktabaserat sök-API och mata resultaten till en basmodell. Denna modell är bäst för enkla till måttligt komplexa frågor som drar nytta av aktuell webbdata.
Välj denna modell när du behöver: (1) låg kostnad per förfrågan, (2) automatisk webbsökning utan anpassad integration, (3) snabba svarstider och (4) ett stort kontextfönster. Välj en full GPT-4o-variant om du behöver multimodala indata eller djupare resonemang. Välj basversionen GPT-4o-mini om du inte behöver webbsökning och vill ha något snabbare svar. Välj ett dedikerat sök-API plus en liten modell om du behöver detaljerad kontroll över sökkällor och resultat. Denna modell är bäst som en drop-in-ersättning för GPT-3.5 eller GPT-4o-mini i applikationer som skulle dra nytta av liveinformation.
OpenAI-kompatibel — behåll det SDK du redan använder
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-mini-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Inmatning / 1M token | $0.150 |
| Utdata / 1M tokens | $0.600 |
| Valuta | USD |
Uppskattning baserad på listpris
Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.
GET /api/public/models/openai/gpt-4o-mini-search-previewÖppna @misc{orcarouter_gpt_4o_mini_search_preview,
title = {GPT-4o-mini Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview}
}OpenAI. (2025). GPT-4o-mini Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview