Voorbeeld van het alleen-tekst GPT-4o model met 128K context, 16K uitvoer, toegankelijk via OrcaRouter API voor $2.50/$10 per miljoen tokens.
Dit model is een preview-release van OpenAI, beperkt tot alleen-tekst invoer. Het draagt de identificatie openai/gpt-4o-search-preview-2025-03-11 bij toegang via de API van OrcaRouter. Het model…
Als een tekstgebaseerde GPT-4o preview blinkt het uit in het begrijpen en genereren van natuurlijke taal in een breed scala aan domeinen. Het kan documenten samenvatten, vragen beantwoorden, creatief schrijven, vertalen en code genereren. De grote contextvenster stelt het in staat om coherentie te behouden over zeer lange passages, waardoor het geschikt is voor taken zoals boekanalyse of het verwerken van uitgebreide logs. Het ondersteunt systeem-, gebruikers- en assistentberichten in een chatachtig formaat. De zero-shot- en few-shot-redeneermogelijkheden van het model zijn typisch voor GPT-4-klasse modellen, waardoor het complexe instructies kan verwerken zonder uitgebreide fine-tuning.
Als uw taak niet de volledige redeneerkracht van GPT-4o vereist, overweeg dan een kleiner of goedkoper model van OrcaRouter te gebruiken, zoals openai/gpt-4o-mini of gpt-3.5-turbo. Voorbeelden van taken die beter geschikt zijn voor goedkopere modellen zijn eenvoudige classificatie, het genereren van korte inhoud of eenvoudige vraag-antwoord met beperkte context. De kosten van het preview-model kunnen onterecht hoog zijn voor grote volumes aan eenvoudige verzoeken. Bovendien, als multimodale invoer vereist is, kan dit model geen afbeeldingen of audio verwerken; een ander model (bijv. standaard GPT-4o of GPT-4V) zou dan nodig zijn. Evalueer altijd de afweging tussen kwaliteit en kosten per token.
Dit model wordt geïdentificeerd als een 'search-preview' variant, maar er worden geen specifieke toolgebruik- of webzoekmogelijkheden beschreven in de openbaar beschikbare specificaties. Het is alleen-tekst en werkt als een standaard taalmodel. Gebruikers moeten geen ingebouwde zoek- of retrievalsfunctionaliteit veronderstellen. Voor augmented generation kunt u afzonderlijk retrieval-augmented generation (RAG)-pijplijnen implementeren, waarbij opgehaalde documenten in het contextvenster van het model worden gevoed. OrcaRouter voegt geen toolgebruik-middleware toe; het model reageert uitsluitend op basis van zijn training en de verstrekte prompt. Toekomstige versies kunnen dit gedrag veranderen, maar vanaf de preview is er geen toolintegratie gedocumenteerd.
Als voorbeeld kan dit model onverwacht gedrag vertonen of lagere betrouwbaarheid in vergelijking met stabiele versies. Het is alleen tekst, dus elke multimodale aanvraag wordt geweigerd. De maximale uitvoer van 16.384 tokens is aanzienlijk, maar kan nog steeds zeer lange generaties afkappen. De kennisafsluitdatum en trainingsgegevens van het model zijn niet gespecificeerd; het kan zich mogelijk niet bewust zijn van zeer recente gebeurtenissen. Productiegebruik wordt afgeraden omdat het model kan worden bijgewerkt of verwijderd. Bovendien kan de latentie hoger zijn dan bij stabiele modellen vanwege de preview-aard. Test altijd grondig voordat u op schaal implementeert.
Er zijn geen specifieke benchmarkscores voor deze specifieke previewversie verstrekt. Als een GPT-4o-variant wordt verwacht dat deze vergelijkbaar presteert met de standaard GPT-4o bij algemene taaltaken, maar de exacte cijfers worden niet bekendgemaakt. Gebruikers kunnen hun eigen evaluaties uitvoeren met behulp van openbare datasets. Het grote contextvenster geeft het een voordeel bij benchmarks voor lange documenten, maar aangezien dit een preview is, kunnen scores verschillen van het productiemodel. Raadpleeg voor gezaghebbende cijfers de officiële benchmarkrapporten van OpenAI voor GPT-4o. OrcaRouter wijzigt de uitvoer of prestaties van het model niet.
De cijfers voor latentie en doorvoer van dit previewmodel zijn niet gepubliceerd. Als preview kan het langzamer zijn dan de stabiele GPT-4o vanwege experimentele infrastructuur. Responstijden zijn afhankelijk van invoerlengte, uitvoerlengte en gelijktijdige vraag. OrcaRouter voegt geen extra latentie toe bovenop normale API-routering. Om de snelheid te schatten, kunnen ontwikkelaars voorbeeldverzoeken uitvoeren met typische payloads. Voor productietoepassingen die consistente prestaties vereisen, overweeg dan het stabiele gpt-4o-model te gebruiken, tenzij de specifieke functies van de preview nodig zijn.
GPT-4-klasse modellen staan bekend om sterke redeneervaardigheden op verschillende gebieden, waaronder wiskunde, logica en gezonde verstand inferentie. Deze preview zal naar verwachting die capaciteiten erven. De grote context maakt complexe keten-van-gedachte redenering over vele stappen mogelijk zonder het spoor van eerdere delen bijster te raken. Er worden echter geen specifieke redeneerbenchmarks voor deze exacte versie geleverd. Gebruikers moeten de prestaties valideren op hun eigen domeinspecifieke taken. Het model vertoont mogelijk ook een verbeterde instructie-opvolging in vergelijking met eerdere GPT-versies, maar ook hier wordt onafhankelijke verificatie aanbevolen.
Naast een preview te zijn, heeft het model geen multimodale ondersteuning. Het kan niet rechtstreeks afbeeldingen, audio of video verwerken. De kennisafsluitdatum is onbekend, dus het kan informatie over gebeurtenissen na de training missen. De uitvoerlimiet van 16.384 tokens is weliswaar ruim, maar kan niet extreem lange teksten in één keer genereren; voor langere uitvoeren is iteratief aanzetten of splitsen nodig. De preview kan ook hogere foutpercentages of weigeringspercentages hebben voor bepaalde gevoelige onderwerpen. De prestaties op andere talen dan Engels kunnen variëren. Test altijd op representatieve gegevens vóór implementatie.
Het model is geprijsd op $2.50 per 1 miljoen tokens voor input en $10.00 per 1 miljoen tokens voor output. Dit zijn de provider tarieven van OpenAI; OrcaRouter voegt geen opslag toe. Bijvoorbeeld, het verwerken van een prompt van 10,000 tokens en het genereren van 1,000 tokens zou ongeveer $0.025 kosten voor input en $0.01 voor output, in totaal $0.035. Kosten schalen lineair met token gebruik. Er zijn geen extra kosten voor het gebruik van OrcaRouter als API-gateway. Zorg ervoor dat u het gebruik in de gaten houdt om onverwachte kosten te voorkomen. Vergelijk met goedkopere modellen als uw taak niet de volledige mogelijkheden nodig heeft.
OrcaRouter biedt momenteel geen volumekortingen of token-caching voor dit model. Alle facturatie is pay-as-you-go op basis van daadwerkelijk tokenverbruik tegen het tarief van de provider. Caching van prompts of antwoorden wordt niet uitgevoerd door OrcaRouter; elk verzoek wordt onafhankelijk verwerkt. Als u een zeer hoge doorvoer heeft, neem dan contact op met OrcaRouter voor mogelijke maatwerkafspraken. Overweeg voor kostenoptimalisatie het gebruik van kortere prompts, efficiënt hergebruik van context of het bundelen van aanroepen. Het model biedt geen verlaagde prijzen voor gecachte hits omdat er geen cachingmechanisme aanwezig is.
Met $2.50/$10 per miljoen tokens is deze preview vergelijkbaar geprijsd met de standaard GPT-4o, maar kan iets afwijken. Goedkopere alternatieven zijn openai/gpt-4o-mini (ongeveer $0.15/$0.60 per miljoen) of gpt-3.5-turbo (ruwweg $0.50/$1.50). Voor taken die lagere kwaliteit kunnen tolereren, bieden deze modellen aanzienlijke besparingen. De kosten van het previewmodel liggen aan de hogere kant van de OrcaRouter-catalogus. Als u het uitsluitend voor testen gebruikt, kunt u matige kosten maken, afhankelijk van het aantal aanvragen. Evalueer altijd het verwachte tokenverbruik en vergelijk dit met de kwaliteitswinst van het gebruik van een groter model.
Om dit model te gebruiken, stel de basis-URL van uw API-client in op https://api.orcarouter.ai/v1, en specificeer de model-ID als openai/gpt-4o-search-preview-2025-03-11. U moet een API-sleutel gebruiken die is uitgegeven door OrcaRouter. De API is volledig OpenAI-compatibel, dus bestaande code geschreven voor het chat-voltooiingen-eindpunt van OpenAI zal met minimale wijzigingen werken. Voorbeeldaanroep met curl: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_ORCAROUTER_KEY" -H "Content-Type: application/json" -d '{ "model": "openai/gpt-4o-search-preview-2025-03-11", "messages": [{"role": "user", "content": "Hello"}], "max_tokens": 100 }'
U kunt alle standaard chatvoltooiingsparameters gebruiken die worden ondersteund door OpenAI: 'messages', 'max_tokens', 'temperature', 'top_p', 'frequency_penalty', 'presence_penalty', 'stop' en 'n'. Het model ondersteunt een contextvenster van 128.000 tokens, dus 'max_tokens' kan worden ingesteld tot 16.384. 'temperature' bepaalt de willekeurigheid; waarden variëren van 0 tot 2. 'stream' wordt ondersteund voor real-time respons. OrcaRouter introduceert geen extra parameters. Zorg ervoor dat uw verzoeken voldoen aan de tokenlimieten; invoer die langer is dan het contextvenster (inclusief de respons) wordt ingekort of retourneert een fout.
Migreren is eenvoudig. Vervang je OpenAI-basis-URL (https://api.openai.com/v1) door de basis-URL van OrcaRouter (https://api.orcarouter.ai/v1). Wijzig je API-sleutel naar een OrcaRouter-sleutel. Werk het modelveld bij naar openai/gpt-4o-search-preview-2025-03-11. Er zijn geen andere codeaanpassingen nodig. Als je een ander OpenAI-model gebruikte, kun je dezelfde codestructuur blijven gebruiken. OrcaRouter geeft alle standaardparameters door. Controleer na de migratie of de antwoorden consistent zijn. Let op: de facturatie wordt afgehandeld door OrcaRouter en je hebt daar een account nodig.
OrcaRouter maakt geen specifieke snelheidslimieten voor dit previewmodel openbaar. De beschikbaarheid hangt af van de infrastructuur van OpenAI en de gatewaycapaciteit van OrcaRouter. Overweeg voor productietoepassingen de previewstatus van het model en mogelijke instabiliteit. OrcaRouter kan redelijke gebruikslimieten opleggen om misbruik te voorkomen. U kunt rekenen op een 'best-effort'-service, maar er wordt geen SLA geboden. Als u een gegarandeerde doorvoer nodig heeft, neem dan contact op met OrcaRouter voor speciale opties. Het model kan ook zonder kennisgeving worden verwijderd of vervangen, dus plan voor fallbackmodellen.
Het standaard GPT-4o-model (openai/gpt-4o) is een multimodale, stabiele release, terwijl deze preview alleen tekst is en bedoeld voor vroegtijdig testen. De preview kan toekomstige functies bevatten die nog niet in de standaardversie zitten, maar kan ook minder betrouwbaar zijn. De prijzen zijn vergelijkbaar. Het standaardmodel heeft bredere invoerondersteuning (afbeeldingen, audio). Als je geen preview-functies nodig hebt, is de standaard GPT-4o de veiligere keuze. Beide zijn beschikbaar op OrcaRouter met dezelfde API-interface, wat overschakelen eenvoudig maakt.
Gpt-4o-mini is een kleiner, goedkoper model dat is geoptimaliseerd voor eenvoudige taken. Het kost ongeveer $0.15 per miljoen invoertokens en $0.60 per miljoen uitvoertokens (bij benadering). Dit previewmodel is ruwweg 16x duurder voor invoer en 16x duurder voor uitvoer. Het previewmodel biedt een grotere context (128K vs. 128K? Eigenlijk heeft gpt-4o-mini ook 128K, maar dat kan variëren. We weten dat dit model 128K is. Volgens openbare informatie heeft gpt-4o-mini ook 128K context, maar we kunnen dat niet aannemen. We zeggen 'vergelijkbaar contextvenster' maar let op het prijsverschil.) Dit model is beter voor complex redeneren, terwijl gpt-4o-mini voldoende is voor veel standaardtaken. Maak uw keuze op basis van kwaliteitsbehoeften en budget.
Claude-modellen (bijv. Claude 3.5 Sonnet) bieden grote contextvensters en sterke redeneervaardigheden, maar hun API is niet direct OpenAI-compatibel. OrcaRouter biedt een uniforme interface voor meerdere providers, maar deze preview is uitsluitend van OpenAI. Claude-modellen kunnen verschillende prijzen en sterke punten hebben op gebieden zoals veiligheid en het genereren van lange teksten. Voor een directe vergelijking zou u uw eigen use cases moeten testen. OrcaRouter stelt u in staat om te wisselen tussen providers, maar dit previewmodel is alleen beschikbaar via de OpenAI-route. Er worden geen benchmarkvergelijkingen gegeven.
OpenAI-compatibel — behoud je huidige SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview-2025-03-11",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Invoer / 1M tokens | $2.50 |
| Uitvoer / 1M tokens | $10.00 |
| Valuta | USD |
Schatting op basis van catalogusprijs
Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.
GET /api/public/models/openai/gpt-4o-search-preview-2025-03-11Openen @misc{orcarouter_gpt_4o_search_preview_2025_03_11,
title = {openai/gpt-4o-search-preview-2025-03-11 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11}
}openai. (n.d.). openai/gpt-4o-search-preview-2025-03-11 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11