GPT-4o ("o" voor "omni") is het nieuwste AI-model van OpenAI, dat zowel tekst- als afbeeldingsinvoer ondersteunt met tekstuitvoer. Het behoudt het intelligentieniveau van [GPT-4 Turbo](/models/openai/gpt-4-turbo) terwijl het twee keer zo...
GPT-4o is een multimodaal groot taalmodel van OpenAI. Het accepteert tekst-, afbeelding- en bestandsinvoer, en produceert tekst. Het model is ontworpen voor gebruikers die lange inhoud moeten…
GPT-4o blinkt uit in multimodale redenering, verwerking van lange contexten en wiskundig probleemoplossen. De 128k-token context stelt het in staat om grote hoeveelheden informatie te bewaren en te raadplegen, wat het nuttig maakt voor taken zoals documentanalyse, codegeneratie over volledige projecten en complexe meerstapsgesprekken. Het model scoorde 75.9 op de MATH-500 benchmark, wat wijst op een sterke vaardigheid in het oplossen van wiskundige problemen. Bovendien betekent de mogelijkheid om afbeeldingen en bestanden te accepteren dat het visuele inhoud—zoals diagrammen, grafieken of foto's—in combinatie met tekst kan redeneren. Op OrcaRouter kunt u deze sterke punten benutten zonder enige toeslag bovenop de vermelde prijzen van OpenAI te betalen.
GPT-4o is zeer effectief voor taken die zowel tekstueel als visueel begrip vereisen. Voorbeelden hiervan zijn: het beantwoorden van vragen over een diagram in een studieboek, het extraheren van gegevens uit een gescande factuur, het genereren van code op basis van een wireframe-afbeelding, of het samenvatten van een lang onderzoekspaper met figuren. De grote context maakt het ook geschikt voor het analyseren van volledige codebases of lange gesprekslogs. Wiskundig redeneren is een ander sterk punt, zoals blijkt uit de 75,9 op MATH-500. Op OrcaRouter zijn deze use cases eenvoudig te implementeren: u stuurt een standaard OpenAI-compatibel verzoek met de juiste inhoudstypen en het model retourneert een tekstuele reactie.
Als uw taak geen multimodale invoer of een grote context vereist, kan een goedkoper model kosteneffectiever zijn. Voor eenvoudige tekstclassificatie-, samenvattings- of vertaaltaken die binnen een kleinere context passen, zijn modellen zoals GPT-3.5 Turbo (geprijsd op $0,50 per 1M invoer en $1,50 per 1M uitvoer) aanzienlijk goedkoper. De invoerkosten van GPT-4o bedragen $2,50 per 1M tokens, wat vijf keer hoger is dan die van GPT-3.5 Turbo. Als u grote hoeveelheden tekstgegevens verwerkt zonder multimodale redenering nodig te hebben, kan een kleiner model de kosten verlagen. OrcaRouter biedt een verscheidenheid aan modellen, zodat u de beste prijs-prestatieverhouding kunt kiezen.
GPT-4o is ontworpen om afbeeldingen en bestanden als invoer te accepteren, waardoor het taken kan uitvoeren zoals visuele vraagbeantwoording, het genereren van bijschriften bij afbeeldingen en het begrijpen van documenten. Hoewel er in de beschikbare feiten geen specifieke multimodale benchmarkscores worden vermeld, ondersteunt de architectuur van het model gezamenlijk redeneren over tekst en afbeeldingen. Het kan bijvoorbeeld objecten in een afbeelding tellen of een grafiek interpreteren. Het model geeft alleen tekst als uitvoer, geen afbeeldingen. Op OrcaRouter worden multimodale verzoeken verzonden met dezelfde parameters als de API van OpenAI: voeg een image_url of bestandsinhoud toe in de messages-array. Het model verwerkt de visuele gegevens en retourneert een tekstuele reactie op basis van de gecombineerde invoer.
GPT-4o behaalt een score van 75.9 op de MATH-500-benchmark. MATH-500 is een subset van de MATH-dataset, die bestaat uit 500 uitdagende wiskundeproblemen over verschillende onderwerpen zoals algebra, meetkunde en calculus. Een score van 75.9 betekent dat het model ongeveer 76% van deze problemen correct oplost. Dit duidt op een sterk wiskundig redeneervermogen, hoewel het niet perfect is. Ter vergelijking: veel kleinere modellen scoren onder de 50 op vergelijkbare benchmarks. Deze score weerspiegelt het vermogen van het model om meerstapsredeneringen uit te voeren en wiskundige notatie te verwerken. Op OrcaRouter kun je GPT-4o gebruiken voor wiskundige taken zoals bijles, toetsvoorbereiding of het verifiëren van berekeningen.
Zoals alle grote taalmodellen heeft GPT-4o beperkingen. Het kan onjuiste of verzonnen antwoorden produceren, vooral over onderwerpen met beperkte trainingsdata of die zeer recente kennis vereisen (de trainingsafsluitdatum wordt niet vermeld in de feiten, maar als OpenAI-model heeft het een kennisafsluiting). Het kan gevoelig zijn voor de formulering van prompts en moeite hebben met dubbelzinnige instructies. Ondanks zijn sterke MATH-500-score is het niet onfeilbaar bij complexe wiskundige bewijzen. Het model verwerkt afbeeldingen, maar genereert geen afbeeldingen. Bovendien kan de grote contextvenster (128k tokens) leiden tot verhoogd tokenverbruik, wat de kosten verhoogt als dit niet zorgvuldig wordt beheerd. Op OrcaRouter kun je sommige problemen beperken door parameters zoals temperature en top_p aan te passen.
Exacte latentiecijfers voor GPT-4o worden niet vermeld in de feiten. Over het algemeen is GPT-4o een groot model en zal het een hogere latentie hebben vergeleken met kleinere modellen zoals GPT-3.5 Turbo of Llama 3.1 8B. Het is echter waarschijnlijk geoptimaliseerd voor snellere inferentie dan de originele GPT-4. Via OrcaRouter kun je responstijden verwachten die vergelijkbaar zijn met wat je rechtstreeks van OpenAI zou krijgen, aangezien het platform verzoeken routeert zonder extra verwerking. Voor real-time toepassingen waar snelheid cruciaal is, overweeg dan om een sneller, goedkoper model te gebruiken voor eenvoudigere taken en GPT-4o te reserveren voor complexe vragen die profiteren van zijn mogelijkheden.
Op OrcaRouter is GPT-4o geprijsd tegen exact de officiële tarieven van OpenAI: $2,50 per 1 miljoen inputtokens en $10,00 per 1 miljoen outputtokens. Er wordt geen opslag toegevoegd door OrcaRouter. Facturering vindt plaats op basis van tokenaantallen afgerond op het dichtstbijzijnde gehele token. Inputtokens omvatten de tekst, afbeeldingen en bestanden die je verzendt, hoewel afbeeldingen doorgaans tegen een vast tarief door het model worden getokeniseerd (bijv. elke afbeelding verbruikt een bepaald aantal tokens). Outputtokens zijn de door het model gegenereerde tekst. Je betaalt alleen voor wat je gebruikt; er zijn geen maandelijkse kosten of minimumverplichtingen. Deze transparante prijsstelling stelt je in staat om nauwkeurig te budgetteren voor je AI-workloads.
De primaire afweging is kosten versus capaciteit. GPT-4o kost $2,50 invoer en $10 uitvoer per 1M tokens. Goedkopere modellen zoals GPT-3.5 Turbo ($0,50 invoer, $1,50 uitvoer) of Llama 3.1 8B zijn zuiniger voor eenvoudige of omvangrijke taken. GPT-4o biedt echter multimodale invoer en een groter contextvenster. Als uw toepassing het begrijpen van afbeeldingen of het verwerken van zeer lange documenten vereist, kan GPT-4o noodzakelijk zijn ondanks de hogere kosten. Voor tekst-only taken met korte invoer kan een goedkoper model geld besparen. Op OrcaRouter kunt u eenvoudig tussen modellen schakelen door de model-ID te wijzigen, zodat u de kosten voor elke aanvraag kunt optimaliseren.
Nee. OrcaRouter rekent GPT-4o tegen het exacte aanbiedertarief zonder opslag. De prijzen zijn $2.50 per 1M invoertokens en $10.00 per 1M uitvoertokens. Er zijn geen verborgen kosten, upsells of extra kosten. OrcaRouter geeft de kosten direct door van OpenAI. Dit beleid is van toepassing op alle modellen die op het platform worden vermeld. De basis-URL is https://api.orcarouter.ai/v1 en de model-ID is "openai/gpt-4o". U kunt de prijzen op elk moment controleren door uw gebruiksdashboard te bekijken. Er is geen gelaagde prijsstelling of verplichting vereist—betaal alleen voor de verbruikte tokens.
Om GPT-4o via OrcaRouter te gebruiken, stuur HTTP POST-verzoeken naar de basis-URL https://api.orcarouter.ai/v1/chat/completions. Stel de modelparameter in op "openai/gpt-4o". Uw verzoek moet een API-sleutel bevatten (geef uw OrcaRouter API-sleutel op in de Authorization-header). De verzoekbody volgt de standaard OpenAI chat completions-indeling: een messages-array met role/content-paren, optionele parameters zoals temperature, max_tokens, top_p, enz. Gebruik voor multimodale invoer content-onderdelen met een type "text" of "image_url" (of file). De respons is een JSON-object met de voltooiing van het model. Voorbeeld curl-opdracht: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model":"openai/gpt-4o","messages":[{"role":"user","content":[{"type":"text","text":"Wat staat er op deze afbeelding?"},{"type":"image_url","image_url":{"url":"https://example.com/image.jpg"}}]}]}'
Bij het aanroepen van GPT-4o via OrcaRouter kun je dezelfde parameters gebruiken als de API van OpenAI. Veelgebruikte parameters zijn: - temperature (float, 0-2): Bepaalt de willekeur. Lagere waarden zoals 0.2 maken de uitvoer meer deterministisch. - max_tokens (integer, standaard 16384): Maximaal aantal tokens in het antwoord. - top_p (float, 0-1): Nucleus sampling parameter. - frequency_penalty en presence_penalty: Verminderen herhaling. - stop (string of array): Stopsequenties. - stream (boolean): Schakel streaming antwoorden in (true/false). - seed (integer): Voor deterministische sampling. Je kunt ook het optionele "user"-veld gebruiken om individuele gebruikers te volgen. Het model ondersteunt functieaanroepen en toolgebruik, hoewel dit niet expliciet in de feiten wordt vermeld. Op OrcaRouter worden alle standaardparameters geaccepteerd.
Migreren is eenvoudig omdat OrcaRouter een OpenAI-compatibel eindpunt biedt. Stappen: 1. Verkrijg een API-sleutel van OrcaRouter (meld u aan op hun website). 2. Wijzig de basis-URL van https://api.openai.com/v1 naar https://api.orcarouter.ai/v1. 3. Wijzig de model-ID van "gpt-4o" naar "openai/gpt-4o". 4. Gebruik dezelfde verzoekbody-indeling. Er zijn geen codewijzigingen nodig anders dan het eindpunt en de modelnaam. 5. Werk de Authorization-header bij om uw OrcaRouter API-sleutel te gebruiken. Testen met een enkel verzoek wordt aanbevolen. OrcaRouter gebruikt dezelfde streaming- en niet-streamingmodi. Er is geen verschil in hoe het model zich gedraagt, aangezien het hetzelfde onderliggende OpenAI-model is. Uw bestaande prompts en parameters zullen identiek werken.
De basis-URL voor de OrcaRouter API is https://api.orcarouter.ai/v1. De specifieke model-ID voor GPT-4o is "openai/gpt-4o". Deze exacte tekenreeks moet worden doorgegeven in de parameter "model" van de aanvraag. Bijvoorbeeld, in een chat completions endpoint-aanroep stelt u "model": "openai/gpt-4o" in. OrcaRouter ondersteunt dit model voor zowel streaming als niet-streaming completions. Als u een OpenAI SDK of bibliotheek gebruikt die is geconfigureerd om naar een aangepaste basis-URL te wijzen, stelt u eenvoudigweg de basis-URL in op https://api.orcarouter.ai/v1 en verstrekt u uw OrcaRouter API-sleutel. Het model-ID-voorvoegsel "openai/" onderscheidt het van modellen van andere aanbieders op OrcaRouter.
GPT-4o is de multimodale opvolger van GPT-4 Turbo. Beide modellen hebben een contextvenster van 128k. GPT-4o voegt echter native ondersteuning voor afbeeldings- en bestandsinvoer toe, terwijl GPT-4 Turbo voornamelijk alleen tekst was (met visie alleen beschikbaar in aparte versies). GPT-4o heeft ook een hogere maximale output van 16.384 tokens vergeleken met GPT-4 Turbo's typische 4.096 of 8.192. De prijzen verschillen: GPT-4 Turbo kost $10.00 per 1M invoer en $30.00 per 1M uitvoer, waardoor GPT-4o aanzienlijk goedkoper is ($2.50/$10.00). De MATH-500-score van 75,9 voor GPT-4o is over het algemeen hoger dan de gerapporteerde benchmarks van GPT-4 Turbo, alhoewel exacte Turbo-scores niet in de feiten voorkomen. Op OrcaRouter zijn beide modellen beschikbaar zonder opslag.
GPT-3.5 Turbo is een goedkoper, sneller model geoptimaliseerd voor eenvoudige taken. Het contextvenster is 16.384 tokens, veel kleiner dan het 128k van GPT-4o. GPT-3.5 ondersteunt geen beeldinvoer—het is alleen tekst. De prijs is $0,50 per 1M invoer- en $1,50 per 1M uitvoertokens, waardoor het ongeveer 5x goedkoper is voor invoer en 6,6x goedkoper voor uitvoer dan GPT-4o. Op de MATH-500 benchmark scoort GPT-3.5 Turbo doorgaans veel lager (exacte cijfers niet gegeven). GPT-4o is beter geschikt voor complex redeneren, lange documenten en multimodale taken. Gebruik GPT-3.5 Turbo voor hoogvolume, eenvoudige interacties. Op OrcaRouter kunt u eenvoudig wisselen tussen deze modellen door het model-ID te wijzigen.
Claude 3.5 Sonnet is een concurrerend model van Anthropic. Het heeft ook een 200k contextvenster (groter dan GPT-4o's 128k) en ondersteunt beeldinvoer. De prijzen voor Claude 3.5 Sonnet zijn doorgaans $3,00 per 1M input en $15,00 per 1M output, waardoor GPT-4o goedkoper is op input maar duurder op output? Eigenlijk is GPT-4o $2,50 input versus $3,00, dus goedkoper; output $10 versus $15, dus goedkoper. Op benchmarks behaalt Claude 3.5 Sonnet vergelijkbare prestaties op wiskunde en redeneren, maar exacte scores variëren. Beide modellen zijn sterk in multimodale taken. De keuze tussen hen kan afhangen van specifieke prestatiekenmerken of ecosysteemvoorkeuren. Op OrcaRouter zijn beide toegankelijk via dezelfde API-indeling met verschillende model-ID's (bijv. "anthropic/claude-3.5-sonnet").
Llama 3.1 405B is een open-weight-model van Meta met 405 miljard parameters. Het ondersteunt ook een contextvenster van 128k en tekstinvoer, maar de multimodale mogelijkheden zijn minder duidelijk (het ondersteunt mogelijk niet native afbeeldingen). Llama 3.1 405B is beschikbaar via OrcaRouter tegen een lagere prijs, doorgaans rond $1,00 per 1M input en $1,00 per 1M output tokens (bij benadering, niet vermeld in feiten). De benchmarkscores op MATH-500 zijn niet gegeven, maar zijn waarschijnlijk lager dan die van GPT-4o (75,9). GPT-4o is propriëtair en biedt betere out-of-the-box multimodale redeneringen en mogelijk hogere nauwkeurigheid bij complexe taken. Llama 3.1 405B is een goede keuze voor gebruikers die een open model willen of zelf moeten hosten. Op OrcaRouter kun je beide modellen side-by-side vergelijken.
OpenAI-compatibel — behoud je huidige SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokensnparallel_tool_callspredictionpresence_penaltyresponse_formatseedservice_tierstopstreamstructured_outputstemperaturetool_choicetoolstop_logprobstop_pweb_search_options| Invoer / 1M tokens | $2.50 |
| Uitvoer / 1M tokens | $10.00 |
| Cache lezen / 1M | $1.25 |
| Valuta | USD |
Schatting op basis van catalogusprijs
Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.
GET /api/public/models/openai/gpt-4oOpenen @misc{orcarouter_gpt_4o,
title = {GPT-4o API},
author = {OpenAI},
year = {2024},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o}
}OpenAI. (2024). GPT-4o API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o