GPT-4o (2024-08-06)

openai/gpt-4o-2024-08-06
VisionVerktygJSON
av OpenAI · 2024-08-06

GPT-4o-versionen från 2024-08-06 erbjuder förbättrad prestanda i strukturerade utdata, med möjlighet att ange ett JSON-schema i response_format. Läs mer [här](https://openai.com/index/introducing-structured-outputs-in-the-api/). GPT-4o ("o" står för "omni") är...

ctx128K tokens
Max output16K
Inmatningtext + image + file
Utdatatext
p50 TTFT687 ms
INMATNING$2.50/ 1M token
UTDATA$10.00/ 1M token
p50 TTFT687 ms7d
p95 TTFT926 ms7d
TRAFIK301tokens/7d

GPT-4o (2024-08-06) är en version av OpenAIs GPT-4o-modell, släppt i augusti 2024. Det är en multimodal stor språkmodell som bearbetar text-, bild- och filinmatningar. Modellen nås via OrcaRouters…

Vad är GPT-4o (2024-08-06)?

Vem är den här modellen till för?

Vilka inmatningsmetoder stöder den?

Nyckelspecifikationer i korthet

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="openai/gpt-4o-2024-08-06",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Priser

Priser
Inmatning / 1M token$2.50
Utdata / 1M tokens$10.00
Cacheläsning / 1M$1.25
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $47.50 · Med promptcachning $43.13

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.005045

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
687 ms
Utdatahastighet
31.0 tok/s
p95 TTFT
926 ms
Felfrekvens
9.1%

Offentliga benchmarks

16.6
AA Coding
Bättre än 11% av jämförda modeller
#123 av 138
7.7
AA Intelligence
Bättre än 9% av jämförda modeller
#128 av 141
AIME
11.7
GPQA Diamond
52.1
Humanity's Last Exam
2.3
IFBench
36.0
LiveCodeBench
31.7
Long-Context Recall
41.0
MATH-500
79.5
SciCode
33.1
TerminalBench Hard
8.3
τ²-Bench
28.9
Källa: artificialanalysis.ai

Community-buzz

Vad utvecklare säger den här veckan

Hacker News0 omnämnanden · 7d

Så jämför den sig

GPT-4o (2024-08-06)GPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$2.50$21.00$60.00$5.00
Output $/M$10.00$168.00$270.00$30.00
Kontext128K400K1.1M
Kvalitet3/1010/1010/1010/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden per token för GPT-4o (2024-08-06) på OrcaRouter?
Priset är $2.50 per 1 miljon input-tokens och $10.00 per 1 miljon output-tokens, fakturerat till OpenAIs leverantörspris utan påslag från OrcaRouter. Bild- och filinmatningar medför extra token-kostnader enligt OpenAIs policy.
Vad är kontextfönstret och maximala utdatatokens?
Kontextfönstret är 128 000 tokens. Maximal utdata är 16 384 tokens. Detta möjliggör bearbetning av långa dokument eller konversationer och generering av omfattande svar.
Vilka är de främsta styrkorna hos denna modell?
Den erbjuder stark matematisk resonemangsförmåga (79,5 på MATH-500), multimodal inmatning (text, bilder, filer), ett stort kontextfönster och OpenAI:s högkvalitativa generering. Den är väl lämpad för komplexa resonemangs- och synuppgifter.
Hur jämför sig denna modell med en billigare modell som GPT-4o mini?
GPT-4o (2024-08-06) är dyrare men generellt sett mer kapabel i resonemang och multimodala uppgifter. GPT-4o mini är billigare ($0.15/$0.60 per 1M tokens) och tillräcklig för enkla uppgifter. Välj baserat på uppgiftens komplexitet och budget.
Vilka policyer för datahantering gäller?
Dina data skickas till OpenAI för bearbetning. OrcaRouter lagrar inte prompts. OpenAI:s policyer för dataanvändning gäller. Använd OrcaRouters multi-leverantörsdirigering för att dirigera förfrågningar till leverantörer som uppfyller dina efterlevnadskrav.
Kan jag använda den här modellen med OpenAI Python client?
Ja, genom att sätta bas-URL till https://api.orcarouter.ai/v1 och använda modell-ID "openai/gpt-4o-2024-08-06". Din befintliga kod för ChatCompletion, streaming och funktionsanrop fungerar utan ändringar.
Hur skickar jag bildinmatningar via API:t?
Inkludera bilden som en base64-kodad sträng eller URL i innehållsarrayen för ett meddelande, med formatet "image_url" och detaljparameter. Modellen tolkar bilder för analys. Detta följer OpenAIs multimodala API-format.
Vad är det maximala utdatat som kan genereras per förfrågan?
Den maximala utdata är 16,384 tokens. Använd parametern max_tokens för att kontrollera svarslängden. Var medveten om att längre utdata ökar kostnad och latens.
Är denna modell tillgänglig för streaming?
Ja, när du använder det OpenAI-kompatibla API:t kan du ställa in stream=True för att ta emot svar stegvis. Detta fungerar med OrcaRouters slutpunkt.
Kan jag använda den här modellen gratis eller med en provperiod?
Modellen debiteras enligt leverantörens priser. OrcaRouter kan erbjuda en gratisnivå eller provkrediter—kolla deras webbplats för aktuella erbjudanden. Användning utöver eventuella gratiskrediter medför standardkostnader per token.

Bädda in denna badge

OpenAI: GPT-4o (2024-08-06)$2.50/M in687ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg" alt="OpenAI: GPT-4o (2024-08-06) på OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o (2024-08-06)](https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06)

Modellkort som data

GET /api/public/models/openai/gpt-4o-2024-08-06Öppna