GPT-4o-mini

openai/gpt-4o-mini
VisionVerktygJSON
av OpenAI · 2024-07-18

GPT-4o mini är OpenAIs nyaste modell efter [GPT-4 Omni](/models/openai/gpt-4o), som stöder både text- och bildinmatning med textutmatning. Som deras mest avancerade lilla modell är den många gånger billigare...

ctx128K tokens
Max output16.4K
Inmatningtext + image + file
Utdatatext
p50 TTFT4.23 s
INMATNING$0.15/ 1M token
UTDATA$0.60/ 1M token
p50 TTFT4.23 s7d
p95 TTFT10.00 s7d
TRAFIK9.6Mtokens/7d

GPT-4o-mini är en mindre, snabbare variant av OpenAIs GPT-4o-modell, optimerad för lägre beräkningskostnad samtidigt som den behåller multimodala förmågor. Den kan bearbeta text, bilder och…

Vad är GPT-4o-mini?

Vem borde använda GPT-4o-mini?

Hur skiljer sig modellarkitekturen från GPT-4o?

Vilka inmatningsmodaliteter stöds?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Priser

Inmatning / 1M token$0.150
Utdata / 1M tokens$0.600
Cacheläsning / 1M$0.075
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $2.85 · Med promptcachning $2.59

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000303

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
4.23 s
Utdatahastighet
870 tok/s
p95 TTFT
10.00 s
Felfrekvens
0.30%

Offentliga benchmarks

11.4
AA Coding
Bättre än 7% av jämförda modeller
#114 av 123
6.9
AA Intelligence
Bättre än 3% av jämförda modeller
#119 av 125
14.7
AA Math
Bättre än 2% av jämförda modeller
#78 av 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Källa: artificialanalysis.ai

Så jämför den sig

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$0.15$21.00$60.00$5.00
Output $/M$0.60$168.00$270.00$30.00
Kontext128K400K1.1M
Kvalitet2/1010/1010/1010/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden för att använda GPT-4o-mini via OrcaRouter?
Indatatokens kostar $0.15 per 1M, utdatatokens kostar $0.60 per 1M, exakt matchande OpenAIs priser med noll påslag.
Vad är kontextfönstret för GPT-4o-mini?
Kontextfönstret är 128 000 tokens, och den maximala utmatningen är 16 384 tokens.
Vilka är de främsta styrkorna hos GPT-4o-mini?
Den kombinerar multimodal input (text, bilder, filer), ett stort kontextfönster, snabb inferens och låg kostnad för ett brett spektrum av uppgifter.
Hur står sig GPT-4o-mini jämfört med GPT-4o?
GPT-4o-mini är ungefär 94 % billigare vad gäller tokenprissättning men kan vara mindre noggrann vid komplexa resonemang och kreativ generering. På MATH-500 får det 78,9 jämfört med GPT-4o:s högre poäng.
Loggar eller lagrar OrcaRouter mina prompts?
OrcaRouter loggar eller lagrar inte dina promptar; all data skickas vidare till OpenAI. Se OpenAIs policy för dataanvändning för deras hantering.
Hur anropar jag GPT-4o-mini via OrcaRouters API?
Använd den OpenAI-kompatibla slutpunkten på https://api.orcarouter.ai/v1 med modell-ID "openai/gpt-4o-mini". Inkludera din OrcaRouter API-nyckel.
Kan GPT-4o-mini bearbeta både text och bilder i samma förfrågan?
Ja, den accepterar text, bilder och filer samtidigt inom 128K token-kontexten.
Vad är hastigheten/latensen för GPT-4o-mini?
Latency är generellt låg—first token under en sekund för måttliga prompts—men varierar med kontextlängd och API-belastning. Streaming minskar upplevd latency.

Bädda in denna badge

OpenAI: GPT-4o-mini$0.15/M in4232ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini på OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

Modellkort som data

GET /api/public/models/openai/gpt-4o-miniÖppna