GPT-4o-mini

openai/gpt-4o-mini
VisieToolsJSON
door OpenAI · 2024-07-18

GPT-4o mini is OpenAI's nieuwste model na [GPT-4 Omni](/models/openai/gpt-4o), dat zowel tekst- als afbeeldingsinvoer ondersteunt met tekstuitvoer. Als hun meest geavanceerde kleine model is het vele malen betaalbaarder...

ctx128K tokens
Max. uitvoer16.4K
Invoertext + image + file
Uitvoertext
p50 TTFT4.23 s
INPUT$0.15/ 1M tokens
OUTPUT$0.60/ 1M tokens
p50 TTFT4.23 s7d
p95 TTFT10.00 s7d
VERKEER9.6Mtokens / 7d

GPT-4o-mini is een kleinere, snellere variant van OpenAI's GPT-4o-model, geoptimaliseerd voor lagere rekenkosten terwijl het multimodale mogelijkheden behoudt. Het kan tekst, afbeeldingen en…

Wat is GPT-4o-mini?

Wie zou GPT-4o-mini moeten gebruiken?

Hoe verschilt de modelarchitectuur van GPT-4o?

Welke invoermodaliteiten worden ondersteund?

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Prijzen

Invoer / 1M tokens$0.150
Uitvoer / 1M tokens$0.600
Cache lezen / 1M$0.075
ValutaUSD

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $2.85 · Met prompt-caching $2.59

Schatting op basis van catalogusprijs

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.000303

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
4.23 s
Outputsnelheid
870 tok/s
p95 TTFT
10.00 s
Foutpercentage
0.30%

Openbare benchmarks

11.4
AA Coding
Beter dan 7% van de vergeleken modellen
#114 van 123
6.9
AA Intelligence
Beter dan 3% van de vergeleken modellen
#119 van 125
14.7
AA Math
Beter dan 2% van de vergeleken modellen
#78 van 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Bron: artificialanalysis.ai

Vergelijking

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Invoer $/M$0.15$21.00$60.00$5.00
Uitvoer $/M$0.60$168.00$270.00$30.00
Context128K400K1.1M
Kwaliteit2/1010/1010/1010/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Wat zijn de kosten om GPT-4o-mini via OrcaRouter te gebruiken?
Input tokens kosten $0,15 per 1M, output tokens kosten $0,60 per 1M, exact overeenkomend met OpenAI’s tarieven zonder opslag.
Wat is het contextvenster van GPT-4o-mini?
De contextvenster is 128.000 tokens en de maximale uitvoer is 16.384 tokens.
Wat zijn de belangrijkste sterke punten van GPT-4o-mini?
Het combineert multimodale invoer (tekst, afbeeldingen, bestanden), een groot contextvenster, snelle inferentie en lage kosten voor een breed scala aan taken.
Hoe verhoudt GPT-4o-mini zich tot GPT-4o?
GPT-4o-mini is ongeveer 94% goedkoper qua tokenprijzen, maar kan minder accuraat zijn bij complex redeneren en creatieve generatie. Op MATH-500 scoort het 78,9 tegenover de hogere score van GPT-4o.
Logt of slaat OrcaRouter mijn prompts op?
OrcaRouter logt of bewaart uw prompts niet; alle gegevens worden doorgestuurd naar OpenAI. Raadpleeg het gegevensgebruiksbeleid van OpenAI voor hun verwerking.
Hoe roep ik GPT-4o-mini aan via OrcaRouter's API?
Gebruik het OpenAI-compatibele eindpunt op https://api.orcarouter.ai/v1 met model-id "openai/gpt-4o-mini". Voeg uw OrcaRouter API-sleutel toe.
Kan GPT-4o-mini zowel tekst als afbeeldingen in hetzelfde verzoek verwerken?
Ja, het accepteert tegelijkertijd tekst, afbeeldingen en bestanden binnen de 128K token-context.
Wat is de snelheid/latentie van GPT-4o-mini?
Latentie is over het algemeen laag—het eerste token is doorgaans onder een seconde voor gemiddelde prompts—maar varieert met contextlengte en API-belasting. Streaming vermindert de waargenomen latentie.

Sluit deze badge in

OpenAI: GPT-4o-mini$0.15/M in4232ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini op OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

Modelkaart als data

GET /api/public/models/openai/gpt-4o-miniOpenen
Machineleesbaar:/llms.txt/llms-full.txt