GPT-4o-mini

openai/gpt-4o-mini
VisionToolsJSON
von OpenAI · 2024-07-18

GPT-4o mini ist das neueste Modell von OpenAI nach [GPT-4 Omni](/models/openai/gpt-4o) und unterstützt sowohl Text- als auch Bildeingaben mit Textausgaben. Als ihr fortschrittlichstes kleines Modell ist es um ein Vielfaches erschwinglicher...

Ktx128K Tokens
Max. Ausgabe16.4K
Eingabetext + image + file
Ausgabetext
p50 TTFT4.23 s
EINGABE$0.15/ 1M Tokens
AUSGABE$0.60/ 1M Tokens
p50 TTFT4.23 s7 T
p95 TTFT10.00 s7 T
DATENVERKEHR9.6MTokens / 7 T

GPT-4o-mini ist eine kleinere, schnellere Variante des GPT-4o-Modells von OpenAI, optimiert für geringere Rechenkosten unter Beibehaltung multimodaler Fähigkeiten. Es kann Text, Bilder und…

Was ist GPT-4o-mini?

Wer sollte GPT-4o-mini verwenden?

Wie unterscheidet sich die Modellarchitektur von GPT-4o?

Welche Eingabemodalitäten werden unterstützt?

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Preise

Eingabe / 1M Tokens$0.150
Ausgabe / 1M Tokens$0.600
Cache-Lesen / 1M$0.075
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $2.85 · Mit Prompt-Caching $2.59

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.000304

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
4.23 s
Ausgabegeschwindigkeit
870 tok/s
p95 TTFT
10.00 s
Fehlerquote
0.30%

Öffentliche Benchmarks

11.4
AA Coding
Besser als 7 % der verglichenen Modelle
Nr. 114 von 123
6.9
AA Intelligence
Besser als 3 % der verglichenen Modelle
Nr. 119 von 125
14.7
AA Math
Besser als 2 % der verglichenen Modelle
Nr. 78 von 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Quelle: artificialanalysis.ai

Im Vergleich

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Eingabe $/M$0.15$21.00$60.00$5.00
Ausgabe $/M$0.60$168.00$270.00$30.00
Kontext128K400K1.1M
Qualität2/1010/1010/1010/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Was kostet die Nutzung von GPT-4o-mini über OrcaRouter?
Input-Tokens kosten $0.15 pro 1M, Output-Tokens kosten $0.60 pro 1M, entspricht exakt den Tarifen von OpenAI mit null Aufschlag.
Wie groß ist das Kontextfenster von GPT-4o-mini?
Der Kontextfenster umfasst 128.000 Tokens, und die maximale Ausgabe beträgt 16.384 Tokens.
Was sind die Hauptstärken von GPT-4o-mini?
Es kombiniert multimodale Eingabe (Text, Bilder, Dateien), ein großes Kontextfenster, schnelle Inferenz und niedrige Kosten für eine breite Palette von Aufgaben.
Wie schneidet GPT-4o-mini im Vergleich zu GPT-4o ab?
GPT-4o-mini ist auf Token-Preise rund 94% günstiger, könnte jedoch bei komplexem Denken und kreativem Generieren weniger genau sein. Bei MATH-500 erreicht es 78,9 Punkte im Vergleich zu GPT-4os höherer Punktzahl.
Protokolliert oder speichert OrcaRouter meine Eingaben?
OrcaRouter protokolliert oder speichert Ihre Prompts nicht; alle Daten werden an OpenAI weitergeleitet. Siehe OpenAIs Datennutzungsrichtlinie für deren Handhabung.
Wie rufe ich GPT-4o-mini via OrcaRouters API auf?
Verwenden Sie den OpenAI-kompatiblen Endpunkt unter https://api.orcarouter.ai/v1 mit der Modell-ID "openai/gpt-4o-mini". Fügen Sie Ihren OrcaRouter-API-Schlüssel hinzu.
Kann GPT-4o-mini sowohl Text als auch Bilder in derselben Anfrage verarbeiten?
Ja, es akzeptiert gleichzeitig Text, Bilder und Dateien innerhalb des 128K-Token-Kontexts.
Was ist die Geschwindigkeit/Latenz von GPT-4o-mini?
Die Latenz ist generell niedrig – der erste Token liegt typischerweise unter einer Sekunde bei moderaten Eingabeaufforderungen –, variiert jedoch mit der Kontextlänge und API-Last. Streaming reduziert die gefühlte Latenz.

Dieses Abzeichen einbetten

OpenAI: GPT-4o-mini$0.15/M in4232ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini auf OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

Modellkarte als Daten

GET /api/public/models/openai/gpt-4o-miniÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt