GPT-5.4 Mini

openai/gpt-5.4-mini
VisionVerktygJSONResonemang
av OpenAI · 2026-03-17

GPT-5.4 mini för med sig kärnfunktionerna från GPT-5.4 i en snabbare, mer effektiv modell optimerad för arbetsbelastningar med hög genomströmning. Den stöder text- och bildinmatningar med stark prestanda inom resonemang, kodning,...

ctx400K tokens
Max output128K
Inmatningfile + image + text
Utdatatext
p50 TTFT4.00 s
INMATNING$0.75/ 1M token
UTDATA$4.50/ 1M token
p50 TTFT4.00 s7d
p95 TTFT6.52 s7d
TRAFIK1.2Mtokens/7d

GPT‑5.4 Mini är en kompakt språkmodell från OpenAI som balanserar kapacitet med lägre beräkningskostnad. Den stöder ett kontextfönster på 400 000 tokens och en maximal utdata på 128 000 tokens,…

Vad är GPT‑5.4 Mini?

Vem bör använda GPT‑5.4 Mini?

Vilka inmatningsmetoder stöder den?

Hur fungerar kontextfönstret i praktiken?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-5.4-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • include_reasoning
  • max_completion_tokens
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stream
  • structured_outputs
  • tool_choice
  • tools

Priser

Inmatning / 1M token$0.750
Utdata / 1M tokens$4.50
Cacheläsning / 1M$0.075
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $18.75 · Med promptcachning $16.39

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.002264

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
4.00 s
Utdatahastighet
169 tok/s
p95 TTFT
6.52 s
Felfrekvens
0%

Offentliga benchmarks

56.1
AA Coding
Bättre än 70% av jämförda modeller
#34 av 123
40.0
AA Intelligence
Bättre än 66% av jämförda modeller
#42 av 125
49.5
AA Math
Bättre än 25% av jämförda modeller
#61 av 81
GPQA Diamond
87.5
Humanity's Last Exam
26.6
IFBench
73.3
Long-Context Recall
69.3
MMLU-Pro
58.5 index
SciCode
49.9
tau_banking
21.4
TerminalBench Hard
52.3
terminalbench_v2_1
59.2
τ²-Bench
83.3
Källa: artificialanalysis.ai

Så jämför den sig

GPT-5.4 MiniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$0.75$21.00$60.00$5.00
Output $/M$4.50$168.00$270.00$30.00
Kontext400K400K1.1M
Kvalitet8/1010/1010/1010/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden per token för GPT‑5.4 Mini på OrcaRouter?
OrcaRouter fakturerar till leverantörens taxa utan påslag: $0.75 per 1M inmatningstoken och $4.50 per 1M utmatningstoken. Inmatningstoken inkluderar fil- och bildtoken; utmatningstoken räknar all genererad text.
Vad är kontextfönstret och maximal utdata?
GPT‑5.4 Mini stöder en kontextfönster på 400 000 tokens och en maximal utmatning på 128 000 tokens. Kontexten inkluderar både in- och utmatningstokens.
Vilka är de viktiga styrkorna hos GPT‑5.4 Mini?
Styrkor inkluderar ett stort kontext på 400K, hög resonemangsprestanda (GPQA Diamond 87.5), multimodal inmatning (fil, bild, text) och en hög utmatningsgräns (128K). Den balanserar kapacitet och kostnad.
Hur står sig GPT‑5.4 Mini jämfört med GPT‑4o?
GPT‑5.4 Mini har ett större kontextfönster (400K vs 128K) och högre maximal utdata (128K vs 4K‑16K typiskt). Prissättningen är annorlunda: $0.75/$4.50 vs GPT‑4o's $2.50/$10 per 1M tokens. Prestandamätningar gynnar GPT‑5.4 Mini när det gäller resonemang.
Lagrar eller kommer OrcaRouter åt mina data när jag använder denna modell?
OrcaRouter vidarebefordrar förfrågningar direkt till OpenAI utan att cachelagra eller lagra innehåll utöver vad som är nödvändigt för routing och fakturering. Se OrcaRouter's integritetspolicy för detaljer. OpenAI's policyer för datahantering gäller.
Hur anropar jag GPT‑5.4 Mini via ett OpenAI‑kompatibelt API?
Ställ in base_url till https://api.orcarouter.ai/v1, använd modell-ID "openai/gpt-5.4-mini" och ange din OrcaRouter-API-nyckel. Alla standardparametrar för OpenAI-chattkomplettering fungerar. Ett Python-exempel finns i API-avsnittet.
Vad är latensen för GPT‑5.4 Mini?
Latens beror på in-/utdatastorlek och OpenAIs infrastruktur. För korta prompts (10K in, 500 ut) förvänta dig under 5 sekunder. För långa utdata minskar streaming upplevd latens. OrcaRouter tillför försumbar överhead (<50ms).
Kan jag använda GPT‑5.4 Mini för bildförståelse?
Ja, den accepterar bild- och filinmatningar tillsammans med text. Bildtokens räknas enligt OpenAIs tokeniseringsregler. Modellen kan beskriva, analysera eller svara på frågor om visuellt innehåll.

Bädda in denna badge

OpenAI: GPT-5.4 Mini$0.75/M in4000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-5.4-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-5.4-mini.svg" alt="OpenAI: GPT-5.4 Mini på OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-5.4 Mini](https://www.orcarouter.ai/embed/openai/gpt-5.4-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-5.4-mini)

Modellkort som data

GET /api/public/models/openai/gpt-5.4-miniÖppna