GPT-4o-mini

openai/gpt-4o-mini
VisiAlatJSON
oleh OpenAI · 2024-07-18

GPT-4o mini adalah model terbaru OpenAI setelah [GPT-4 Omni](/models/openai/gpt-4o), yang mendukung input teks dan gambar dengan output teks. Sebagai model kecil mereka yang paling canggih, harganya berkali-kali lipat lebih terjangkau...

ctx128K token
Output maks16.4K
Masukantext + image + file
Keluarantext
p50 TTFT4.23 s
INPUT$0.15/ 1M token
OUTPUT$0.60/ 1M token
p50 TTFT4.23 s7h
p95 TTFT10.00 s7h
LALU LINTAS9.6Mtoken / 7h

GPT-4o-mini adalah varian yang lebih kecil dan lebih cepat dari model GPT-4o milik OpenAI, dioptimalkan untuk biaya komputasi yang lebih rendah namun tetap mempertahankan kemampuan multimodal. Model…

Apa itu GPT-4o-mini?

Siapa yang seharusnya menggunakan GPT-4o-mini?

Bagaimana arsitektur model ini berbeda dari GPT-4o?

Modalitas input apa yang didukung?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Harga

Input / 1M token$0.150
Output / 1M token$0.600
Baca cache / 1M$0.075
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $2.85 · Dengan cache prompt $2.59

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000303

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
4.23 s
Kecepatan output
870 tok/s
p95 TTFT
10.00 s
Tingkat kesalahan
0.30%

Benchmark publik

11.4
AA Coding
Lebih baik dari 7% model yang dibandingkan
#114 dari 123
6.9
AA Intelligence
Lebih baik dari 3% model yang dibandingkan
#119 dari 125
14.7
AA Math
Lebih baik dari 2% model yang dibandingkan
#78 dari 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Sumber: artificialanalysis.ai

Perbandingan

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$0.15$21.00$60.00$5.00
Output $/M$0.60$168.00$270.00$30.00
Konteks128K400K1.1M
Kualitas2/1010/1010/1010/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya untuk menggunakan GPT-4o-mini melalui OrcaRouter?
Token input berbiaya $0.15 per 1M, token output berbiaya $0.60 per 1M, persis sesuai dengan tarif OpenAI tanpa markup.
Apa yang dimaksud dengan jendela konteks dari GPT-4o-mini?
Jendela konteks adalah 128.000 token, dan output maksimum adalah 16.384 token.
Apa saja kekuatan utama dari GPT-4o-mini?
Ini menggabungkan input multimodal (teks, gambar, berkas), jendela konteks yang besar, inferensi cepat, dan biaya rendah untuk berbagai macam tugas.
Bagaimana perbandingan GPT-4o-mini dengan GPT-4o?
GPT-4o-mini kira-kira 94% lebih murah dalam harga token tetapi mungkin kurang akurat dalam penalaran kompleks dan generasi kreatif. Pada MATH-500, skornya 78.9 dibandingkan dengan skor GPT-4o yang lebih tinggi.
Apakah OrcaRouter mencatat atau menyimpan prompt saya?
OrcaRouter tidak mencatat atau menyimpan prompt Anda; semua data diteruskan ke OpenAI. Rujuk kebijakan penggunaan data OpenAI untuk penanganan mereka.
Bagaimana cara memanggil GPT-4o-mini melalui API OrcaRouter?
Gunakan endpoint yang kompatibel dengan OpenAI di https://api.orcarouter.ai/v1 dengan model id "openai/gpt-4o-mini". Sertakan kunci API OrcaRouter Anda.
Bisakah GPT-4o-mini memproses teks dan gambar dalam permintaan yang sama?
Ya, ini menerima teks, gambar, dan file secara bersamaan dalam konteks token 128K.
Berapa kecepatan/latensi dari GPT-4o-mini?
Latensi umumnya rendah—token pertama biasanya di bawah satu detik untuk prompt yang moderat—tetapi bervariasi tergantung pada panjang konteks dan beban API. Streaming mengurangi latensi yang dirasakan.

Sematkan lencana ini

OpenAI: GPT-4o-mini$0.15/M in4232ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini di OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

Kartu model sebagai data

GET /api/public/models/openai/gpt-4o-miniBuka