openai/gpt-5.4-2026-03-05

openai/gpt-5.4-2026-03-05
VisiAlatJSONPenalaran
oleh openai

OpenAI GPT-5.4-2026-03-05: 1.05M konteks, 128K output, 92.0 GPQA Diamond. Input teks, gambar, file.

ctx1M token
Output maks128K
Masukantext + image + file
Keluarantext
p50 TTFT857 ms
INPUT$2.50/ 1M token
OUTPUT$15.00/ 1M token
p50 TTFT857 ms7h
p95 TTFT1.58 s7h
LALU LINTAS589token / 7h

Ini adalah model bahasa besar dari OpenAI dengan jendela konteks 1,050,000 token dan output maksimum 128,000 token. Model ini menerima masukan teks, gambar, dan file, memungkinkan pengguna untuk…

Apa itu openai/gpt-5.4-2026-03-05 dan untuk siapa?

Format input apa yang didukung?

Apakah ini mendukung prompt sistem, suhu, dan parameter lainnya?

Apa keuntungan utama dari model ini dibandingkan dengan alternatif yang lebih kecil?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="openai/gpt-5.4-2026-03-05",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • include_reasoning
  • max_completion_tokens
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stream
  • structured_outputs
  • tool_choice
  • tools

Harga

TingkatInput / 1M tokenOutput / 1M tokenBaca cache / 1M
272K$2.50$15.00$0.250
$5.00$22.50$0.500
Tingkat dipilih berdasarkan jumlah token input setiap permintaan

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $62.50 · Dengan cache prompt $54.63

Perkiraan berdasarkan harga daftar

Harga berjenjang — perkiraan ini memakai tarif jenjang dasar.

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.007542

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
857 ms
Kecepatan output
45.7 tok/s
p95 TTFT
1.58 s
Tingkat kesalahan
0%

Benchmark publik

71.1
AA Coding
Lebih baik dari 82% model yang dibandingkan
#24 dari 138
39.0
AA Intelligence
Lebih baik dari 82% model yang dibandingkan
#25 dari 141
GPQA Diamond
92.0
Humanity's Last Exam
43.7
IFBench
73.9
Long-Context Recall
82.0
SciCode
56.6
tau_banking
39.6
TerminalBench Hard
57.6
terminalbench_v2_1
78.3
τ²-Bench
87.1
Sumber: artificialanalysis.ai

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News0 sebutan · 7 hr

Perbandingan

openai/gpt-5.4-2026-03-05GPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$2.50$21.00$60.00$5.00
Output $/M$15.00$168.00$270.00$30.00
Konteks1.1M400K1.1M
Kualitas5/1010/1010/1010/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya untuk menggunakan openai/gpt-5.4-2026-03-05?
Harga tidak diungkapkan secara publik dalam fakta yang disediakan. Untuk tarif per-token saat ini, lihat dasbor OrcaRouter atau hubungi dukungan mereka. Biaya kemungkinan akan lebih tinggi daripada model yang lebih kecil karena konteks dan kemampuan output yang besar.
Berapa ukuran jendela konteksnya?
Jendela konteks adalah 1.050.000 token. Ini mencakup semua token masukan dari teks, gambar, dan berkas. Output maksimum adalah 128.000 token.
Apa kelebihan utama dari model ini?
Kekuatan termasuk jendela konteks yang sangat besar untuk memproses seluruh dokumen atau percakapan panjang, input multimodal (teks, gambar, file), panjang output yang tinggi, dan skor GPQA Diamond yang kuat sebesar 92.0 yang menunjukkan penalaran tingkat pascasarjana.
Bagaimana perbandingannya dengan GPT-4o?
Model ini memiliki jendela konteks 8 kali lebih besar (1,05M vs 128K) dan output 8 kali lebih besar (128K vs 16K). Skornya juga lebih tinggi pada GPQA Diamond (92 vs ~80). GPT-4o mungkin lebih murah dan lebih cepat untuk tugas-tugas pendek.
Apakah ia menangani gambar dan file?
Ya. Modalitas input meliputi teks, gambar, dan file. Anda dapat mengirim permintaan dengan gambar (URL atau base64) dan file (PDF, Word, dll.) beserta teks.
Bagaimana cara memanggilnya dari kode saya?
Gunakan API yang kompatibel dengan OpenAI dari OrcaRouter pada base_url https://api.orcarouter.ai/v1 dengan ID model "openai/gpt-5.4-2026-03-05". Gunakan pustaka klien OpenAI apa pun dengan base URL yang dimodifikasi dan kunci API OrcaRouter Anda.
Apa yang terjadi pada data saya ketika saya menggunakan model ini di OrcaRouter?
Kebijakan penanganan data bergantung pada ketentuan OrcaRouter dan kebijakan OpenAI. Fakta yang diberikan tidak menyebutkan detail retensi data atau privasi. Hubungi OrcaRouter untuk praktik pemrosesan data dan privasi mereka.
Apakah ini cocok untuk digunakan dalam produksi?
Ya, tetapi evaluasi latensi dan biaya untuk beban kerja spesifik Anda. Konteks yang besar dapat menyebabkan respons yang lebih lambat dan tagihan yang lebih tinggi. Uji dengan sampel representatif sebelum penerapan penuh.
Bisakah saya melakukan streaming output?
Ya. Atur parameter 'stream' menjadi true dalam panggilan API. Model akan mengirim Server-Sent Events saat token dihasilkan, seperti streaming OpenAI.
Berapa panjang output maksimum?
Output maksimum adalah 128.000 token. Tetapkan parameter 'max_tokens' hingga 128.000. Model akan berhenti menghasilkan ketika mencapai batas tersebut atau urutan penghentian.

Sematkan lencana ini

openai/gpt-5.4-2026-03-05$2.50/M in857ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-5.4-2026-03-05" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-5.4-2026-03-05.svg" alt="openai/gpt-5.4-2026-03-05 di OrcaRouter" /> </a>
Markdown [![openai/gpt-5.4-2026-03-05](https://www.orcarouter.ai/embed/openai/gpt-5.4-2026-03-05.svg)](https://www.orcarouter.ai/models/openai/gpt-5.4-2026-03-05)

Kartu model sebagai data

GET /api/public/models/openai/gpt-5.4-2026-03-05Buka