GPT-4o-mini Search Preview

openai/gpt-4o-mini-search-preview
JSON
oleh OpenAI · 2025-03-12

GPT-4o mini Search Preview adalah model khusus untuk pencarian web di Chat Completions. Model ini dilatih untuk memahami dan menjalankan kueri pencarian web.

ctx128K token
Output maks16.4K
Masukantext
Keluarantext
p50 TTFT2.00 s
INPUT$0.15/ 1M token
OUTPUT$0.60/ 1M token
p50 TTFT2.00 s7h
p95 TTFT3.48 s7h
LALU LINTAS17token / 7h

GPT-4o-mini Search Preview adalah varian dari model GPT-4o-mini milik OpenAI yang dilengkapi dengan kemampuan pencarian web bawaan. Model ini dirancang untuk memberikan jawaban yang menggabungkan…

Apa itu GPT-4o-mini Search Preview?

Siapa yang harus menggunakan model ini?

Spesifikasi utama

Bagaimana cara kerja pratinjau pencarian?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini-search-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • max_tokens
  • response_format
  • stream
  • structured_outputs
  • web_search_options

Harga

Input / 1M token$0.150
Output / 1M token$0.600
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $2.85

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000303

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
2.00 s
Kecepatan output
Mengumpulkan…
p95 TTFT
3.48 s
Tingkat kesalahan
0%

Benchmark publik

Sumber: Design Arena

Perbandingan

GPT-4o-mini Search PreviewGPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$0.15$21.00$60.00$5.00
Output $/M$0.60$168.00$270.00$30.00
Konteks128K400K1.1M
Kualitas2/1010/1010/1010/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya untuk menggunakan GPT-4o-mini Search Preview di OrcaRouter?
Harga adalah $0.15 per juta token masukan dan $0.60 per juta token keluaran, ditagih sesuai tarif penyedia dengan markup nol. Anda membayar persis seperti yang dikenakan OpenAI, tanpa biaya tambahan.
Apa itu jendela konteks dan panjang output maksimum?
Jendela konteks adalah 128,000 token. Panjang output maksimum adalah 16,384 token. Model hanya menerima input teks.
Apa keunggulan utama dari GPT-4o-mini Search Preview?
Kekuatannya meliputi pencarian web bawaan untuk informasi terkini, jendela konteks besar, inferensi cepat dibandingkan dengan GPT-4o, dan biaya rendah. Ini ideal untuk aplikasi yang membutuhkan data terkini tanpa API pencarian terpisah.
Bagaimana perbandingannya dengan GPT-4o-mini dasar?
Keduanya memiliki harga dan spesifikasi yang identik, kecuali varian Search Preview dapat melakukan pencarian web. Model dasar hanya mengandalkan data pelatihannya. Pilih Search Preview jika Anda membutuhkan informasi langsung; jika tidak, model dasar menawarkan performa serupa dengan harga yang sama.
Apakah OrcaRouter melatih data saya?
OrcaRouter tidak menggunakan data pelanggan untuk pelatihan. Penanganan data mengikuti kebijakan OpenAI dan OrcaRouter. Biasanya, data tidak digunakan untuk meningkatkan model kecuali secara eksplisit diikutsertakan. Lihat kebijakan privasi OrcaRouter untuk detailnya.
Bagaimana cara memanggil model melalui API OrcaRouter?
Gunakan URL dasar https://api.orcarouter.ai/v1 dengan klien yang kompatibel dengan OpenAI. Atur parameter model menjadi "openai/gpt-4o-mini-search-preview". Sertakan kunci API OrcaRouter Anda di header Authorization. Semua parameter penyelesaian obrolan standar didukung.
Jenis kueri apa yang memicu pratinjau pencarian?
Model secara otomatis memutuskan kapan harus mencari di web, biasanya untuk pertanyaan tentang peristiwa terkini, data terkini, atau informasi yang kemungkinan telah berubah sejak batas waktu pelatihannya. Anda juga dapat memintanya secara eksplisit untuk mencari topik tertentu.
Apakah ada latensi tambahan untuk pratinjau pencarian?
Ya, pengambilan web menambahkan sedikit latensi dibandingkan dengan GPT-4o-mini dasar. Waktu respons tipikal adalah beberapa detik. Anda dapat menggunakan streaming untuk menampilkan respons parsial.

Sematkan lencana ini

OpenAI: GPT-4o-mini Search Preview$0.15/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg" alt="OpenAI: GPT-4o-mini Search Preview di OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini Search Preview](https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview)

Kartu model sebagai data

GET /api/public/models/openai/gpt-4o-mini-search-previewBuka