GPT-4o Search Preview adalah model khusus untuk pencarian web di Chat Completions. Model ini dilatih untuk memahami dan menjalankan kueri pencarian web.
GPT-4o Search Preview adalah model teks-only dari OpenAI, yang ditawarkan sebagai bagian dari keluarga GPT-4o. Model ini dapat diakses melalui API OrcaRouter di URL dasar https://api.orcarouter.ai/v1…
Model ini sangat cocok untuk tugas-tugas yang memerlukan penalaran terhadap urutan teks yang panjang, seperti peringkasan, tanya-jawab dari dokumen besar, dan menghasilkan respons yang koheren dalam dialog yang panjang. Mengingat label pratinjau pencariannya, kemungkinan model ini menangani agregasi hasil pencarian dan pengambilan konteks secara efektif. Jendela konteksnya yang besar memungkinkan analisis seluruh laporan, buku, atau basis kode dalam satu perintah.
Keterbatasan utama adalah kurangnya dukungan multimodal. Model ini tidak dapat memproses input gambar, audio, atau video, yang membatasi penggunaannya dalam aplikasi seperti tanya-jawab visual atau transkripsi ucapan. Selain itu, tidak ada skor benchmark resmi atau angka latensi yang tersedia, sehingga sulit untuk membandingkan kinerja pada tugas-tugas tertentu. Model ini mungkin tidak dioptimalkan untuk tugas-tugas di luar penalaran berbasis teks.
Untuk tugas dengan kebutuhan konteks kecil (misalnya, klasifikasi sederhana, pembuatan teks pendek), model yang lebih murah dan lebih cepat seperti GPT-3.5 Turbo mungkin lebih hemat biaya. Jika input multimodal diperlukan, pertimbangkan model GPT-4o standar. Untuk beban kerja teks saja dengan volume sangat tinggi, evaluasi apakah penetapan harga zero-markup di OrcaRouter membenarkan biaya per token dibandingkan dengan penyedia lain.
Tidak. GPT-4o Search Preview hanya menerima input teks. Ini tidak mendukung gambar, audio, atau video. Ini merupakan pembeda utama dari model GPT-4o standar yang bersifat multimodal. Pengguna yang memerlukan pemahaman visual atau auditori harus memilih model yang berbeda.
OpenAI belum mempublikasikan skor tolok ukur apa pun secara khusus untuk varian GPT-4o Search Preview. Karena merupakan bagian dari keluarga GPT-4o, varian ini mungkin memiliki karakteristik kinerja yang sama dengan GPT-4o pada tugas pemahaman bahasa, tetapi tidak ada angka resmi yang disediakan. Pengguna disarankan untuk melakukan evaluasi sendiri pada kumpulan data yang representatif guna menentukan kesesuaian.
Angka latensi dan throughput tidak didokumentasikan secara publik untuk GPT-4o Search Preview. Sebagai varian dari GPT-4o, kemungkinan memiliki waktu respons yang mirip dengan model GPT-4o standar, tetapi kinerja aktual tergantung pada faktor-faktor seperti konkurensi permintaan, jumlah token, dan infrastruktur OrcaRouter. Pengguna sebaiknya melakukan benchmark menggunakan beban kerja mereka sendiri.
Selain tidak adanya dukungan multimodal, model ini tidak memiliki skor tolok ukur yang dipublikasikan dan jaminan latensi. Sebutan pratinjau pencariannya menunjukkan optimasi untuk tugas-tugas terkait pencarian, namun sejauh mana optimasi ini tidak disebutkan. Pengguna tidak boleh berasumsi bahwa model ini akan mengungguli GPT-4o standar pada tugas non-pencarian. Selain itu, tidak ada jaminan harga yang lebih rendah atau efisiensi yang lebih baik dibandingkan varian GPT-4o lainnya.
Harga adalah $2.50 per 1 juta token input dan $10.00 per 1 juta token output. OrcaRouter mengenakan biaya persis sesuai tarif penyedia tanpa markup. Tidak ada biaya tambahan yang dikenakan. Penggunaan token ditagih secara terpisah untuk input dan output. Tarif ini konsisten dengan harga standar GPT-4o OpenAI di platform mereka.
Dibandingkan dengan banyak model lainnya, GPT-4o Search Preview diposisikan pada tarif per-token premium, yang khas untuk model berkemampuan tinggi. Misalnya, GPT-3.5 Turbo jauh lebih murah. Kebijakan zero-markup di OrcaRouter memastikan pengguna membayar sama dengan penagihan langsung OpenAI, tetapi tanpa biaya tambahan. Ini dapat menguntungkan untuk aplikasi yang sensitif terhadap biaya di mana jendela konteks yang besar diperlukan.
OrcaRouter tidak secara publik mengiklankan diskon caching atau program penghematan token yang khusus untuk GPT-4o Search Preview. Pengguna ditagih berdasarkan total jumlah token input dan output yang digunakan. Untuk mengelola biaya, pertimbangkan untuk mengoptimalkan panjang prompt dan membatasi token output. Pemrosesan batch dapat meningkatkan efisiensi tetapi tidak disebutkan dalam dokumentasi yang tersedia.
Model diakses melalui API yang kompatibel dengan OpenAI milik OrcaRouter. Atur base URL ke https://api.orcarouter.ai/v1 dan sertakan ID model "openai/gpt-4o-search-preview" dalam permintaan Anda. Gunakan pustaka klien OpenAI standar (misalnya, paket Python openai) dengan kunci API OrcaRouter Anda. Contoh: openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...])
Karena API ini kompatibel dengan OpenAI, parameter standar tersedia: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, dan lainnya. Parameter max_tokens tidak boleh melebihi batas output 16.384 token. Model ini tidak mendukung input multimodal, jadi messages hanya boleh berisi konten teks.
Untuk beralih dari varian GPT-4o lain (misalnya, "gpt-4o" atau "gpt-4o-mini"), cukup ubah model ID dalam panggilan API Anda menjadi "openai/gpt-4o-search-preview". Pastikan permintaan Anda hanya berisi konten teks, karena varian ini tidak menerima gambar atau audio. Sesuaikan parameter max_tokens jika diperlukan. Tidak diperlukan perubahan kode lainnya.
Autentikasi ditangani melalui kunci API. Anda memerlukan kunci API OrcaRouter, yang diteruskan dalam header permintaan (biasanya sebagai "Authorization: Bearer <your_key>"). Dapatkan kunci dari platform OrcaRouter. Autentikasi yang sama digunakan untuk semua model yang dapat diakses melalui gateway.
GPT-4o Search Preview hanya teks, sementara GPT-4o standar mendukung teks, gambar, dan audio. Varian pratinjau pencarian mungkin memiliki pengoptimalan mendasar untuk kueri terkait pencarian, tetapi hal tersebut tidak dirinci secara publik. Harga identik: $2,50/M input dan $10/M output. Keduanya menggunakan jendela konteks 128k dan output maksimal 16k. Trade-off utama adalah dukungan modalitas versus kinerja pencarian yang mungkin lebih terspesialisasi.
GPT-4 Turbo (konteks 128k, teks+gambar) adalah pendahulu dari GPT-4o. GPT-4o Search Preview lebih baru dan merupakan bagian dari keluarga GPT-4o, yang secara umum menawarkan penalaran dan efisiensi yang lebih baik dibandingkan GPT-4 Turbo. Namun, dukungan multimodal di GPT-4 Turbo terbatas pada gambar, sedangkan GPT-4o sepenuhnya multimodal. Search Preview menghilangkan keunggulan tersebut. Harga untuk GPT-4 Turbo biasanya $10/M masukan dan $30/M keluaran, menjadikan Search Preview lebih murah (jika menggunakan tarif yang diberikan). Perhatikan bahwa harga GPT-4 Turbo tidak disediakan di sini; ini adalah pengetahuan umum.
Model lain yang berfokus pada pencarian (misalnya, sistem generasi berbasis pengambilan khusus) mungkin menawarkan pencarian web bawaan atau pengambilan file. GPT-4o Search Preview tidak menyertakan fungsionalitas pencarian sendiri; ini adalah model bahasa yang dapat memproses hasil pencarian yang disediakan dalam prompt. Jika Anda memerlukan pengambilan eksternal, gabungkan model ini dengan API pencarian. Jendela konteksnya yang besar membuatnya cocok untuk mengagregasi banyak hasil pencarian dalam satu permintaan.
Trade-off utama adalah antara dukungan modalitas dan potensi optimasi tugas pencarian. Anda mendapatkan jendela konteks besar dan harga tanpa markup, tetapi kehilangan kemampuan untuk memproses gambar atau audio. Pada tolok ukur yang diketahui, kinerja mungkin setara dengan GPT-4o, tetapi tidak ada skor spesifik yang tersedia. Untuk tugas hanya teks yang memanfaatkan konteks 128k, model ini adalah pilihan hemat biaya dalam keluarga GPT-4o.
Kompatibel OpenAI — pakai SDK Anda yang sekarang
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Input / 1M token | $2.50 |
| Output / 1M token | $10.00 |
| Mata uang | USD |
Perkiraan berdasarkan harga daftar
Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.
GET /api/public/models/openai/gpt-4o-search-previewBuka @misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview