Pratinjau model GPT-4o hanya teks dengan konteks 128K, keluaran 16K, diakses melalui API OrcaRouter seharga $2.50/$10 per M token.
Model ini adalah rilis pratinjau dari OpenAI, terbatas untuk input teks saja. Model ini memiliki pengenal openai/gpt-4o-search-preview-2025-03-11 ketika diakses melalui API OrcaRouter. Model ini…
Sebagai pratinjau GPT-4o yang hanya teks, model ini unggul dalam memahami dan menghasilkan bahasa alami di berbagai bidang. Model ini dapat melakukan summarisasi dokumen, tanya jawab, penulisan kreatif, penerjemahan, dan pembuatan kode. Jendela konteks yang besar memungkinkannya mempertahankan koherensi pada bagian teks yang sangat panjang, sehingga cocok untuk tugas seperti analisis buku atau pemrosesan log yang ekstensif. Model ini mendukung pesan sistem, pengguna, dan asisten dalam format seperti obrolan. Kemampuan penalaran zero-shot dan few-shot model ini tipikal untuk model kelas GPT-4, memungkinkannya menangani instruksi kompleks tanpa penyesuaian yang ekstensif.
Jika tugas Anda tidak memerlukan kemampuan penalaran penuh dari GPT-4o, pertimbangkan untuk menggunakan model yang lebih kecil atau lebih murah dari OrcaRouter, seperti openai/gpt-4o-mini atau gpt-3.5-turbo. Contoh tugas yang lebih cocok untuk model yang lebih murah termasuk klasifikasi sederhana, pembuatan konten pendek, atau Tanya Jawab dasar dengan konteks terbatas. Biaya model pratinjau mungkin tidak sebanding untuk permintaan bervolume tinggi dan kompleksitas rendah. Selain itu, jika input multimodal diperlukan, model ini tidak dapat menangani gambar atau audio; model lain (misalnya, GPT-4o standar atau GPT-4V) akan diperlukan. Selalu evaluasi trade-off antara kualitas dan biaya per token.
Model ini diidentifikasi sebagai varian 'search-preview', tetapi tidak ada kemampuan penggunaan alat atau pencarian web spesifik yang dirinci dalam spesifikasi yang tersedia untuk umum. Model ini hanya teks dan beroperasi sebagai model bahasa standar. Pengguna tidak boleh mengasumsikan adanya fungsi pencarian atau pengambilan bawaan. Untuk generasi yang ditingkatkan, Anda dapat menerapkan pipeline retrieval-augmented generation (RAG) secara terpisah, dengan memberikan dokumen yang diambil ke dalam jendela konteks model. OrcaRouter tidak menambahkan middleware penggunaan alat; model hanya merespons berdasarkan pelatihan dan perintah yang diberikan. Versi mendatang mungkin mengubah perilaku ini, tetapi pada pratinjau saat ini, tidak ada integrasi alat yang didokumentasikan.
Sebagai pratinjau, model ini mungkin menunjukkan perilaku yang tidak terduga atau keandalan yang lebih rendah dibandingkan dengan rilis stabil. Model ini hanya berbasis teks, sehingga permintaan multimodal apa pun akan ditolak. Output maksimum 16.384 token cukup besar tetapi masih dapat memotong generasi yang sangat panjang. Batas pengetahuan dan data pelatihan model tidak ditentukan; model mungkin tidak mengetahui peristiwa yang sangat baru. Penggunaan produksi tidak disarankan karena model dapat diperbarui atau dihapus. Selain itu, latensi mungkin lebih tinggi daripada model stabil karena sifat pratinjaunya. Selalu uji secara menyeluruh sebelum menerapkan dalam skala besar.
Tidak ada skor tolok ukur khusus untuk versi pratinjau ini yang telah diberikan. Sebagai varian GPT-4o, model ini diharapkan memiliki kinerja yang serupa dengan GPT-4o standar pada tugas bahasa umum, tetapi angka pastinya tidak diungkapkan. Pengguna dapat menjalankan evaluasi mereka sendiri menggunakan kumpulan data publik. Jendela konteks yang besar memberikan keunggulan pada tolok ukur dokumen panjang, tetapi karena ini adalah pratinjau, skor mungkin berbeda dari model produksi. Untuk angka yang otoritatif, lihat laporan tolok ukur resmi OpenAI untuk GPT-4o. OrcaRouter tidak mengubah keluaran atau kinerja model.
Angka latensi dan throughput untuk model pratinjau ini belum dipublikasikan. Sebagai pratinjau, model ini mungkin lebih lambat daripada GPT-4o yang stabil karena infrastruktur eksperimental. Waktu respons bergantung pada panjang input, panjang output, dan permintaan bersamaan. OrcaRouter tidak menambahkan latensi tambahan di luar perutean API normal. Untuk memperkirakan kecepatan, pengembang dapat menjalankan permintaan sampel dengan muatan tipikal. Untuk aplikasi produksi yang memerlukan kinerja yang konsisten, pertimbangkan untuk menggunakan model gpt-4o yang stabil sebagai gantinya, kecuali jika fitur spesifik pratinjau diperlukan.
Model-model kelas GPT-4 dikenal memiliki penalaran yang kuat di berbagai domain, termasuk matematika, logika, dan inferensi akal sehat. Pratinjau ini diharapkan mewarisi kemampuan tersebut. Konteks yang besar memungkinkan penalaran rantai pemikiran (chain-of-thought) yang kompleks dalam banyak langkah tanpa kehilangan jejak bagian sebelumnya. Namun, tidak ada tolok ukur penalaran spesifik yang disediakan untuk versi yang tepat ini. Pengguna harus memvalidasi kinerja pada tugas-tugas khusus domain mereka sendiri. Model ini juga dapat menunjukkan peningkatan dalam mengikuti instruksi dibandingkan dengan versi GPT sebelumnya, tetapi sekali lagi, verifikasi independen direkomendasikan.
Selain sebagai pratinjau, model ini tidak memiliki dukungan multimodal. Model ini tidak dapat memproses gambar, audio, atau video secara langsung. Tanggal batas pengetahuannya tidak diketahui, sehingga mungkin kekurangan informasi tentang peristiwa setelah pelatihannya. Batas keluaran 16.384 token, meskipun cukup besar, tidak dapat menghasilkan teks yang sangat panjang dalam satu generasi; untuk keluaran yang lebih panjang, diperlukan prompt berulang atau pemisahan. Pratinjau ini juga mungkin memiliki tingkat kesalahan atau penolakan yang lebih tinggi untuk topik sensitif tertentu. Performa pada bahasa selain Inggris dapat bervariasi. Selalu uji pada data yang representatif sebelum penerapan.
Model ini dihargai $2.50 per 1 juta token untuk input dan $10.00 per 1 juta token untuk output. Ini adalah tarif penyedia OpenAI; OrcaRouter tidak menambahkan markup. Sebagai contoh, memproses prompt sebanyak 10,000 token dan menghasilkan 1,000 token akan memakan biaya sekitar $0.025 untuk input dan $0.01 untuk output, total $0.035. Biaya meningkat secara linear dengan penggunaan token. Tidak ada biaya tambahan untuk menggunakan OrcaRouter sebagai gateway API. Pastikan untuk memantau penggunaan untuk menghindari tagihan yang tidak terduga. Bandingkan dengan model yang lebih murah jika tugas Anda tidak memerlukan kemampuan penuh.
OrcaRouter saat ini tidak menawarkan diskon volume atau caching token untuk model ini. Semua penagihan bersifat bayar sesuai pemakaian berdasarkan penggunaan token aktual dengan tarif penyedia. Caching dari prompt atau respons tidak dilakukan oleh OrcaRouter; setiap permintaan diproses secara independen. Jika Anda memiliki throughput yang sangat tinggi, hubungi OrcaRouter untuk kemungkinan pengaturan khusus. Untuk optimalisasi biaya, pertimbangkan untuk menggunakan prompt yang lebih pendek, menggunakan ulang konteks secara efisien, atau mengelompokkan panggilan. Model tidak mendukung harga yang lebih rendah untuk cache hits karena tidak ada mekanisme caching yang diterapkan.
Pada $2.50/$10 per juta token, pratinjau ini diberi harga yang mirip dengan GPT-4o standar tetapi mungkin sedikit berbeda. Alternatif yang lebih murah termasuk openai/gpt-4o-mini (sekitar $0.15/$0.60 per juta) atau gpt-3.5-turbo (kira-kira $0.50/$1.50). Untuk tugas yang dapat mentolerir kualitas lebih rendah, model-model tersebut menawarkan penghematan yang signifikan. Biaya model pratinjau berada di ujung yang lebih tinggi dari katalog OrcaRouter. Jika Anda menggunakannya semata-mata untuk pengujian, Anda mungkin akan menimbulkan biaya sedang tergantung pada volume permintaan. Selalu evaluasi penggunaan token yang diharapkan dan bandingkan dengan peningkatan kualitas dari menggunakan model yang lebih besar.
Untuk menggunakan model ini, atur URL dasar klien API Anda ke https://api.orcarouter.ai/v1, dan tentukan ID model sebagai openai/gpt-4o-search-preview-2025-03-11. Anda harus menggunakan kunci API yang dikeluarkan oleh OrcaRouter. API ini sepenuhnya kompatibel dengan OpenAI, sehingga kode yang sudah ada yang ditulis untuk titik akhir chat completions OpenAI akan berfungsi dengan perubahan minimal. Contoh panggilan menggunakan curl: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_ORCAROUTER_KEY" -H "Content-Type: application/json" -d '{ "model": "openai/gpt-4o-search-preview-2025-03-11", "messages": [{"role": "user", "content": "Hello"}], "max_tokens": 100 }'.
Anda dapat menggunakan semua parameter penyelesaian obrolan standar yang didukung oleh OpenAI: 'messages', 'max_tokens', 'temperature', 'top_p', 'frequency_penalty', 'presence_penalty', 'stop', dan 'n'. Model ini mendukung jendela konteks 128.000 token, sehingga 'max_tokens' dapat diatur hingga 16.384. 'temperature' mengontrol keacakan; nilainya berkisar dari 0 hingga 2. 'stream' didukung untuk respons waktu nyata. OrcaRouter tidak memperkenalkan parameter tambahan. Pastikan permintaan Anda mematuhi batas token; input yang lebih panjang dari jendela konteks (termasuk respons) akan dipotong atau mengembalikan kesalahan.
Migrasi itu mudah. Ganti base URL OpenAI Anda (https://api.openai.com/v1) dengan base URL OrcaRouter (https://api.orcarouter.ai/v1). Ubah kunci API Anda menjadi kunci OrcaRouter. Perbarui field model menjadi openai/gpt-4o-search-preview-2025-03-11. Tidak ada perubahan kode lain yang diperlukan. Jika Anda menggunakan model OpenAI yang berbeda, Anda dapat terus menggunakan struktur kode yang sama. OrcaRouter melewatkan semua parameter standar. Setelah migrasi, verifikasi bahwa respons konsisten. Perhatikan bahwa penagihan akan ditangani oleh OrcaRouter, dan Anda perlu memiliki akun di sana.
OrcaRouter tidak secara publik mengungkapkan batas kecepatan spesifik untuk model pratinjau ini. Ketersediaan tergantung pada infrastruktur OpenAI dan kapasitas gateway OrcaRouter. Untuk aplikasi produksi, pertimbangkan status pratinjau model dan potensi ketidakstabilan. OrcaRouter dapat memberlakukan batas penggunaan yang wajar untuk mencegah penyalahgunaan. Anda dapat mengharapkan layanan upaya terbaik, tetapi tidak ada SLA yang disediakan. Jika Anda memerlukan throughput yang dijamin, hubungi OrcaRouter untuk opsi khusus. Model juga dapat dihapus atau diganti tanpa pemberitahuan, jadi rencanakan model cadangan.
Model standar GPT-4o (openai/gpt-4o) adalah multimodal, rilis stabil, sedangkan pratinjau ini hanya teks dan ditujukan untuk pengujian awal. Pratinjau mungkin mencakup fitur mendatang yang belum ada di versi standar, tetapi juga bisa kurang andal. Harga serupa. Model standar memiliki dukungan input yang lebih luas (gambar, audio). Jika Anda tidak memerlukan fitur pratinjau, GPT-4o standar adalah pilihan yang lebih aman. Keduanya tersedia di OrcaRouter dengan antarmuka API yang sama, sehingga memudahkan peralihan.
Gpt-4o-mini adalah model yang lebih kecil dan lebih murah, dioptimalkan untuk tugas-tugas sederhana. Harganya sekitar $0,15 per juta token input dan $0,60 per juta token output (perkiraan). Model pratinjau ini kira-kira 16 kali lebih mahal untuk input dan 16 kali lebih mahal untuk output. Model pratinjau menawarkan konteks yang lebih besar (128K vs. 128K? Sebenarnya gpt-4o-mini juga memiliki 128K, tetapi itu bisa berbeda. Kita tahu model ini memiliki 128K. Konteks Gpt-4o-mini juga 128K menurut informasi publik, tetapi kita tidak bisa berasumsi. Kita akan menyebutnya 'jendela konteks yang sebanding' tetapi perhatikan perbedaan harga.) Model ini lebih baik untuk penalaran yang kompleks, sementara gpt-4o-mini sudah cukup untuk banyak tugas standar. Pilih berdasarkan kebutuhan kualitas dan anggaran.
Model Claude (misalnya, Claude 3.5 Sonnet) menawarkan jendela konteks yang besar dan penalaran yang kuat, tetapi API mereka tidak langsung kompatibel dengan OpenAI. OrcaRouter menyediakan antarmuka terpadu untuk berbagai penyedia, namun pratinjau ini eksklusif dari OpenAI. Model Claude mungkin memiliki harga dan kekuatan yang berbeda di area seperti keamanan dan pembuatan teks bentuk panjang. Untuk perbandingan langsung, Anda perlu mengujinya pada kasus penggunaan Anda sendiri. OrcaRouter memungkinkan Anda untuk beralih antar penyedia, tetapi model pratinjau ini hanya tersedia melalui jalur OpenAI. Tidak ada perbandingan tolak ukur yang disediakan.
Kompatibel OpenAI — pakai SDK Anda yang sekarang
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview-2025-03-11",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Input / 1M token | $2.50 |
| Output / 1M token | $10.00 |
| Mata uang | USD |
Perkiraan berdasarkan harga daftar
Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.
GET /api/public/models/openai/gpt-4o-search-preview-2025-03-11Buka @misc{orcarouter_gpt_4o_search_preview_2025_03_11,
title = {openai/gpt-4o-search-preview-2025-03-11 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11}
}openai. (n.d.). openai/gpt-4o-search-preview-2025-03-11 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11