GPT-4o ("o" untuk "omni") adalah model AI terbaru OpenAI, yang mendukung input teks dan gambar dengan output teks. Ia mempertahankan tingkat kecerdasan [GPT-4 Turbo](/models/openai/gpt-4-turbo) sementara dua kali lebih...
GPT-4o adalah model bahasa besar multimodal oleh OpenAI. Ia menerima input teks, gambar, dan file, serta menghasilkan output teks. Model ini dirancang untuk pengguna yang perlu memproses konten…
GPT-4o unggul dalam penalaran multimodal, pemrosesan konteks panjang, dan pemecahan masalah matematika. Konteks 128k token memungkinkannya menyimpan dan merujuk informasi dalam jumlah besar, sehingga berguna untuk tugas-tugas seperti analisis dokumen, pembuatan kode di seluruh proyek, dan percakapan multi-putaran yang kompleks. Model ini mendapat skor 75,9 pada tolok ukur MATH-500, yang menunjukkan kemampuan kuat dalam memecahkan masalah matematika. Selain itu, kemampuannya menerima input gambar dan file berarti ia dapat bernalar tentang konten visual—seperti diagram, grafik, atau foto—dikombinasikan dengan teks. Di OrcaRouter, Anda dapat memanfaatkan kekuatan ini tanpa membayar markup apa pun di atas harga yang tercantum di OpenAI.
GPT-4o sangat efektif untuk tugas-tugas yang memerlukan pemahaman teks dan visual. Contohnya termasuk: menjawab pertanyaan tentang diagram di buku teks, mengekstrak data dari faktur yang dipindai, menghasilkan kode berdasarkan gambar wireframe, atau merangkum makalah penelitian panjang dengan gambar. Konteksnya yang besar juga membuatnya cocok untuk menganalisis seluruh basis kode atau log percakapan yang panjang. Penalaran matematis adalah keunggulan lainnya, seperti yang ditunjukkan oleh skor 75.9 pada MATH-500. Di OrcaRouter, kasus penggunaan ini mudah diimplementasikan—Anda mengirim permintaan standar yang kompatibel dengan OpenAI dengan jenis konten yang sesuai, dan model mengembalikan respons teks.
Jika tugas Anda tidak memerlukan input multimodal atau konteks besar, model yang lebih murah bisa lebih hemat biaya. Misalnya, untuk tugas klasifikasi teks sederhana, peringkasan, atau terjemahan yang sesuai dengan konteks yang lebih kecil, model seperti GPT-3.5 Turbo (dengan harga $0.50 per 1M input dan $1.50 per 1M output) jauh lebih murah. Biaya input GPT-4o adalah $2.50 per 1M token, yang lima kali lebih tinggi daripada GPT-3.5 Turbo. Jika Anda memproses volume besar data teks saja tanpa memerlukan penalaran multimodal, model yang lebih kecil dapat mengurangi biaya. OrcaRouter menawarkan berbagai model sehingga Anda dapat memilih keseimbangan harga-kinerja terbaik.
GPT-4o dirancang untuk menerima gambar dan file sebagai masukan, memungkinkannya melakukan tugas seperti menjawab pertanyaan visual, memberi keterangan gambar, dan memahami dokumen. Meskipun skor benchmark multimodal spesifik tidak disediakan dalam fakta yang tersedia, arsitektur model ini mendukung penalaran bersama atas teks dan gambar. Misalnya, ia dapat menghitung objek dalam gambar atau menginterpretasikan bagan. Model ini hanya mengeluarkan teks, bukan gambar. Di OrcaRouter, permintaan multimodal dikirim menggunakan parameter yang sama dengan API OpenAI: sertakan bagian konten image_url atau file dalam array messages. Model memproses data visual dan mengembalikan respons teks berdasarkan masukan gabungan.
GPT-4o mencapai skor 75,9 pada tolok ukur MATH-500. MATH-500 adalah bagian dari dataset MATH yang terdiri dari 500 soal matematika menantang dari berbagai topik seperti aljabar, geometri, dan kalkulus. Skor 75,9 berarti model tersebut berhasil menyelesaikan sekitar 76% dari soal-soal ini. Hal ini menunjukkan kemampuan penalaran matematika yang kuat, meskipun belum sempurna. Sebagai perbandingan, banyak model yang lebih kecil mendapat skor di bawah 50 pada tolok ukur serupa. Skor ini mencerminkan kemampuan model dalam melakukan penalaran multi-langkah dan menangani notasi matematika. Di OrcaRouter, Anda dapat menggunakan GPT-4o untuk tugas-tugas terkait matematika seperti bimbingan belajar, persiapan ujian, atau memverifikasi perhitungan.
Seperti semua model bahasa besar, GPT-4o memiliki keterbatasan. Ia dapat menghasilkan jawaban yang salah atau halusinasi, terutama pada topik dengan data pelatihan terbatas atau yang membutuhkan pengetahuan yang sangat baru (tanggal batas pelatihannya tidak diberikan dalam fakta, tetapi sebagai model OpenAI ia memiliki batas pengetahuan). Ia dapat sensitif terhadap susunan kata perintah dan mungkin kesulitan dengan instruksi yang ambigu. Meskipun nilai MATH-500-nya kuat, ia tidak sempurna dalam pembuktian matematika yang kompleks. Model ini memproses gambar tetapi tidak menghasilkan gambar. Selain itu, jendela konteks yang besar (128k token) dapat menyebabkan peningkatan penggunaan token, meningkatkan biaya jika tidak dikelola dengan hati-hati. Di OrcaRouter, Anda dapat mengurangi beberapa masalah dengan menyesuaikan parameter seperti temperature dan top_p.
Angka latensi pasti untuk GPT-4o tidak disediakan dalam fakta. Secara umum, GPT-4o adalah model besar dan akan memiliki latensi lebih tinggi dibandingkan dengan model yang lebih kecil seperti GPT-3.5 Turbo atau Llama 3.1 8B. Namun, kemungkinan besar dioptimalkan untuk inferensi yang lebih cepat daripada GPT-4 asli. Melalui OrcaRouter, Anda dapat mengharapkan waktu respons yang mirip dengan yang Anda dapatkan langsung dari OpenAI, karena platform ini merutekan permintaan tanpa pemrosesan tambahan. Untuk aplikasi real-time di mana kecepatan sangat penting, pertimbangkan untuk menggunakan model yang lebih cepat dan lebih murah untuk tugas yang lebih sederhana dan menyisihkan GPT-4o untuk kueri kompleks yang mendapatkan keuntungan dari kemampuannya.
Di OrcaRouter, GPT-4o dibanderol dengan harga persis sesuai tarif yang ditetapkan OpenAI: $2.50 per 1 juta token input dan $10.00 per 1 juta token output. Tidak ada markup sama sekali yang ditambahkan oleh OrcaRouter. Penagihan didasarkan pada jumlah token yang dibulatkan ke token bilangan bulat terdekat. Token input mencakup teks, gambar, dan file yang Anda kirim, meskipun gambar biasanya ditokenisasi dengan tarif tetap oleh model (misalnya, setiap gambar menggunakan sejumlah token tertentu). Token output adalah teks yang dihasilkan oleh model. Anda hanya dikenakan biaya untuk apa yang Anda gunakan; tidak ada biaya bulanan atau komitmen minimum. Harga yang transparan ini memungkinkan Anda untuk menganggarkan secara akurat untuk beban kerja AI Anda.
Trade-off utama adalah biaya versus kemampuan. GPT-4o berharga $2.50 untuk input dan $10 untuk output per 1 juta token. Model yang lebih murah seperti GPT-3.5 Turbo ($0.50 input, $1.50 output) atau Llama 3.1 8B lebih ekonomis untuk tugas sederhana atau volume tinggi. Namun, GPT-4o menawarkan input multimodal dan jendela konteks yang lebih besar. Jika aplikasi Anda memerlukan pemahaman gambar atau memproses dokumen yang sangat panjang, GPT-4o mungkin diperlukan meskipun biayanya lebih tinggi. Untuk tugas teks saja dengan input pendek, model yang lebih murah dapat menghemat uang. Di OrcaRouter, Anda dapat beralih antar model dengan mengubah ID model secara sederhana, sehingga Anda dapat mengoptimalkan biaya untuk setiap permintaan.
Tidak. OrcaRouter menagih GPT-4o sesuai tarif persis dari penyedia tanpa markup sama sekali. Harganya adalah $2,50 per 1 juta token input dan $10,00 per 1 juta token output. Tidak ada biaya tersembunyi, upsell, atau biaya tambahan. OrcaRouter meneruskan biaya langsung dari OpenAI. Kebijakan ini berlaku untuk semua model yang tercantum di platform. URL dasar adalah https://api.orcarouter.ai/v1 dan ID model adalah "openai/gpt-4o". Anda dapat memverifikasi harga kapan saja dengan memeriksa dasbor penggunaan Anda. Tidak ada harga berjenjang atau komitmen yang diperlukan—bayar hanya untuk token yang digunakan.
Untuk menggunakan GPT-4o melalui OrcaRouter, kirim permintaan HTTP POST ke URL dasar https://api.orcarouter.ai/v1/chat/completions. Atur parameter model menjadi "openai/gpt-4o". Permintaan Anda harus menyertakan kunci API (berikan kunci API OrcaRouter Anda di header Authorization). Badan permintaan mengikuti format completions chat standar OpenAI: array pesan dengan pasangan peran/konten, parameter opsional seperti temperature, max_tokens, top_p, dll. Untuk input multimodal, sertakan bagian konten yang memiliki tipe "text" atau "image_url" (atau file). Responsnya adalah objek JSON yang berisi completion model. Contoh perintah curl: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model":"openai/gpt-4o","messages":[{"role":"user","content":[{"type":"text","text":"What is in this image?"},{"type":"image_url","image_url":{"url":"https://example.com/image.jpg"}}]}]}'
Saat memanggil GPT-4o melalui OrcaRouter, Anda dapat menggunakan parameter yang sama seperti API OpenAI. Parameter yang umum digunakan meliputi: - **temperature** (float, 0-2): Mengontrol keacakan. Nilai yang lebih rendah seperti 0,2 membuat output lebih deterministik. - **max_tokens** (integer, default 16384): Jumlah maksimum token dalam respons. - **top_p** (float, 0-1): Parameter pengambilan sampel inti (nucleus sampling). - **frequency_penalty** dan **presence_penalty**: Mengurangi pengulangan. - **stop** (string atau array): Urutan penghentian. - **stream** (boolean): Mengaktifkan respons streaming (true/false). - **seed** (integer): Untuk pengambilan sampel deterministik. Anda juga dapat menggunakan kolom opsional "user" untuk melacak pengguna individu. Model ini mendukung pemanggilan fungsi dan penggunaan alat, meskipun tidak secara eksplisit tercantum dalam fakta. Di OrcaRouter, semua parameter standar diterima.
Migrasi sangat mudah karena OrcaRouter menawarkan endpoint yang kompatibel dengan OpenAI. Langkah-langkah: 1. Dapatkan kunci API dari OrcaRouter (daftar di situs web mereka). 2. Ubah URL dasar dari https://api.openai.com/v1 menjadi https://api.orcarouter.ai/v1. 3. Ubah ID model dari "gpt-4o" menjadi "openai/gpt-4o". 4. Gunakan format body permintaan yang sama. Tidak ada perubahan kode selain endpoint dan nama model yang diperlukan. 5. Perbarui header Authorization untuk menggunakan kunci API OrcaRouter Anda. Pengujian dengan satu permintaan disarankan. OrcaRouter menggunakan mode streaming dan non-streaming yang sama. Tidak ada perbedaan dalam cara model berperilaku, karena model OpenAI yang mendasarinya sama. Prompt dan parameter yang ada akan bekerja secara identik.
URL dasar untuk API OrcaRouter adalah https://api.orcarouter.ai/v1. ID model spesifik yang digunakan untuk GPT-4o adalah "openai/gpt-4o". String persis ini harus dimasukkan dalam parameter "model" dari permintaan. Misalnya, dalam panggilan endpoint chat completions, Anda mengatur "model": "openai/gpt-4o". OrcaRouter mendukung model ini untuk completions streaming maupun non-streaming. Jika Anda menggunakan SDK atau pustaka OpenAI yang dikonfigurasi untuk menunjuk ke URL dasar kustom, cukup atur URL dasar ke https://api.orcarouter.ai/v1 dan berikan kunci API OrcaRouter Anda. Awalan ID model "openai/" membedakannya dari model penyedia lain di OrcaRouter.
GPT-4o adalah penerus multimodal dari GPT-4 Turbo. Kedua model memiliki jendela konteks 128k. Namun, GPT-4o menambahkan dukungan input gambar dan file asli, sedangkan GPT-4 Turbo terutama hanya teks (dengan visi hanya tersedia dalam versi terpisah). GPT-4o juga memiliki output maksimal yang lebih tinggi yaitu 16,384 token dibandingkan dengan GPT-4 Turbo yang biasanya 4,096 atau 8,192. Harga berbeda: GPT-4 Turbo berharga $10.00 per 1M input dan $30.00 per 1M output, menjadikan GPT-4o jauh lebih murah ($2.50/$10.00). Skor MATH-500 sebesar 75,9 untuk GPT-4o umumnya lebih tinggi dari tolok ukur yang dilaporkan untuk GPT-4 Turbo, meskipun skor pasti Turbo tidak disebutkan dalam fakta. Di OrcaRouter, kedua model tersedia tanpa markup.
GPT-3.5 Turbo adalah model yang lebih murah dan lebih cepat, dioptimalkan untuk tugas-tugas sederhana. Jendela konteksnya adalah 16.384 token, jauh lebih kecil dibandingkan 128k milik GPT-4o. GPT-3.5 tidak mendukung input gambar—hanya teks. Harganya adalah $0,50 per 1M input dan $1,50 per 1M token output, membuatnya kira-kira 5x lebih murah untuk input dan 6,6x lebih murah untuk output dibandingkan GPT-4o. Pada tolok ukur MATH-500, GPT-3.5 Turbo biasanya mendapatkan skor yang jauh lebih rendah (angka pasti tidak diberikan). GPT-4o lebih cocok untuk penalaran kompleks, dokumen panjang, dan tugas multimodal. Gunakan GPT-3.5 Turbo untuk interaksi sederhana dengan volume tinggi. Di OrcaRouter, Anda dapat dengan mudah beralih di antara keduanya dengan mengubah ID model.
Claude 3.5 Sonnet adalah model saingan dari Anthropic. Model ini juga memiliki jendela konteks 200k (lebih besar dari 128k milik GPT-4o) dan mendukung input gambar. Harga untuk Claude 3.5 Sonnet biasanya $3,00 per 1M input dan $15,00 per 1M output, membuat GPT-4o lebih murah untuk input tetapi lebih mahal untuk output? Sebenarnya GPT-4o $2,50 input vs $3,00, jadi lebih murah; output $10 vs $15, jadi lebih murah. Pada tolok ukur, Claude 3.5 Sonnet mencapai kinerja serupa dalam matematika dan penalaran, tetapi skor pastinya bervariasi. Kedua model sama-sama kuat dalam tugas multimodal. Pilihan di antara keduanya mungkin bergantung pada karakteristik kinerja spesifik atau preferensi ekosistem. Di OrcaRouter, keduanya dapat diakses melalui format API yang sama dengan ID model yang berbeda (misalnya, "anthropic/claude-3.5-sonnet").
Llama 3.1 405B adalah model berbobot terbuka dari Meta dengan 405 miliar parameter. Model ini juga mendukung jendela konteks 128k dan input teks, namun kemampuan multimodalnya kurang jelas (mungkin tidak mendukung gambar secara native). Llama 3.1 405B tersedia melalui OrcaRouter dengan harga yang lebih rendah, biasanya sekitar $1,00 per 1M input dan $1,00 per 1M token output (perkiraan, tidak disebutkan dalam fakta). Skor tolok ukurnya pada MATH-500 tidak diberikan, tetapi kemungkinan lebih rendah dari 75,9 milik GPT-4o. GPT-4o bersifat proprietary dan menawarkan penalaran multimodal yang lebih baik di luar kotak serta potensi akurasi yang lebih tinggi pada tugas-tugas kompleks. Llama 3.1 405B adalah pilihan yang baik bagi pengguna yang menginginkan model terbuka atau perlu melakukan hosting mandiri. Di OrcaRouter, Anda dapat membandingkan kedua model secara berdampingan.
Kompatibel OpenAI — pakai SDK Anda yang sekarang
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokensnparallel_tool_callspredictionpresence_penaltyresponse_formatseedservice_tierstopstreamstructured_outputstemperaturetool_choicetoolstop_logprobstop_pweb_search_options| Input / 1M token | $2.50 |
| Output / 1M token | $10.00 |
| Baca cache / 1M | $1.25 |
| Mata uang | USD |
Perkiraan berdasarkan harga daftar
Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.
GET /api/public/models/openai/gpt-4oBuka @misc{orcarouter_gpt_4o,
title = {GPT-4o API},
author = {OpenAI},
year = {2024},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o}
}OpenAI. (2024). GPT-4o API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o