Kartu judul untuk perbandingan GPT-5.3 Codex Spark versus GPT-5.6 Sol, menampilkan dua kartu membulat: kartu kiri berlabel GPT-5.3 Codex Spark dengan ikon petir, bertuliskan pratinjau riset 1.000+ tok/s dengan spanduk bertuliskan belum ada harga API publik, dan kartu kanan berlabel GPT-5.6 Sol dengan ikon perisai, bertuliskan flagship $5 / $30 dengan spanduk bertuliskan API dapat dipanggil hari ini.
Guides & Insights

GPT-5.3 Codex Spark vs GPT-5.6 Sol: Permainan Kecepatan OpenAI Belum Ada di API (Untuk Saat Ini)

Penulis

Elias Hawthorne

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

GPT-5.3 Codex Spark adalah model coding tercepat yang pernah dirilis — sebuah pratinjau riset yang menghasilkan lebih dari 1.000 token per detik pada silikon Cerebras dan menyelesaikan pengeditan kode hingga 15x lebih cepat daripada versi penuh GPT-5.3 Codex, klaim vendor. Inilah bagian yang dikubur oleh sebagian besar liputan: ini bukan produk API umum. Tidak ada harga API publik, akses terbatas untuk pelanggan ChatGPT Pro melalui aplikasi Codex dan CLI, dan tidak tersedia di OrcaRouter. Dua model coding yang benar-benar dapat Anda panggil melalui satu endpoint saat ini adalah GPT-5.3 Codex dengan harga $1.75 per juta input dan $14.00 per juta output, dan GPT-5.6 Sol dengan harga $5.00 / $30.00 — dan perbandingan antara pratinjau kecepatan dan model unggulan itulah yang memberi tahu Anda apakah Spark layak ditunggu.

Garis waktunya menjelaskan kebingungan ini. GPT-5.3 Codex, model coding agenik OpenAI, tersedia di API pada Februari 2026; varian Spark menyusul di bulan yang sama sebagai pratinjau riset yang secara langsung menyasar coding interaktif, tempat milidetik antara penekanan tombol dan respons lebih berarti daripada skor tolok ukur. Lima bulan kemudian OpenAI merilis keluarga GPT-5.6 — Sol, Terra, dan Luna — dan GPT-5.6 Sol, model unggulan $5 / $30 yang dirilis 9 Juli 2026, adalah model yang membuat sebagian besar kesenjangan kecepatan tidak lagi relevan. Ini bukan pertarungan antara dua rival; ini adalah pertarungan antara pratinjau riset dan model unggulan yang hadir setelahnya.

Apa sebenarnya GPT-5.3 Codex Spark itu

GPT-5.3 Codex Spark adalah model pertama OpenAI yang dirancang untuk pengodean real-time, serta pencapaian publik pertama dalam kemitraan Januari 2026 dengan produsen chip Cerebras. Model ini berjalan pada Cerebras Wafer Scale Engine 3, chip seukuran piring makan dengan empat triliun transistor, yang memungkinkannya menghindari kemacetan komunikasi kluster GPU yang mendominasi latensi pada inferensi biasa. Di samping chip tersebut, OpenAI memangkas overhead per perjalanan bolak-balik sekitar 80%, overhead per token sekitar 30%, dan waktu hingga token pertama sekitar 50% melalui koneksi WebSocket persisten serta perubahan pada Responses API — jalur WebSocket diaktifkan secara default untuk Spark.

Trade-off-nya gamblang. Pada benchmark rekayasa perangkat lunak agentik yang dikutip OpenAI, Spark berada jauh di bawah GPT-5.3 Codex versi penuh — 58,4% berbanding 77,3% di Terminal-Bench 2.0, keduanya dilaporkan vendor — karena secara bawaan ia memakai gaya kerja ringan yang membuat pengeditan minimal dan terarah, serta tidak otomatis menjalankan tes kecuali Anda meminta secara eksplisit. Ini adalah model berkonteks 128K dan khusus teks, yang menempatkannya jauh di belakang model flagship saat ini dalam hal kapasitas. Kecepatan adalah produknya, dan produknya adalah pratinjau.

The OrcaRouter model page for openai/gpt-5.6-sol, showing the GPT-5.6 Sol header with Vision, Tools, and JSON badges, the 1.05M-token context window, a 128K max output, the p50 TTFT figure, and the flagship description covering deep reasoning and long-horizon agentic workflows.

Situasi harga: tidak ada harga API, dan apa yang dikatakan para pelacak.

{{1}}OpenAI belum mengumumkan harga API untuk GPT-5.3 Codex Spark.{{/1}} {{2}}Saat peluncuran, tersedia untuk pelanggan ChatGPT Pro melalui aplikasi Codex, Codex CLI, dan ekstensi VS Code,{{/2}} {{3}}dengan akses API hanya ditawarkan kepada mitra desain terpilih,{{/3}} {{4}}dan memiliki rate limit tersendiri, bukan dihitung terhadap penggunaan standar.{{/4}} {{5}}Setengah tahun kemudian, ringkasan jujur itu masih berlaku.{{/5}} {{6}}Beberapa pelacak harga pihak ketiga kini mencantumkan $1,75 / $14,00 per juta baris untuk Spark — identik dengan GPT-5.3 Codex versi lengkap —{{/6}} {{7}}tetapi OpenAI belum membuat pengumuman ketersediaan umum,{{/7}} {{8}}dan angka di pelacak bukanlah angka yang bisa Anda pakai untuk membeli.{{/8}} {{9}}Anggaplah semua harga Spark belum terkonfirmasi sampai OpenAI mengatakan sebaliknya.{{/9}}

Apa yang dapat Anda beli hari ini, dengan harga yang dipublikasikan:

GPT-5.3 Codex — $1.75 per juta input, $14.00 per juta output, input cache sebesar $0.175. Jendela konteks 400K dengan batas output 128K. Model coding agenik OpenAI, tersedia di API publik sejak Februari 2026.

GPT-5.6 Sol — $5.00 per juta input dan $30.00 per juta output untuk permintaan hingga 32K token input, naik menjadi $10 / $45 di atas itu; input cache $0.50, penulisan cache $6.25. Konteks sekitar 1.05M token dengan output 128K, input teks plus gambar plus file. Produk unggulan OpenAI, dirilis 9 Juli 2026.

Keduanya berada di OrcaRouter pada harga daftar vendor dengan markup 0% — baris $1,75 / $14 dan baris $5 / $30 adalah harga di sini, bukan versi pengecer. Potongan harga penyedia sudah aktif di sisi ini pada hari yang sama vendor melakukannya, karena OrcaRouter meneruskan harga daftar alih-alih menandai ulang.

The OrcaRouter model page for openai/gpt-5.3-codex, showing the GPT-5.3-Codex header with Vision, Tools, JSON, and Reasoning badges, the 400K-token context window, the $1.75 per million input and $14.00 per million output pricing, and an OpenAI-compatible code snippet pointing at the OrcaRouter base URL.

GPT-5.3 Codex Spark vs GPT-5.6 Sol, dimensi demi dimensi

Kecepatan — Spark pada 1.000+ token per detik di perangkat keras Cerebras (dilaporkan vendor), itulah alasan utama ia ada; output terukur GPT-5.6 Sol di OrcaRouter selama 7 hari terakhir sekitar 244 token per detik. Tidak mendekati — dan itu bukan keseluruhan ceritanya.

Harga — Spark tidak memiliki harga API publik; GPT-5.6 Sol seharga $5 / $30 pada tingkat dasar, $10 / $45 di atas 32K token input.

Konteks — Spark pada 128K, hanya teks; GPT-5.6 Sol sekitar 1.05M dengan masukan teks, gambar, dan file.

Coding agentik — Spark mencetak 58,4% pada Terminal-Bench 2.0 (dilaporkan vendor); GPT-5.6 Sol mencatat skor AA Coding 77,4, yang diukur secara independen oleh Artificial Analysis, menempatkannya di peringkat #2 dari 132 model.

Gaya kerja — Spark membuat suntingan minimal dan melewatkan uji coba secara bawaan; GPT-5.6 Sol adalah andalan agen penuh dengan penalaran dan penggunaan alat.

Akses — Spark adalah pratinjau riset ChatGPT Pro; GPT-5.6 Sol adalah model API publik dengan harga yang dipublikasikan.

Jika yang Anda inginkan hanyalah draf pertama yang cepat dari sebuah suntingan kecil, desain Spark memang ideal. Jika Anda menginginkan agen yang membaca repositori, merencanakan perubahan, menjalankan pengujian, dan mengulangi hingga lulus, Spark tidak berusaha menjadi seperti itu — dan skor AA Coding 77,4 milik Sol adalah angka yang harus dipertimbangkan dibandingkan dengan pratinjau yang tidak memiliki skor sama sekali.

A three-column comparison scoreboard for GPT-5.3 Codex Spark, GPT-5.3 Codex, and GPT-5.6 Sol: Spark shows no public API price, a 128K context, 1,000+ tokens per second vendor-reported, Terminal-Bench 2.0 of 58.4 percent, text-only input, and Pro-only preview access; GPT-5.3 Codex shows $1.75/$14, a 400K context, about 73 tokens per second, Terminal-Bench 2.0 of 77.3 percent, text plus image plus file input, and public API access; GPT-5.6 Sol shows $5/$30, a 1.05M context, about 244 tokens per second, an AA Coding score of 77.4, text plus image plus file input, and public API access.

Realita routing: Anda tidak harus memilih secara membabi buta.

Ini adalah salah satu pertandingan di mana lapisan routing mengubah keputusan. Kedua model yang dapat dipanggil tersedia di OrcaRouter dengan harga daftar vendor masing-masing dan markup 0% — openai/gpt-5.3-codex di $1,75 / $14 dan openai/gpt-5.6-sol di $5 / $30 — sehingga Anda dapat menjalankan beban kerja yang sama melalui keduanya dengan satu kunci dan membiarkan lalu lintas Anda sendiri yang memutuskan, alih-alih mempercayai narasi vendor mana pun. DSL routing membuat hal itu praktis: aturan failover di mana pekerjaan agen berbentuk coding berjalan di GPT-5.3 Codex dan panggilan sulit berkonteks panjang meningkat ke GPT-5.6 Sol, diukur per-tugas pada data Anda sendiri.

Tiga kekhasan OrcaRouter membuat ini lebih murah daripada alternatifnya. Pertama, markup $0 per token — Anda membayar harga daftar penyedia, tanpa biaya tambahan. Kedua, BYOK — bawa kunci penyedia Anda yang sudah ada dan vendor menagih Anda secara langsung, sehingga tidak ada kumpulan kredit prabayar dan tidak ada faktur yang digelembungkan router yang harus direkonsiliasi. Ketiga, endpoint-nya adalah kompatibel dengan OpenAI: arahkan klien chat/completions atau Responses Anda yang sudah ada ke URL dasar OrcaRouter dan kode yang sama tetap berfungsi, dengan 200+ model di belakang satu endpoint untuk saat Anda melebihi lini satu vendor. Lapisan guardrails di depan endpoint itu adalah alasan lain mengapa keinginan untuk mencoba pratinjau penelitian aman untuk ditunda — sampai Spark memiliki API publik dan SLA, jawaban produksi adalah model yang diterbitkan, dan lapisan routing menjaga model tersebut pada harga daftar dengan failover otomatis sehingga lonjakan batas kecepatan tidak menghentikan pipeline.

Ketika Spark adalah jawaban yang salah

Batasan yang jujur, karena desain Spark adalah kompromi yang sebaiknya tidak membuat Anda tersandung. Jika pekerjaan Anda adalah pengodean agen jangka panjang — tugas yang perlu memahami seluruh repositori, menjaga rencana di banyak giliran, dan memverifikasi perubahannya sendiri — pengaturan default-nya yang menerapkan edit minimal dan tanpa menjalankan tes adalah jebakan, dan konteks 128K yang hanya teks tidak akan cukup untuk menampung repositori tersebut. Jika Anda membutuhkan gambar atau file di dalam prompt, ia tidak dapat menerimanya. Jika Anda membutuhkan harga yang bisa Anda ramalkan atau SLA yang bisa Anda andalkan, ia tidak memiliki keduanya. Dan jika beban kerja Anda adalah pipeline batch dengan throughput tinggi, 1.000 token per detik tidak masalah; biaya per token dan throughput yang penting, dan hal-hal itu lebih menguntungkan GPT-5.3 Codex yang lebih murah.

Juga perlu menyebutkan apa yang tidak kami hosting: GPT-5.3 Codex Spark tidak ada di OrcaRouter, karena tidak ada API publik untuk dirutekan. Kami tidak berpura-pura sebaliknya, dan langkah perencanaan yang jujur adalah membangun di atas model yang ada — GPT-5.3 Codex untuk pekerjaan agen berbentuk coding dengan harga $1,75 / $14, GPT-5.6 Sol untuk panggilan agen multimodal berkonteks panjang yang sulit dengan harga $5 / $30 — dan memperlakukan Spark sebagai pratinjau untuk dipantau, bukan ketergantungan untuk dipertaruhkan pada pipeline.

Intinya

GPT-5.3 Codex Spark adalah pratinjau riset paling menarik yang dirilis OpenAI tahun ini, dan ini belum menjadi keputusan produksi. Keputusan produksi — yang memiliki harga terpublikasi, tolok ukur yang dapat Anda verifikasi, dan API yang merespons — adalah GPT-5.3 Codex untuk pekerjaan agen berbentuk pengodean dan GPT-5.6 Sol untuk panggilan terberat, keduanya pada satu endpoint dengan harga daftar dan markup 0%. Ketika Spark benar-benar mencapai API publik, hampir dapat dipastikan ia akan berada di balik endpoint yang sama, dan peralihannya hanya perubahan nama model, bukan migrasi. Sampai saat itu, ini adalah alasan untuk terus mengamati — dan cara tercepat untuk bersiap adalah dengan menghubungkan model-model yang dapat dipanggil pada kunci yang sudah Anda miliki.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

providers@orcarouter.ai

Gabung komunitas kami

Discordsupport@orcarouter.aiXGitHubYouTube