
Hari Platform September OpenAI: GPT-Live-1 Hadir di API saat API Agents Dibuka dalam Beta
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiBARUOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleBARUGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenBARUQwen: Qwen3.8 Max (0902)2026-09-0240Kecerdasan72Koding
- anthropicBARUAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0340Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2134Kecerdasan69Koding
Dua hal meninggalkan platform OpenAI pada 10 September 2026, dan yang lebih senyap memiliki radius ledakan yang lebih besar. GPT-Live-1 — model suara dupleks penuh yang telah berjalan di dalam ChatGPT sejak 8 Juli — kini dapat dipanggil oleh pengembang dengan tarif $0,05 per menit suara. Di sampingnya, dan jauh lebih jarang disebut dalam liputan, Agents API memasuki beta publik: harness yang sama yang menjalankan Codex, diekspos sebagai produk yang dihosting dengan sandbox terkelola. Yang satu adalah suara yang lebih baik. Yang lainnya adalah OpenAI menjual hal yang dulunya menjadi bagian tersulit dalam membangun agen.
Keduanya dibaca dari sumber-sumber primer untuk tulisan ini: pengumuman Agents API dari OpenAI, pos komunitas pengembangnya yang memperkenalkan GPT-Live-1 di API, dan dokumentasi pengembang untuk keduanya. Jika suatu angka berasal dari OpenAI dan bukan dari evaluator luar, angka itu dilabeli demikian di bawah ini — dan satu angka memang berasal dari luar, yang sedikit mengubah ceritanya.

Artificial Analysis mulai menerbitkan Speech to Speech Index tahun ini, dan GPT-Live-1 memiliki baris di dalamnya: 69,8%, rata-rata berbobot untuk penalaran ucapan, kinerja agentic, preferensi arena, dan keberhasilan tugas. Itu menempatkannya di peringkat ketujuh dari sebelas model yang dinilai — di belakang GPT-Realtime-2.1 pada 73,9%, yaitu model yang digantikannya, dan di belakang Grok Voice Think Fast 2.0 pada 79,0%. Papan skor independen dan tabel tolok ukur milik OpenAI sendiri tidak menceritakan kisah yang sama, dan keduanya benar.
Apa yang sudah dirilis, sesuai urutan yang akan mengubah arsitektur Anda
• Suara — GPT-Live-1 kini tersedia di API sebagai gpt-live-1, dengan tarif $0.05 per menit penggunaan suara, ditagih per detik, sementara model penalaran backend ditagih secara terpisah sesuai tarifnya sendiri.
• Agents — Agents API berada dalam beta publik. OpenAI mengatakan tidak ada biaya tambahan untuk API itu sendiri; Anda membayar untuk token model, alat, dan waktu kontainer sandbox yang dihosting.
• Sandbox — OpenAI kini menghosting lingkungan eksekusi, menggunakan kembali infrastruktur sandbox yang sama seperti Codex dan ChatGPT, dapat dikonfigurasi dengan file, paket, skill, dan plugin.
• Lingkungan — selain sandbox milik OpenAI sendiri, tim dapat mengarahkan agen ke infrastruktur mereka sendiri atau ke vendor sandbox pihak ketiga dalam daftar mitra beta.
Rilis suara adalah cerita tentang model. Agents API adalah cerita tentang platform, dan cerita platform-lah yang diam-diam mengarahkan ulang basis kode.
The Agents API: agen dalam satu POST
Panggilan utamanya adalah POST /v1/agents/sessions, dikirim dengan OpenAI-Beta: agents=v1 header, dan tawarannya adalah bahwa tugas, model, alat, dan lingkungan sudah cukup untuk mendapatkan kembali agen yang berjalan. SDK mencakup Python, TypeScript/JavaScript, Go, Java, dan Ruby.
Yang membuatnya lebih dari sekadar pembungkus adalah bahwa OpenAI mengoperasikan harness tersebut, bukan sekadar merilisnya. Harness AgentKit bersifat open source dan dapat diperiksa, tetapi salinan yang berjalan adalah milik OpenAI — pemadatan konteks di seluruh sesi panjang, pencarian alat, pemanggilan alat secara programatik, dukungan MCP, fungsi kustom, pencarian web bawaan, dan orkestrasi subagen dengan konkurensi yang dapat dikonfigurasi. Kemampuan harness yang diberi versi hadir bersamaan dengan peluncuran model, dan itulah komitmen yang menarik: perancah bergerak dengan tempo yang sama seperti model.
Bagi siapa pun yang telah menghabiskan seperempat tahun untuk memelihara sebuah loop — logika percobaan ulang, pemangkasan konteks, perutean alat, fan-out subagen yang selalu membocorkan state — itulah produk yang sebenarnya. Bukan pemanggilan model. Melainkan perpipaan di sekitarnya yang tidak lagi Anda tulis.
Sandbox yang dihosting adalah bagian yang disertai tagihan
Agen yang mengeksekusi kode memerlukan tempat untuk mengeksekusinya, dan versi beta ini menghadirkan jawaban OpenAI sendiri: sandbox terkelola yang menjalankan kode, bekerja dengan file dan menghasilkan artefak, dapat dikonfigurasi dengan paket, keterampilan, dan plugin. Pengembang yang sudah memiliki lingkungan eksekusi yang diperkuat tidak dipaksa untuk menggunakannya — bring-your-own-infrastructure dan serangkaian mitra sandbox yang disebutkan namanya sama-sama ada di versi beta.
Dua catatan operasional layak dicatat sebelum Anda membangun di atasnya. Residensi data pada versi beta hanya untuk AS, dan Zero Data Retention tidak didukung. Untuk beban kerja yang diregulasi, dua hal itu menentukan apakah ini jalur pilot atau jalur produksi, dan itulah detail yang cenderung baru terungkap belakangan.
GPT-Live-1 di API: penagihan tarif tetap per menit adalah perubahan yang sesungguhnya
Model suara itu sendiri bukan hal baru — ia menggantikan Advanced Voice Mode di dalam ChatGPT pada 8 Juli — tetapi bentuk komersialnya baru. Di bawah lini Realtime, audio diukur dalam token, yang berarti memperkirakan biaya panggilan memerlukan pemodelan konsumsi audio: berapa token yang dikonsumsi per detik keheningan, bagaimana penelpon yang bicara bersamaan dengan agen mengubah panjang output. Tarif tetap $0,05 per menit suara menyederhanakan itu menjadi sekadar perkalian. Satu jam sambungan terbuka tanpa putus biayanya $3,00. Rata-rata empat menit untuk seribu panggilan sehari sekitar $200 sehari.
Sesi berjalan dari endpoint Live Sessions dengan satu ID model dan tanpa snapshot bertanggal untuk dipin. Dokumentasi mencakup WebRTC, WebSockets, dan teleponi/SIP sebagai jalur koneksi, dan quickstart yang dipublikasikan membangun jalur WebRTC. Penagihan memiliki dua meter, dan hanya satu di antaranya adalah suara: setiap panggilan penalaran yang didelegasikan, pemanggilan alat, dan pencarian web ditagih dengan tarif normal model backend.
Arsitekturnya adalah delegasi. GPT-Live-1 menangani percakapan — berkali-kali dalam satu detik memutuskan apakah akan terus mendengarkan, berhenti sejenak, menyela, atau mengalihkan pekerjaan — dan meneruskan apa pun yang memerlukan penalaran sungguhan melintasi batas asinkron ke backend terpisah, yang tetap bekerja sementara percakapan lisan berlanjut. Dokumentasi mendefinisikan dua mode: delegasi Responses, di mana OpenAI memanggil model Responses yang didukung untuk Anda dan menyediakan konteks percakapan, serta delegasi klien, di mana aplikasi Anda sendiri menyediakan backend dan tetap memegang kendali atas eksekusi, konteks, dan hasil mana yang mencapai lapisan suara. Dalam contoh Responses yang dipublikasikan, backend tersebut adalah GPT-5.6 Terra, yang disebutkan dalam objek delegasi bersama instruksi dan alatnya sendiri. Pada peluncuran konsumen bulan Juli, modelnya adalah GPT-5.5; tulisan-tulisan komunitas sejak itu mengarah ke GPT-6 Astra.

Setiap angka utama untuk lapisan suara adalah milik OpenAI sendiri dan, pada saat penulisan ini, belum direproduksi secara independen oleh siapa pun: 80,1% pada interaktivitas Full Duplex Bench v1.5 versus 45,4% untuk GPT-Realtime-2.1, latensi pergantian giliran 0,798 detik versus 1,41 detik, keberhasilan pemanggilan alat 87%, dan tingkat kelulusan 32% pada evaluasi dukungan suara perbankan versus 12,4% untuk model yang digantikannya. Pasangan terakhir itulah yang jujur — peningkatan besar, tetapi tetap sistem yang gagal pada sekitar dua pertiga alur kerja yang diatur regulasi. Bukti pelanggan pihak ketiga ada tetapi minim dan berkepentingan sendiri: Yelp untuk reservasi telepon, EliseAI, dan platform pembelajaran Speak melaporkan hampir 80% lebih sedikit interupsi dibandingkan stack berbasis giliran sebelumnya.
Hasil independen ini kurang menguntungkan, dan layak diletakkan di samping daftar di atas, bukan di bawahnya. Pada Artificial Analysis Speech to Speech Index — satu skor komposit untuk penalaran ucapan, performa agentik, preferensi arena, dan keberhasilan tugas — GPT-Live-1 berada di 69,8%, di bawah 73,9% milik GPT-Realtime-2.1 dan jauh di bawah 79,0% milik Grok Voice Think Fast 2.0. Baca keduanya bersama-sama dan bentuk produknya menjadi jelas: OpenAI membangun mekanisme percakapan terbaik yang tersedia dan tidak membangun agen suara terbaik, karena penalarannya didelegasikan ke model yang dinilai secara terpisah oleh indeks tersebut.

Dua pengumuman itu adalah satu pengumuman
Jika dibaca bersama, rilis-rilis ini menggambarkan reorganisasi yang sama dari dua arah. Agents API memindahkan loop, sandbox, dan manajemen konteks ke dalam produk yang dihosting. GPT-Live-1 memindahkan permukaan percakapan ke front end tipis yang mendelegasikan pemikirannya ke tempat lain. Pada keduanya, model berhenti menjadi hal yang Anda bangun di sekitarnya dan menjadi komponen yang Anda pilih — dan pada keduanya, pilihan itu adalah baris konfigurasi, bukan komitmen arsitektural.
Itulah tepatnya celah yang ditempati lapisan perutean. OrcaRouter tidak menyediakan gpt-live-1: endpoint Live Sessions hanya milik OpenAI, dan kami tidak merutekan sedikit pun darinya. Bagian delegasi adalah cerita yang berbeda. Backend tempat lapisan suara menyerahkan pekerjaan berbicara dalam Responses API, dan itu adalah panggilan model normal — model yang disebutkan oleh contoh OpenAI sendiri, GPT-5.6 Terra, tersedia melalui OrcaRouter dengan harga daftar OpenAI sebesar $2.00 per juta token masukan dan $12.00 per juta token keluaran, dengan endpoint Responses yang diekspos. Delegasi klien melangkah lebih jauh: ini memungkinkan aplikasi Anda menyediakan backend sepenuhnya, yang berarti model di balik suara bisa berupa endpoint apa pun yang Anda kendalikan. Hal yang sama berlaku untuk slot model Agents API: harness-nya milik OpenAI, tetapi model di dalamnya adalah pilihan yang Anda pertahankan, dan sekitar 190 model dari sebelas penyedia hulu berada di belakang satu kunci dengan harga daftar penyedia tanpa markup tambahan.
Secara konkret, tiga hal mengikuti dari itu. Backend dapat di-A/B pada lalu lintas langsung hanya dengan mengedit satu baris, dan dari situlah Anda mengetahui apakah reasoner murah sudah cukup baik sebelum menetapkan saluran telepon untuknya. Failover dapat berada di bawah model delegasi, sehingga sore buruk di sisi hulu tidak ikut menjatuhkan percakapan. Dan sebuah tugas dapat dijalankan terhadap beberapa backend dalam satu panggilan melalui DSL routing, atau dijawab oleh panel model sekaligus dengan fusi model — berguna begitu keluaran agen harus dipercaya, bukan sekadar dihasilkan.
Apa yang tidak ada di kedua rilis itu
• Tidak ada input gambar atau video pada GPT-Live-1 — antarmuka suara multimodal yang dimiliki mode ChatGPT lama masih belum ditangani.
• Tidak ada output terstruktur pada lapisan suara, sehingga argumen alat yang divalidasi skema harus ditegakkan di model backend.
• Tidak ada akses tingkat Gratis ke GPT-Live-1, dan batas lajunya dinyatakan dalam sesi bersamaan — 25 pada Tier 1, meningkat menjadi 500 pada Tier 5.
• Tidak ada Zero Data Retention dan tidak ada residensi data di luar AS dalam beta Agents API.
• Tidak ada reproduksi independen atas angka benchmark GPT-Live-1 mana pun.
Taruhan yang dibuat OpenAI pada 10 September adalah bahwa para pengembang ingin membeli harness dan memilih otak secara terpisah. Paruh pertama dari itu kini menjadi pos tersendiri. Paruh kedua adalah tempat tekanan kompetitif dua belas bulan ke depan akan bermuara — karena harness yang dihosting dengan slot model yang dapat ditukar hanya sebaik model yang dapat Anda masukkan ke dalamnya, dan saat ini itulah satu bagian dari stack yang tidak dikendalikan OpenAI sendirian.
Bagian delegasi adalah cerita yang berbeda — backend tempat lapisan suara menyerahkan pekerjaan adalah panggilan model biasa, dan GPT-5.6 Terra tersedia melalui OrcaRouter dengan harga daftar OpenAI dengan endpoint Responses yang diekspos.
