Kartu judul hero untuk artikel 'September Platform Day OpenAI', dengan subjudul 'GPT-Live-1 hadir di API, Agents API dibuka dalam beta', membawa lencana bertuliskan 'Kedua pengumuman bertanggal 10 September 2026' dan tiga kartu bertuliskan 'GPT-Live-1 di API: $0,05 per menit suara, endpoint Live Sessions, satu ID model', 'Agents API: beta publik, harness Codex, sandbox yang dihosting atau bawa sendiri' dan 'Mengapa ini penting: model menjadi komponen yang Anda pilih, harness menjadi produk yang Anda sewa', di atas strip footer bertuliskan 'Angka suara dilaporkan OpenAI dan belum direproduksi; harga Agents API bersifat pass-through.' Logo OrcaRouter dikompositkan di sudut kanan bawah.
Guides & Insights

Hari Platform September OpenAI: GPT-Live-1 Hadir di API saat API Agents Dibuka dalam Beta

Penulis

Elias Hawthorne

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Dua hal meninggalkan platform OpenAI pada 10 September 2026, dan yang lebih senyap memiliki radius ledakan yang lebih besar. GPT-Live-1 — model suara dupleks penuh yang telah berjalan di dalam ChatGPT sejak 8 Juli — kini dapat dipanggil oleh pengembang dengan tarif $0,05 per menit suara. Di sampingnya, dan jauh lebih jarang disebut dalam liputan, Agents API memasuki beta publik: harness yang sama yang menjalankan Codex, diekspos sebagai produk yang dihosting dengan sandbox terkelola. Yang satu adalah suara yang lebih baik. Yang lainnya adalah OpenAI menjual hal yang dulunya menjadi bagian tersulit dalam membangun agen.

Keduanya dibaca dari sumber-sumber primer untuk tulisan ini: pengumuman Agents API dari Ope​nAI, pos komunitas pengembangnya yang memperkenalkan GPT-Live-1 di API, dan dokumentasi pengembang untuk keduanya. Jika suatu angka berasal dari Ope​nAI dan bukan dari evaluator luar, angka itu dilabeli demikian di bawah ini — dan satu angka memang berasal dari luar, yang sedikit mengubah ceritanya.

A two-column scoreboard titled 'September 10, 2026 — what Ope​nAI shipped'. The left column, labelled GPT-Live-1 in the API, reads 'What it is: full-duplex voice model', 'Access: Live Sessions API, one model ID', 'Price: $0.05 per voice minute', 'Status: generally available since Sept 10, 2026', 'Independent score: 69.8% on the Artificial Analysis Speech to Speech Index', 'Catch: delegates its thinking to a backend model'. The right column, labelled Agents API, reads 'What it is: hosted agent runtime', 'Access: public beta, Codex harness', 'Price: no API fee; sandbox time is billed', 'Status: public beta since Sept 10, 2026', 'Evidence: Ope​nAI documentation only, no independent evaluation', 'Catch: US-only data residency, no Zero Data Retention'. The footer reads 'GPT-Live-1 voice benchmarks Ope​nAI-reported and unreproduced; the AA index figure is independently run.' The OrcaRouter logo is composited in the bottom-right corner.

Artificial Analysis mulai menerbitkan Speech to Speech Index tahun ini, dan GPT-Live-1 memiliki baris di dalamnya: 69,8%, rata-rata berbobot untuk penalaran ucapan, kinerja agentic, preferensi arena, dan keberhasilan tugas. Itu menempatkannya di peringkat ketujuh dari sebelas model yang dinilai — di belakang GPT-Realtime-2.1 pada 73,9%, yaitu model yang digantikannya, dan di belakang Gr​ok Voice Think Fast 2.0 pada 79,0%. Papan skor independen dan tabel tolok ukur milik Ope​nAI sendiri tidak menceritakan kisah yang sama, dan keduanya benar.

Apa yang sudah dirilis, sesuai urutan yang akan mengubah arsitektur Anda

• Suara — GPT-Live-1 kini tersedia di API sebagai gpt-live-1, dengan tarif $0.05 per menit penggunaan suara, ditagih per detik, sementara model penalaran backend ditagih secara terpisah sesuai tarifnya sendiri.

• Agents — Agents API berada dalam beta publik. OpenAI mengatakan tidak ada biaya tambahan untuk API itu sendiri; Anda membayar untuk token model, alat, dan waktu kontainer sandbox yang dihosting.

• Sandbox — OpenAI kini menghosting lingkungan eksekusi, menggunakan kembali infrastruktur sandbox yang sama seperti Codex dan ChatGPT, dapat dikonfigurasi dengan file, paket, skill, dan plugin.

• Lingkungan — selain sandbox milik Ope​nAI sendiri, tim dapat mengarahkan agen ke infrastruktur mereka sendiri atau ke vendor sandbox pihak ketiga dalam daftar mitra beta.

Rilis suara adalah cerita tentang model. Agents API adalah cerita tentang platform, dan cerita platform-lah yang diam-diam mengarahkan ulang basis kode.

The Agents API: agen dalam satu POST

Panggilan utamanya adalah POST /v1/agents/sessions, dikirim dengan Ope​nAI-Beta: agents=v1 header, dan tawarannya adalah bahwa tugas, model, alat, dan lingkungan sudah cukup untuk mendapatkan kembali agen yang berjalan. SDK mencakup Python, TypeScript/JavaScript, Go, Java, dan Ruby.

Yang membuatnya lebih dari sekadar pembungkus adalah bahwa OpenAI mengoperasikan harness tersebut, bukan sekadar merilisnya. Harness AgentKit bersifat open source dan dapat diperiksa, tetapi salinan yang berjalan adalah milik OpenAI — pemadatan konteks di seluruh sesi panjang, pencarian alat, pemanggilan alat secara programatik, dukungan MCP, fungsi kustom, pencarian web bawaan, dan orkestrasi subagen dengan konkurensi yang dapat dikonfigurasi. Kemampuan harness yang diberi versi hadir bersamaan dengan peluncuran model, dan itulah komitmen yang menarik: perancah bergerak dengan tempo yang sama seperti model.

Bagi siapa pun yang telah menghabiskan seperempat tahun untuk memelihara sebuah loop — logika percobaan ulang, pemangkasan konteks, perutean alat, fan-out subagen yang selalu membocorkan state — itulah produk yang sebenarnya. Bukan pemanggilan model. Melainkan perpipaan di sekitarnya yang tidak lagi Anda tulis.

Sandbox yang dihosting adalah bagian yang disertai tagihan

Agen yang mengeksekusi kode memerlukan tempat untuk mengeksekusinya, dan versi beta ini menghadirkan jawaban Ope​nAI sendiri: sandbox terkelola yang menjalankan kode, bekerja dengan file dan menghasilkan artefak, dapat dikonfigurasi dengan paket, keterampilan, dan plugin. Pengembang yang sudah memiliki lingkungan eksekusi yang diperkuat tidak dipaksa untuk menggunakannya — bring-your-own-infrastructure dan serangkaian mitra sandbox yang disebutkan namanya sama-sama ada di versi beta.

Dua catatan operasional layak dicatat sebelum Anda membangun di atasnya. Residensi data pada versi beta hanya untuk AS, dan Zero Data Retention tidak didukung. Untuk beban kerja yang diregulasi, dua hal itu menentukan apakah ini jalur pilot atau jalur produksi, dan itulah detail yang cenderung baru terungkap belakangan.

GPT-Live-1 di API: penagihan tarif tetap per menit adalah perubahan yang sesungguhnya

Model suara itu sendiri bukan hal baru — ia menggantikan Advanced Voice Mode di dalam ChatGPT pada 8 Juli — tetapi bentuk komersialnya baru. Di bawah lini Realtime, audio diukur dalam token, yang berarti memperkirakan biaya panggilan memerlukan pemodelan konsumsi audio: berapa token yang dikonsumsi per detik keheningan, bagaimana penelpon yang bicara bersamaan dengan agen mengubah panjang output. Tarif tetap $0,05 per menit suara menyederhanakan itu menjadi sekadar perkalian. Satu jam sambungan terbuka tanpa putus biayanya $3,00. Rata-rata empat menit untuk seribu panggilan sehari sekitar $200 sehari.

Sesi berjalan dari endpoint Live Sessions dengan satu ID model dan tanpa snapshot bertanggal untuk dipin. Dokumentasi mencakup WebRTC, WebSockets, dan teleponi/SIP sebagai jalur koneksi, dan quickstart yang dipublikasikan membangun jalur WebRTC. Penagihan memiliki dua meter, dan hanya satu di antaranya adalah suara: setiap panggilan penalaran yang didelegasikan, pemanggilan alat, dan pencarian web ditagih dengan tarif normal model backend.

Arsitekturnya adalah delegasi. GPT-Live-1 menangani percakapan — berkali-kali dalam satu detik memutuskan apakah akan terus mendengarkan, berhenti sejenak, menyela, atau mengalihkan pekerjaan — dan meneruskan apa pun yang memerlukan penalaran sungguhan melintasi batas asinkron ke backend terpisah, yang tetap bekerja sementara percakapan lisan berlanjut. Dokumentasi mendefinisikan dua mode: delegasi Responses, di mana Ope​nAI memanggil model Responses yang didukung untuk Anda dan menyediakan konteks percakapan, serta delegasi klien, di mana aplikasi Anda sendiri menyediakan backend dan tetap memegang kendali atas eksekusi, konteks, dan hasil mana yang mencapai lapisan suara. Dalam contoh Responses yang dipublikasikan, backend tersebut adalah GPT-5.6 Terra, yang disebutkan dalam objek delegasi bersama instruksi dan alatnya sendiri. Pada peluncuran konsumen bulan Juli, modelnya adalah GPT-5.5; tulisan-tulisan komunitas sejak itu mengarah ke GPT-6 Astra.

A screenshot of Ope​nAI's developer documentation page 'Agents' under the API section, headed 'Choose a runtime, connect tools, and manage multi-step work', showing a routing row reading 'Run an agent with the Codex harness managed by Ope​nAI — Agents API', and a comparison table with columns Agents API, Agents SDK and Responses API whose rows read 'Where the agent runs: Ope​nAI runs a managed Codex harness', 'State between tasks: saved session configuration, turns, and items' and 'Execution environment: Ope​nAI hosted sandbox, self-hosted sandbox, or no sandbox'.

Setiap angka utama untuk lapisan suara adalah milik Ope​nAI sendiri dan, pada saat penulisan ini, belum direproduksi secara independen oleh siapa pun: 80,1% pada interaktivitas Full Duplex Bench v1.5 versus 45,4% untuk GPT-Realtime-2.1, latensi pergantian giliran 0,798 detik versus 1,41 detik, keberhasilan pemanggilan alat 87%, dan tingkat kelulusan 32% pada evaluasi dukungan suara perbankan versus 12,4% untuk model yang digantikannya. Pasangan terakhir itulah yang jujur — peningkatan besar, tetapi tetap sistem yang gagal pada sekitar dua pertiga alur kerja yang diatur regulasi. Bukti pelanggan pihak ketiga ada tetapi minim dan berkepentingan sendiri: Yelp untuk reservasi telepon, EliseAI, dan platform pembelajaran Speak melaporkan hampir 80% lebih sedikit interupsi dibandingkan stack berbasis giliran sebelumnya.

Hasil independen ini kurang menguntungkan, dan layak diletakkan di samping daftar di atas, bukan di bawahnya. Pada Artificial Analysis Speech to Speech Index — satu skor komposit untuk penalaran ucapan, performa agentik, preferensi arena, dan keberhasilan tugas — GPT-Live-1 berada di 69,8%, di bawah 73,9% milik GPT-Realtime-2.1 dan jauh di bawah 79,0% milik Gr​ok Voice Think Fast 2.0. Baca keduanya bersama-sama dan bentuk produknya menjadi jelas: Ope​nAI membangun mekanisme percakapan terbaik yang tersedia dan tidak membangun agen suara terbaik, karena penalarannya didelegasikan ke model yang dinilai secara terpisah oleh indeks tersebut.

A screenshot of the Artificial Analysis Speech to Speech Index chart, updated September 2026, ranking eleven speech models by a weighted average of speech reasoning, agentic performance, arena preference and task success rate. Bars run left to right: Grok Voice Think Fast 2.0 at 79.0%, GPT-Realtime-2.1 at 73.9%, GPT-Realtime-2 at 73.6%, Grok Voice Think Fast at 72.3%, Gemini 3.1 Flash Live at 71.5%, GPT-Live-1 mini at 70.3%, GPT-Live-1 at 69.8%, Qwen-Audio-Omni at 66.8%, RealTime Omni at 64.2%, Qwen 3.x Omni at 63.9% and Gemini 2.5 Flash at 52.6%. Companion charts show time to first audio, where GPT-Live-1 sits mid-pack at 0.78 seconds, and cost per hour of input audio, where GPT-Live-1 is $4.42 against GPT-Realtime-2.1 at $10.75.

Dua pengumuman itu adalah satu pengumuman

Jika dibaca bersama, rilis-rilis ini menggambarkan reorganisasi yang sama dari dua arah. Agents API memindahkan loop, sandbox, dan manajemen konteks ke dalam produk yang dihosting. GPT-Live-1 memindahkan permukaan percakapan ke front end tipis yang mendelegasikan pemikirannya ke tempat lain. Pada keduanya, model berhenti menjadi hal yang Anda bangun di sekitarnya dan menjadi komponen yang Anda pilih — dan pada keduanya, pilihan itu adalah baris konfigurasi, bukan komitmen arsitektural.

Itulah tepatnya celah yang ditempati lapisan perutean. OrcaRouter tidak menyediakan gpt-live-1: endpoint Live Sessions hanya milik Ope​nAI, dan kami tidak merutekan sedikit pun darinya. Bagian delegasi adalah cerita yang berbeda. Backend tempat lapisan suara menyerahkan pekerjaan berbicara dalam Responses API, dan itu adalah panggilan model normal — model yang disebutkan oleh contoh Ope​nAI sendiri, GPT-5.6 Terra, tersedia melalui OrcaRouter dengan harga daftar Ope​nAI sebesar $2.00 per juta token masukan dan $12.00 per juta token keluaran, dengan endpoint Responses yang diekspos. Delegasi klien melangkah lebih jauh: ini memungkinkan aplikasi Anda menyediakan backend sepenuhnya, yang berarti model di balik suara bisa berupa endpoint apa pun yang Anda kendalikan. Hal yang sama berlaku untuk slot model Agents API: harness-nya milik Ope​nAI, tetapi model di dalamnya adalah pilihan yang Anda pertahankan, dan sekitar 190 model dari sebelas penyedia hulu berada di belakang satu kunci dengan harga daftar penyedia tanpa markup tambahan.

Secara konkret, tiga hal mengikuti dari itu. Backend dapat di-A/B pada lalu lintas langsung hanya dengan mengedit satu baris, dan dari situlah Anda mengetahui apakah reasoner murah sudah cukup baik sebelum menetapkan saluran telepon untuknya. Failover dapat berada di bawah model delegasi, sehingga sore buruk di sisi hulu tidak ikut menjatuhkan percakapan. Dan sebuah tugas dapat dijalankan terhadap beberapa backend dalam satu panggilan melalui DSL routing, atau dijawab oleh panel model sekaligus dengan fusi model — berguna begitu keluaran agen harus dipercaya, bukan sekadar dihasilkan.

Apa yang tidak ada di kedua rilis itu

• Tidak ada input gambar atau video pada GPT-Live-1 — antarmuka suara multimodal yang dimiliki mode ChatGPT lama masih belum ditangani.

• Tidak ada output terstruktur pada lapisan suara, sehingga argumen alat yang divalidasi skema harus ditegakkan di model backend.

• Tidak ada akses tingkat Gratis ke GPT-Live-1, dan batas lajunya dinyatakan dalam sesi bersamaan — 25 pada Tier 1, meningkat menjadi 500 pada Tier 5.

• Tidak ada Zero Data Retention dan tidak ada residensi data di luar AS dalam beta Agents API.

• Tidak ada reproduksi independen atas angka benchmark GPT-Live-1 mana pun.

Taruhan yang dibuat Ope​nAI pada 10 September adalah bahwa para pengembang ingin membeli harness dan memilih otak secara terpisah. Paruh pertama dari itu kini menjadi pos tersendiri. Paruh kedua adalah tempat tekanan kompetitif dua belas bulan ke depan akan bermuara — karena harness yang dihosting dengan slot model yang dapat ditukar hanya sebaik model yang dapat Anda masukkan ke dalamnya, dan saat ini itulah satu bagian dari stack yang tidak dikendalikan Ope​nAI sendirian.

Bagian delegasi adalah cerita yang berbeda — backend tempat lapisan suara menyerahkan pekerjaan adalah panggilan model biasa, dan GPT-5.6 Terra tersedia melalui OrcaRouter dengan harga daftar Ope​nAI dengan endpoint Responses yang diekspos.