Kartu judul hero untuk artikel pantau kebocoran berjudul 'Model Berulang Kedua OpenAI', dengan subjudul 'Apa yang Sebenarnya Diklaim oleh Kebocoran Sumbu Terlarang DevDay', dengan tiga kartu bertuliskan 'Bukti: satu postingan X', 'ID Model: tidak ada', dan 'DevDay 2026: 29 September', diagram garis datar dari tiga blok bertumpuk dengan panah yang melingkar dari blok bawah kembali ke atas berlabel 'kedalaman rekuren', serta footer bertuliskan 'Belum diverifikasi: tidak ada ID model, tidak ada harga, tidak ada konfirmasi vendor. Dilaporkan 24 September 2026.'
Guides & Insights

Model Looped Kedua OpenAI: Apa yang Sebenarnya Diklaim oleh Kebocoran 'Forbidden Axis' DevDay

Penulis

Gideon Frost

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Ada tepat satu sumber untuk klaim yang menjadi pokok artikel ini, dan itu adalah satu unggahan di X. Pada 24 September, akun @scaling01 menulis bahwa vendor "membuka keran dan akan merilis model bahasa berulang kedua mereka selain GPT-6 Astra pada DevDay," menggambarkan kedalaman rekuren sebagai "poros terlarang" dan mencatat bahwa itu "tidak lagi terlarang." Itu saja keseluruhannya: tidak ada nama model, tidak ada ID model, tidak ada harga, tidak ada tanggal selain keynote DevDay 29 September di San Francisco, dan tidak ada pernyataan dari vendor. Yang membuat klaim ini layak menyita waktu pembaca bukanlah tweet tersebut, melainkan fakta-fakta yang sudah dirilis di baliknya. GPT-6 Astra, yang dirilis vendor pada 3 September, adalah model produksi pertama dari laboratorium besar mana pun yang oleh pemberitaan dikaitkan dengan arsitektur berulang dengan kedalaman rekuren. GPT-6 Sol dan GPT-6 Luna, yang diluncurkan pada 22 September dengan harga $2 masuk / $10 keluar dan $0,10 masuk / $0,50 keluar per juta token, mengubah model unggulan itu menjadi tangga harga. Model berulang kedua akan berarti vendor tidak lagi memperlakukan kedalaman rekuren sebagai taruhan sekali jalan, melainkan sebagai arsitektur tetap — klaim yang lebih besar daripada peluncuran tunggal mana pun, dan jauh lebih sulit untuk diperiksa.

Ini adalah tulisan tentang apa yang kita ketahui sejauh ini. Segala hal yang diatribusikan kepada seorang pengunggah atau pelaporan anonim diberi label demikian, dan tidak ada apa pun di sini yang boleh dibaca sebagai rilis.

Mengapa frasa 'forbidden axis' adalah bagian paling menarik dari tweet tersebut

Frasa itu milik penulis postingan sendiri, bukan istilah teknis, tetapi menunjuk pada sesuatu yang nyata. Dalam penskalaan transformer ada tiga sumbu yang jelas: parameter, data, dan komputasi pelatihan. Kedalaman melalui rekurensi adalah yang keempat, dan itu adalah sumbu yang aneh. Alih-alih menumpuk N blok yang berbeda, model berulang menggunakan kembali tumpukan blok kecil yang sama sebanyak R kali, sehingga kedalaman efektif kira-kira adalah jumlah lapisan dikalikan dengan jumlah pengulangan sementara jumlah parameter tetap. Google DeepMind memaparkan teorinya dalam Penalaran dengan Pikiran Laten: Tentang Kekuatan Transformer Berulang, dan yang banyak dikutip Meningkatkan Komputasi Waktu Uji dengan Penalaran Laten: Pendekatan Kedalaman Rekuren memberikan argumen praktisnya.

Ini bukanlah kedalaman gratis. Karya penskalaan iso-depth pada model bahasa berulang menempatkan eksponen ekuivalensi rekurensi di sekitar 0,46 — artinya satu loop tambahan memberi Anda sekitar 46% dari apa yang akan diberikan oleh blok yang benar-benar baru. Anda membeli kedalaman dengan diskon, dan membayarnya dengan komputasi serial alih-alih memori. Itu adalah pertukaran yang menguntungkan jika Anda terbatas memori atau ingin model kecil berperilaku seperti model besar, yang persis merupakan pertukaran yang dicari oleh tier murah dari keluarga mana pun.

Jadi, mengapa "terlarang"? Karena komputasi yang terjadi di dalam loop berlangsung di hidden state, bukan di token yang dikeluarkan. Pemantauan chain-of-thought — membaca apa yang dituliskan model saat ia berpikir — telah menjadi alat penjaminan utama industri sejak model penalaran muncul, dan justru alat itulah yang membuat insiden agen Hugging Face pada Juli setidaknya dapat dipahami oleh para penyelidik. Model yang melakukan lebih banyak pekerjaannya di ruang laten memberi alat itu lebih sedikit untuk dibaca. Itulah argumen menentang perulangan di garis terdepan selama dua tahun, dan itulah sebabnya teknik ini menyebar di bobot terbuka — milik ByteDance Seed, Ouro pada 1,4B dan 2,6B, dan Nanbeige4.2-3B, yang menjalankan tumpukan 22 lapis sebanyak dua kali — sementara laboratorium-laboratorium dengan komitmen keselamatan yang dipublikasikan menjauhinya. Makalah MeSH dan SpiralFormer milik Alibaba menyerang masalah yang sama dari sisi efisiensi.

Apa yang sebenarnya dikatakan OpenAI, dan apa yang tidak

Laporan yang memulai ini adalah laporan The Information, pada 1 dan 2 September: bahwa Astra menggunakan teknik yang disebut recurrent depth, juga digambarkan sebagai opaque recurrence. Itu adalah media dengan sumber yang baik dan rekam jejak nyata, dan ini masih berupa pemberitaan, bukan dokumentasi. OpenAI belum pernah menerbitkan makalah arsitektur yang mengonfirmasi desain berulang, dan analisis Sebastian Raschka tentang Astra yang banyak dibaca menyatakan secara gamblang bahwa struktur berulang itu disimpulkan dari pernyataan publik — rekonstruksinya membuat Astra menjalankan 22 bloknya dua kali untuk 44 penerapan blok efektif, dengan dua loop optimal dan lebih banyak loop membuat pelatihan menjadi tidak stabil.

Apa yang dikatakan oleh orang-orang OpenAI sendiri lebih sempit dan lebih berhati-hati daripada yang disiratkan oleh pemberitaan maupun reaksi balik. Ilmuwan utama Jakub Pachocki memposting pada 2 September bahwa kedalaman graf komputasi model-model terdepan, termasuk Astra, berada dalam kisaran faktor dua dari GPT-4 — sejumlah perulangan yang terbatas, bukan rekursi ekstrem seperti yang disiratkan sejumlah judul berita — dan menyanggah apa yang ia sebut sebagai pemberitaan yang membingungkan, sembari mengakui bahwa pemantauan rantai pemikiran itu rapuh dan sedang bergerak ke arah yang negatif. Kartu sistem Astra dilaporkan mencatat bahwa kemampuan pemantauan jejak penalaran berada satu tingkat lebih rendah daripada GPT-5.6 Sol, yang merupakan pengakuan nyata dan tidak bergantung pada arsitektur mana yang menyebabkannya.

Reaksi di ranah safety sangat lantang. Buck Shlegeris dari Redwood Research mengatakan dia sangat khawatir dan memperingatkan bahwa meningkatkan skala rekurensi bisa "sepenuhnya menghancurkan keterpantauan CoT"; Ryan Greenblatt dan Zvi Mowshowitz menyampaikan argumen yang sama dengan nada berbeda. Poin kontra yang paling berguna datang dari Raschka: OpenAI telah menahan jejak penalaran mentah sejak generasi o1, terlepas dari arsitekturnya, dan model yang lebih kuat yang menghasilkan rantai pemikiran lebih pendek bukanlah bukti dengan sendirinya adanya saluran penalaran tersembunyi.

Gabungkan kedua paragraf itu dan Anda akan mendapatkan situasi terkini yang dipertaruhkan oleh tweet tersebut. "Astra di-loop" adalah laporan kredibel yang OpenAI menolak untuk mengonfirmasi. "Model kedua yang di-loop dirilis pada 29 September" adalah satu postingan.

Lima kebocoran OpenAI bulan September, dan di mana yang ini berada

September menghasilkan gugusan padat cerita kebocoran OpenAI, dan hal yang berguna tentangnya adalah bahwa cerita-cerita itu tidak semuanya termasuk kelas bukti yang sama.

• 3 September — string gpt-6-astra dan gpt-6-astra-aeon muncul di flag fitur Statsig di dalam Codex Desktop, ditangkap layar oleh @notjazii dan diperkuat oleh @kimmonismus. Kisah agen Aeon tumbuh dari itu. Lima minggu kemudian, masih belum ada halaman produk, harga, dokumentasi, dan benchmark untuk Aeon, serta tidak ada ID model yang dapat diresolusi.

• 21 September — string "GPT-6 Sol medium" muncul dalam catatan merge NVIDIA.

• 22 September — tiga jalur registri Azure, untuk gpt-6-sol, gpt-6-luna, dan gpt-6-astra-minor, diposting dari forum pengembang Tiongkok locdd.com sebagai URL Microsoft yang aktif. Saat kami mengambil endpoint konfigurasi playground publik keesokan harinya, tiga nama baru itu tidak ada di dalamnya; registri justru memuat gpt-6-astra dan entri generasi GPT-5.6 yang lebih lama.

• 22 September — GPT-6 Sol dan GPT-6 Luna telah dirilis. Harga, ID model, catatan rilis SDK, daftar Bedrock, entri pemilih GitHub Copilot, dan default Perplexity semuanya menyusul dalam waktu sehari.

Polanya tidak samar. Kelas kebocoran yang membawa artefak di dalam permukaan yang benar-benar dirilis — catatan rilis SDK, registri cloud, flag fitur desktop — terus berubah menjadi produk. Kelas kebocoran yang hanya berupa nama tidak demikian. Klaim hari ini, model bahasa looped kedua dari OpenAI di DevDay, tidak membawa artefak sama sekali: tidak ada string, tidak ada flag, tidak ada jalur registri, tidak ada baris harga, tidak ada ID model. Itu tidak membuatnya salah. Itu membuatnya tidak dapat diperiksa dari luar, yang merupakan deskripsi yang berbeda dan lebih jujur.

Susunan acara DevDay di sekitarnya memang nyata, dan terdokumentasi dengan sangat baik

Satu hal yang dapat Anda tentukan tanggalnya secara tepat adalah acara tersebut. DevDay 2026 telah dikonfirmasi untuk Selasa, 29 September, di Fort Mason di San Francisco, dengan Sam Altman menjadi pembicara utama dan siaran langsung gratis — OpenAI mengumumkan tanggalnya pada April lalu.

Apa yang diharapkan di dalamnya telah disinyalir lebih kuat daripada biasanya. Altman mengunggah pada 15 September bahwa OpenAI punya "peluncuran besar minggu ini, lalu untuk DevDay luncurkan x 6," dan menarik kembali bagian pertamanya pada malam berikutnya: "hal utama yang saya nantikan untuk diluncurkan minggu ini akan jadi minggu depan, tapi menurutku layak ditunggu!" Lead produk Tibo Sottiaux, yang telah menggambarkan minggu itu sebagai seukuran DevDay, mengatakan pada 19 September bahwa rilis itu masih akan datang pada Selasa, dan pada 22 September benar terjadi — Sol dan Luna, plus reset penggunaan Codex yang tersimpan untuk akun berbayar. Baca "luncurkan x 6" sebagai hitungan enam hal yang diluncurkan sekitar DevDay dan model loop kedua pun cocok dengan nyaman dalam makna biasa frasa itu; baca sebagai hiperbola dan itu sama sekali tidak cocok. Apa pun itu, ini unggahan seorang pendiri, bukan peta jalan.

Kebocoran-kebocoran yang berdekatan menunjuk ke arah yang sama tanpa menyebut nama model. Sebuah build Codex Cloud muncul di build desktop ChatGPT 9922 dengan integrasi Tailscale dan proxy, dan alur onboarding menunjukkan tingkatan paket developer — Free, Prototype, dan Accelerate, yang terakhir seharga $50 — beberapa hari sebelum keynote. Keduanya bukan model yang di-loop. Keduanya konsisten dengan DevDay yang lebih menekankan platform daripada riset.

Jika itu nyata, model apa itu?

Tidak ada yang melaporkan identitas, jadi berikut ini adalah inferensi dan harus dibaca seperti itu.

Jalur terpendek menuju "model berulang kedua OpenAI" adalah penerus Astra. Altman mengatakan model yang lebih mumpuni akan datang "dalam waktu sangat dekat," dan cara termurah untuk membangunnya di atas basis kedalaman rekuren adalah mempertahankan arsitekturnya dan menaikkan anggaran loop — lebih banyak rekurensi per token ketimbang lebih banyak bobot. Penafsiran itu juga paling baik menjelaskan pembingkaian "floodgates", karena andalan kedua pada arsitektur yang sama adalah pernyataan bahwa yang pertama berhasil.

Pembacaan kedua adalah tier baru di dalam lini GPT-6 yang sudah ada. Tata bahasa penamaannya telah memunculkan string gpt-6-astra-minor, gpt-6-sol, dan gpt-6-luna, dan saudara loop pada anggaran kedalaman yang berbeda sepenuhnya konsisten dengan keluarga yang kini merentang dari $0.10 hingga $50 per juta token output. Model loop yang lebih murah akan menjadi versi dari hal ini yang paling terasa di dompet pembaca.

Pembacaan ketiga — perilisan open-weight yang di-loop — adalah yang paling lemah didukung. Ini akan menjelaskan frasa tersebut lebih baik daripada apa pun, dan literatur loop terbuka yang akan menjadi tempatnya bersanding sudah ada pada Ouro dan Nanbeige4.2-3B, tetapi OpenAI belum mengumumkan apa pun ke arah itu untuk generasi ini, dan menciptakan produk agar cocok dengan sebuah kata adalah cara liputan kebocoran menjadi keliru.

A two-column scoreboard titled 'GPT-6 Astra vs the second looped model - the scoreboard'. The left column, GPT-6 Astra, reads: Status: shipped Sep 3, 2026; Model ID: gpt-6-astra; Architecture: reported looped; Price per MTok: $10 / $50; Context window: about 1.05M tokens; Evidence: vendor docs and API. The right column, Second looped model, reads: Status: not announced; Model ID: none; Architecture: reported looped; Price per MTok: not published; Context window: not published; Evidence: one X post. A footer reads 'Astra figures per OpenAI and Artificial Analysis. Second looped model: unconfirmed, single social post, no vendor documentation.'

Apa yang akan membuat ini dapat diperiksa sebelum 29 September?

Amati permukaan yang menyelesaikan tiga kebocoran terakhir, dalam urutan ini:

• ID model yang berfungsi di API OpenAI, atau baris baru di halaman harganya.

• Catatan rilis di SDK openai-go atau openai-node yang menyebutkan pengenal model baru — itulah persis bagaimana Sol dan Luna membocorkan kedatangan mereka sendiri, dengan SDK v3.65.0 merilis pengenal model beberapa jam sebelum halaman pengumuman tayang.

• Listing Bedrock atau Azure, atau string flag Statsig yang baru dalam build desktop.

• Sebuah kalimat arsitektur dalam kartu sistem. Inilah yang paling penting dan datang paling akhir, karena OpenAI belum pernah mengonfirmasi desain berulang untuk Astra.

Apa pun selain tiga yang pertama adalah nama, dan nama telah menjadi artefak yang paling tidak dapat diandalkan dari keseluruhan siklus ini.

A screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the model title GPT-6 Astra with its OpenAI vendor badge and a 2026-09-04 date, Vision, Tools, JSON and Reasoning capability tags, a 1M-token context window with a 128K maximum output, text, image and file input, an input price of $10.00 and an output price of $50.00 per million tokens, a p50 time to first token of 10.00 seconds, and 298.3M tokens of traffic over seven days.

Mengapa ini penting bahkan jika tweet itu ternyata salah

Dua hal berubah jika kedalaman rekuren menjadi standar, bukan pengecualian.

Yang pertama adalah jaminan. Jika generasi berikutnya melakukan lebih banyak penalarannya dalam keadaan tersembunyi, maka evaluasi apa pun yang bergantung pada pembacaan rantai pemikiran tertulis sebuah model akan kehilangan sinyal — dan itu mencakup evaluasi keselamatan pihak ketiga, bukan hanya pemantauan OpenAI sendiri. Itu adalah masukan pengadaan bagi siapa pun yang memiliki persyaratan jaminan, dan itu tidak akan terlihat dalam tabel tolok ukur.

Yang kedua adalah bentuk tangga harganya. Looping menukar parameter dengan komputasi serial, sehingga memindahkan biaya dari memori ke waktu: berpotensi lebih murah untuk di-hosting, berpotensi lebih lambat per token. Lini GPT-6 sudah menetapkan harga untuk pertukaran itu secara eksplisit — GPT-6 Astra dengan $10 masuk / $50 keluar per juta token adalah model pendalaman, GPT-6 Sol dengan $2 / $10 adalah yang cepat, GPT-6 Luna dengan $0,10 / $0,50 adalah yang bervolume tinggi. Ketiganya sudah aktif di OrcaRouter dengan harga daftar OpenAI tanpa markup, jadi jika model keempat yang di-loop hadir pada 29 September, kartu tarif di sisi kami adalah kartu tarif vendor pada hari peluncurannya — dan pemotongan harga dari vendor langsung berlaku di sini pada hari yang sama saat berlaku di sana.

Kegunaan praktis dari kebocoran seperti ini bukanlah prediksi, melainkan persiapan. Model yang mungkin dirilis dalam lima hari dan tidak memiliki tolok ukur independen justru merupakan kasus yang menjadi alasan automatic failover ada: arahkan sebuah rute ke model baru, pertahankan GPT-6 Astra atau GPT-6 Sol di belakangnya, dan minggu pertama yang buruk hanya menghabiskan sebagian kecil trafik Anda, bukan jalur produksi Anda. Itu juga cara yang masuk akal untuk menguji model yang berat pada kedalaman — DSL routing menyusunnya menjadi satu panggilan bersama model-model yang hendak digantikannya, dan fusi model akan menjalankan panel model terhadap prompt yang sama, yang merupakan penilaian lebih cepat terhadap arsitektur baru daripada tulisan peluncuran mana pun.

Apa yang sebenarnya benar malam ini

Satu unggahan di X menyatakan bahwa model bahasa looped kedua dari OpenAI hadir pada 29 September. Tidak ada ID model, tidak ada harga, tidak ada nama, tidak ada sumber kedua, tidak ada artefak. Di baliknya: sebuah produk unggulan yang dirilis pada 3 September yang menurut laporan bersifat looped dan yang belum pernah dikonfirmasi OpenAI sebagai looped, penurunan yang diakui dalam keterpantauan jejak penalaran dibandingkan dengan GPT-5.6 Sol, seorang kepala ilmuwan yang mengatakan bahwa looping dibatasi sampai tidak lebih dari dua kali kedalaman grafik komputasi GPT-4, dan tier murah yang dirilis pada 22 September yang membuat pertanyaan arsitektur menjadi relevan secara komersial, bukan sekadar akademis.

Itu adalah klaim tipis yang bersandar pada cerita tebal, bentuk normal sebuah kebocoran lima hari sebelum acara. Jika model yang di-loop kedua muncul di Fort Mason pada hari Selasa, detail yang menarik bukanlah angka benchmark — melainkan apakah kartu sistem mengulangi catatan keterpantauan itu. Kalimat tunggal itulah yang memberi tahu Anda apakah "tidak lagi dilarang" adalah slogan atau kebijakan.

A screenshot of the Artificial Analysis model page for OpenAI GPT-6 Astra (max), showing the model title with a 'Proprietary model, Released September 2026' label, its position of #6 of 210 on Intelligence and #82 of 210 on Verbosity, an input price of $10.00 and an output price of $50.00 per million tokens, a 52.5 output-speed reading, a $3.26 blended cost figure, a comparison summary reading that it is among the leading models in intelligence but particularly expensive, notably slow and fairly concise, and technical specifications listing text and image input, text output, and a 1M-token context window with knowledge up to April 2026.

Dibandingkan dalam artikel ini3

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari