
Kebocoran GPT-6.5 "Doug", Dikoreksi: Doug Adalah Model Dasar GPT-6 Astra
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiBARUOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleBARUGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenBARUQwen: Qwen3.8 Max (0902)2026-09-0240Kecerdasan72Koding
- anthropicBARUAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0340Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2134Kecerdasan69Koding
Siklus kebocoran terpendek yang pernah dilacak blog ini berlangsung sekitar dua belas jam. Pada 7 September, analis model independen teortaxesTex memprediksi bahwa model unggulan berikutnya OpenAI akan diberi merek GPT-6.5, bahwa nama kode internalnya adalah lari pra-pelatihan "Doug" yang dilaporkan, dan bahwa itu akan menjadi "sesuatu yang berbeda… bukan sekadar lebih besar" — perubahan jenis, bukan peningkatan skala. Dalam waktu sekitar dua belas jam dia menarik kembali. Setelah menyelidiki, teortaxesTex mengatakan dia salah menghubungkan model dengan nama yang salah: "Doug" bukan GPT-6.5 masa depan. Dalam pembacaan yang diperbaikinya, itu adalah model dasar dari GPT-6 Astra — model unggulan yang dikirim OpenAI pada 3 September dengan harga $10 / $50 per juta token dengan konteks sekitar 1,05 juta token, yang tingkat standarnya mencapai ketersediaan umum pada 5 September. Lari pra-pelatihan raksasa yang diburu oleh mesin rumor sepanjang Agustus, menurut catatan ini, adalah fondasi di bawah hal yang sudah dalam produksi.
Halaman ini adalah pelacak apa yang kita ketahui, jadi label-labelnya harus bergerak mengikuti koreksi. GPT-6 Astra itu nyata, terukur secara independen, dan dapat dipanggil; kisah nama kode di sekitarnya tidak demikian. Tindak lanjut teortaxesTex adalah catatan pribadinya tentang apa yang ia pelajari, bukan pernyataan OpenAI, dan tidak ada artefak untuk "Doug" — tidak ada pengidentifikasi, tidak ada entri pemilih model, tidak ada daftar katalog cloud — yang muncul dalam interpretasi apa pun. Yang diselesaikan oleh koreksi tersebut adalah salah baca yang diulang oleh versi awal pos ini. Bacalah yang berikut sebagai jejak rumor yang mengoreksi dirinya sendiri, dengan setiap klaim masih dapat ditelusuri ke akun bernama atau anonim, bukan ke OpenAI.
Klaim tersebut, dan koreksinya.
Pos asli teortaxesTex, jika dibaca secara harfiah, memiliki tiga bagian: model OpenAI berikutnya akan diberi nomor GPT-6.5; nama kodenya adalah Doug; dan model tersebut mewakili perubahan jenis, bukan peningkatan skala. Dua bagian pertama adalah hipotesis penamaan yang sejalan dengan laporan nama kode yang sudah ada. Bagian ketiga adalah yang membuat pos itu menyebar, karena ia melampaui 'kapan' — pertanyaan yang sedang diperdebatkan oleh kalangan pengamat rumor lainnya — dan membuat klaim tentang 'apa.' Penerus yang berbeda, bukan yang lebih besar, tidak hanya akan mengatur ulang posisi OpenAI di papan peringkat independen; ia akan mengubah apa yang dimaksud sebagai generasi berikutnya dari yang terdepan.
Tindak lanjutnya menarik kembali sebagian besar dari itu, dan koreksi tersebut punya tiga bagian tersendiri. Pertama, "Doug" adalah model dasar dari GPT-6/Astra — bukan model terpisah yang lebih besar yang menunggu giliran, melainkan proses pra-pelatihan yang menjadi dasar Astra yang sudah dirilis. Kedua, "Bel," penerus yang dilaporkan memiliki 10 triliun parameter, adalah — dalam frasanya — "omong kosong insider bro." Ketiga, proses pra-pelatihan yang benar-benar mengarah pada apa yang akan datang setelah Astra dimulai "mungkin kurang dari dua bulan lalu" dengan nama kode berbeda yang belum dilaporkan oleh siapa pun. Ketiganya adalah pernyataan teortaxesTex tentang apa yang ia temukan, dengan nada yang sama seperti kebocoran aslinya: berguna sebagai sinyal tentang di mana jejak rumor berada, tak berharga sebagai dokumen. Tak satu pun dari itu adalah konfirmasi OpenAI, dan ia menambahkan bahwa semua ini tidak banyak mengubah pandangannya — poin strategis dari kiriman aslinya, menurut dia, tetap bertahan meski nama berubah. Itulah bagian yang layak diuji di bawah.
Dari mana bacaan "Doug" berasal — dan bagaimana itu dikoreksi
Pembacaan model masa depan tidak dimulai dengan teortaxesTex, dan penting untuk menjelaskan asal-usulnya karena versi awal tulisan ini bergantung padanya. Pada 7 Agustus, perusahaan riset SemiAnalysis menerbitkan memo — bertanggal 9 Juli — yang memberi tahu klien institusional bahwa OpenAI telah "mengatasi masalah pra-pelatihan mereka" dan bahwa "model yang jauh lebih besar dengan nama kode 'Doug' sedang aktif dikerjakan." Dua hari kemudian, akun X ChrisGPT melengkapi gambaran: Doug bukan model yang sama dengan GPT-6 (yang oleh sebagian besar akun dianggap sebagai Astra), melainkan proyek pra-pelatihan terbesar OpenAI hingga saat ini, dan bisa hadir paling cepat November. Berdasarkan kedua laporan tersebut, "Doug" menjadi sebutan untuk suatu hal besar, terpisah, yang terjadi pada akhir tahun.
Anggapan bahwa Doug justru merupakan basis di bawah Astra juga bukan hal baru — dan itulah alasan terkuat untuk memperlakukan koreksi teortaxesTex sebagai lebih dari sekadar iseng. Catatan pasar Samsung Securities tertanggal 10 Agustus, sebulan sebelum tindak lanjutnya, sudah mencatat koreksi yang beredar di komunitas: sebagian akun menafsirkan Doug sebagai model terpisah yang akan muncul setelah Astra, demikian isi catatan itu, tetapi "juga dikoreksi bahwa Doug adalah model pra-pelatihan yang menjadi basis Astra", dengan catatan bahwa hubungan pastinya masih belum terkonfirmasi. Pelaporan era Bel terpecah pada hal yang sama: unggahan 25 Agustus dari akun anonim @synthwavedd menggambarkan sebuah run yang telah selesai bernama "Bel", yang oleh sebagian penceritaan ulang dianggap sebagai penerus Doug dan oleh sebagian lainnya dianggap "mungkin basis untuk GPT-6". Pohon keluarga ini tidak pernah konsisten di berbagai akun. Tindak lanjut teortaxesTex hanya memilih sisi yang sudah tercatat dalam catatan Samsung dan membuang lapisan Bel sepenuhnya.

Setelah membaca koreksinya, laporan SemiAnalysis dan ChrisGPT sebenarnya melacak sebuah run yang sedang berada di tahap akhir, bukan proyek yang akan datang. Model dasar yang "secara aktif sedang digarap" pada awal Juli, yang lolos tinjauan keamanan pada Agustus, dan yang dirilis sebagai produk pada 3 September adalah model dasar yang pra-pelatihannya telah selesai berbulan-bulan sebelumnya — dengan musim panas yang dihabiskan untuk reinforcement learning, alignment, dan jeda peluncuran yang menyusul peringkat keamanan siber "Critical" milik Astra di bawah Preparedness Framework milik OpenAI sendiri. Garis waktu itu cocok dengan Doug sebagai model dasar Astra; garis waktu itu tidak cocok dengan Doug sebagai peluncuran November. Jika teortaxesTex benar, jendela November itu milik run yang salah dibaca, dan laporan yang menjanjikan Doug yang terpisah dan lebih besar hanyalah keliru melihat objeknya.
Apa yang bertahan dari koreksi
Tesis strategis itu tetap bertahan dalam bentuk yang dibingkai ulang. Argumen mendasar SemiAnalysis — bahwa keuntungan OpenAI sejak GPT-4o sebagian besar berasal dari pasca-pelatihan, pembelajaran penguatan, dan komputasi waktu inferensi di atas basis yang lebih lama, dan bahwa imbal hasil tersebut berkurang tanpa fondasi yang lebih baik — tidak bergantung pada nama kode yang disandang fondasi tersebut. Jika Doug adalah basis Astra, maka reset model dasar yang diprediksi memo itu telah terjadi dan telah dirilis: GPT-6 Astra adalah produk pertama dari prapelatihan yang dimulai ulang dan dikoreksi, bukan polesan lain dari otak era GPT-4o.
Hal itu membuat hasil pengukuran tersebut lebih menarik, bukan kurang menarik. Produk pertama dari reset ini bukanlah jawara dunia seperti yang dijanjikan pemberitaan "kentang terbesar". Pada Artificial Analysis Intelligence Index, GPT-6 Astra (max) mencetak skor 61 — sekitar peringkat kedelapan dari lebih dari 200 model — sementara Claude Fable 5.1 memuncaki papan peringkat dengan skor 66. Jika itulah yang didapat dari basis yang dimulai ulang saat ini, maka "berbeda, bukan sekadar lebih besar" tidak pernah menjadi deskripsi tentang apa adanya Astra saat ini; itu adalah harapan tentang apa yang pada akhirnya akan dihasilkan oleh basis berikutnya — proses yang dimulai kurang dari dua bulan lalu dengan nama kode yang belum pernah dilaporkan. Energi dari kebocoran awal adalah milik proses masa depan itu, bukan milik nama kode yang selama ini diperdebatkan semua orang.

Dua implikasi lanjutan muncul jika koreksi tersebut benar, dan keduanya layak dinyatakan sebagai inferensi, bukan fakta. Pertama, narasi “penerus segera hadir” — komentar Sam Altman kepada Axios bahwa “model-model yang jauh, jauh, jauh lebih mumpuni akan segera hadir,” dan klip yang beredar, yang memperlihatkan dia mengatakan bahwa model yang OpenAI “baru-baru ini membahas penghentiannya” adalah “model masa depan” — tidak mungkin merujuk pada proses pre-training yang baru; proses yang dimulai pada pertengahan Juli tidak akan menghasilkan produk pada September. Jika penerus benar-benar segera hadir, ia akan menjadi produk pasca-pelatihan dari basis Doug/Astra, bukan basis baru itu sendiri. Kedua, “Bel” selalu menjadi bagian dari kisah yang paling rentan terhadap penolakan semacam ini, yang menjadi pokok bahasan bagian berikutnya.
Mengapa "Bel" adalah mata rantai yang terlemah
Laporan Bel, dari akun anonim @synthwavedd pada 25 Agustus, memiliki bentuk permukaan seperti kebocoran besar: OpenAI telah "menyelesaikan" proses pre-training raksasa dengan total lebih dari 10 triliun parameter, yang digambarkan sebagai penerus Doug dan, dalam beberapa pembacaan, sebagai basis untuk generasi GPT-6. Laporan itu tidak pernah memiliki substansi. Laporan tersebut berakar dari satu posting anonim; tidak ada sumber kedua, tidak ada pengidentifikasi, tidak ada entri picker, tidak ada listing cloud yang pernah muncul; dan penceritaan ulang saling bertentangan satu sama lain pada pertanyaan paling mendasar tentang apakah Bel muncul sebelum atau sesudah Doug — sebuah tanda bahwa akun tersebut tidak memiliki referensi yang tetap. Garis waktunya juga tidak koheren di permukaannya: sebuah model dasar tidak dapat "menyelesaikan" pre-training di akhir Agustus dan juga menjadi dasar dari model yang sudah dibangun, ditinjau keamanannya, dan disiapkan untuk peluncurannya pada 3 September.
Penolakan teortaxesTex — "omong kosong insider bro" — memang lebih blak-blakan daripada pemberitaan mana pun, tetapi ia menunjuk pada bukti yang sama. Penjelasan tentang penerus dari blog tersebut sebelumnya telah menandai ketidaksesuaian Bel/Doug pada minggu laporan itu terbit, dan penjelasan peluncuran Astra juga menyampaikan peringatan serupa. Yang ditambahkan oleh koreksi ini adalah alasan untuk berhenti bersikap ragu-ragu: jika pra-pelatihan penerus yang sesungguhnya dimulai kurang dari dua bulan lalu dengan nama kode yang belum pernah dilaporkan siapa pun, maka cerita tentang "Bel dengan 10 triliun parameter yang telah selesai" bukan sekadar belum terverifikasi — cerita itu menggambarkan sesuatu yang, pada linimasa yang telah dikoreksi, tidak mungkin ada.
Apa yang bisa menyelesaikannya
Daftar periksa tidak berubah, dan koreksi tersebut menaikkan standar alih-alih menurunkannya. Setiap siklus kebocoran OpenAI yang dilacak blog ini selalu meninggalkan objek yang dapat diverifikasi sebelum pengumuman — pengidentifikasi gpt-6-astra dalam kode klien Codex, nama Sol/Terra/Luna di pemilih model GPT-5.6, serta daftar katalog Azure dan Bedrock sebelum Astra. Tidak ada apa pun dalam kisah Doug yang menghasilkan semua itu, dan koreksi tersebut tidak mengubahnya: bahkan jika Doug adalah model dasar Astra, nama itu tetap merupakan sebutan internal yang belum pernah dikonfirmasi oleh artefak mana pun. Yang dapat memastikan pembacaan hasil koreksi tersebut hanyalah pernyataan OpenAI, kartu sistem yang menyebut nama model dasarnya, atau kesaksian orang dalam yang disertai dokumen — dan tidak satu pun dari itu yang ada. Sampai salah satunya ada, label yang akurat untuk "Doug adalah model dasar GPT-6 Astra" adalah: analis yang pertama kali menyebutnya GPT-6.5 kini mengatakan demikian, catatan riset berusia satu bulan mencatat koreksi yang sama di komunitas, dan OpenAI belum mengatakan apa pun.
Pertanyaan tentang jadwal adalah bagian yang paling terasa dampak koreksinya. Jika sesi pra-pelatihan berikutnya yang sesungguhnya baru berusia dua bulan dan belum diberi nama, maka setiap tanggal yang melekat pada "Doug" dalam pemberitaan — jendela November milik ChrisGPT, ekspektasi penerus yang "segera hadir" — sebenarnya melekat pada sesi yang salah. Yang benar-benar bisa diandalkan pembaca justru lebih sempit: OpenAI telah merilis Astra, para eksekutif telah mengatakan bahwa model yang lebih cakap akan datang, dan penyetelan ulang model dasar berikutnya tampaknya memang cepat. Tak satu pun dari itu adalah tanggal rilis, dan posisi yang jujur adalah bahwa hitungan mundur penerus dimulai ketika sebuah identitas atau pengumuman muncul — bukan ketika seorang pembocor menyebutkan nama kode.
Apa yang harus dilakukan sambil menunggu jalan cerita berakhir.
Fakta-fakta yang relevan untuk pengambilan keputusan tidak berubah ketika terjadi koreksi, karena model yang ada adalah model yang dapat Anda panggil. GPT-6 Astra sudah aktif, sudah di-benchmark, dan tersedia melalui API milik OpenAI sendiri dan paket ChatGPT — juga di OrcaRouter dengan harga daftar OpenAI, $10 / $50, dengan konteks ~1,05M token yang diteruskan sesuai harga penyedia dan tanpa markup. Jika Anda menginginkan opini kedua tentang frontier saat ini, Claude Fable 5.1 memuncaki indeks independen, dan GPT-5.6 Sol tetap menjadi jalur OpenAI yang lebih murah dan terbukti untuk pekerjaan konteks panjang.

Persiapan yang berguna sama seperti sebelum koreksi, karena ketidakpastiannya tidak menyusut — ia berpindah. Router pass-through membuat penerus mana pun yang benar-benar muncul dapat dipanggil melalui kunci yang sudah Anda gunakan, dengan harga daftar vendor itu sendiri, pada hari yang sama saat ia muncul di katalog penyedia: tanpa kontrak kedua, tanpa penulisan ulang, dan perubahan harga berlaku langsung begitu vendor mempostingnya. Dan karena model dasar yang benar-benar baru adalah jenis hal yang belum terbukti yang tidak ingin Anda pertaruhkan pada jalur produksi sebelum diuji beban, failover otomatis adalah cara yang jujur untuk mencobanya: kunci produksi ke model yang telah Anda validasi, arahkan sebagian lalu lintas bayangan ke pendatang baru, dan biarkan permintaan nyata yang memutuskan. Jika pembacaan yang dikoreksi benar dan "Doug" hanyalah basis di bawah model yang sudah dapat Anda panggil, tidak ada yang sia-sia dari pengaturan itu; jika penerus yang tidak disebutkan namanya dirilis, biaya mengikuti kabar angin itu adalah nol.
Ringkasan yang berimbang dari koreksi ini adalah versi yang lebih sempit dari ketidakpastian awal. teortaxesTex, analis yang melabeli Doug sebagai "GPT-6.5", kini mengakui bahwa dia keliru: Doug adalah model dasar dari GPT-6 Astra yang sudah dirilis, "Bel" hanyalah noise, dan proses pre-training yang menentukan usianya baru kurang dari dua bulan serta belum diberi nama — sebuah pembacaan yang telah tercatat dalam laporan riset Samsung Securities sebulan sebelumnya, dan yang hingga kini belum dikonfirmasi oleh artefak apa pun maupun pernyataan OpenAI. Yang bertahan adalah poin strategisnya, kini diarahkan pada sasaran yang tepat: OpenAI telah memulai kembali pre-training model dasar, produk pertamanya berada di peringkat kedelapan pada indeks independen, dan proses yang menentukan apa yang akan hadir berikutnya baru saja dimulai. Posisi yang dapat dipertahankan tidak berubah — teruslah memanggil model yang telah Anda validasi, tetap buka opsi untuk menghindari rilis berikutnya, dan perlakukan pengumuman, bukan nama kode dan bukan koreksi, sebagai satu-satunya jadwal yang penting.
Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
