
GPT-6.7 dan Pertanyaan "Bob": Akankah Produk Unggulan OpenAI yang Belum Dirilis Benar-Benar Berjalan 2x Lebih Lambat?
- DeepSeekBARUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 juta token
- z-aiBARUZ.ai: GLM 5.32026-08-1860Kecerdasan75Koding
- obsidianBARUQwen3.8 27B2026-08-1552Kecerdasan68Koding
- qwenBARUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekBARUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Kecerdasan69Koding
- grokBARUSpaceXAI: Grok 4.62026-08-1261Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0557Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0358Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Kecerdasan69Koding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Kecerdasan49Koding
- metaMeta: Muse Spark 1.12026-07-1653Kecerdasan71Koding
- kimiMoonshotAI: Kimi K32026-07-1560Kecerdasan76Koding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Kecerdasan71Koding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Kecerdasan77Koding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Kecerdasan77Koding
Pada tanggal 15 Agustus, sebuah unggahan X dari akun @Yuchenj_UW memadatkan sebuah rumor menjadi satu kalimat: "Bob, raja kernel GPU, keluar dari perusahaan? GPT-6.7 akan berjalan 2x lebih lambat…." Dua klaim melekat pada tanda tanya itu — bahwa insinyur paling tertutup di perusahaan telah keluar, dan bahwa kepergiannya memangkas kecepatan layanan GPT-6.7 hingga setengahnya, produk andalan perusahaan yang belum dirilis (diubah namanya menjadi GPT-6-7 pada Oktober lalu). Tidak ada satu pun klaim yang terverifikasi. Tetapi unggahan itu muncul pada saat model berikutnya perusahaan sudah tinggal soal kapan, bukan apakah: nama keluarga Astra hadir pada 1 Agustus, peninjauan keamanan menghentikannya untuk sementara pada 7 Agustus, dan GPT-5.6 Sol — andalan saat ini, tayang di OrcaRouter — adalah satu-satunya tolok ukur konkret yang harus dikalahkan generasi berikutnya. Inilah yang sebenarnya dapat diketahui per hari ini.
Satu hal di awal: tidak ada seorang pun di luar OpenAI yang telah menjalankan GPT-6.7. Klaim apa pun tentang seberapa cepat ia akan menyajikan token hanyalah ekstrapolasi — termasuk angka "2x lebih lambat". Apa yang berikut ini memisahkan fakta-fakta yang terverifikasi (penggantian nama, garis waktu perilisan, pengunduran diri yang tercatat) dari legenda (Bob, kernel, dan angka tersebut). Semua materi rumor diberi label demikian.
Siapa "Bob" itu, dan mengapa seorang insinyur tunggal menjadi legenda
"Bob" adalah nama panggilan yang digunakan karyawan OpenAI untuk seorang insinyur yang namanya tidak pernah dikonfirmasi oleh perusahaan. Laporan pers dari September 2025 — termasuk QbitAI, The Paper, dan itbear, yang semuanya mengutip mantan dan karyawan OpenAI saat ini — menggambarkan seorang peneliti misterius yang sendirian menulis kernel CUDA yang digunakan untuk inferensi, kode GPU tingkat rendah yang mengubah matematika transformer menjadi token. Kernel perhatiannya, yang disebut "kernel Bob" di dalam OpenAI, dilaporkan dieksekusi triliunan kali sehari di ratusan ribu GPU, dengan presisi yang sepadan: sebuah bug akan memaksa pemulihan checkpoint dan siklus pelatihan ulang.
The legend is consistent across accounts. Former employees say Bob fixed in minutes a performance problem colleagues had wrestled with for a week. OpenAI's internal Slack has a "Bob magic" emoji. Industry estimates cited in the same reporting put the number of people alive who can write high-performance training CUDA kernels at under a hundred — which is why a single-person dependency of this kind is treated as genuinely risky rather than a nice-to-have.
Mengenai identitas, OpenAI tidak pernah menyatakan siapa Bob. Hipotesis utama yang berulang dalam liputan pers yang sama adalah Scott Gray — seorang lulusan fisika dan ilmu komputer yang bergabung dengan OpenAI pada tahun 2016, menjadi penulis utama posting blog OpenAI tahun 2017, "Block-sparse GPU kernels," dan kemudian ikut menulis laporan teknis GPT-4 serta makalah tentang scaling-laws, dengan bibliografi 51 makalah dan lebih dari 80.000 sitasi. Kecocokan ini bersifat tidak langsung tetapi banyak diulang; itu adalah inferensi, bukan konfirmasi.
Apakah Bob benar-benar pergi?
Tweet tersebut adalah sebuah pertanyaan, bukan klaim. Namun kepergian yang ditunjukkannya memiliki jejak dokumentasi. Ringkasan pergantian kepemimpinan yang diterbitkan pada 15 Agustus 2026 mencantumkan Scott Gray — digambarkan sebagai "insinyur sistem GPU yang sudah lama berkarier" yang bergabung pada tahun 2016 dan membantu membangun infrastruktur di balik sparse transformers, scaling laws, dan GPT-3 — di antara setidaknya dua belas orang senior yang meninggalkan OpenAI pada tahun 2026. Daftar yang sama menyebutkan kepala pendapatan Denise Dresser, mantan COO Brad Lightcap, CEO aplikasi Fidji Simo, kepala Sora Bill Peebles, serta kepala keamanan, etika, pemasaran, dan perangkat keras. Itu adalah laporan sekunder, bukan konfirmasi resmi, dan tidak memberikan tanggal kepergian Gray.
Konteks yang lebih luas membuat rumor tersebut tidak terlalu mengejutkan. Pemberitaan pada minggu yang sama membingkai pergantian ini sebagai guncangan pra-IPO: salah satu pendiri, Greg Brockman, menarik otoritas operasional kepada dirinya sendiri menjelang rencana pencatatan saham publik, dan CNBC melaporkan keluarnya CRO pada 13 Agustus. Dan "Bob" telah menjadi target rekrutmen yang dikenal selama setahun — laporan sejak September 2025 mengatakan Mark Zuckerberg dari Meta telah menjadikan "siapa Bob?" sebagai agenda tetap dalam rapat-rapat perekrutan. Perang talenta seputar keterampilan spesifik ini nyata adanya, yang merupakan bagian dari alasan mengapa kebocoran ini terdengar masuk akal.
Meski begitu, rantai klaim ini memiliki dua mata rantai yang belum terverifikasi: bahwa Scott Gray adalah Bob, dan bahwa daftar dalam ringkasan itu adalah keberangkatan yang sama dengan yang dimaksud tweet. Sangat mungkin tweet tersebut mengulangi gosip yang sudah ada sebelum adanya keberangkatan nyata. Bagian ini adalah ringkasan yang jujur: secara resmi, seorang insinyur GPU senior bernama Scott Gray muncul dalam daftar keberangkatan 2026; secara tidak resmi, orang tersebut mungkin atau mungkin bukan Bob yang dimaksud tweet.
Mengapa "2x lebih lambat" akan penting — dan mengapa mungkin tidak sesederhana itu.
Kernel menentukan dua angka yang menentukan ekonomi sebuah model: token per detik dan biaya per token. Jika GPT-6.7 dirilis dengan kernel penyajian yang efisiensinya setengah dari versi hipotetis "Bob-optimized", perangkat keras yang sama hanya akan melayani setengah token dan permintaan yang sama akan memakan waktu dua kali lebih lama — dengan biaya marjinal kira-kira dua kali lipat. Bagi pengembang yang mengarahkan lalu lintas produksi, itu berarti latensi 2x dan biaya 2x pada model unggulan, jenis angka yang tepat yang mengubah pilihan model. Itulah mengapa rumor ini berbobot.
Sekarang, alasan untuk tidak mempercayainya:
"2x" tidak memiliki dasar yang dinyatakan. Itu hanyalah angka dalam sebuah unggahan — eksperimen pemikiran, bukan pengukuran, dan gambar yang ditautkan pun tidak memuatnya.
• Kernel adalah kode, dan kode bertahan lebih lama daripada penulisnya. Serving stack yang ditulis Bob (atau siapa pun) untuk model-model sebelumnya tidak hilang ketika seseorang pergi; model berikutnya mewarisi sebagian besarnya.
Organisasi infrastruktur OpenAI berukuran besar, dan legenda "satu orang menulis semuanya" hampir pasti merupakan penyederhanaan. Risiko orang kunci itu nyata tetapi jarang bersifat biner.
• Bahkan pukulan efisiensi yang nyata tidak akan mengubah kemampuan. Itu mengubah biaya dan latensi — menyakitkan, tetapi vendor dapat menyerapnya sebagian atau menetapkan harga di sekitarnya, dan OpenAI telah merilis fitur kecepatan (Ultrafast, hingga 14x lebih cepat pada flagship saat ini) yang ditujukan tepat untuk tekanan biaya penyajian semacam ini.
Versi terkuat dari klaim tersebut adalah statistik di bawah seratus. Jika orang yang menulis kernel serving produk unggulan itu tidak ada lagi, penggantinya bukanlah perekrutan untuk mengisi jumlah staf — melainkan proses bertahap yang memakan waktu bertahun-tahun. Itu adalah risiko yang sah terhadap ekonomi serving OpenAI. Tetapi itu adalah risiko tentang tim, bukan fakta terukur tentang model yang belum dirilis.
Apa yang sebenarnya kita ketahui tentang GPT-6.7
Model yang menjadi bahan rumor ini memiliki jejak publik yang lebih panjang daripada yang disiratkan tweet tersebut, dan sebagian besar di antaranya baru-baru ini:
• 31 Okt 2025 — Sam Altman mengumumkan di X bahwa "GPT-6" akan diubah namanya menjadi "GPT-6-7," yang secara luas dibaca sebagai anggukan pada slang Gen-Alpha "6-7." Apakah "GPT-6.7" dan "GPT-6-7" secara ketat hal yang sama tidak resmi; cuitan tersebut memperlakukan keduanya sebagai dapat dipertukarkan, dan begitu pula sebagian besar pemberitaan.
• April 2026 — Laporan bahwa pelatihan awal GPT-6 telah selesai, dengan rilis yang dikabarkan sekitar 14 April. Tanggal tersebut berlalu tanpa peluncuran.
• Agustus 2026 — Bocoran mengatakan peluncurannya dimajukan ke awal Agustus, dengan OpenAI melewati GPT-5.7 hingga GPT-5.9. Tidak terverifikasi.
• 1 Agustus 2026 — OpenAI mengumumkan "Astra" sebagai nama keluarga model berikutnya, melalui laporan riset yang mengklaim sepuluh masalah matematika terbuka terpecahkan. Belum terkonfirmasi apakah Astra akan rilis dengan nama GPT-6.
• 7 Agustus 2026 — OpenAI menjeda pengembangan Astra dan menunda peluncurannya setelah tinjauan keselamatan internal menandai risiko keamanan siber "kritis" — model pertama yang memicu tingkat tersebut. Altman mengatakan rilis luas "membutuhkan waktu sedikit lebih lama."
• Pasar prediksi — Hingga pertengahan Agustus, para trader memperkirakan perilisan GPT-6 pada 30 September sekitar 62% dan pada 31 Desember sekitar 90%.
• Spesifikasi yang dirumorkan — konteks sekitar 2M token, kinerja sekitar 40% lebih baik dari generasi saat ini, memori yang dipersonalisasi, dan arsitektur multimodal asli dengan nama kode "Symphony." Semuanya belum terverifikasi.
Jadi model di balik "2x slower" belum dirilis, belum memiliki tanggal rilis yang dikonfirmasi, dan sedang dalam tinjauan keselamatan aktif. Angka kecepatan penyajian yang melekat padanya bersifat spekulatif dua kali lipat — sekali untuk tanggalnya, sekali untuk kecepatannya.

Satu-satunya papan skor yang jujur hari ini
Karena GPT-6.7 belum ada, papan skor hanya dapat membandingkan rumor dengan apa yang sebenarnya sudah tersedia:
• GPT-6.7 (belum dirilis) — status: belum diluncurkan; rilis: dikabarkan musim gugur 2026; konteks: ~2M token (dikabarkan); kecepatan: "2x lebih lambat?" belum terverifikasi; harga: n/a; dapat dirutekan: belum.
• GPT-5.6 Sol (live) — status: dikirim; konteks: 1,05M token, output maks 128K; kecepatan: ~290 tok/s teramati pada statistik 7 hari OrcaRouter; harga: $5,00 masuk / $30,00 keluar per juta token pada tier input standar; dapat dirutekan: ya, dengan harga sesuai daftar penyedia.
Perbedaan yang menarik ada di kolom harga. Produk unggulan OpenAI saat ini berharga $5/$30 per juta token melalui OrcaRouter, dan tarif pass-through adalah harga daftar vendor itu sendiri tanpa markup — jadi berapa pun harga GPT-6.7 yang ditetapkan OpenAI, angka di sisi kami bergerak pada hari yang sama saat dirilis, tanpa negosiasi ulang. Itulah bagian yang berguna dari papan skor bagi siapa pun yang merencanakan seputar model berikutnya.

Cara mengatasi kebocoran seperti ini
Polanya sudah lazim: model yang belum dirilis, angka yang dramatis, seseorang yang disebutkan namanya. Setiap bagian masuk akal dan tidak ada yang terverifikasi. Respons yang tepat bukan mengabaikan rumor tersebut, juga bukan bertaruh padanya — melainkan menyusun keputusan sehingga Anda tidak perlu memilih.
Itulah kasus untuk routing. Ketika GPT-6.7 dirilis, cara mengevaluasi klaim 2x lebih lambat tanpa mempertaruhkan jalur produksi pada klaim tersebut adalah dengan menempatkannya di belakang endpoint yang sama dengan yang sudah Anda gunakan: satu kunci API, failover otomatis ke GPT-5.6 Sol begitu model baru kurang berkinerja, dan lalu lintas nyata yang menentukan apakah rumor itu benar. Klaim tersebut kemudian menjadi sebuah pengukuran, bukan sekadar cuitan. Jika daftar harga OpenAI berubah dengan rilis baru, tarif pass-through diperbarui pada hari yang sama — OrcaRouter meneruskan daftar harga penyedia dengan markup nol, sehingga pemotongan harga (atau kenaikan) dari vendor langsung aktif di sini, tanpa negosiasi ulang.
Sementara itu, andalan saat ini adalah hal yang konkret. GPT-5.6 Sol sudah tersedia di OrcaRouter hari ini dengan harga $5/$30 per juta token, dengan konteks 1.05M token dan sekitar 290 tok/s seperti yang ditunjukkan papan skor. Mode Ultrafast yang diumumkan pada 13 Agustus — hingga 14x lebih cepat, sekitar 750 token per detik pada infrastruktur Cerebras — berlaku untuk model tersebut, bukan untuk GPT-6.7, dan ini mengingatkan bahwa OpenAI dapat menyerang biaya penyajian dengan infrastruktur maupun dengan kernel.

Yang sedang kami tonton sekarang
• Apakah kepergian Bob dikonfirmasi. OpenAI tidak berkomentar tentang siapa Bob; peristiwa tercatat terdekat adalah nama Scott Gray dalam daftar kepergian 2026. Jika OpenAI atau Gray mengonfirmasinya, mata rantai pertama dalam rantai ini menjadi fakta.
• Apakah angka "2x lebih lambat" itu pernah memiliki dasar. Jika GPT-6.7 dirilis dan pengukuran kecepatan independen muncul, angka tersebut berhenti menjadi rumor — entah dikonfirmasi atau ditarik. Sampai saat itu, angka itu hanyalah angka dalam sebuah postingan.
• Apakah jeda keamanan Astra menggeser tanggalnya. Pasar prediksi sudah memindahkan GPT-6 keluar dari Agustus; sebutan "kritis" dan pengujian pemerintah yang OpenAI katakan diinginkannya sama-sama menjadi sumber penundaan lebih lanjut.
Apakah kernel bench menyortir ulang. Jika tim serving OpenAI menyerap kerugian tersebut — atau legenda tersebut melebih-lebihkan bagian satu orang — seluruh rumor menjadi tidak relevan, dan tanda pertama akan terlihat pada performa serving model berikutnya dibandingkan dengan pendahulunya.
Bacaan yang jujur: "2x lebih lambat" adalah cerita yang menarik dan, sejauh ini, hanya itu. Kepergian kernel-wizard adalah titik data nyata dengan jejak dokumen nyata; angka kecepatan hanyalah angka dalam sebuah tweet. Sampai GPT-6.7 dirilis, posisi yang dapat dipertahankan adalah merencanakan kedua hasil — anggaplah rumor itu mungkin sebagian benar, dan bangun perutean sehingga flagship yang lebih lambat dari perkiraan tidak memerlukan biaya apa pun untuk diuji. Itulah inti dari merutekan model yang belum Anda temui.
