En hero-titelkort för GPT-6.7, OpenAIs ej släppta nästa flaggskepp, med titeln 'GPT-6.7: kärnfrågan', som visar en platt GPU-chippikon med ett fetstilt frågetecken ovanför, en mätarur med en röd nål vid en '2x'-etikett, små linjeikoner för hastighetsmätare/nyckel/läckdokument, och en nedre remsa med texten 'GPT-6.7 · EJ SLÄPPT · VAD VI VET HITTILLS', med OrcaRouter-logotypen i nedre högra hörnet.
Guides & Insights

GPT-6.7 och "Bob"-frågan: Kommer OpenAIs osläppta flaggskepp verkligen att köra 2x långsammare?

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Den 15 augusti pressade ett X-inlägg från kontot @Yuchenj_UW ihop ett rykte till en mening: "Bob, kungen av GPU-kärnor, har slutat på företaget? GPT-6.7 kommer att gå 2x långsammare…." Två påståenden vilar på det frågetecknet — att företagets mest hemlighetsfulla ingenjör har slutat, och att hans avhopp halverar servningshastigheten för GPT-6.7, företagets outgivna flaggskepp (omdöpt till GPT-6-7 i oktober). Inget av påståendena är verifierat. Men inlägget landar i ett läge där företagets nästa modell redan är en fråga om när, inte om: Astra-familjenamnet kom den 1 augusti, en säkerhetsgranskning pausade det den 7 augusti, och GPT-5.6 Sol — det nuvarande flaggskeppet, live på OrcaRouter — är den enda konkreta referenspunkten för vad nästa generation måste slå. Här är vad som faktiskt går att veta i dag.

Inledningsvis en sak: ingen utanför OpenAI har kört GPT-6.7. Alla påståenden om hur snabbt den kommer att leverera tokens är extrapolering — inklusive siffran "2x långsammare". Det som följer skiljer de verifierade fakta (namnbytet, utgivningstidslinjen, avhoppen som är dokumenterade) från legenden (Bob, kärnan och siffran). Allt rykkesmaterial är märkt som sådant.

Vem "Bob" är, och varför en enda ingenjör blev en legend

"Bob" är smeknamnet som OpenAI-anställda använder för en ingenjör vars namn företaget aldrig har bekräftat. Pressrapporter från september 2025 – inklusive QbitAI, The Paper och itbear, som alla citerar före detta och nuvarande OpenAI-anställda – beskriver en hemlighetsfull forskare som helt på egen hand skriver de CUDA-kärnor som används för inferens, den GPU-kod på låg nivå som omvandlar transformatormatematik till tokens. Hans uppmärksamhetskärna, kallad "Bob-kärnan" inom OpenAI, utförs enligt uppgift biljoner gånger om dagen över hundratusentals GPU:er, med motsvarande precision: en bugg skulle tvinga fram en återställning av kontrollpunkter och en omträningscykel.

Legenden är densamma över alla konton. Tidigare anställda säger att Bob på några minuter löste ett prestandaproblem som kollegor kämpat med i en vecka. OpenAIs interna Slack har en "Bob magic"-emoji. Branschuppskattningar som citeras i samma rapportering anger att antalet levande personer som kan skriva högpresterande CUDA-kernlar för träning är under hundra – vilket är anledningen till att ett beroende av denna typ med en enda person betraktas som genuint riskabelt snarare än ett trevligt att ha.

Angående identitet har OpenAI aldrig sagt vem Bob är. Den ledande hypotesen, som upprepas i samma pressbevakning, är Scott Gray — en examen i fysik och datavetenskap som gick med i OpenAI 2016, var förstaförfattare till OpenAIs blogginlägg "Block-sparse GPU kernels" från 2017, och senare medförfattare till GPT-4-teknisk rapport och scaling-laws-artikeln, med en bibliografi på 51 publikationer och över 80 000 citeringar. Det är en indiciebaserad men vitt upprepad slutsats; det är en inferens, inte en bekräftelse.

Lämnade Bob faktiskt?

Tweeten är en fråga, inte ett påstående. Men det avhopp den pekar på har ett pappersspår. En sammanfattning av ledningsförändringar som publicerades den 15 augusti 2026 listar Scott Gray – beskriven som en ”mångårig GPU-systemingenjör” som gick med 2016 och hjälpte till att bygga infrastrukturen bakom sparse transformers, scaling laws och GPT-3 – bland minst tolv högre chefer som lämnat OpenAI under 2026. Samma lista nämner intäktschefen Denise Dresser, tidigare COO Brad Lightcap, applikationschefen Fidji Simo, Sora-chefen Bill Peebles samt cheferna för säkerhet, etik, marknadsföring och hårdvara. Det är en sekundär rapport, inte en officiell bekräftelse, och den anger inget avgångsdatum för Gray.

Det bredare sammanhanget gör ryktet mindre förvånande. Rapportering från samma vecka beskriver personalomsättningen som en omställning inför en börsnotering: medgrundaren Greg Brockman drar till sig operativt inflytande inför en planerad notering, och CNBC rapporterade om CRO:ns avgång den 13 augusti. Och 'Bob' har varit ett känt rekryteringsmål i ett år — rapporter från september 2025 sade att Metas Mark Zuckerberg hade gjort 'vem är Bob?' till en stående punkt på rekryteringsmöten. Kampen om talanger kring just denna kompetens är verklig, vilket delvis förklarar varför läckan framstår som trovärdig.

Ändå har påståendekedjan två overifierade länkar: att Scott Gray är Bob, och att sammanställningens notering är samma avgång som tweeten avser. Det är fullt möjligt att tweeten upprepar ett rykte som föregår någon faktisk avgång. Detta avsnitt är den ärliga sammanfattningen: officiellt förekommer en senior GPU-ingenjör vid namn Scott Gray på en avgångslista för 2026; inofficiellt kan den personen vara eller inte vara den Bob som tweeten menar.

Varför "2x långsammare" skulle spela roll — och varför det förmodligen inte är så enkelt

Kernels avgör de två siffror som bestämmer en modells ekonomi: tokens per sekund och kostnad per token. Om GPT-6.7 levererades med serveringskernels hälften så effektiva som den hypotetiska "Bob-optimerade" versionen, skulle samma hårdvara servera hälften så många tokens och samma förfrågan skulle ta dubbelt så lång tid — till ungefär dubbla marginalkostnaden. För en utvecklare som dirigerar produktionstrafik är det en 2x latens- och 2x kostnadsökning på flaggskeppsmodellen, exakt den typen av siffra som förändrar ett modellval. Det är därför ryktet har substans.

Nu till anledningarna att misstro det:

"2x" har ingen angiven grund. Det är en siffra i ett inlägg — ett tankeexperiment, inte en mätning, och den länkade bilden innehåller inte heller någon sådan.

• Kernels är kod, och kod överlever sina författare. Den serving stack som Bob (eller någon annan) skrev för tidigare modeller försvinner inte när en person slutar; nästa modell ärver det mesta av den.

OpenAI:s infrastrukturorganisation är stor, och legenden om att "en person skriver allt" är nästan säkert en förenkling. Nyckelpersonsrisk är verklig men sällan binär.

• Även en verklig effektivitetsförlust skulle inte ändra kapaciteten. Den ändrar kostnad och latens — smärtsamt, men en leverantör kan delvis absorbera det eller prissätta runt det, och OpenAI har redan lanserat en hastighetsfunktion (Ultrafast, upp till 14x snabbare på nuvarande flaggskepp) som är inriktad på exakt denna typ av serveringskostnadstryck.

Den starkaste versionen av påståendet är under-hundra-statistiken. Om personen som skrev flaggskeppets serving-kärnor är borta, är ersättningen inte en headcount-anställning — det är en flerårig upptrappning. Det är en legitim risk för OpenAIs serving-ekonomi. Men det är en risk som rör teamet, inte ett uppmätt faktum om en modell som inte har lanserats.

Vad vi faktiskt vet om GPT-6.7

Modellen som ryktet handlar om har ett längre offentligt spår än vad tweeten antyder, och det mesta av det är nytt:

• 31 okt. 2025 — Sam Altman tillkännagav på X att "GPT-6" skulle döpas om till "GPT-6-7," vilket allmänt tolkades som en nick till Gen-Alpha-slangen "6-7." Huruvida "GPT-6.7" och "GPT-6-7" är strikt samma sak är inte officiellt; tweeten behandlar dem som utbytbara, och det gör även de flesta rapporteringar.

• April 2026 — Rapporter om att GPT-6:s förträning var klar, med ett ryktat släpp runt den 14 april. Det datumet passerade utan en lansering.

• Augusti 2026 — Enligt läckor flyttades lanseringen fram till början av augusti, där OpenAI hoppade över GPT-5.7 till GPT-5.9. Overifierat.

• 1 aug 2026 — OpenAI meddelade att "Astra" är namnet på dess nästa modellfamilj, via en forskningsrapport som hävdar att tio öppna matematikproblem har lösts. Huruvida Astra levereras under namnet GPT-6 är obekräftat.

• 7 aug 2026 — OpenAI pausade utvecklingen av Astra och sköt upp lanseringen efter att en intern säkerhetsgranskning flaggade en "kritisk" cybersäkerhetsrisk — den första modellen som utlöste den nivån. Altman sa att en bred lansering "behöver lite mer tid."

• Predictionsmarknader — I mitten av augusti bedömde handlare en GPT-6-lansering senast 30 september till cirka 62 % och senast 31 december till cirka 90 %.

• Ryktade specifikationer — runt en kontext på 2M token, ungefär 40 % bättre prestanda än nuvarande generation, personligt minne och inbyggd multimodal arkitektur under kodnamnet "Symphony." Allt overifierat.

Så modellen bakom "2x långsammare" har inte levererats, har inget bekräftat releasedatum och är föremål för en pågående säkerhetsgranskning. En serveringshastighetssiffra kopplad till den är spekulativ på två sätt — en gång för datumet, en gång för hastigheten.

A timeline infographic titled 'GPT-6.7 — the trail so far' with five milestone cards: Oct 31 2025 (renamed GPT-6-7 by Altman), Apr 2026 (pre-training reported done), Aug 1 2026 (Astra family name announced), Aug 7 2026 (safety pause: critical cyber risk), Aug 15 2026 (Bob departure rumor circulates); footer reads 'Timeline per OpenAI announcements and press reports; model unreleased as of Aug 15 2026.' OrcaRouter logo in the bottom-right corner.

Den enda resultattavlan som är ärlig idag

Eftersom GPT-6.7 inte finns ännu, kan en poängtavla bara kontrastera ryktet med det som faktiskt är live:

• GPT-6.7 (ej utgiven) — status: ej levererad; release: ryktas hösten 2026; kontext: ~2M tokens (ryktas); hastighet: "2x långsammare?" overifierad; pris: n/a; dirigerbar: ännu inte.

• GPT-5.6 Sol (live) — status: leverans; kontext: 1.05M tokens, 128K max utdata; hastighet: ~290 tok/s observerad på OrcaRouters 7-dagars statistik; pris: $5.00 in / $30.00 ut per miljon tokens vid standardnivån för inmatning; dirigerbar: ja, till leverantörens listpris.

Det intressanta glappet är priskolumnen. OpenAI:s nuvarande flaggskepp kostar 5/30 dollar per miljon tokens via OrcaRouter, och priset som förs vidare är leverantörens eget listpris utan påslag — så oavsett vad OpenAI prissätter GPT-6.7 till, ändras siffran hos oss samma dag som den lanseras, utan omförhandling. Det är den användbara delen av resultattavlan för alla som planerar utifrån nästa modell.

A two-column scoreboard titled 'GPT-6.7 vs GPT-5.6 Sol — the scoreboard'. Left column GPT-6.7 (unreleased): Status not shipped, Release rumored autumn 2026, Context ~2M (rumored), Speed 2x slower? (unverified), Price n/a, On OrcaRouter not yet. Right column GPT-5.6 Sol (live): Status shipping, Release live now, Context 1.05M tokens, Speed ~290 tok/s, Price $5.00/$30.00 per M, On OrcaRouter yes at list price. Footer: 'GPT-6.7 figures rumored/unaudited; GPT-5.6 Sol per OrcaRouter model page.' OrcaRouter logo in the bottom-right corner.

Hur man behandlar ett läckage som detta

Mönstret är välbekant: en outgiven modell, en dramatisk siffra, en namngiven person. Varje del är trovärdig och ingen är verifierad. Det rätta svaret är varken att ignorera ryktet eller att satsa på det — det är att strukturera beslutet så att du inte behöver välja.

Det gäller för routing. När GPT-6.7 släpps är sättet att utvärdera ett påstående om 2x långsammare utan att satsa en produktionsväg på det att placera det bakom samma endpoint som du redan använder: en API-nyckel, automatisk failover till GPT-5.6 Sol i samma stund som den nya modellen underpresterar, och att riktig trafik avgör om ryktet var sant. Påståendet blir då en mätning i stället för en tweet. Om OpenAIs prislista ändras med den nya releasen uppdateras pass-through-priset samma dag — OrcaRouter för vidare leverantörernas listpriser utan påslag, så en prissänkning (eller höjning) från leverantören är live här direkt, ingen omförhandling.

Samtidigt är den nuvarande flaggskeppsmodellen det konkreta. GPT-5.6 Sol är live på OrcaRouter idag till $5/$30 per miljon tokens, med 1,05M-token-kontexten och ~290 tok/s som resultattavlan visar. Ultrafast-läget som tillkännagavs den 13 augusti — upp till 14x snabbare, ungefär 750 tokens per sekund på Cerebras infrastruktur — gäller för den modellen, inte för GPT-6.7, och det är en påminnelse om att OpenAI kan angripa serveringskostnaden med infrastruktur såväl som med kernlar.

Screen capture of the OrcaRouter model page for GPT-5.6 Sol, showing the OpenAI flagship's pricing ($5.00 in / $30.00 out per million tokens), a 1.05M-token context window, 128K max output, Vision/Tools/JSON/Reasoning capability tags, and a p50 time-to-first-token of 1.87 seconds.

Vad vi tittar på nu

• Huruvida Bobs avgång bekräftas. OpenAI kommenterar inte vem Bob är; den närmaste dokumenterade händelsen är Scott Grays namn på avgångslistan för 2026. Om OpenAI eller Gray bekräftar det, blir den första länken i kedjan ett faktum.

• Huruvida siffran "2x slower" någonsin får en grund. Om GPT-6.7 släpps och oberoende hastighetsmätningar dyker upp, upphör siffran att vara ett rykte – antingen bekräftad eller avfärdad. Tills dess är den en siffra i ett inlägg.

• Huruvida Astras säkerhetspaus försenar datumet. Prediktionsmarknaderna har redan flyttat GPT-6 från augusti; den "kritiska" klassificeringen och de statliga tester som OpenAI säger sig vilja ha är båda naturliga källor till ytterligare förseningar.

• Huruvida kernel-bänken sorterar om. Om OpenAIs servingteam absorberar förlusten — eller om myten överdriver en persons andel — är hela ryktet irrelevant, och det första tecknet blir nästa modells servingprestanda jämfört med sin föregångare.

Den ärliga läsningen: "2x långsammare" är en övertygande berättelse och, hittills, bara det. Kärntrollkarlens avhopp är en verklig datapunkt med ett verkligt pappersspår; hastighetssiffran är en siffra i en tweet. Tills GPT-6.7 släpps är den försvarbara ståndpunkten att planera för båda utfallen — anta att ryktet kan vara delvis rätt, och bygg routingen så att ett flaggskepp som är långsammare än väntat inte kostar dig något att testa. Det är hela poängen med att routa en modell du inte har träffat.

© 2026 OrcaRouter

För leverantörer

Driver du en inferensplattform? Få dina modeller på OrcaRouter.

providers@orcarouter.ai

Gå med i vår community

Discordsupport@orcarouter.aiXGitHubYouTube