
GPT-6.7 и «вопрос Боба»: Действительно ли невыпущенный флагман OpenAI будет работать в 2 раза медленнее?
- DeepSeekНОВИНКАDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 за 1 млн токенов
- z-aiНОВИНКАZ.ai: GLM 5.32026-08-1860Интеллект75Кодинг
- obsidianНОВИНКАQwen3.8 27B2026-08-1552Интеллект68Кодинг
- qwenНОВИНКАQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekНОВИНКАDeepSeek: DeepSeek V4 Pro 08132026-08-1253Интеллект69Кодинг
- grokНОВИНКАSpaceXAI: Grok 4.62026-08-1261Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0557Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0358Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2152Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
- metaMeta: Muse Spark 1.12026-07-1653Интеллект71Кодинг
- kimiMoonshotAI: Kimi K32026-07-1560Интеллект76Кодинг
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Интеллект71Кодинг
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Интеллект77Кодинг
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Интеллект77Кодинг
15 августа пост в X от аккаунта @Yuchenj_UW сжал слух до одного предложения: «Боб, король GPU-ядер, уволился? GPT-6.7 будет работать в 2 раза медленнее…». За этим вопросительным знаком стоят два утверждения — что самый скрытный инженер компании уволился и что его уход вдвое снижает скорость инференса GPT-6.7, невыпущенного флагмана компании (переименованного в GPT-6-7 в октябре прошлого года). Ни одно из утверждений не подтверждено. Но пост появляется в момент, когда следующая модель компании — это уже вопрос «когда, а не если»: название семейства Astra появилось 1 августа, 7 августа проверка безопасности поставила её на паузу, а GPT-5.6 Sol — текущий флагман, работающий на OrcaRouter, — единственная конкретная точка отсчёта, которую следующему поколению предстоит превзойти. Вот что достоверно известно на сегодняшний день.
{{1}}Сразу скажу: никто за пределами OpenAI не запускал GPT-6.7.{{/1}} {{2}}Любое утверждение о том, как быстро он будет выдавать токены, является экстраполяцией{{/2}} — {{3}}включая цифру «в 2 раза медленнее».{{/3}} {{4}}Далее я отделяю подтверждённые факты{{/4}} {{5}}(переименование, сроки релиза, задокументированные уходы){{/5}} {{6}}от легенды{{/6}} {{7}}(Боб, ядро и число).{{/7}} Весь материал, основанный на слухах, помечен как таковой.
Кто такой «Боб» и почему один инженер стал легендой.
"Боб" — это прозвище, которое сотрудники OpenAI используют для инженера, чьё имя компания так и не подтвердила. Сообщения прессы от сентября 2025 года — включая QbitAI, The Paper и itbear, все со ссылками на бывших и нынешних сотрудников OpenAI, — описывают скрытного исследователя, который в одиночку пишет CUDA-ядра, используемые для инференса, то есть низкоуровневый код для GPU, превращающий математику трансформеров в токены. Его ядро внимания, называемое внутри OpenAI «ядром Боба», по сообщениям, выполняется триллионы раз в день на сотнях тысяч GPU, и точность должна быть соответствующей: ошибка привела бы к откату контрольных точек и повторному циклу обучения.
Легенда не меняется от рассказа к рассказу. Бывшие сотрудники говорят, что Боб за считанные минуты решил проблему производительности, над которой коллеги бились неделю. Во внутреннем Slack OpenAI есть эмодзи «магия Боба». Отраслевые оценки, приведённые в том же репортаже, показывают, что число живущих людей, способных писать высокопроизводительные CUDA-ядра для обучения, составляет меньше ста — поэтому зависимость от одного человека в этой области считается по-настоящему рискованной, а не просто приятным бонусом.
Что касается личности, OpenAI никогда не сообщала, кто такой Боб. Основная гипотеза, повторяемая в тех же публикациях прессы, — это Скотт Грей, выпускник по физике и информатике, который присоединился к OpenAI в 2016 году, был первым автором поста в блоге OpenAI за 2017 год "Block-sparse GPU kernels", а позже стал соавтором технического отчёта о GPT-4 и статьи о законах масштабирования, с библиографией из 51 работы и более чем 80 000 цитирований. Это предположение косвенное, но широко повторяемое; оно является выводом, а не подтверждением.
Боб действительно ушёл?
Твит — это вопрос, а не утверждение. Но уход, на который он указывает, имеет документальный след. Сводка о смене руководства, опубликованная 15 августа 2026 года, называет Скотта Грея — описанного как «давний инженер GPU-систем», который присоединился в 2016 году и помог создать инфраструктуру для разреженных трансформеров, законов масштабирования и GPT-3, — в числе как минимум двенадцати руководителей, покинувших OpenAI в 2026 году. В том же списке значатся директор по доходам Дениз Дрессер, бывший операционный директор Брэд Лайткэп, генеральный директор приложений Фиджи Симо, глава Sora Билл Пиблз, а также руководители отделов безопасности, этики, маркетинга и оборудования. Это вторичный отчёт, а не официальное подтверждение, и в нём не указана дата ухода Грея.
Более широкий контекст делает слух менее удивительным. Репортажи той же недели описывают эту текучку как перестановки перед IPO: соучредитель Грег Брокман стягивает на себя операционные полномочия в преддверии запланированного публичного размещения, а CNBC сообщил об уходе CRO 13 августа. А «Боб» уже год является известной целью для найма — согласно сообщениям от сентября 2025 года, Марк Цукерберг из Meta сделал вопрос «кто такой Боб?» постоянным пунктом на встречах по найму. Война за таланты вокруг этого конкретного набора навыков — реальность, и отчасти поэтому утечка выглядит правдоподобной.
Тем не менее в цепочке утверждений есть два непроверенных звена: то, что Скотт Грей — это Боб, и то, что упоминание в сводке относится к тому же уходу, о котором говорится в твите. Вполне возможно, что твит повторяет слух, появившийся раньше любого реального ухода. Этот раздел — честное резюме: официально старший GPU-инженер по имени Скотт Грей фигурирует в списке уходов на 2026 год; неофициально этот человек может быть или не быть тем Бобом, о котором говорится в твите.
Почему «в 2 раза медленнее» имеет значение — и почему, скорее всего, всё не так просто
Ядра определяют два числа, которые решают экономику модели: токенов в секунду и стоимость за токен. Если бы GPT-6.7 поставлялся на серверных ядрах вдвое менее эффективных, чем гипотетическая версия «Bob-optimized», то на том же оборудовании обслуживалось бы вдвое меньше токенов, а тот же запрос выполнялся бы вдвое дольше — при примерно вдвое большей предельной стоимости. Для разработчика, маршрутизирующего производственный трафик, это двукратное увеличение задержки и двукратный рост стоимости на флагмане — именно тот показатель, который меняет выбор модели. Вот почему у слуха есть основания.
Теперь причины не доверять этому:
• У "2x" нет указанного обоснования. Это число в посте — мысленный эксперимент, а не измерение, и на прикреплённом изображении его тоже нет.
• Ядра — это код, а код переживает авторов. Серверный стек, который Боб (или кто-либо ещё) написал для прежних моделей, не исчезает, когда человек уходит; следующая модель наследует большую его часть.
• Инфраструктурная организация OpenAI велика, и легенда о том, что «все пишет один человек», почти наверняка является упрощением. Риск, связанный с ключевыми сотрудниками, реален, но редко бывает бинарным.
• Даже реальное снижение эффективности не изменило бы возможности. Оно меняет стоимость и задержку — это болезненно, но вендор может частично поглотить это или компенсировать ценой, и OpenAI уже выпустил функцию скорости (Ultrafast, до 14 раз быстрее на текущем флагмане), нацеленную именно на такое давление стоимости обслуживания.
Самая сильная версия утверждения — это статистика «меньше сотни». Если человек, написавший serving-ядра для флагманской модели, ушёл, замена — это не наём по штатной численности, а многолетний процесс выхода на полную мощность. Это законный риск для экономики serving в OpenAI. Но это риск, относящийся к команде, а не измеренный факт о модели, которая ещё не выпущена.
Что мы на самом деле знаем о GPT-6.7
Модель, о которой идёт молва, имеет более длинный публичный след, чем предполагает твит, и большая часть его — недавняя:
• 31 октября 2025 г. — Сэм Альтман объявил в X, что «GPT-6» будет переименован в «GPT-6-7», что широко расценили как отсылку к сленгу поколения Alpha «6-7». Являются ли «GPT-6.7» и «GPT-6-7» строго одним и тем же, официально не подтверждено; в твите они используются как взаимозаменяемые, как и в большинстве публикаций.
• Апрель 2026 года — Сообщения о том, что предварительное обучение GPT-6 завершено, с предполагаемым выпуском около 14 апреля. Эта дата прошла без запуска.
• Август 2026 — Согласно утечкам, запуск был перенесён на начало августа, при этом OpenAI пропускает GPT-5.7 — GPT-5.9. Не подтверждено.
• 1 августа 2026 г. — OpenAI объявила «Astra» названием своего следующего семейства моделей, опубликовав исследовательский отчёт, в котором утверждается, что решено десять открытых математических задач. Будет ли Astra выпущена под именем GPT-6, не подтверждено.
• 7 августа 2026 г. — OpenAI приостановила разработку Astra и отложила выпуск после того, как внутренняя проверка безопасности отметила «критический» риск кибербезопасности — первая модель, вызвавшая такой уровень. Альтман заявил, что широкий выпуск «требует немного больше времени».
• Рынки прогнозов — По состоянию на середину августа трейдеры оценивали выпуск GPT-6 к 30 сентября примерно в 62%, а к 31 декабря — примерно в 90%.
• Слухи о характеристиках — контекст примерно на 2M токенов, производительность примерно на 40% выше текущего поколения, персонализированная память и нативная мультимодальная архитектура под кодовым названием «Symphony». Всё неподтверждено.
Итак, модель, стоящая за «2x slower», ещё не выпущена, у неё нет подтверждённой даты выхода, и она является предметом активной проверки безопасности. Привязанное к ней значение скорости обслуживания спекулятивно вдвойне — как по дате, так и по скорости.

Единственное табло, которое сегодня честно.
Поскольку GPT-6.7 пока не существует, табло может лишь сопоставить слух с тем, что реально доступно:
• GPT-6.7 (не выпущен) — статус: не выпущен; выход: предположительно осенью 2026; контекст: ~2M токенов (по слухам); скорость: «в 2 раза медленнее?» не подтверждено; цена: н/д; маршрутизация: пока нет.
• GPT-5.6 Sol (live) — статус: в работе; контекст: 1.05M токенов, макс. выход: 128K; скорость: ~290 ток/с по данным 7-дневной статистики OrcaRouter; цена: вход $5.00 / выход $30.00 за миллион токенов на стандартном входном тарифе; маршрутизация: да, по цене провайдера.
Интересный разрыв — в колонке цен. Текущий флагман OpenAI стоит $5/$30 за миллион токенов через OrcaRouter, а сквозная ставка — это собственная цена вендора с нулевой наценкой, так что какую бы цену OpenAI ни установила на GPT-6.7, число на нашей стороне изменится в тот же день, когда модель выйдет, без пересмотра условий. Это и есть полезная часть табло для всех, кто планирует что-то вокруг следующей модели.

Как устранить такую утечку
Это знакомый паттерн: невыпущенная модель, внушительная цифра, названное имя. Каждая часть правдоподобна, и ни одна не подтверждена. Правильный ответ — не игнорировать слух и не делать на него ставку, а структурировать решение так, чтобы не приходилось выбирать.
Это касается маршрутизации. Когда GPT-6.7 выйдет, способ проверить утверждение о двукратном замедлении, не ставя на кон продакшн-маршрут, — это поместить его за тот же endpoint, который вы уже используете: один API-ключ, автоматический переход на GPT-5.6 Sol в момент, когда новая модель показывает худшие результаты, и реальный трафик решает, была ли молва правдивой. Тогда это утверждение становится измерением, а не твитом. Если прайс-лист OpenAI изменится с новым релизом, передаваемая клиентам цена обновится в тот же день — OrcaRouter передаёт цены провайдеров без наценки, поэтому снижение (или повышение) цены вендора немедленно вступает в силу здесь, без пересмотра условий.
Между тем текущий флагман — это конкретная вещь. GPT-5.6 Sol уже доступен на OrcaRouter сегодня по цене $5/$30 за миллион токенов, с контекстом в 1,05 млн токенов и примерно 290 ток/с, как показывает табло. Режим Ultrafast, анонсированный 13 августа, — до 14 раз быстрее, примерно 750 токенов в секунду на инфраструктуре Cerebras — применим к этой модели, а не к GPT-6.7, и напоминает, что OpenAI может атаковать стоимость обслуживания как инфраструктурой, так и ядрами.

Что мы сейчас смотрим
• Подтвердится ли уход Боба. OpenAI не комментирует, кто такой Боб; ближайшее документально подтверждённое событие — имя Скотта Грея в списке уходов на 2026 год. Если OpenAI или Грей подтвердят это, первое звено цепочки станет фактом.
• Получит ли когда-либо обоснование цифра «в 2 раза медленнее». Если GPT-6.7 выйдет и появятся независимые замеры скорости, этот показатель перестанет быть слухом — его либо подтвердят, либо опровергнут. Пока же это просто число в посте.
Повлияет ли пауза безопасности Astra на сроки. Рынки прогнозов уже перенесли GPT-6 за пределы августа; статус «критически важной» системы и государственное тестирование, которое, по словам OpenAI, она хочет провести, — оба являются естественными источниками дальнейших задержек.
Пересортирует ли ядерный бенчмарк результаты. Если команда обслуживания OpenAI возьмёт потери на себя — или легенда преувеличивает вклад одного человека — весь слух становится неактуальным, и первым признаком будет производительность обслуживания следующей модели по сравнению с её предшественницей.
Честная оценка: «в 2 раза медленнее» — убедительная история, и пока что только она. Уход гуру ядра — реальная точка данных с реальным документальным следом; показатель скорости — просто цифра в твите. До выхода GPT-6.7 обоснованная позиция — планировать оба исхода: допустить, что слух может быть отчасти прав, и построить маршрутизацию так, чтобы тестирование флагмана, оказавшегося медленнее ожидаемого, ничего вам не стоило. В этом весь смысл маршрутизации модели, с которой вы ещё не встречались.
