Герой-титульная карточка для GPT-6.7 — следующего флагмана OpenAI, который ещё не выпущен, — под названием «GPT-6.7: вопрос ядра», на которой изображены плоская иконка GPU-чипа с жирным знаком вопроса над ней, циферблат с красной стрелкой у отметки «2x», мелкие линейные иконки спидометра/ключа/документа об утечке и нижняя полоса с текстом «GPT-6.7 · НЕ ВЫПУЩЕН · ЧТО МЫ ЗНАЕМ НА ДАННЫЙ МОМЕНТ», а в правом нижнем углу — логотип OrcaRouter.
Guides & Insights

GPT-6.7 и «вопрос Боба»: Действительно ли невыпущенный флагман OpenAI будет работать в 2 раза медленнее?

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

15 августа пост в X от аккаунта @Yuchenj_UW сжал слух до одного предложения: «Боб, король GPU-ядер, уволился? GPT-6.7 будет работать в 2 раза медленнее…». За этим вопросительным знаком стоят два утверждения — что самый скрытный инженер компании уволился и что его уход вдвое снижает скорость инференса GPT-6.7, невыпущенного флагмана компании (переименованного в GPT-6-7 в октябре прошлого года). Ни одно из утверждений не подтверждено. Но пост появляется в момент, когда следующая модель компании — это уже вопрос «когда, а не если»: название семейства Astra появилось 1 августа, 7 августа проверка безопасности поставила её на паузу, а GPT-5.6 Sol — текущий флагман, работающий на OrcaRouter, — единственная конкретная точка отсчёта, которую следующему поколению предстоит превзойти. Вот что достоверно известно на сегодняшний день.

{{1}}Сразу скажу: никто за пределами OpenAI не запускал GPT-6.7.{{/1}} {{2}}Любое утверждение о том, как быстро он будет выдавать токены, является экстраполяцией{{/2}} — {{3}}включая цифру «в 2 раза медленнее».{{/3}} {{4}}Далее я отделяю подтверждённые факты{{/4}} {{5}}(переименование, сроки релиза, задокументированные уходы){{/5}} {{6}}от легенды{{/6}} {{7}}(Боб, ядро и число).{{/7}} Весь материал, основанный на слухах, помечен как таковой.

Кто такой «Боб» и почему один инженер стал легендой.

"Боб" — это прозвище, которое сотрудники OpenAI используют для инженера, чьё имя компания так и не подтвердила. Сообщения прессы от сентября 2025 года — включая QbitAI, The Paper и itbear, все со ссылками на бывших и нынешних сотрудников OpenAI, — описывают скрытного исследователя, который в одиночку пишет CUDA-ядра, используемые для инференса, то есть низкоуровневый код для GPU, превращающий математику трансформеров в токены. Его ядро внимания, называемое внутри OpenAI «ядром Боба», по сообщениям, выполняется триллионы раз в день на сотнях тысяч GPU, и точность должна быть соответствующей: ошибка привела бы к откату контрольных точек и повторному циклу обучения.

Легенда не меняется от рассказа к рассказу. Бывшие сотрудники говорят, что Боб за считанные минуты решил проблему производительности, над которой коллеги бились неделю. Во внутреннем Slack OpenAI есть эмодзи «магия Боба». Отраслевые оценки, приведённые в том же репортаже, показывают, что число живущих людей, способных писать высокопроизводительные CUDA-ядра для обучения, составляет меньше ста — поэтому зависимость от одного человека в этой области считается по-настоящему рискованной, а не просто приятным бонусом.

Что касается личности, OpenAI никогда не сообщала, кто такой Боб. Основная гипотеза, повторяемая в тех же публикациях прессы, — это Скотт Грей, выпускник по физике и информатике, который присоединился к OpenAI в 2016 году, был первым автором поста в блоге OpenAI за 2017 год "Block-sparse GPU kernels", а позже стал соавтором технического отчёта о GPT-4 и статьи о законах масштабирования, с библиографией из 51 работы и более чем 80 000 цитирований. Это предположение косвенное, но широко повторяемое; оно является выводом, а не подтверждением.

Боб действительно ушёл?

Твит — это вопрос, а не утверждение. Но уход, на который он указывает, имеет документальный след. Сводка о смене руководства, опубликованная 15 августа 2026 года, называет Скотта Грея — описанного как «давний инженер GPU-систем», который присоединился в 2016 году и помог создать инфраструктуру для разреженных трансформеров, законов масштабирования и GPT-3, — в числе как минимум двенадцати руководителей, покинувших OpenAI в 2026 году. В том же списке значатся директор по доходам Дениз Дрессер, бывший операционный директор Брэд Лайткэп, генеральный директор приложений Фиджи Симо, глава Sora Билл Пиблз, а также руководители отделов безопасности, этики, маркетинга и оборудования. Это вторичный отчёт, а не официальное подтверждение, и в нём не указана дата ухода Грея.

Более широкий контекст делает слух менее удивительным. Репортажи той же недели описывают эту текучку как перестановки перед IPO: соучредитель Грег Брокман стягивает на себя операционные полномочия в преддверии запланированного публичного размещения, а CNBC сообщил об уходе CRO 13 августа. А «Боб» уже год является известной целью для найма — согласно сообщениям от сентября 2025 года, Марк Цукерберг из Meta сделал вопрос «кто такой Боб?» постоянным пунктом на встречах по найму. Война за таланты вокруг этого конкретного набора навыков — реальность, и отчасти поэтому утечка выглядит правдоподобной.

Тем не менее в цепочке утверждений есть два непроверенных звена: то, что Скотт Грей — это Боб, и то, что упоминание в сводке относится к тому же уходу, о котором говорится в твите. Вполне возможно, что твит повторяет слух, появившийся раньше любого реального ухода. Этот раздел — честное резюме: официально старший GPU-инженер по имени Скотт Грей фигурирует в списке уходов на 2026 год; неофициально этот человек может быть или не быть тем Бобом, о котором говорится в твите.

Почему «в 2 раза медленнее» имеет значение — и почему, скорее всего, всё не так просто

Ядра определяют два числа, которые решают экономику модели: токенов в секунду и стоимость за токен. Если бы GPT-6.7 поставлялся на серверных ядрах вдвое менее эффективных, чем гипотетическая версия «Bob-optimized», то на том же оборудовании обслуживалось бы вдвое меньше токенов, а тот же запрос выполнялся бы вдвое дольше — при примерно вдвое большей предельной стоимости. Для разработчика, маршрутизирующего производственный трафик, это двукратное увеличение задержки и двукратный рост стоимости на флагмане — именно тот показатель, который меняет выбор модели. Вот почему у слуха есть основания.

Теперь причины не доверять этому:

• У "2x" нет указанного обоснования. Это число в посте — мысленный эксперимент, а не измерение, и на прикреплённом изображении его тоже нет.

• Ядра — это код, а код переживает авторов. Серверный стек, который Боб (или кто-либо ещё) написал для прежних моделей, не исчезает, когда человек уходит; следующая модель наследует большую его часть.

• Инфраструктурная организация OpenAI велика, и легенда о том, что «все пишет один человек», почти наверняка является упрощением. Риск, связанный с ключевыми сотрудниками, реален, но редко бывает бинарным.

• Даже реальное снижение эффективности не изменило бы возможности. Оно меняет стоимость и задержку — это болезненно, но вендор может частично поглотить это или компенсировать ценой, и OpenAI уже выпустил функцию скорости (Ultrafast, до 14 раз быстрее на текущем флагмане), нацеленную именно на такое давление стоимости обслуживания.

Самая сильная версия утверждения — это статистика «меньше сотни». Если человек, написавший serving-ядра для флагманской модели, ушёл, замена — это не наём по штатной численности, а многолетний процесс выхода на полную мощность. Это законный риск для экономики serving в OpenAI. Но это риск, относящийся к команде, а не измеренный факт о модели, которая ещё не выпущена.

Что мы на самом деле знаем о GPT-6.7

Модель, о которой идёт молва, имеет более длинный публичный след, чем предполагает твит, и большая часть его — недавняя:

• 31 октября 2025 г. — Сэм Альтман объявил в X, что «GPT-6» будет переименован в «GPT-6-7», что широко расценили как отсылку к сленгу поколения Alpha «6-7». Являются ли «GPT-6.7» и «GPT-6-7» строго одним и тем же, официально не подтверждено; в твите они используются как взаимозаменяемые, как и в большинстве публикаций.

• Апрель 2026 года — Сообщения о том, что предварительное обучение GPT-6 завершено, с предполагаемым выпуском около 14 апреля. Эта дата прошла без запуска.

• Август 2026 — Согласно утечкам, запуск был перенесён на начало августа, при этом OpenAI пропускает GPT-5.7 — GPT-5.9. Не подтверждено.

• 1 августа 2026 г. — OpenAI объявила «Astra» названием своего следующего семейства моделей, опубликовав исследовательский отчёт, в котором утверждается, что решено десять открытых математических задач. Будет ли Astra выпущена под именем GPT-6, не подтверждено.

• 7 августа 2026 г. — OpenAI приостановила разработку Astra и отложила выпуск после того, как внутренняя проверка безопасности отметила «критический» риск кибербезопасности — первая модель, вызвавшая такой уровень. Альтман заявил, что широкий выпуск «требует немного больше времени».

• Рынки прогнозов — По состоянию на середину августа трейдеры оценивали выпуск GPT-6 к 30 сентября примерно в 62%, а к 31 декабря — примерно в 90%.

• Слухи о характеристиках — контекст примерно на 2M токенов, производительность примерно на 40% выше текущего поколения, персонализированная память и нативная мультимодальная архитектура под кодовым названием «Symphony». Всё неподтверждено.

Итак, модель, стоящая за «2x slower», ещё не выпущена, у неё нет подтверждённой даты выхода, и она является предметом активной проверки безопасности. Привязанное к ней значение скорости обслуживания спекулятивно вдвойне — как по дате, так и по скорости.

A timeline infographic titled 'GPT-6.7 — the trail so far' with five milestone cards: Oct 31 2025 (renamed GPT-6-7 by Altman), Apr 2026 (pre-training reported done), Aug 1 2026 (Astra family name announced), Aug 7 2026 (safety pause: critical cyber risk), Aug 15 2026 (Bob departure rumor circulates); footer reads 'Timeline per OpenAI announcements and press reports; model unreleased as of Aug 15 2026.' OrcaRouter logo in the bottom-right corner.

Единственное табло, которое сегодня честно.

Поскольку GPT-6.7 пока не существует, табло может лишь сопоставить слух с тем, что реально доступно:

• GPT-6.7 (не выпущен) — статус: не выпущен; выход: предположительно осенью 2026; контекст: ~2M токенов (по слухам); скорость: «в 2 раза медленнее?» не подтверждено; цена: н/д; маршрутизация: пока нет.

• GPT-5.6 Sol (live) — статус: в работе; контекст: 1.05M токенов, макс. выход: 128K; скорость: ~290 ток/с по данным 7-дневной статистики OrcaRouter; цена: вход $5.00 / выход $30.00 за миллион токенов на стандартном входном тарифе; маршрутизация: да, по цене провайдера.

Интересный разрыв — в колонке цен. Текущий флагман OpenAI стоит $5/$30 за миллион токенов через OrcaRouter, а сквозная ставка — это собственная цена вендора с нулевой наценкой, так что какую бы цену OpenAI ни установила на GPT-6.7, число на нашей стороне изменится в тот же день, когда модель выйдет, без пересмотра условий. Это и есть полезная часть табло для всех, кто планирует что-то вокруг следующей модели.

A two-column scoreboard titled 'GPT-6.7 vs GPT-5.6 Sol — the scoreboard'. Left column GPT-6.7 (unreleased): Status not shipped, Release rumored autumn 2026, Context ~2M (rumored), Speed 2x slower? (unverified), Price n/a, On OrcaRouter not yet. Right column GPT-5.6 Sol (live): Status shipping, Release live now, Context 1.05M tokens, Speed ~290 tok/s, Price $5.00/$30.00 per M, On OrcaRouter yes at list price. Footer: 'GPT-6.7 figures rumored/unaudited; GPT-5.6 Sol per OrcaRouter model page.' OrcaRouter logo in the bottom-right corner.

Как устранить такую утечку

Это знакомый паттерн: невыпущенная модель, внушительная цифра, названное имя. Каждая часть правдоподобна, и ни одна не подтверждена. Правильный ответ — не игнорировать слух и не делать на него ставку, а структурировать решение так, чтобы не приходилось выбирать.

Это касается маршрутизации. Когда GPT-6.7 выйдет, способ проверить утверждение о двукратном замедлении, не ставя на кон продакшн-маршрут, — это поместить его за тот же endpoint, который вы уже используете: один API-ключ, автоматический переход на GPT-5.6 Sol в момент, когда новая модель показывает худшие результаты, и реальный трафик решает, была ли молва правдивой. Тогда это утверждение становится измерением, а не твитом. Если прайс-лист OpenAI изменится с новым релизом, передаваемая клиентам цена обновится в тот же день — OrcaRouter передаёт цены провайдеров без наценки, поэтому снижение (или повышение) цены вендора немедленно вступает в силу здесь, без пересмотра условий.

Между тем текущий флагман — это конкретная вещь. GPT-5.6 Sol уже доступен на OrcaRouter сегодня по цене $5/$30 за миллион токенов, с контекстом в 1,05 млн токенов и примерно 290 ток/с, как показывает табло. Режим Ultrafast, анонсированный 13 августа, — до 14 раз быстрее, примерно 750 токенов в секунду на инфраструктуре Cerebras — применим к этой модели, а не к GPT-6.7, и напоминает, что OpenAI может атаковать стоимость обслуживания как инфраструктурой, так и ядрами.

Screen capture of the OrcaRouter model page for GPT-5.6 Sol, showing the OpenAI flagship's pricing ($5.00 in / $30.00 out per million tokens), a 1.05M-token context window, 128K max output, Vision/Tools/JSON/Reasoning capability tags, and a p50 time-to-first-token of 1.87 seconds.

Что мы сейчас смотрим

• Подтвердится ли уход Боба. OpenAI не комментирует, кто такой Боб; ближайшее документально подтверждённое событие — имя Скотта Грея в списке уходов на 2026 год. Если OpenAI или Грей подтвердят это, первое звено цепочки станет фактом.

• Получит ли когда-либо обоснование цифра «в 2 раза медленнее». Если GPT-6.7 выйдет и появятся независимые замеры скорости, этот показатель перестанет быть слухом — его либо подтвердят, либо опровергнут. Пока же это просто число в посте.

Повлияет ли пауза безопасности Astra на сроки. Рынки прогнозов уже перенесли GPT-6 за пределы августа; статус «критически важной» системы и государственное тестирование, которое, по словам OpenAI, она хочет провести, — оба являются естественными источниками дальнейших задержек.

Пересортирует ли ядерный бенчмарк результаты. Если команда обслуживания OpenAI возьмёт потери на себя — или легенда преувеличивает вклад одного человека — весь слух становится неактуальным, и первым признаком будет производительность обслуживания следующей модели по сравнению с её предшественницей.

Честная оценка: «в 2 раза медленнее» — убедительная история, и пока что только она. Уход гуру ядра — реальная точка данных с реальным документальным следом; показатель скорости — просто цифра в твите. До выхода GPT-6.7 обоснованная позиция — планировать оба исхода: допустить, что слух может быть отчасти прав, и построить маршрутизацию так, чтобы тестирование флагмана, оказавшегося медленнее ожидаемого, ничего вам не стоило. В этом весь смысл маршрутизации модели, с которой вы ещё не встречались.

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube