
Агент «o» от OpenAI: что на самом деле говорит утечка с DevDay 2026, а что — нет
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 610 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 189 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
Название, о котором сообщается, — наименее интересная часть. Утечка говорит о постоянно работающем агенте компании следующее: его назовут "o", он будет присутствовать в каждом тарифе ChatGPT Pro, а к нему привязан Fast Mode — работающий на кремниевых чипах Cerebras. Но деталь, на которой стоит задержаться, меньше и страннее этого: сообщается, что упоминание было замечено на странице апгрейда для тарифа Pro за $100, а не за $200, в тот же месяц, когда компания вообще перестала продавать тариф за $200. Нет ни страницы продукта, ни цены, ни идентификатора модели, ни заявления компании, где эта буква использовалась бы как название продукта. Пост, лежащий в основе этой статьи, — это пересказ одного аккаунта о том, что он, по его словам, видел, а конференция, к которой всё это привязано, реальна: DevDay 2026 состоится 29 сентября в Fort Mason Center в Сан-Франциско. Агент, с которым он конкурирует, тоже реален — Grok Bot, продукт «цифровой сотрудник», который SpaceXAI выпустил в раннюю бету 11 августа. Модель, на которой, предположительно, будет работать агент, реальна и имеет дату: GPT-6 Astra, общедоступна с 3 сентября. Почти ничего остального в этом утверждении не соответствует действительности.
Из чего на самом деле состоит утечка, отсортировано по весу
Сообщается о трёх вещах, и они не заслуживают того, чтобы их воспринимали как одно утверждение.
Упоминания, запечатлённые на скриншотах, — самая сильная часть. В репортаже, опубликованном 26 сентября, говорится, что упоминания «O» встречаются по всей собственной конфигурации ChatGPT — как отображаемое имя и как почтовый суффикс, записанный в виде «-o», — и что та же строка недавно была указана как преимущество на странице обновления до плана ChatGPT Pro за $100. Это артефакты, связанные с развёртыванием, а не выдумка: конфигурационные поверхности — это место, где компания готовит продукт перед его анонсом, точно так же, как это делают флаги функций. Это ещё и самый слабый тип доступных артефактов, потому что подготовленную строку можно переименовать, перепрофилировать или забросить, и она не несёт с собой никакого поведения. В отчёте прямо указывается на этот пробел: что делает агент, к чему он может иметь доступ, планирует ли он что-либо, как долго он помнит и кто его получает, — всё это не указано.
Название — это утверждение второго порядка. Приостановленный аккаунт @o в X приводится как возможное резервирование. Приостановленный никнейм — это точка данных о намерении в какой-то момент, а не о том, чем является продукт, и эта же буква уже однажды прошла через отдел нейминга OpenAI — подробнее об этом ниже.
Третий слой — это часть, которая пришла из сигнала этой недели, а не из репортажа: что «o» присутствует во всех тарифах Pro, что Fast Mode подтверждён, что он, предположительно, входит в тариф подписки за $500, и что именно кремний Cerebras делает такую скорость возможной. «Предположительно» в этом предложении выполняет заметную работу. Сам сигнальный пост усечён в снимке, который сделал радар, — его пятый пункт начинается с «shared m…» и обрывается, — так что воспринимайте список как неполный, а не как пять окончательно установленных пунктов.
Проблема именования, которую никто не проверял
OpenAI уже использовала эту букву. Её модели рассуждений выпускались под названиями o1, o3, o3-mini и o4-mini на протяжении 2024 и 2025 годов, и эта линейка была свёрнута, а не расширена: o4-mini была удалена из ChatGPT в феврале 2026 года, GPT-4.5 ушла в июне, а для o3 был объявлен 90-дневный период сворачивания согласно примечаниям к выпуску модели от 28 мая — об этом уходе этот блог писал в то время, поскольку пользователи сообщали об исчезающих ответах ещё до крайнего срока.
Итак, голое «o» в качестве имени потребительского агента конфликтовало бы с недавней историей самой компании и было бы двусмысленным в единственном месте, где двусмысленность обходится дорого: в селекторе модели. Это не доказывает, что утечка неверна, — вендоры переиспользуют буквы, а внутреннее кодовое имя часто умирает на этапе проверки названий, — но это причина относиться к имени как к самой легко заменяемой части истории. Если «o» выйдет под другим названием, все датированные факты ниже остаются в силе.
Почему тайминг правдоподобен, хотя сам продукт — нет
Самое сильное доказательство запуска агента на DevDay — не утечка. Это то, что OpenAI уже успела подготовить за четыре недели до него.
• 3 сентября — GPT-6 Astraдостигла общего доступа как фронтирная модель OpenAI: контекст в 1,05 млн токенов, максимальный объём вывода 128 тыс. токенов, заявленная цена — $10,00 за миллион входных токенов и $50,00 за миллион выходных, при этом кэшированный ввод стоит $1,00, а запись в кэш — $12,50. В нашем собственном каталоге эта же модель указана с датой листинга 2026-09-04; Artificial Analysis датирует релиз 3 сентября.
• 10 сентября — OpenAI открыла Agents API в публичной бете, предлагая разработчикам управляемый каркас Codex: OpenAI выполняет оркестрацию, сжатие контекста и восстановление, а разработчик предоставляет задачу, модель, инструменты и среду. Это инфраструктура постоянно работающего агента, продаваемая как продукт для разработчиков.
• 10 сентября — в тот же день были приостановлены новые регистрации и переходы на план ChatGPT Pro за $200; причиной назвали спрос на GPT-6 Astra. Тариф за $100, Plus, Go, Business и Enterprise, а также API остались открытыми.
• 22 сентября — GPT-6 Sol и GPT-6 Luna вышли по цене $2.00 / $10.00 и $0.10 / $0.50 за миллион токенов, которые OpenAI назвала постоянными, а не промоакционными, расширяя дешёвый сегмент линейки, к которому агент будет обращаться для рутинной работы.
• 26 сентября — документация уровня обслуживания Ultrafast расширилась: в Responses API Playground был замечен неопубликованный селектор скорости с вариантами Standard, Fast и Ultrafast, а сообщения указывают на более широкое развёртывание около DevDay.
• 29 сентября — DevDay 2026, пленарный доклад транслируется в прямом эфире, открывает Сэм Альтман. Аккаунт разработчиков OpenAI опубликовал «72 часа до OpenAI DevDay» в те же выходные, когда вышел отчёт об агенте.

Прочитайте эти шесть строк вместе — и структура истории становится связной: OpenAI превратила агентную обвязку в продукт, продала её разработчикам, ограничила потребительский тариф, в котором доступна её лучшая модель, а через четыре дня у неё ключевой доклад. Потребительская версия той же обвязки — продаваемая по подписке, а не через эндпоинт с оплатой за токен, — очевидный следующий шаг. Ничего из этого не делает название, уровень или связь с Cerebras подтверждёнными. Это делает сроки правдоподобными — а это другое и более слабое утверждение.
Fast Mode, Ultrafast и утверждение Cerebras
Сигнал говорит, что Fast Mode «подтверждён» и что чип Cerebras «начинает действовать». Их нужно отделить друг от друга, потому что одно — это задокументированная инфраструктура платформы, а другое — вывод о том, какой чип обслуживает какой продукт.
Fast mode — это реальный, тарифицируемый уровень в API OpenAI для линейки GPT-6: он тарифицируется по двойному стандартному тарифу и обеспечивает примерно 2,5-кратную скорость вывода, и это тот же уровень, который был переименован из Priority processing 30 июля 2026 года — API принимает либо service_tier: "fast", либо service_tier: "priority". Он недоступен при включённом хранении данных в ЕС как минимум для одной модели в линейке. Внутри подписки ChatGPT, согласно отчётности о структуре кредитов подписки, Fast mode стоит 2,5× от базовой ставки кредитов, а не 2×, как в API, из-за чего самая быстрая настройка оказывается чуть менее выгодной внутри ChatGPT, чем вне его — деталь, которую стоит знать, прежде чем предполагать, что преимущество Fast Mode стоит того, как это звучит.
Ultrafast — это тариф Cerebras, и это совсем другая история. OpenAI анонсировала его 13 августа 2026 года как первый продукт своего партнёрства в области вычислений с Cerebras — сделка, по сообщениям, оценивается примерно в 10 миллиардов долларов за три года — и он обеспечивает до 14-кратной стандартной пропускной способности и до 750 выходных токенов в секунду на GPT-5.6 Sol, модели, на которую он сейчас распространяется. Доступ к нему контролируется, опубликованной цены нет, и по состоянию на эту неделю он всё ещё остаётся тарифом со списком ожидания, а не общедоступным. В справочнике Responses API ultrafast указан как значение для параметра service_tier с оговоркой, что он «в настоящее время доступен для gpt-5.6-sol».
Именно поэтому предложение из утечки о Cerebras следует рассматривать как догадку с правдоподобным основанием, а не как подтверждение. Для потребительского агента, который работает непрерывно, главным ограничением были бы задержка и стоимость одной задачи, и скорость класса Cerebras — это реальный ответ на первую половину этой проблемы. Но пока нет ни документированного пути Ultrafast ни для одной модели GPT-6, ни тарифной сетки для него, ни чего-либо от OpenAI, что связывало бы потребительского агента с этим кремнием. Направление вывода разумно; уверенность в формулировке не подкреплена.
Во что вам обойдётся «доступно во всех тарифах Pro»
Это та часть утверждения, которую читатель действительно может оценить, поскольку лежащая в его основе структура уровней опубликована.
• Ежемесячные цены — тарифы ChatGPT Pro за $100 и $200 оба продавались до сентября включительно; приём новых подписчиков на тариф за $200 приостановлен с 10 сентября, и OpenAI не опубликовала никакого порога для возобновления.
• Версия той же возможности с лимитами — GPT-6 Pro ограничен 200 сообщениями в неделю на плане за $200 и 50 в неделю на плане за $100, причём последние берутся из квоты, общей с GPT-5.6 Sol Pro. Бизнес-тарифы — ещё ниже. Это опубликованные OpenAI цифры, и именно они задают реальный предел того, чего стоит «преимущество на странице апгрейда».
• Арифметика токенов для базовой модели — при $10.00 / $50.00 за миллион, $500 в GPT-6 Astra API — это примерно 50 млн входных токенов или 10 млн выходных токенов, а выше порога в 272K входных токенов эффективная работа снова сокращается вдвое, поскольку весь запрос пересчитывается по цене $20.00 / $2.00 / $75.00.
• Более дешёвая половина линейки — на те же $500 можно получить примерно 250 млн входных или 50 млн выходных токенов на GPT-6 Sol по $2,00 / $10,00, а в десять раз больше — на GPT-6 Luna по $0,10 / $0,50.
Если агент появляется внутри существующей подписки, сравнение перестаёт быть про цену по прайс-листу и становится про то, за какое место вы уже платите. Если он появляется отдельной строкой в счёте, OpenAI приходится обосновывать его в категории, где конкурент уже шесть недель выпускает продукт. В любом случае постоянно активный агент меняет структуру счёта: ассистент, который продолжает работать, пока вы спите, расходует токены без участия человека, и именно такую рабочую нагрузку наказывает тариф с оплатой по потреблению, а тариф за место поглощает. Это также та нагрузка, в которой кэшированный ввод по цене в одну десятую от свежего ввода определяет итог: постоянный агент повторно отправляет почти неизменный контекст на каждом шаге, а это как раз тот паттерн, для которого создана скидка за кэширование.
Это тот уровень, на котором работает OrcaRouter, и стоит прямо сказать, чего он не покрывает. Мы маршрутизируем модели OpenAI по токенам с ценой из прайс-листа провайдера, передаваемой без наценки — 0%, поэтому изменение тарифа вендора отражается здесь в тот же день, вместе с автоматическим переключением при сбое между провайдерами и DSL маршрутизации для компоновки вызовов. GPT-6 Astra, GPT-5.6 Sol, GPT-6 Sol и GPT-6 Luna — всё на одном ключе. Чего мы не можем вам продать, так это подписку ChatGPT или агента, которого ещё не существует — маршрутизировать нечего, пока OpenAI его не выпустит.
Планка, которую агент должен преодолеть, ниже, чем кажется.
Grok Bot — это сравнение, которое делает сама утечка, и честная интерпретация этого такова: SpaceXAI установила низкую планку. Он вышел в раннюю бету 11 августа в начальной конфигурации за $120 за место, включённой в Cursor Premium Teams, с индивидуальными тарифами за $200 и $300 в месяц, а использование сверх включённых лимитов оплачивается по стоимости токенов. Каждый бот получает собственную облачную ВМ с браузером, файловой системой и терминалом; он выполняет вход в приложения, у которых нет API; он сохраняет показанные рабочие процессы как рутины и продолжает работу после закрытия ноутбука.
Не опубликована как раз та часть, которая позволила бы что-то решить. SpaceXAI не выпустила никаких независимых бенчмарков или данных о надёжности для него, модельный роутер за ним работает автоматически, и пользователи не могут закрепить модель, ранние тестировщики публично не высказали восторга, а обозреватели отмечают отсутствие корпоративного уровня контроля — нет разрешений с ограниченной областью действия, правил эскалации или журнала аудита. Muse от Meta последовал 8 сентября, пополнив категорию, в которой теперь три продукта.

Эта последняя строка — суть всего сравнения. Индекса Artificial Analysis для вопроса «выполнил ли агент задачу, не сделав ничего катастрофического» не существует, поэтому постоянный агент покупается на тех же основаниях, на каких в 2023 году покупали чат-бота: демо и вайбы. Единственное датированное ограничение, о котором никто в этой истории не упоминает, — это собственная позиция OpenAI в области безопасности. GPT-6 Astra достигла критического порога возможностей компании в области кибербезопасности, и OpenAI предупредила, что мониторинг может замедлять, приостанавливать или останавливать легитимные задачи — в том числе, как прямо указано, длительные задания. Постоянно работающий агент по определению является длительным заданием — на платформе, которая уже заявила, что может прервать такое задание.
Что сделало бы это проверяемым и когда?
Слухи о продукте за четыре дня до выхода дёшевы, а проверки конкретны.
• Страница OpenAI, примечание к выпуску или статья в справочном центре, где это название используется как название продукта. Пока ничего не появилось, и история этой буквы внутри OpenAI делает этот тест тем, у которого больше всего шансов провалиться.
• Поверхность конфигурации, которая переживает обновление, — по-настоящему покупаемый тариф, указанная квота, страница настроек — а не строка отображения, зашитая в сборку.
• Любая спецификация поведения вообще: что ему может быть предоставлено, что оно планирует, как долго оно помнит, есть ли у него собственная почтовая идентичность в продакшене или только в конфигурационном файле.
• Цена. «Во всех тарифах Pro» — это не цена, и тариф за $500 не становится фактом из-за того, что отдельный отчёт обнаружил строки подписки за $500 в другом месте.
• Либо ссылка на Cerebras появится в собственной документации OpenAI по обслуживанию для этого уровня — так же, как это было с ограничением Ultrafast до GPT-5.6 Sol, — либо не появится вовсе.

Решение, к которому это подводит читателя, меньше, чем подразумевает утечка, и оно не о письме. Если вы оцениваете постоянно работающего агента для рабочих задач, существующий сегодня продукт — это Grok Bot, и разумный шаг — короткий пробный прогон на вашем собственном рабочем процессе, а не обязательство по количеству мест — его начальный тариф за $120 — это нижний порог, а не потолок, а использование сверх включённых лимитов тарифицируется по стоимости токенов. Если вы разрабатываете, Agents API находится в публичной бете с 10 сентября, и это та часть этой истории, которую вы действительно можете протестировать сегодня: тестовый стенд, песочница и биллинг — всё задокументировано.
И если вы оцениваете, во сколько обойдётся запуск всего этого, делайте это по моделям, а не по слухам. GPT-6 Astra по цене $10,00 / $50,00 за миллион токенов уже доступна на OrcaRouter по собственной прайсовой цене OpenAI без наценки, GPT-6 Sol и GPT-6 Luna там же по $2,00 / $10,00 и $0,10 / $0,50, а ставка за чтение из кэша — $1,00 против $10,00 у Astra — это та строка, которая определяет, во сколько на самом деле обходится постоянная рабочая нагрузка. Агента, которого OpenAI не анонсировала, нельзя ни протестировать, ни маршрутизировать, ни купить. А вот токены, лежащие в его основе, можно — уже сегодня, и счётчик, который вы построите с опорой на них, останется правильным счётчиком, даже если название на коробке окажется не одной буквой, а чем-то иным.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
