
Сентябрьский день платформы OpenAI: GPT-Live-1 появляется в API, а Agents API открывается в бета-версии
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
10 сентября 2026 года платформу OpenAI покинули две вещи, и у более тихой из них — больший радиус поражения. GPT-Live-1 — полнодуплексная голосовая модель, работающая внутри ChatGPT с 8 июля, — теперь доступна разработчикам по цене $0,05 за минуту голоса. Наряду с ней — и упомянутый в публикациях гораздо реже — Agents API вышел в открытую бету: тот же каркас, который запускает Codex, представленный как хостируемый продукт с управляемыми песочницами. Одно — голос получше. Другое — OpenAI продаёт то, что раньше было самой сложной частью создания агента.
Оба были взяты из первоисточников для этого материала: анонс Agents API от OpenAI, его пост в сообществе разработчиков, представляющий GPT-Live-1 в API, и документация для разработчиков по обоим. Там, где цифра исходит от OpenAI, а не от внешнего оценщика, она помечена как таковая ниже — и одна цифра действительно взята извне, что немного меняет картину.

Artificial Analysis в этом году начала публиковать Speech to Speech Index, и в нём есть строка GPT-Live-1: 69,8% — взвешенное среднее по речевому рассуждению, агентной производительности, предпочтениям в арене и успешности выполнения задач. Это ставит его на седьмое место среди одиннадцати оценённых моделей — позади GPT-Realtime-2.1 с 73,9%, модели, которую он заменяет, и позади Grok Voice Think Fast 2.0 с 79,0%. Независимая таблица результатов и собственная таблица бенчмарков OpenAI рассказывают не одну и ту же историю, и обе верны.
Что вышло — в порядке того, как это изменит вашу архитектуру
• Голос — GPT-Live-1 уже доступен в API как gpt-live-1, тарифицируется по цене $0,05 за минуту голоса с оплатой по секундам, при этом модель рассуждений на стороне бэкенда тарифицируется отдельно по своим собственным тарифам.
• Агенты — Agents API находится в открытой бете. OpenAI заявляет, что за сам API дополнительная плата не взимается; вы платите за токены модели, инструменты и время работы размещённого контейнера-песочницы.
• Песочницы — OpenAI теперь размещает среду выполнения, переиспользуя ту же инфраструктуру песочниц, что и Codex и ChatGPT, которую можно настраивать с помощью файлов, пакетов, навыков и плагинов.
• Среды — помимо собственной песочницы OpenAI, команды могут направлять агентов на свою инфраструктуру или на сторонних поставщиков песочниц из списка бета-партнёров.
Релиз голосовых функций — это история про модель. Agents API — это история про платформу, а истории про платформу — это те, что незаметно переориентируют кодовую базу.
Agents API: агент в одном POST
Основной вызов — это POST /v1/agents/sessions, отправляемый с заголовком OpenAI-Beta: agents=v1, а суть в том, что задачи, модели, инструментов и окружения достаточно, чтобы получить работающего агента обратно. SDK охватывают Python, TypeScript/JavaScript, Go, Java и Ruby.
Что делает его не просто обёрткой, так это то, что OpenAI управляет харнессом, а не поставляет его. Харнесс AgentKit имеет открытый исходный код и доступен для изучения, но работающий экземпляр принадлежит OpenAI — сжатие контекста на протяжении долгих сессий, поиск инструментов, программный вызов инструментов, поддержка MCP, пользовательские функции, встроенный веб-поиск и оркестрация субагентов с настраиваемой конкурентностью. Версионированные возможности харнесса выходят вместе с релизами моделей — и это интересное обязательство: каркас развивается в том же темпе, что и модели.
Для тех, кто потратил квартал на поддержку цикла — логика повторных попыток, обрезка контекста, маршрутизация инструментов, веерный запуск субагентов, который вечно приводит к утечке состояния, — это и есть настоящий продукт. А не вызов модели. Та обвязка вокруг него, которую вы больше не пишете.
Хостинговые песочницы — это та часть, к которой прилагается счёт.
Агентам, которые исполняют код, нужно где-то его исполнять, и бета-версия предлагает собственный ответ OpenAI: управляемая песочница, которая выполняет код, работает с файлами и создаёт артефакты, конфигурируемая с помощью пакетов, навыков и плагинов. Разработчиков, у которых уже есть защищённая среда исполнения, не принуждают к её использованию — в бета-версии доступны как bring-your-own-infrastructure, так и набор именованных партнёров по песочницам.
Два операционных предостережения стоит зафиксировать, прежде чем строить на этом. В бете размещение данных доступно только в США, а Zero Data Retention не поддерживается. Для регулируемой рабочей нагрузки эти два пункта решают, будет ли это пилотом или продуктивным путём, и именно такие детали обычно обнаруживаются поздно.
GPT-Live-1 в API: фиксированная поминутная тарификация — вот настоящее изменение
Сама голосовая модель не нова — она заменила Advanced Voice Mode внутри ChatGPT 8 июля — но коммерческая форма — новая. В линейке Realtime аудио измерялось в токенах, что означало, что для прогнозирования звонка требовалось моделировать расход аудио: сколько токенов стоит секунда тишины, как звонящий, говорящий поверх агента, меняет длину вывода. Фиксированные $0.05 за голосовую минуту сводят это к умножению. Час непрерывной открытой линии стоит $3.00. Средняя продолжительность в четыре минуты на тысячу звонков в день — это примерно $200 в день.
Сессии работают через эндпоинт Live Sessions с одним ID модели и без датированных снапшотов, которые можно закрепить. В документации описаны WebRTC, WebSockets и телефония/SIP как способы подключения, а опубликованное руководство по быстрому старту собирает вариант с WebRTC. В биллинге есть два счётчика, и только один из них — голосовой: каждый делегированный вызов рассуждения, вызов инструмента и веб-поиск тарифицируются по обычным тарифам бэкенд-модели.
Архитектура строится на делегировании. GPT-Live-1 ведёт разговор — много раз в секунду решая, продолжать ли слушать, сделать паузу, перебить или передать работу дальше, — и передаёт всё, что требует настоящих рассуждений, через асинхронную границу отдельному бэкенду, который продолжает работать, пока устный разговор идёт своим чередом. В документации описаны два режима: делегирование Responses, при котором OpenAI сам вызывает поддерживаемую модель Responses и предоставляет контекст разговора, и клиентское делегирование, при котором ваш собственный сервис предоставляет бэкенд и сохраняет контроль над выполнением, контекстом и тем, какие результаты доходят до голосового слоя. В опубликованном примере с Responses этот бэкенд — GPT-5.6 Terra, указанный в объекте delegation вместе со своими инструкциями и инструментами. На июльском запуске для потребителей это была GPT-5.5; публикации сообщества с тех пор указывают на GPT-6 Astra.

Все ключевые показатели голосового слоя — собственные показатели OpenAI, и на момент написания их никто независимо не воспроизвёл: 80,1% по интерактивности в Full Duplex Bench v1.5 против 45,4% у GPT-Realtime-2.1, задержка смены реплики 0,798 секунды против 1,41 секунды, 87% успешных вызовов инструментов и 32% успешных прохождений в оценке банковской голосовой поддержки против 12,4% у модели, которую она заменяет. Последняя пара — честная: большое улучшение, и всё же система проваливает примерно две трети регламентированного рабочего процесса. Свидетельства сторонних клиентов существуют, но они скудны и корыстны: Yelp для телефонных бронирований, EliseAI и обучающая платформа Speak сообщают о почти 80%-ном сокращении числа прерываний по сравнению с их предыдущим стеком на основе поочерёдных реплик.
Независимый результат менее лестный, и его стоит поставить рядом со списком выше, а не под ним. В индексе Artificial Analysis Speech to Speech Index — одной сводной оценке по речевому рассуждению, агентной производительности, предпочтениям на арене и успешности выполнения задач — GPT-Live-1 находится на уровне 69,8%, ниже 73,9% у GPT-Realtime-2.1 и значительно ниже 79,0% у Grok Voice Think Fast 2.0. Если читать эти два вместе, суть продукта становится ясной: OpenAI создала лучшую из доступных механику разговора, но не создала лучшего голосового агента, потому что рассуждение делегируется модели, которую индекс оценивает отдельно.

Два объявления — это одно объявление.
Если читать их вместе, эти релизы описывают одну и ту же реорганизацию с двух сторон. Agents API переносит цикл, песочницу и управление контекстом в хостируемый продукт. GPT-Live-1 переносит разговорную поверхность в тонкий фронтенд, который делегирует своё мышление куда-то ещё. В обоих случаях модель перестаёт быть тем, вокруг чего вы строите, и становится компонентом, который вы выбираете, — и в обоих случаях этот выбор представляет собой строку конфигурации, а не архитектурное обязательство.
Именно в этот стык и встраивается слой маршрутизации. OrcaRouter не обслуживает gpt-live-1: эндпоинт Live Sessions принадлежит только OpenAI, и мы его вовсе не маршрутизируем. С половиной, отвечающей за делегирование, история другая. Бэкенд, которому голосовой слой передаёт работу, говорит на Responses API, а это обычный вызов модели — модель, которую называет сам OpenAI в своём примере, GPT-5.6 Terra, доступна через OrcaRouter по прайс-листовой цене OpenAI: $2.00 за миллион входных токенов и $12.00 за миллион выходных, при этом эндпоинт Responses открыт. Делегирование на стороне клиента идёт дальше: оно позволяет вашему приложению само предоставлять бэкенд, а значит, модель за голосом может быть любым эндпоинтом, который вы контролируете. То же самое верно и для слота модели в Agents API: обвязка принадлежит OpenAI, но модель внутри — это выбор, который остаётся за вами, и примерно 190 моделей от одиннадцати вышестоящих провайдеров доступны через один ключ по прайс-листовой цене провайдера без какой-либо наценки сверху.
Конкретно, из этого следуют три вещи. Бэкенды можно A/B-тестировать на живом трафике, отредактировав одну строку, — так вы узнаёте, достаточно ли хорош дешёвый механизм рассуждений, прежде чем выделять под него телефонную линию. Отказоустойчивость может находиться под моделью делегирования, так что неудачный день у вышестоящего сервиса не обрушит вместе с собой разговор. А задачу можно запустить против нескольких бэкендов за один вызов через DSL маршрутизации или чтобы на неё одновременно ответила панель моделей с помощью объединения моделей — это полезно, как только вывод агента должен вызывать доверие, а не просто быть сгенерированным.
Что не входит ни в один из релизов
• Нет ввода изображений или видео в GPT-Live-1 — мультимодальная голосовая поверхность, которой обладают более старые режимы ChatGPT, всё ещё не реализована.
• На голосовом слое нет структурированных выходных данных, поэтому соответствие аргументов инструментов схеме должно обеспечиваться на уровне бэкенд-модели.
• Нет доступа к GPT-Live-1 на бесплатном уровне, а ограничения скорости исчисляются в количестве одновременных сессий — 25 на уровне 1, с ростом до 500 к уровню 5.
• В бета-версии Agents API нет Zero Data Retention и отсутствует возможность размещения данных за пределами США.
• Никакого независимого воспроизведения каких-либо показателей бенчмарка GPT-Live-1.
Ставка, которую OpenAI сделала 10 сентября, заключается в том, что разработчики хотят покупать обвязку и выбирать «мозг» отдельно. Первая половина этого теперь стала отдельной позицией. Вторая половина — это то, куда обрушится конкурентное давление следующих двенадцати месяцев, ведь хостируемая обвязка со сменным слотом для модели хороша лишь настолько, насколько хороши модели, которые в неё можно поставить, а сейчас это как раз та часть стека, которую OpenAI не контролирует в одиночку.
Часть с делегированием — совсем другая история: бэкенд, которому голосовой слой передаёт работу, — это обычный вызов модели, и GPT-5.6 Terra доступна через OrcaRouter по прейскурантной цене OpenAI с открытым эндпоинтом Responses.
