Главная титульная карточка статьи «Сентябрьский день платформы Ope​nAI», с подзаголовком «GPT-Live-1 выходит в API, Agents API открывается в бета-версии», с бейджем «Оба анонса датированы 10 сентября 2026 года» и тремя карточками: «GPT-Live-1 в API: 0,05 $ за голосовую минуту, эндпоинт Live Sessions, один ID модели», «Agents API: публичная бета, харнесс Codex, хостируемые песочницы или свои собственные» и «Почему это важно: модель становится компонентом, который вы выбираете, а харнесс становится продуктом, который вы арендуете», над нижней полосой с надписью «Голосовые показатели заявлены Ope​nAI и не воспроизведены; цены Agents API — сквозные.» Логотип OrcaRouter наложен в правом нижнем углу.
Guides & Insights

Сентябрьский день платформы OpenAI: GPT-Live-1 появляется в API, а Agents API открывается в бета-версии

Автор

Elias Hawthorne

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

10 сентября 2026 года платформу Ope​nAI покинули две вещи, и у более тихой из них — больший радиус поражения. GPT-Live-1 — полнодуплексная голосовая модель, работающая внутри ChatGPT с 8 июля, — теперь доступна разработчикам по цене $0,05 за минуту голоса. Наряду с ней — и упомянутый в публикациях гораздо реже — Agents API вышел в открытую бету: тот же каркас, который запускает Codex, представленный как хостируемый продукт с управляемыми песочницами. Одно — голос получше. Другое — Ope​nAI продаёт то, что раньше было самой сложной частью создания агента.

Оба были взяты из первоисточников для этого материала: анонс Agents API от OpenAI, его пост в сообществе разработчиков, представляющий GPT-Live-1 в API, и документация для разработчиков по обоим. Там, где цифра исходит от OpenAI, а не от внешнего оценщика, она помечена как таковая ниже — и одна цифра действительно взята извне, что немного меняет картину.

A two-column scoreboard titled 'September 10, 2026 — what Ope​nAI shipped'. The left column, labelled GPT-Live-1 in the API, reads 'What it is: full-duplex voice model', 'Access: Live Sessions API, one model ID', 'Price: $0.05 per voice minute', 'Status: generally available since Sept 10, 2026', 'Independent score: 69.8% on the Artificial Analysis Speech to Speech Index', 'Catch: delegates its thinking to a backend model'. The right column, labelled Agents API, reads 'What it is: hosted agent runtime', 'Access: public beta, Codex harness', 'Price: no API fee; sandbox time is billed', 'Status: public beta since Sept 10, 2026', 'Evidence: Ope​nAI documentation only, no independent evaluation', 'Catch: US-only data residency, no Zero Data Retention'. The footer reads 'GPT-Live-1 voice benchmarks Ope​nAI-reported and unreproduced; the AA index figure is independently run.' The OrcaRouter logo is composited in the bottom-right corner.

Artificial Analysis в этом году начала публиковать Speech to Speech Index, и в нём есть строка GPT-Live-1: 69,8% — взвешенное среднее по речевому рассуждению, агентной производительности, предпочтениям в арене и успешности выполнения задач. Это ставит его на седьмое место среди одиннадцати оценённых моделей — позади GPT-Realtime-2.1 с 73,9%, модели, которую он заменяет, и позади Grok Voice Think Fast 2.0 с 79,0%. Независимая таблица результатов и собственная таблица бенчмарков OpenAI рассказывают не одну и ту же историю, и обе верны.

Что вышло — в порядке того, как это изменит вашу архитектуру

• Голос — GPT-Live-1 уже доступен в API как gpt-live-1, тарифицируется по цене $0,05 за минуту голоса с оплатой по секундам, при этом модель рассуждений на стороне бэкенда тарифицируется отдельно по своим собственным тарифам.

• Агенты — Agents API находится в открытой бете. Ope​nAI заявляет, что за сам API дополнительная плата не взимается; вы платите за токены модели, инструменты и время работы размещённого контейнера-песочницы.

• Песочницы — OpenAI теперь размещает среду выполнения, переиспользуя ту же инфраструктуру песочниц, что и Codex и ChatGPT, которую можно настраивать с помощью файлов, пакетов, навыков и плагинов.

• Среды — помимо собственной песочницы OpenAI, команды могут направлять агентов на свою инфраструктуру или на сторонних поставщиков песочниц из списка бета-партнёров.

Релиз голосовых функций — это история про модель. Agents API — это история про платформу, а истории про платформу — это те, что незаметно переориентируют кодовую базу.

Agents API: агент в одном POST

Основной вызов — это POST /v1/agents/sessions, отправляемый с заголовком Ope​nAI-Beta: agents=v1, а суть в том, что задачи, модели, инструментов и окружения достаточно, чтобы получить работающего агента обратно. SDK охватывают Python, TypeScript/JavaScript, Go, Java и Ruby.

Что делает его не просто обёрткой, так это то, что OpenAI управляет харнессом, а не поставляет его. Харнесс AgentKit имеет открытый исходный код и доступен для изучения, но работающий экземпляр принадлежит OpenAI — сжатие контекста на протяжении долгих сессий, поиск инструментов, программный вызов инструментов, поддержка MCP, пользовательские функции, встроенный веб-поиск и оркестрация субагентов с настраиваемой конкурентностью. Версионированные возможности харнесса выходят вместе с релизами моделей — и это интересное обязательство: каркас развивается в том же темпе, что и модели.

Для тех, кто потратил квартал на поддержку цикла — логика повторных попыток, обрезка контекста, маршрутизация инструментов, веерный запуск субагентов, который вечно приводит к утечке состояния, — это и есть настоящий продукт. А не вызов модели. Та обвязка вокруг него, которую вы больше не пишете.

Хостинговые песочницы — это та часть, к которой прилагается счёт.

Агентам, которые исполняют код, нужно где-то его исполнять, и бета-версия предлагает собственный ответ OpenAI: управляемая песочница, которая выполняет код, работает с файлами и создаёт артефакты, конфигурируемая с помощью пакетов, навыков и плагинов. Разработчиков, у которых уже есть защищённая среда исполнения, не принуждают к её использованию — в бета-версии доступны как bring-your-own-infrastructure, так и набор именованных партнёров по песочницам.

Два операционных предостережения стоит зафиксировать, прежде чем строить на этом. В бете размещение данных доступно только в США, а Zero Data Retention не поддерживается. Для регулируемой рабочей нагрузки эти два пункта решают, будет ли это пилотом или продуктивным путём, и именно такие детали обычно обнаруживаются поздно.

GPT-Live-1 в API: фиксированная поминутная тарификация — вот настоящее изменение

Сама голосовая модель не нова — она заменила Advanced Voice Mode внутри ChatGPT 8 июля — но коммерческая форма — новая. В линейке Realtime аудио измерялось в токенах, что означало, что для прогнозирования звонка требовалось моделировать расход аудио: сколько токенов стоит секунда тишины, как звонящий, говорящий поверх агента, меняет длину вывода. Фиксированные $0.05 за голосовую минуту сводят это к умножению. Час непрерывной открытой линии стоит $3.00. Средняя продолжительность в четыре минуты на тысячу звонков в день — это примерно $200 в день.

Сессии работают через эндпоинт Live Sessions с одним ID модели и без датированных снапшотов, которые можно закрепить. В документации описаны WebRTC, WebSockets и телефония/SIP как способы подключения, а опубликованное руководство по быстрому старту собирает вариант с WebRTC. В биллинге есть два счётчика, и только один из них — голосовой: каждый делегированный вызов рассуждения, вызов инструмента и веб-поиск тарифицируются по обычным тарифам бэкенд-модели.

Архитектура строится на делегировании. GPT-Live-1 ведёт разговор — много раз в секунду решая, продолжать ли слушать, сделать паузу, перебить или передать работу дальше, — и передаёт всё, что требует настоящих рассуждений, через асинхронную границу отдельному бэкенду, который продолжает работать, пока устный разговор идёт своим чередом. В документации описаны два режима: делегирование Responses, при котором OpenAI сам вызывает поддерживаемую модель Responses и предоставляет контекст разговора, и клиентское делегирование, при котором ваш собственный сервис предоставляет бэкенд и сохраняет контроль над выполнением, контекстом и тем, какие результаты доходят до голосового слоя. В опубликованном примере с Responses этот бэкенд — GPT-5.6 Terra, указанный в объекте delegation вместе со своими инструкциями и инструментами. На июльском запуске для потребителей это была GPT-5.5; публикации сообщества с тех пор указывают на GPT-6 Astra.

A screenshot of Ope​nAI's developer documentation page 'Agents' under the API section, headed 'Choose a runtime, connect tools, and manage multi-step work', showing a routing row reading 'Run an agent with the Codex harness managed by Ope​nAI — Agents API', and a comparison table with columns Agents API, Agents SDK and Responses API whose rows read 'Where the agent runs: Ope​nAI runs a managed Codex harness', 'State between tasks: saved session configuration, turns, and items' and 'Execution environment: Ope​nAI hosted sandbox, self-hosted sandbox, or no sandbox'.

Все ключевые показатели голосового слоя — собственные показатели OpenAI, и на момент написания их никто независимо не воспроизвёл: 80,1% по интерактивности в Full Duplex Bench v1.5 против 45,4% у GPT-Realtime-2.1, задержка смены реплики 0,798 секунды против 1,41 секунды, 87% успешных вызовов инструментов и 32% успешных прохождений в оценке банковской голосовой поддержки против 12,4% у модели, которую она заменяет. Последняя пара — честная: большое улучшение, и всё же система проваливает примерно две трети регламентированного рабочего процесса. Свидетельства сторонних клиентов существуют, но они скудны и корыстны: Yelp для телефонных бронирований, EliseAI и обучающая платформа Speak сообщают о почти 80%-ном сокращении числа прерываний по сравнению с их предыдущим стеком на основе поочерёдных реплик.

Независимый результат менее лестный, и его стоит поставить рядом со списком выше, а не под ним. В индексе Artificial Analysis Speech to Speech Index — одной сводной оценке по речевому рассуждению, агентной производительности, предпочтениям на арене и успешности выполнения задач — GPT-Live-1 находится на уровне 69,8%, ниже 73,9% у GPT-Realtime-2.1 и значительно ниже 79,0% у Gr​ok Voice Think Fast 2.0. Если читать эти два вместе, суть продукта становится ясной: Ope​nAI создала лучшую из доступных механику разговора, но не создала лучшего голосового агента, потому что рассуждение делегируется модели, которую индекс оценивает отдельно.

A screenshot of the Artificial Analysis Speech to Speech Index chart, updated September 2026, ranking eleven speech models by a weighted average of speech reasoning, agentic performance, arena preference and task success rate. Bars run left to right: Grok Voice Think Fast 2.0 at 79.0%, GPT-Realtime-2.1 at 73.9%, GPT-Realtime-2 at 73.6%, Grok Voice Think Fast at 72.3%, Gemini 3.1 Flash Live at 71.5%, GPT-Live-1 mini at 70.3%, GPT-Live-1 at 69.8%, Qwen-Audio-Omni at 66.8%, RealTime Omni at 64.2%, Qwen 3.x Omni at 63.9% and Gemini 2.5 Flash at 52.6%. Companion charts show time to first audio, where GPT-Live-1 sits mid-pack at 0.78 seconds, and cost per hour of input audio, where GPT-Live-1 is $4.42 against GPT-Realtime-2.1 at $10.75.

Два объявления — это одно объявление.

Если читать их вместе, эти релизы описывают одну и ту же реорганизацию с двух сторон. Agents API переносит цикл, песочницу и управление контекстом в хостируемый продукт. GPT-Live-1 переносит разговорную поверхность в тонкий фронтенд, который делегирует своё мышление куда-то ещё. В обоих случаях модель перестаёт быть тем, вокруг чего вы строите, и становится компонентом, который вы выбираете, — и в обоих случаях этот выбор представляет собой строку конфигурации, а не архитектурное обязательство.

Именно в этот стык и встраивается слой маршрутизации. OrcaRouter не обслуживает gpt-live-1: эндпоинт Live Sessions принадлежит только Ope​nAI, и мы его вовсе не маршрутизируем. С половиной, отвечающей за делегирование, история другая. Бэкенд, которому голосовой слой передаёт работу, говорит на Responses API, а это обычный вызов модели — модель, которую называет сам Ope​nAI в своём примере, GPT-5.6 Terra, доступна через OrcaRouter по прайс-листовой цене Ope​nAI: $2.00 за миллион входных токенов и $12.00 за миллион выходных, при этом эндпоинт Responses открыт. Делегирование на стороне клиента идёт дальше: оно позволяет вашему приложению само предоставлять бэкенд, а значит, модель за голосом может быть любым эндпоинтом, который вы контролируете. То же самое верно и для слота модели в Agents API: обвязка принадлежит Ope​nAI, но модель внутри — это выбор, который остаётся за вами, и примерно 190 моделей от одиннадцати вышестоящих провайдеров доступны через один ключ по прайс-листовой цене провайдера без какой-либо наценки сверху.

Конкретно, из этого следуют три вещи. Бэкенды можно A/B-тестировать на живом трафике, отредактировав одну строку, — так вы узнаёте, достаточно ли хорош дешёвый механизм рассуждений, прежде чем выделять под него телефонную линию. Отказоустойчивость может находиться под моделью делегирования, так что неудачный день у вышестоящего сервиса не обрушит вместе с собой разговор. А задачу можно запустить против нескольких бэкендов за один вызов через DSL маршрутизации или чтобы на неё одновременно ответила панель моделей с помощью объединения моделей — это полезно, как только вывод агента должен вызывать доверие, а не просто быть сгенерированным.

Что не входит ни в один из релизов

• Нет ввода изображений или видео в GPT-Live-1 — мультимодальная голосовая поверхность, которой обладают более старые режимы ChatGPT, всё ещё не реализована.

• На голосовом слое нет структурированных выходных данных, поэтому соответствие аргументов инструментов схеме должно обеспечиваться на уровне бэкенд-модели.

• Нет доступа к GPT-Live-1 на бесплатном уровне, а ограничения скорости исчисляются в количестве одновременных сессий — 25 на уровне 1, с ростом до 500 к уровню 5.

• В бета-версии Agents API нет Zero Data Retention и отсутствует возможность размещения данных за пределами США.

• Никакого независимого воспроизведения каких-либо показателей бенчмарка GPT-Live-1.

Ставка, которую OpenAI сделала 10 сентября, заключается в том, что разработчики хотят покупать обвязку и выбирать «мозг» отдельно. Первая половина этого теперь стала отдельной позицией. Вторая половина — это то, куда обрушится конкурентное давление следующих двенадцати месяцев, ведь хостируемая обвязка со сменным слотом для модели хороша лишь настолько, насколько хороши модели, которые в неё можно поставить, а сейчас это как раз та часть стека, которую OpenAI не контролирует в одиночку.

Часть с делегированием — совсем другая история: бэкенд, которому голосовой слой передаёт работу, — это обычный вызов модели, и GPT-5.6 Terra доступна через OrcaRouter по прейскурантной цене Ope​nAI с открытым эндпоинтом Responses.