
Yelp перевела миллион ресторанных звонков на GPT-Live-1 — и не говорит, что купила
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
Yelp заявляет, что с октября 2025 года обработала более миллиона звонков в рестораны через Yelp Host, и что по состоянию на 10 сентября 2026 года эти звонки работают на GPT-Live-1, полнодуплексной голосовой модели OpenAI. В том же объявлении GPT-Live-1 помещается внутрь Hatch, ИИ-платформы Yelp для коммуникаций сервисных компаний, которая, как описывает компания, управляет десятками миллионов лидов по голосовым, текстовым, email- и веб-каналам. Это крупнейшее промышленное внедрение полнодуплексной речевой модели, о котором кто-либо объявлял, — и оно появилось в обёртке самого неконкретного пресс-релиза, какой Yelp только мог написать. Yelp сообщает, что обработка звонков улучшилась, а количество переводов звонков снизилось. В нём не говорится, насколько, на скольких звонках и во сколько обошлось всё это.
Оба факта важны. Развёртывание — это реальное доказательство того, что модель, которая слушает, пока говорит, выдерживает контакт с реальным телефонным трафиком, а это больше, чем способен доказать любой бенчмарк. Молчание — это реальное доказательство того, что собственные показатели вендора были недостаточно лестными, чтобы их публиковать, — или что обязательства Yelp по раскрытию информации перед инвесторами более узки, чем его аппетит к маркетингу.
Что Yelp на самом деле выпустил
Архитектура — это то, что стоит понять, потому что это не голосовая модель Yelp. GPT-Live-1 — это внешний голосовой слой: именно с ним разговаривает звонящий, и именно он решает, когда продолжать слушать, когда вступать в диалог, а когда уступать. Под ним находятся собственные бизнес-данные Yelp и то, что компания называет интеллектом, созданным под конкретные задачи, — часы работы ресторана, доступность бронирований, меню, специальные предложения, зоны посадки и текущее состояние системы бронирования.
Это разделение — и есть весь продукт. GPT-Live-1 не знает, есть ли столик на четверых в 19:30 в пятницу. Он умеет вести разговор, который это выясняет. Задача модели — сделать общение похожим на телефонный звонок, а не на дерево меню; задача Yelp — сделать ответ правильным.
Заявленные поведенческие возможности Yelp конкретны по характеру, но расплывчаты по степени. Звонящие могут перебивать, менять тему на полуслове или говорить поверх фонового шума — и модель адаптируется. Система распознаёт тон звонящего — воодушевление, раздражение, нетерпение — и отвечает соответственно. Наложение языковых усовершенствований Yelp поверх GPT-Live-1 позволяет системе распознавать звонящих и отвечать им почти на любом языке, что решает реальную проблему ресторанов: пропущенный звонок из-за того, что никто в смене не говорит на языке звонящего, — это потерянная бронь, а не просто неудачный опыт.
Два операционных заявления — это именно то, за что оператор ресторана действительно готов платить. Yelp утверждает, что звонящие теперь говорят полными, естественными предложениями, а не короткими голосовыми командами, и что точность расшифровки после звонка повысилась, давая операторам более чистые записи. Первое — опережающий индикатор того, что люди перестали воспринимать агента как машину, с которой нужно говорить в обход. Второе — то, что обладает накопительной ценностью, потому что результат работы линии бронирования — это не только бронирование; это запись, а запись, которую никто не может прочитать, — это запись, по которой никто не может действовать.

Ахил Кудувалли Рамеш сказал полезную вещь
Директор по продукту Yelp привёл стандартную цитату — каждый звонок становится более разговорным и отзывчивым, исключительный опыт гостей, сотрудники освобождены, чтобы обслуживать гостей, а не отвечать на телефон, — а затем одно предложение, которое стоит больше, чем всё остальное в пресс-релизе. Yelp Host, по его словам, улавливает «возможности для получения дохода, которые иначе могли быть упущены».
Это честная формулировка для голосовых агентов в сфере гостеприимства, и она отличается от обычной риторики о замене рабочей силы. Ресторан покупает ИИ-хостес не для того, чтобы уволить хостес. Он покупает его потому, что во время обслуживания звонит телефон, никто не может ответить, и звонящий бронирует столик в другом месте. Миллион звонков, которые Yelp Host обработал с октября 2025 года, — это знаменатель для этого аргумента; и Yelp намеренно не раскрыла числитель, а именно сколько из этих звонков превратились в бронирования или заказы.
Тери Ю, руководитель мультимодального продукта OpenAI, представила то же внедрение с другой стороны, описав клиентов, использующих GPT-Live-1 для всего — от звонков для бронирования до планирования ремонта. Обе трактовки верны. Yelp продаёт вертикальное решение; OpenAI продаёт горизонтальное.
Экономика, которую никто не включил в релиз
GPT-Live-1 стоит $0.05 за минуту голоса, оплата по секундам, и модель была открыта для разработчиков 10 сентября 2026 года — в тот же день, когда появилось объявление Yelp. Этот тариф покрывает только голосовой слой. В документации OpenAI прямо указано, что серверные вызовы, совершаемые от имени модели, включая рассуждения и использование инструментов, которые она делегирует другой модели, оплачиваются по обычным тарифам этой модели.
Сопоставьте это с цифрами Yelp. Звонок для бронирования столика в ресторане короткий — пара минут, иногда меньше. Миллион звонков по две минуты каждый — это примерно два миллиона голосовых минут, или около $100 000 расходов на голосовой слой за всю историю продукта. Для Yelp это погрешность округления, и в этом суть: при $0,05 за минуту голосовой слой — не самая дорогая часть системы. Дорогостоящие части — это рассуждения, стоящие за каждым ходом диалога, телефония, интеграция с книгой бронирований каждого ресторана и люди, которые обрабатывают то, с чем агент не справляется.
Это также означает, что ставка за минуту — не тот показатель, о котором стоит вести переговоры. Голосовой агент, который отвечает за один ход, потому что правильно делегировал задачу, обходится дешевле, чем тот, который барахтается девяносто секунд, хотя оба тарифицируются посекундно. Утверждение Yelp о том, что число переводов снизилось, при всей своей расплывчатости является утверждением о затратах.
Рассуждение за голосом — это обычный вызов модели, и именно этот слой в подобном развёртывании действительно поддаётся настройке.190 моделей от одиннадцати вышестоящих провайдеров доступны через один ключ OrcaRouter по прайс-листовой цене провайдеров без наценки, с автоматическим переключением при ошибке или тайм-ауте бэкенда — поэтому модель, выполняющую рассуждения для бронирования в стиле Yelp, можно заменить или протестировать A/B на живом трафике звонков, изменив одно значение конфигурации, а не перестраивая интеграцию. Именно здесь сосредоточены и деньги, и качество; тарифицируемые минуты голосового слоя относительно фиксированы.

Данные — это ров, а не модель
Любой конкурент может завтра купить GPT-Live-1. Toast, Square, Clover, ServiceTitan и Housecall Pro находятся достаточно близко к одним и тем же клиентам, а Google и Amazon Alexa+ работают над той же проблемой со стороны потребителя. Ничто в позиции Yelp не зависит от эксклюзивного доступа к модели, и собственная формулировка Yelp — проприетарные бизнес-данные плюс интеллект, созданный для конкретных задач, с GPT-Live-1 в качестве слоя, который говорит — признаёт это.
То, чем владеет Yelp, — это граф бронирований: в каких ресторанах есть столики, когда, на сколько человек, и накопленное потребительское намерение, стоящее за миллионом звонков. Модель, которую можно прервать, — обязательное условие для сбора этих данных в масштабе, потому что агент с поочерёдными репликами порождает более короткие звонки, больше сбросов и более грязные транскрипты. Вот почему развёртывание имеет значение, даже если цифры не раскрываются. Полный дуплекс в этом контексте — не более приятный пользовательский опыт; это механизм сбора данных.

Что посмотреть
Три вещи превратили бы эту историю внедрения из правдоподобной в измеримую. Следующий отчётный звонок Yelp — если руководство назовёт цифру по сокращению числа звонков или конверсии бронирований. Вторая вертикаль, объявившая о такой же интеграции, — это показало бы, является ли полнодуплексный голос универсальным улучшением или специфичным для сферы гостеприимства. И первая независимая оценка GPT-Live-1 в рейтинге, который оценивает рассуждения, а не механику разговора, — индекс Artificial Analysis Speech to Speech сейчас ставит его на 70,3%, наравне с GPT-Live-1 mini и на разделённое шестое место в рейтинге из четырнадцати моделей, позади Grok Voice Think Fast 2.0 High с 79,0% и GPT-Realtime-2.1 High с 73,9%. Собственная архитектура Yelp — это неявная ставка на то, что голосовой слой и слой рассуждений следует оценивать отдельно. Независимое оценивание пока что согласуется со второй половиной этой ставки, но не с первой.
Пока Yelp не опубликует, что именно изменилось, остальные из нас читают анонс развёртывания, посвящённый её архитектуре, а не результатам. Это всё равно стоит делать, потому что архитектура — это та часть, которую другие команды могут скопировать в этом квартале.
