Титульная hero-карточка с заголовком «Claude Voice: скрытая вкладка Preview» и подзаголовком «Что подтверждено, что сообщается, а что всё ещё является предположением», а также три карточки с текстом: «Замечено: отдельный пункт Voice в веб-навигации Claude с пометкой Preview, о чём сообщалось 4 октября 2026 года», «Не выпущено: нет речевой модели, нет карточки модели, нет записи в API, нет цены» и «Датируется: добровольное согласие потребителей на передачу голосовых данных для обучения модели, о чём сообщалось 5 октября 2026 года», с нижним колонтитулом, ссылающимся на сообщения о видимом пункте навигации и справочную документацию Anthropic, прочитанную 11 октября 2026 года, и логотипом OrcaRouter в правом нижнем углу.
Guides & Insights

Утечка голосовой функции Claude: скрытая вкладка «Предпросмотр» в приложении Claude и согласие на передачу голосовых данных, появившееся рядом с ней

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

В какой-то момент до 4 октября 2026 года в веб-интерфейсе Claude появился элемент навигации, который ещё не должен был быть виден: отдельная вкладка Voice с внутренней пометкой Preview. Ни анонса, ни карточки модели, ни строки с ценой, ни записи в API, ни даты. Примерно в тот же период — об этом сообщили 5 октября — вендор тихо добавил ещё кое-что, о чём не объявлял: опцию добровольного участия, позволяющую пользователям передавать записи голоса и данные голосовых чатов «для улучшения наших ИИ-моделей», отдельно от согласия, которое он уже запрашивает для текстовых бесед. В актуальной линейке по-прежнему четыре модели с текстовым выводом — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 и Claude Haiku 5.5 — и она ни разу не выпустила собственную речевую модель. Так что полезный вопрос, который ставит эта утечка, — не «выпускает ли компания голосовую модель». Он конкретнее: вкладка доказывает, что интерфейс действительно создаётся, а опция добровольного участия — первое твёрдое свидетельство того, что компании нужны данные для обучения речи. Это два разных утверждения, и датировать можно только второе.

Всё ниже разделено на то, что подтверждено, то, что сообщается, но не подтверждено, и то, что является предположением. Anthropic вообще ничего не сообщила об этой вкладке, а значит, источник центрального факта — скриншот, а не пресс-релиз.

Что на самом деле было замечено, и о чём это нам не говорит

Эта находка исходит от @testingcatalog в X, опубликована 4 октября 2026 года и описана тем же изданием 10 октября. По словам публикации, «в веб-навигации Claude появился отдельный пункт Voice с внутренней меткой Preview», и «его возможности и публичная доступность остаются неизвестными». Это всё, что относится к прямым доказательствам. В отчёте прямо говорится, что эта метка указывает на внутреннюю среду предварительного просмотра, а не на развёртывание.

Из артефакта следуют три вещи, и ни одна из них не является спецификацией:

• Суть — внутренняя метка предварительного просмотра говорит, что где-то внутри Anthropic существует сборка. Она не говорит, что в этой сборке есть новая модель. Навигационная вкладка — это UI.

• Поставщик — в отчёте отмечается, что Anthropic «не подтвердила, кто является поставщиком лежащей в основе голосовой технологии», не выпустила специализированные модели синтеза речи через свой API и не запустила нативную сквозную аудиомодель в реальном времени. Последние два утверждения можно проверить, и они верны. В публичной документации Anthropic по моделям перечислены четыре актуальные модели, и все четыре описаны одинаково: ввод текста и изображений, вывод текста.

• Сроки — ни о какой дате не сообщалось и не намекалось. «Ни слова о сроках публичной доступности», — говорится в публикации.

Есть один прецедент, о котором стоит знать, потому что он может служить аргументом в обе стороны. Anthropic уже выпускала продукты под баннером предварительного доступа — линейка Mythos вышла как preview до общего доступа — так что внутренний ярлык Preview не обязательно является ложным следом. Но у Anthropic также месяцами в продакшен-коде лежали невыпущенные флаги голосового режима: утечка пакета исходного кода Claude Code в апреле 2026 года выявила набор невыпущенных флагов функций, включая голосовой режим, наряду с работой над bridge и фоновыми агентами. Голосовой режим явно разрабатывается в Anthropic уже значительно больше года, но голосовая модель так и не появилась. Эта вкладка согласуется с этой историей и ничего к ней не добавляет.

Опт-ин — это сигнал, на котором стоит дата.

Вторая половина утечки выглядит более надёжной, поскольку это изменение политики конфиденциальности, а не скриншот. 5 октября 2026 года несколько изданий сообщили, что Anthropic добавила необязательную настройку, позволяющую пользователям передавать голосовые записи и данные голосового чата для улучшения моделей. Текст запроса, как сообщается, звучит так: «Разрешите нам использовать ваши голосовые данные для улучшения наших ИИ-моделей», а сопроводительные формулировки говорят, что аудио- и данные голосового чата помогают улучшить то, как модели обрабатывают речь. Сообщаемые конкретные детали — все из одного и того же массива публикаций:

• Где это находится — в настройках Claude, в разделе «Конфиденциальность», в виде явного переключателя согласия.

• По умолчанию — выключено. Пользователей спрашивают; их не подключают автоматически.

• Его сфера действия — отдельно от существующего механизма согласия для текстовых бесед, и это самая важная деталь.

• Обратимость — впоследствии её можно отключить, а голосовые данные удалить из настроек, согласно описанию.

Почему отдельное согласие имеет значение: если бы весь голосовой конвейер был вендорской интеграцией без участия модели Anthropic, естественное место для консолидации согласия уже существовало бы. Выделение отдельного канала голосовых данных — это то, что вы делаете, когда намереваетесь обучать на речи — для новой модели или для специализированного речевого слоя в существующей. Это довод, основанный на стимулах, а не на доказательствах, и именно так его и следует читать. Честная альтернативная интерпретация состоит в том, что компании, эксплуатирующей голосовую функцию в масштабе, нужен собственный оценочный корпус и собственный анализ сбоев независимо от того, кто поставляет аудио, а механизм opt-in, рассчитанный на последующее отключение, — это также самый дешёвый способ соблюдать требования, пока вы принимаете решение.

Ещё один фрагмент контекста, потому что он заставляет это изменение выглядеть резче, чем оно есть на самом деле. В собственной документации Anthropic по конфиденциальности для коммерческих продуктов в статье от 16 марта 2026 года прямо сказано, что «мы не используем ваш голос для обучения наших моделей» и что после расшифровки речи аудиозапись удаляется. Эта статья относится к Claude for Work, Anthropic API и аналогичным коммерческим продуктам. Новая опция согласия — это настройка на стороне потребителей. Оба утверждения могут быть верны одновременно — и именно так выглядит компания, которая разворачивает конвейер обучающих данных в одной части бизнеса, сохраняя при этом договорное обещание в другой.

A single-column scoreboard titled 'Claude Voice - what is actually established' with six rows reading 'First-party speech model: none shipped', 'Underlying voice provider: not disclosed', 'Voice mode status: beta, all plans', 'Models in voice mode: same as text chat, Claude Fable excluded', 'Voice data for training: new consumer opt-in, off by default' and 'Speech-to-speech leaderboards: Anthropic absent', with a footer noting the provider is unconfirmed.

У Anthropic уже год есть голосовой продукт, но за всё это время у неё не было голосовой модели.

Вот та часть, которую освещение утечки обычно упускает, и именно этот контекст нужен, чтобы правильно прочитать вкладку.

Голосовой режим Claude был запущен в мае 2025 года как функция голосового общения в мобильных приложениях. С самого начала он представлял собой обёртку: языковые модели Anthropic отвечали за рассуждения, а сама речь исходила из другого источника. Стек никогда не раскрывался. Когда TechCrunch освещал обновление голосового режима от 23 июля 2026 года, издание отметило и то, что «Anthropic не вносила никаких изменений в голосовую модель в этом релизе», и то, что компания «не раскрывает, какой именно голосовой стек использует». Материалы с 2025 года указывают на ElevenLabs как на поставщика речевых технологий; этот вывод сделан в основном на основе раскрытий Anthropic о субпроцессорах, а не на чём-либо, что Anthropic подтвердила. Считайте этого поставщика неподтверждённым.

Июльское обновление 2026 года показательно тем, чего в нём не было. Оно добавило выбор модели — можно было выбирать между Claude Opus, Claude Sonnet и Claude Haiku, а не только Haiku — а также коннекторы к Gmail, Calendar, Slack, Canva и Notion, более длинные разговоры и многоязычную поддержку, выпущенную в бета-версии. Каждое из этих изменений находится выше по цепочке, чем аудио. Аудио не сдвинулось.

Что такое голосовой режим, согласно собственной справке Anthropic:

• Модели — «В голосовом режиме можно использовать те же модели Claude, что и в текстовом чате», и он «начинается с модели, которую вы последний раз использовали в текстовом чате». Указано одно исключение: Claude Fable недоступна в голосовом режиме.

• Доступность — это бета-функция на всех тарифах, от Free до Enterprise, в Claude Mobile, десктопной и веб-версиях, хотя лучше всего она работает с телефона.

• Голоса — «предустановленный, ограниченный набор», — намеренно, чтобы предотвратить клонирование голоса или подделку личности.

• Оплата — голосовые разговоры учитываются в рамках обычных лимитов вашего тарифа. Отдельного счётчика для голоса нет.

• Ограничения — диктовка существует в Claude Cowork и Claude Code, но голосового режима нет.

• Языки — английский и другие, при этом набор неанглийских языков по-прежнему помечен как бета.

Каждая из этих строк описывает продукт, обёрнутый вокруг чужой речи. Ни одна из них не описывает речевую модель.

Три вещи, которыми могла бы быть вкладка Voice, и только одна из них — модель

Причина, по которой в этой утечке так легко увидеть больше, чем следует, заключается в том, что все три вероятных варианта будущего выглядят в навигационной панели одинаково.

• Изменение интерфейса — отдельный экран голоса, кнопка голоса в строке запроса, выбор голоса в настройках. Сообщалось, что Anthropic уже готовила нечто подобное в феврале 2026 года. Если это всё, что есть, то вкладка — это редизайн, а нижележащий аудиостек не затронут.

• Смена провайдера — та же каскадная архитектура, но за ней другой поставщик речевых технологий. Снаружи незаметно. Это само по себе объяснило бы согласие на использование данных для обучения, потому что невозможно оценить смену поставщика без аудио, которое вам разрешено сохранять.

• Нативная модель речь-в-речь — Anthropic обучает собственную аудиомодель и отказывается от каскада. Это дорогостоящая интерпретация, та, которая имела бы значение для любого, кто создаёт что-либо на Claude, и единственная, которой нужен корпус речи, полученной с согласия. Это также интерпретация, которую доказательства пока не подтверждают.

Вкладка не может их различить. Следующие две проверяемые вещи: ID аудиомодели, отображающийся в списке моделей Anthropic, или новая запись о речи на его подстранице. Ничего из этого не произошло.

Где Anthropic нет

Самый наглядный способ увидеть, насколько Anthropic далека от того, чтобы владеть этим слоем, — это посмотреть, где её нет, а затем на то, что она всё же публикует. Независимые сравнения speech-to-speech — Artificial Analysis поддерживает одно, охватывающее около сорока моделей по рассуждению, динамике разговора и агентной производительности, — заполнены нативными аудиомоделями от Gemini 3.8 Live, GPT-Realtime-2 и GPT-Live-1, Qwen Audio 3.0 Realtime, Grok Voice Think Fast 2.0, StepAudio 3 Realtime, Nova 2.0 Sonic, NVIDIA, Kyutai и нескольких открытых проектов. Anthropic не появляется ни в одном подобном списке. Отдельный набор записей охватывает каскадные конвейеры голосовых агентов — модель распознавания речи, LLM и модель синтеза речи, соединённые вместе, — и именно эту архитектуру больше всего напоминает собственный голосовой режим Anthropic. На этом фоне собственная документация Anthropic по моделям недвусмысленна: четыре актуальные модели, и каждая из них описывается одинаково — ввод текста и изображений, вывод текста, и нигде на странице нет ни одного ID аудиомодели.

Screenshot of the OrcaRouter model catalogue, showing the Models listing with 208 models across 16 providers on one API key, the Text / Image / Embeddings / Video / TTS modality filters, an OpenAI-compatible code sample for calling a model, and model cards including Anthropic Claude Sonnet 5.5.

Это не критика продукта. Это утверждение о том, где сегодня захватывается ценность, и оно объясняет, почему вкладка Voice вообще интересна: речь — единственная модальность, в которой у каждой другой передовой лаборатории есть собственная модель, а у Anthropic — нет.

Что с этим делать в этом месяце — ничего нового.

Практический смысл всего этого в том, что для разработчика 4 октября ничего не изменилось. Голосовой режим — тот же продукт, что и в июле. Ни один идентификатор модели не был добавлен или выведен из эксплуатации. Ни одна цена не изменилась. Если сегодня вы запускаете голосовой функционал на Claude, вы запускаете каскад: модель Claude для размышления, отдельную модель для речи и связующий слой между ними. Утечка этого не меняет, а построение вокруг вкладки с надписью Preview — так у команд возникает зависимость в дорожной карте от чьей-то внутренней ветки.

За что он действительно выступает, так это за сохранение заменяемости речевой половины стека, потому что именно в каскаде и живёт привязка к вендору — не в модели Claude, которую можно вызвать откуда угодно, а в том клее, который вы написали под речевого поставщика. Конкретно, сторона Claude уже маршрутизируется: Claude Opus 5.5, Claude Sonnet 5.5, Claude Fable 5.1 и Claude Haiku 4.5 входят в каталог OrcaRouter по прайс-листовой цене Anthropic с наценкой 0% — цена провайдера из прайс-листа передаётся как есть, так что если Anthropic снижает цену, у нас она действует в тот же день — а модели синтеза речи, с которыми вы бы их сочетали (превью TTS от Gemini, tts-1-hd и другие), доступны по тому же ключу. Один эндпоинт для обеих половин голосового пайплайна означает, что смена вендора — это изменение строки модели, а не второй контракт, и автоматическое переключение при сбое означает, что непроверенная половина вашего пайплайна перейдёт на рабочий резервный вариант вместо сбоя вызова.

Что действительно подтвердило бы это?

Отбросьте домыслы и следите за четырьмя конкретными, проверяемыми местами. Каждое из них — датируемое событие, и любое из них превращает это из утечки в новость:

• Новая запись в документации Anthropic по моделям или в списке Models API с аудиовходом или аудиовыходом. Это единственный артефакт, доказывающий существование собственной речевой модели.

• Дополнение, связанное с речью, на странице субпроцессоров Anthropic. Это доказывает обратное — новый внешний поставщик, а не внутренняя модель.

• Вкладка «Голос» теряет метку «Предварительная версия» в потребительских приложениях. Это и есть развёртывание, и это тот момент, когда функция становится доступной для проверки, а не только для наблюдения.

• Ценовой спор. Anthropic устанавливает цену на то, что продаёт; цена за минуту речи решила бы вопрос архитектуры быстрее любого бенчмарка.

Пока что-то из этого не выйдет, точная сводка за октябрь 2026 года такова: Anthropic создаёт голосовой интерфейс, впервые собирает данные речи с согласия пользователей и до сих пор не выпустила ни одной речевой модели. Вкладка — наименее информативный из этих трёх фактов и тот, что разлетелся дальше всех.

Screenshot of Anthropic's Claude Platform models overview page listing Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 with their model IDs and pricing, alongside the line 'All current models support text and image input, text output, multilingual capabilities, vision, and tool use.'

Открытый вопрос не в том, хочет ли Anthropic лучший голосовой опыт, — на это отвечает сам принцип opt-in. Вопрос в том, означает ли «лучший голос» для Anthropic модель, которой она владеет, или поставщика, которым она управляет более тщательно. Некоторое время эти два пути выглядят снаружи одинаково, а затем между ними не остаётся ничего общего.