
Breeze TTS 2: новый лидер TTS с открытыми весами — 1,215 Elo
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 523 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 187 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
Breeze TTS 2 теперь занимает первое место среди моделей синтеза речи с открытыми весами в Provider Voices Speech Arena от Artificial Analysis, имея 1215 Elo — на 90 очков больше, чем у предыдущего лидера среди моделей с открытыми весами, Fish Audio S2 Pro, — и находится на 6-м месте в общем рейтинге среди более чем 100 оценённых систем. Эта публикация стала первым независимым подтверждением того, о чём BreezeBlue заявляла с момента анонса модели в середине августа 2026 года: двухнедельная голосовая модель стартапа примерно из 15 человек может находиться на переднем крае коммерческого синтеза речи. Открытые веса появились на Hugging Face 25 августа 2026 года; результат арены последовал в течение дня. Чем бы ещё ни оказался Breeze TTS 2, это больше не обещание вендора — у него есть Elo, который это подтверждает.
Что на самом деле произошло, по порядку
Важна хронология, потому что она объясняет, почему пост о «лидерборде открытых весов» исходит от компании, о которой большинство людей не слышали три недели назад. BreezeBlue была основана Ян Бином, бывшим техническим соучредителем одной из ведущих ИИ-лабораторий Китая, на посевном раунде в 6 миллионов долларов под руководством Yuanjing Capital и Redpoint China. Модель прошла через три заметных этапа:
• 7 августа 2026 г. — BreezeBlue опубликовал собственный набор тестов для синтеза речи, предназначенный для оценки дизайна голоса, голосового направления и задержки, на Hugging Face.
• 16–17 августа 2026 года — компания официально анонсировала Breeze TTS 2 как флагманскую модель голоса реального времени для интерактивных медиа и открыла хостируемый API по цене $34 за 1 млн символов.
• 25 августа 2026 года — веса и код инференса PyTorch были опубликованы в открытом доступе на Hugging Face как BreezeBlue/Breeze-TTS-2, модель с 3 миллиардами параметров под лицензией для исследований и некоммерческого использования.
Рейтинг Artificial Analysis Provider Voices появился в сети в течение нескольких дней после публикации открытых весов. Поскольку арена оценивает модели на основе слепого прослушивания в паре, 1 215 Elo — это не бенчмарк, который BreezeBlue проводил сам для себя: это накопленное суждение слушателей, сравнивавших реальные образцы, а именно того, чего такой молодой модели больше всего не хватает.
Табло

• Рейтинг Arena — #6 в общем зачете на Provider Voices; #1 среди всех моделей с открытыми весами, опережая Fish Audio S2 Pro (1,125 Elo).
• Elo — 1 215, с 95 % ДИ примерно ±17 (Artificial Analysis, по состоянию на конец августа 2026 года).
• Языки — 50, по данным BreezeBlue; в карточке модели указаны английский и китайский языки.
• Цена — $34 за 1M символов на хостируемом эндпоинте BreezeBlue; открытые веса можно скачать бесплатно, но они распространяются по некоммерческой лицензии.
• Скорость — ~45 символов в секунду по данным Artificial Analysis — медленнее, чем у нескольких конкурентов, что важно для длинных задач.
• Задержка — задержка стриминга менее 40 мс, по данным BreezeBlue (заявлено производителем, независимо не измерялось).

Что Breeze TTS 2 на самом деле делает иначе
Elo попадает в заголовки, но заявление о продукте интереснее, чем оценка. Breeze TTS 2 построен на двух идеях, которые большинство моделей синтеза речи считают второстепенными: дизайн голоса и направление голоса. Дизайн голоса — zero-shot и без референса: вы описываете голос на естественном языке («тёплый диктор лет сорока пяти с лёгким южным акцентом и сухим остроумием»), и модель генерирует такой голос без студийной записи или референсного клипа. Направление голоса отделяет тембр говорящего от интенции исполнения, так что вы можете заставить реплику звучать саркастично, приглушённо или торопливо, не позволяя модели уходить в другого персонажа. BreezeBlue утверждает, что та же самая идентичность диктора сохраняется при смене интенции, и их собственный бенчмарк направления голоса сообщает о сходстве диктора 0.67 SPK_SIM (по данным вендора).
Эти две возможности указывают на целевой рынок Breeze TTS 2. Пресс-материалы недвусмысленны: игровые персонажи, цифровые компаньоны, повествовательный сторителлинг, драматические радиопостановки и виртуальные стримеры — продолжительное ролевое аудио со множеством персонажей, а не просто очередной API для озвучки. Компания поставляет сопутствующую библиотеку голосов Voice Galaxy, насчитывающую более 15 000 голосов персонажей, созданных сообществом и студиями, а демо-ролик BreezeBlue — это многоперсонажная фанатская радиопостановка длительностью более десяти минут. По собственным опубликованным бенчмаркам (данные предоставлены вендором и не воспроизведены независимо), Breeze TTS 2 занимает первое место в бенчмарке Voice Design для синтеза речи, набрав 78,02 балла по показателю Role Fit против 72,78 у MiMo-V2.5-TTS и композитный показатель Voice Direction 4,25.
Звездочка в лицензии
Прежде чем фраза «открытые веса» сделает слишком много маркетинговой работы, прочитайте карточку модели. Breeze TTS 2 — это 3B параметров, safetensors, F32/BF16, а исходный код лицензирован по Apache 2.0 — но веса, производные модели и выходные данные, полученные при самостоятельном хостинге, лицензированы только для исследовательских и некоммерческих целей, согласно лицензии breezeblue-research-and-non-commercial-license. Это значит, что «открытые веса» здесь — не «бесплатно для вашего продукта». Коммерческий самостоятельный хостинг не разрешён лицензией в её текущем виде; коммерческий путь — это размещённый API по цене $34 за 1M символов. Это та же схема, что и у нескольких других открытых релизов 2026 года: их можно изучать и самостоятельно размещать для исследований, но приносящее доход использование зарезервировано за собственной конечной точкой поставщика.
Почему роутер важен для такой молодой модели
{{1}}Честно говоря, главный риск с Breeze TTS 2 сейчас — не качество, а возраст.{{/1}} {{2}}Модель доступна десять дней, веса — два.{{/2}} {{3}}Ни одна продакшен-команда не должна доверять голосовой пайплайн настолько молодой модели без возможности от неё отказаться{{/3}}, и именно этот сценарий отказа призван компенсировать слой маршрутизации. {{4}}Если вы подключаете Breeze TTS 2 через шлюз, который рассматривает эндпоинт вендора как один из многих маршрутов, вы получаете текущего лидера Elo, автоматический фейловер на резервного провайдера при деградации API и изменение в одну строку, если модель недельной давности показывает регрессию.{{/4}} {{5}}Это та же дисциплина, которую DSL маршрутизации применяет к любой модели: комбинируйте её с альтернативами, сохраняйте стабильный интерфейс и позвольте модели доказать себя, прежде чем делать её несущей конструкцией.{{/5}} Ни одна из моделей этой серии пока не маршрутизируется через сам OrcaRouter, поэтому честный совет — встроить Breeze TTS 2 в тот шлюз, который у вас уже есть, и оставить текущего провайдера активным параллельно с ней, по мере того как рейтинг Elo становится более зрелым и надёжным.
Что посмотреть дальше
Место №1 среди open-weights моделей в Provider Voices — сегодня главная история, но из двух арен для этой модели оно более слабое. На арене Controlled Voice от Artificial Analysis, где все модели сравниваются на одних и тех же фиксированных эталонных голосах, Breeze TTS 2 занимает №3 среди open-weights моделей с 1 002 Elo, уступая Voxtral от Mistral (1 010), и №16 в общем зачёте из 39. Этот разрыв между его показателем в provider-voice (1 215, №1 open) и в controlled-voice (1 002, №3 open) заслуживает внимания: он говорит о том, что преимущество Breeze TTS 2 сосредоточено в голосах, которые он проектирует для себя, а это ровно то, что заявлено в продукте, и именно на это независимому бенчмарку следует давить. Следите, сблизится ли Elo в controlled-voice с показателем provider-voice, ужесточится или смягчится коммерческая лицензия, и — самое главное — воспроизведёт ли кто-нибудь бенчмарки по дизайну голоса и управлению голосом за пределами собственного набора тестов BreezeBlue.
Для модели, которой не существовало месяц назад, Breeze TTS 2 уже заработала самое полезное, что может заработать модель синтеза речи: независимую оценку, которая согласуется с маркетингом. Станет ли она голосом по умолчанию для интерактивных продуктов, зависит меньше от следующего обновления Elo, чем от того, как будут развиваться лицензия и история самостоятельного хостинга — но уже на этой неделе у синтеза речи с открытыми весами новый лидер, и ему две недели от роду.

