Лучшие русские голоса TTS 2026 (4 офлайн-голоса Piper + нейронные Edge)

Опубликовано

У русского языка не самый большой каталог облачных нейросетевых голосов — всего три голоса Edge Online, меньше, чем у немецкого или итальянского. Но есть кое-что более редкое: четыре русских голоса в проекте Piper, включая женский, — они работают целиком в браузере, полностью офлайн. Это делает русский одним из немногих неанглийских языков, где офлайн-каталог Piper больше, чем облачный каталог Edge. Эта статья разбирает все бесплатные русские голоса — Piper, Edge Online, Apple и классические Microsoft — по одному, без маркетинга.

Ландшафт русского TTS в 2026

Русскую ситуацию в 2026 году определяют три факта:

Во-первых: сильная сторона русского — это офлайн, а не облако. В каталоге проекта Piper четыре русских голоса, и среди них есть женский. Важная оговорка сразу: Quick TTS из этих четырёх предлагает одинru_RU-irina-medium; остальные три в нашей браузерной сборке не выбираются (подробности ниже). Всё, что доступно, работает целиком в браузере через WebAssembly, не отправляя текст ни на один сервер.

Во-вторых: в облаке у русского три нейросетевых голоса Edge Online (Светлана, Дмитрий, Дарья), синтезируемых на серверах Azure и доступных через Web Speech в браузере Edge. Это меньше, чем у немецкого (19) или итальянского (14), но три хорошо различающихся голоса — женский по умолчанию, мужской строгий и женский альтернативный — покрывают большинство сценариев.

В-третьих: классические системные голоса (Ирина и Павел на Windows, Милена на macOS) по-прежнему доступны и по-прежнему звучат «по-старому». У них есть своя ниша — короткие уведомления, базовая доступность, — но для любого текста длиннее трёх предложений сегодня есть заметно лучшая альтернатива. Одного у русского нет: голосов Kokoro. Модель Kokoro-82M не покрывает русский, поэтому для нейросетевого TTS офлайн рекомендация — Piper.

Русские голоса Piper: что есть в проекте и что из этого доступно здесь

Обновление 1 августа 2026. Раньше этот раздел описывал четыре голоса так, будто все они выбираются в Quick TTS. Это неверно: в нашей браузерной сборке предлагается один русский голос Piper. Ниже — каталог проекта Piper с честной пометкой по каждому.

Практический вывод: если вам нужен Piper офлайн на русском, это irina-medium. Мужского голоса Piper здесь нет — за мужским тембром идите в Edge Online (Дмитрий Online) или к системным голосам. Все русские голоса Piper — качества medium; голосов «high», как у некоторых других языков, в русском наборе нет.

Важное замечание: голоса «medium» — это большие загрузки, чем «low». На медленном соединении первый запуск голоса Piper может занять время, но затем модель кэшируется и работает целиком локально.

Три нейросетевых голоса Online в Edge

В облаке у русского три голоса Edge Online (синтезируются на серверах Azure, доступны через Web Speech в браузере Edge). Каждый с честной оценкой:

Рекомендация: Светлана Online как безопасный вариант по умолчанию, Дмитрий Online для формального текста, Дарья Online как второй женский тембр. Три голоса — это меньше, чем в других языках, но качество каждого не уступает лучшим нейросетевым голосам Edge.

Существенное ограничение: голоса Edge Online работают только в браузере Microsoft Edge и требуют подключения к интернету — синтез идёт на серверах Azure. Для чувствительного текста (медицинские, юридические, персональные данные) выбирайте вместо них Piper.

Microsoft Ирина и Павел: классические голоса Windows

На каждом Windows два классических голоса SAPI остаются доступными во всех браузерах (Edge не требуется):

Реальный сценарий для этих голосов в 2026: офлайн-читалка на нестабильном соединении, короткие уведомления в киосках, доступность на старых системах. Для всего остального лучше подойдут Edge Online или Piper.

Apple: Милена, Юрий и Катя

На macOS и iOS доступны три русских голоса (Premium-версии загружаются из Настройки → Универсальный доступ → Проговаривание):

На Apple компромисс выгодный: качество почти как у Edge Online, но с локальным синтезом. Для тех, кто пользуется iPhone/Mac и заботится о приватности, Милена Premium или Юрий — правильная точка между качеством и офлайн-обработкой.

Почему нет Kokoro (и что вместо него)

Kokoro-82M — отличная лёгкая нейросетевая модель, работающая на WebGPU, — но она не поддерживает русский язык. В отличие от итальянского или испанского, русских голосов Kokoro нет.

Но с 27 июля 2026 года у русского появился настоящий локальный HD-вариант, и это не Kokoro, а Supertonic HD: русский голос 44,1 кГц, который считается на вашей видеокарте через WebGPU. Синтез идёт целиком в браузере, то есть текст никуда не уходит — это и делает его пригодным для медицинских, юридических и корпоративных документов.

Требования: WebGPU, то есть десктопный Chrome или Edge с вменяемой видеокартой. Первая загрузка около 380 МБ происходит один раз, дальше модель кэшируется и работает офлайн. Запасного варианта на WebAssembly у Supertonic нет: если WebGPU недоступен, пункт просто не появится в меню, и на телефоне рабочий выбор — Piper irina-medium или Browser TTS.

Голос под сценарий: аудиокниги, озвучка, уведомления, технический текст

Практическое решение по сценарию:

Попробуйте сами

Откройте Quick TTS, вставьте абзац на русском и сравните движок браузера (Edge Online или Apple), Piper и — на десктопе — Supertonic HD на одном и том же тексте. Внутри одного движка голос можно сменить прямо во время чтения: Quick TTS перечитает текущий фрагмент новым голосом, так что вы сравните Светлана → Дмитрий на одном предложении. А вот смена движка останавливает воспроизведение — нужно снова нажать play. Это единственный честный способ сравнить дюжину голосов: человеческое ухо, один и тот же материал.

Больше контекста — в руководстве (десять практических сценариев TTS), в часто задаваемых вопросах и на странице О нас, где объясняется, почему Quick TTS обрабатывает всё локально — включая вопрос приватности при чувствительном контенте.