FAQ
Быстрые ответы на частые вопросы.
Это правда бесплатно и без лимита по словам?
Да. Без регистрации, без лимита символов, без платного тарифа. Вставь твит или вставь роман — один и тот же инструмент. Держим бесплатным за счёт рекламы.
Вы храните вставленный мной текст?
Нет. Quick TTS работает целиком на стороне клиента. Текст, который ты вставляешь, обрабатывается твоим браузером и никогда не уходит на наши сервера. Логов нет, потому что текст до нас не доходит.
Последний вставленный текст сохраняется в localStorage браузера, чтобы он остался, если ты случайно закроешь вкладку, но это только на твоём устройстве. Чтобы стереть, очисти данные сайта.
В чём разница между обычным голосом и «AI Voice»?
Обычный (Browser TTS): встроенный движок речи браузера (Web Speech API). Доступен сразу, работает на любом устройстве и звучит как стандартный TTS-голос. Конкретные доступные голоса зависят от ОС — у Mac есть Samantha, у Windows — Zira и Natasha, у Android и iOS свои наборы.
AI Voice — это три нейронных движка, которые ты можешь включить; на русских страницах доступны два из них. Оба работают локально на твоём устройстве после разовой загрузки — твой текст не покидает браузер.
- Piper — ~60MB загрузки, работает на WebAssembly. Работает в
любом десктопном браузере, а теперь и на телефоне. Звучит заметно естественнее,
чем Browser TTS. Русская модель:
ru_RU-irina-medium. - Supertonic HD — лучшее локальное качество для русского: 44,1 кГц, работает на твоей видеокарте через WebGPU. Разовая загрузка около 380 МБ, затем работает офлайн. Требует именно WebGPU — запасного варианта на WebAssembly нет, поэтому без WebGPU этот пункт просто не появляется в меню.
- Kokoro HQ — ~80MB, работает через WebGPU, но только на английском (и каталог голосов, и фонемизация). Поэтому на русских страницах этот движок вообще не показывается.
AI-голос отправляет мой текст на сервер?
Нет. И Piper, и Supertonic HD работают целиком в браузере — Piper через WebAssembly, Supertonic HD через WebGPU. Единственные сетевые запросы — первичные загрузки библиотеки и модели с jsDelivr и Hugging Face. После этого весь синтез текста в звук происходит на твоём устройстве.
Работает на мобильных?
На мобильных у тебя Browser TTS — он работает везде, со встроенными голосами твоего телефона. Piper теперь тоже работает на телефоне: прежние проблемы Piper-WASM на iOS исчезли с обновлениями Safari и Chrome.
Kokoro HQ и Supertonic HD остаются только для десктопа — обоим нужен WebGPU, который мобильные GPU пока стабильно не тянут.
Можно ли использовать аудио в коммерческих целях (YouTube, подкасты, продукты)?
Да, с одной оговоркой: в титрах или описании проекта стоит указать модель голоса.
- Browser TTS: использует встроенные голоса операционной системы. У Microsoft, Apple и Google свои условия для коммерческого использования системных голосов — обычно разрешено для эпизодического и небольшого использования, но при большом масштабе посмотри документацию по нужному голосу.
- Piper: движок под лицензией MIT. Мы поставляем подобранный набор голосов: LibriTTS-R и VCTK — CC-BY 4.0 (коммерческое разрешено при указании авторства), Joe — CC0 / public domain (без ограничений). Атрибуция для CC-BY обычно укладывается в строчку в описании видео или подкаста, например «Voice by Piper TTS — LibriTTS-R / VCTK, CC-BY 4.0».
- Kokoro HQ: модель под лицензией Apache 2.0 — коммерческое использование разрешено. Apache 2.0 строго не требует атрибуции, но мы рекомендуем указывать Kokoro-82M в титрах проекта как нормальную практику.
- Supertonic HD: отличается от остальных — веса модели распространяются по лицензии OpenRAIL-M от BigScience, а не по пермиссивной лицензии. Коммерческое использование разрешено, и права на созданное вами аудио не заявляются, но OpenRAIL-M добавляет ограничения по способам использования, которые вы обязаны соблюдать и передавать всем, с кем делитесь моделью или её выводом. Код инференса — под лицензией MIT.
На аудио, которое ты создаёшь, мы прав не предъявляем. Ты сам отвечаешь за соблюдение лицензий исходных моделей в твоём конкретном случае.
Какой длины может быть текст?
Любой. Мы режем ввод на куски и стримим воспроизведение, поэтому документ на 50 000 слов работает так же, как одно предложение, — просто дольше. В режиме AI Voice генерация идёт параллельно с воспроизведением, длинного ожидания в начале нет.
Почему первое воспроизведение AI Voice так долго стартует?
При первом переключении на AI-движок браузер должен скачать модель — ~60MB для Piper, ~80MB для Kokoro HQ. Это занимает от нескольких секунд до минуты в зависимости от соединения. Дальше она лежит в кеше браузера, и все следующие запуски быстрые. Supertonic HD — исключение: около 380 МБ при первом запуске, учитывайте это на тарифицируемом соединении.
Я с рабочего компьютера, AI Voice завис на «Downloading...»
Некоторые корпоративные сети режут jsDelivr или Hugging Face — это CDN, на которых живут Piper и Supertonic HD. Если ни один из AI-движков не доводит инициализацию до конца, причина почти всегда в этом. Browser TTS работает без внешних загрузок, так что в закрытых средах это хороший запасной вариант.
Почему я вижу рекламу?
Реклама оплачивает домен, хостинг и время на поддержку инструмента. Это сделка, чтобы держать всё бесплатным и без лимитов. Не любишь рекламу — нет проблем, в браузере есть адблок. Морализаторствовать не будем.
Отслеживаете ли вы нажатия клавиш?
Нет. Никакой клавишной аналитики и никакого keystroke-логирования. Подробности в политике конфиденциальности.
Что-то сломалось / есть фидбек
Пиши на hello@quick-tts.com. Укажи браузер и ОС.