Питання
Короткі відповіді на поширені запитання.
Це справді безкоштовно і без обмеження на кількість символів?
Так. Без реєстрації, без обмеження символів, без платних рівнів. Вставте твіт чи вставте роман — це той самий інструмент. Реклама тримає його безкоштовним.
Ви зберігаєте текст, який я вставляю?
Ні. Quick TTS працює повністю на стороні клієнта. Вставлений текст обробляється в браузері й не надсилається на наші сервери. Він навіть не доходить до нас, тож логів немає.
Останній текст зберігається в localStorage браузера, щоб пережити випадкове закриття вкладки, але це існує лише на вашому пристрої. Щоб видалити його, очистіть дані сайту в браузері.
У чому різниця між типовим голосом і «AI-голосом»?
Типовий (Browser TTS): вбудований у браузер голосовий механізм (Web Speech API). Працює миттєво, доступний на будь-якому пристрої й звучить як звичайний системний голос. Точний набір голосів залежить від ОС — на Mac є Samantha, на Windows Zira і Natasha, у Android і iOS — свої голоси.
AI-голос — це три необов'язкові нейромережеві механізми, з яких на українській сторінці показується лише один. Він працює локально на вашому пристрої після одноразового завантаження — текст не залишає браузер.
- Piper — приблизно 60МБ завантаження, працює через WebAssembly. Працює в будь-якому браузері на комп'ютері й тепер на телефоні, але українського голосу не має.
- Supertonic HD — єдиний якісний механізм, що синтезує українську локально в браузері. Працює на GPU через WebGPU на 44,1 кГц, з одноразовим завантаженням близько 380 МБ, після чого доступний офлайн. WebGPU обов'язковий, альтернативи через WebAssembly немає, тому без WebGPU цей пункт узагалі не з'являється в меню.
- Kokoro HQ — приблизно 80МБ, працює через WebGPU, але лише англомовний (і список голосів, і фонемізація). Тому на українській сторінці цей механізм не показується.
Чи надсилає AI-голос мій текст на сервер?
Ні. Supertonic HD працює повністю у браузері через WebGPU. Мережеві запити відбуваються лише під час першого завантаження бібліотек і моделі з Hugging Face, після чого перетворення тексту на мовлення відбувається повністю на вашому пристрої.
Чи працює це на мобільному пристрої?
На телефоні можна користуватися Browser TTS — він використовує вбудовані голоси пристрою, тож працює всюди.
Kokoro HQ і Supertonic HD залишаються доступними лише на комп'ютері — обидва потребують WebGPU, а мобільні GPU ще не підтримують його стабільно.
Чи можна використовувати згенероване аудіо комерційно (YouTube, подкасти, продукти)?
Можна, з однією умовою: варто вказати використану голосову модель у титрах чи описі проєкту.
- Browser TTS: використовує вбудовані голоси ОС. Microsoft, Apple й Google публікують власні умови щодо комерційного використання системних голосів; зазвичай допоміжне або невелике використання дозволене, але для масштабного розповсюдження перевірте документацію конкретного голосу.
- Supertonic HD: відрізняється від інших рушіїв — ваги моделі ліцензовані за OpenRAIL-M BigScience, це не пермісивна ліцензія. Комерційне використання дозволене, і ми не претендуємо на права щодо згенерованого вами аудіо, але OpenRAIL-M додає обмеження використання, яких потрібно дотримуватися і передавати всім, з ким ви ділитеся моделлю чи її результатом. Код інференсу — MIT.
Ми не претендуємо на жодні права щодо аудіо, яке ви генеруєте. Відповідальність за дотримання ліцензій конкретної моделі у вашому випадку використання лежить на вас.
Чи є обмеження на довжину тексту?
Довжина необмежена. Вхідний текст розбивається на частини й транслюється в реальному часі, тож документ на 50 000 слів працює так само, як одне речення — просто довше. У режимі AI-голосу генерація й відтворення відбуваються паралельно, тож довгого очікування на старті немає.
Чому перше відтворення AI-голосу починається так довго?
Під час першого перемикання на AI-механізм браузер має завантажити модель — Piper приблизно 60МБ, Kokoro HQ приблизно 80МБ. Залежно від з'єднання це триває від кількох секунд до хвилини. Далі модель кешується в браузері, і наступні запуски швидкі. Supertonic HD — виняток, оскільки спершу завантажує близько 380МБ. Врахуйте це на лімітованому тарифі.
На робочому комп'ютері AI-голос зависає на «Завантаження...»
Деякі корпоративні мережі блокують Hugging Face — хостинг, де розміщено моделі AI. Якщо AI-механізм не завершує ініціалізацію, це майже завжди причина. Browser TTS працює без зовнішніх завантажень, тож у обмеженому середовищі це надійна альтернатива.
Чому я бачу рекламу?
Реклама покриває вартість домену, хостингу та часу на підтримку інструменту. Це та ціна, яка тримає його безкоштовним без обмежень. Якщо реклама справді заважає, це зрозуміло — можете вільно користуватися блокувальником реклами в браузері. Ми не будемо тиснути на почуття провини.
Чи відстежуються натискання клавіш?
Ні. Ми не ведемо аналітику чи логування натискань клавіш. Деталі — в Політиці конфіденційності.
Щось зламалося / у мене є відгук
Напишіть на hello@quick-tts.com. Вкажіть браузер і операційну систему.