За нас
Причината Quick TTS да съществува е проста. Почти всеки друг безплатен инструмент за текст в говор ви спира на 1000 думи, изисква регистрация или се опитва да ви прехвърли на абонамент. Тук не е така.
Какво представлява този инструмент
Quick TTS е едностранично уеб приложение, което прочита на глас всеки текст, който поставите — направо в браузъра. Няма акаунт, няма ограничение на знаците, няма воден знак, няма „надградете, за да продължите“. Текстово поле, бутон за възпроизвеждане и глас — това е всичко.
Отвътре има два гласови двигателя.
- Вграденият глас на браузъра (Web Speech API). Работи веднага, на компютър и мобилно устройство, дори на по-старо оборудване.
- AI глас. По избор — невронен TTS модел, изпълняван на графичния процесор чрез WebGPU за много по-естествено звучене. Засега поддържан само в Chrome/Edge на компютър.
Защо е безплатно
Разходите за поддръжка на сайта са колкото едно кафе на месец (статичен хостинг във Firebase и регистрация на домейн, това е всичко). Дисплейните реклами от Google AdSense покриват тази сума, а щом наберат обороти, покриват и част от времето за разработка и поддръжка.
Няма планове за платено ниво. Няма „премиум гласове“, скрити зад стена за плащане. AI гласът е безплатен по същата причина, поради която основната функция е безплатна — работи на вашето устройство, така че за нас не носи допълнителни разходи.
Принципи на дизайна
Има няколко принципа, които се стремим да спазваме.
- Текстът ви не напуска устройството ви. Целият синтез се извършва от страна на клиента. Не получаваме текста ви и никога няма да го получаваме.
- Без регистрация. Инструмент, който изисква акаунт за 30-секундно взаимодействие, вече е неуспешен още в тази точка.
- Без тъмни модели. Само дисплейни реклами на фиксирани позиции. Без изскачащи прозорци, интерстициали, „изчакайте 15 секунди за аудио“ или фалшиви бутони за изтегляне.
- Ограниченията се обявяват честно. Единственият случай, в който синтезът не работи, е текст, твърде дълъг за паметта на браузъра. Причините са описани във въпросите.
Изградено върху отворени технологии
Quick TTS нямаше да съществува без отлична работа с отворен код.
- Kokoro-82M — невронният TTS модел зад опцията Kokoro HQ (Apache 2.0).
- Piper (от rhasspy) — универсален невронен TTS зад опцията Piper (MIT). Гласовите модели идват от rhasspy/piper-voices, подбрани по лиценз CC-BY 4.0 (LibriTTS-R, VCTK) и CC0 / обществено достояние (Joe). За подробности вижте MODEL_CARD на всеки глас в хранилището piper-voices.
- Transformers.js — библиотека, която позволява ML модели да работят в браузъра.
- vits-web — WASM обвързване за модели от типа VITS, което кара Piper да работи в браузъра.
- Web Speech API — тихият работен кон, вграден в браузърите от над десет години.
Кой го направи
Quick TTS е дело на малък екип в Next Now Agency, като сестрински проект на WSBSynth (услуга за четене на коментари от r/wallstreetbets на живо). По-голямата част от TTS архитектурата се споделя между двата проекта — WSBSynth беше полигонът, а Quick TTS е версията, приятелска за широката публика.
Свържете се с нас
За бъгове, обратна връзка, заявки за функции и медийни запитвания: hello@quick-tts.com. Вижте страницата за контакт за повече подробности.