Tietoa
Quick TTS on olemassa yksinkertaisesta syystä. Lähes jokainen muu ilmainen tekstistä puheeksi -työkalu tyrehtyy 1 000 sanaan, pakottaa rekisteröitymään tai yrittää houkutella tilaukseen. Tämä ei.
Mikä tämä työkalu on
Quick TTS on yhden sivun verkkosovellus, joka lukee minkä tahansa liitetyn tekstin ääneen suoraan selaimessa. Ei tiliä, ei merkkirajaa, ei vesileimaa, ei "päivitä jatkaaksesi" -muuria. Tekstikenttä, toistopainike ja ääni — siinä kaikki.
Sisällä on kaksi äänimoottoria.
- Selaimeen sisäänrakennettu ääni (Web Speech API). Toimii mukavasti pöytäkoneella ja mobiilissa, myös hieman vanhemmissa ympäristöissä.
- Supertonic HD. Neuroverkkopohjainen tekoälyääni, joka toimii näytönohjaimellasi WebGPU:n kautta ja tarjoaa selvästi luonnollisemman lukukokemuksen. Tällä hetkellä tuettu vain työpöydän Chromessa ja Edgessä.
Rehellisyyden vuoksi: kaksi muuta moottoriamme, Piper ja Kokoro, eivät toistaiseksi tue suomea — Piperin äänikatalogissa ei ole suomenkielistä mallia, ja Kokoro on englanninkielinen. Siksi näet suomenkielisillä sivuilla vain Browser TTS:n ja Supertonic HD:n.
Miksi ilmainen
Sivuston käyttökulut vastaavat suunnilleen kupillista kahvia kuukaudessa (Firebasen staattinen hosting ja verkkotunnuksen rekisteröinti, siinä kaikki). Google AdSensen näyttömainokset kattavat tämän, ja kun toiminta vakiintuu, myös osan kehitykseen ja ylläpitoon käytetystä ajasta.
Maksullisia tasoja ei ole suunnitteilla. Ei maksumuurin taakse piilotettuja "premium-ääniä". Supertonic HD on ilmainen samasta syystä kuin peruspiirteetkin — se toimii laitteellasi, joten se ei aiheuta meille lisäkuluja.
Suunnitteluperiaatteet
Muutama periaate, joista pidämme kiinni.
- Tekstisi ei poistu laitteeltasi. Kaikki puheentuotto tapahtuu selaimessasi. Emme vastaanota tekstiäsi emmekä koskaan tule vastaanottamaan.
- Ei rekisteröitymistä. Työkalu, joka vaatii tilin 30 sekunnin käyttöä varten, on jo epäonnistunut.
- Ei manipulointikeinoja. Ainoat mainokset ovat kiinteäpaikkaisia näyttömainoksia. Ei ponnahdusikkunoita, välimainoksia, "odota 15 sekuntia ennen toistoa" -tempuilla eikä väärennettyjä latauspainikkeita.
- Rajoitukset kerrotaan rehellisesti. Ainoa tapaus, jossa puhetta ei voida tuottaa, on teksti, joka on liian pitkä mahtuakseen selaimen muistiin. Miksi jokin ei toimi, on selitetty UKK:ssa.
Rakennettu avoimen teknologian varaan
Quick TTS ei olisi olemassa ilman erinomaista avoimen lähdekoodin työtä.
- Kokoro-82M — neuroverkko-TTS-malli, joka ajaa Kokoro HQ -vaihtoehtoa (Apache 2.0).
- Piper (rhasspyn tekemä) — yleiskäyttöinen neuroverkko-TTS, joka ajaa Piper-vaihtoehtoa (MIT). Äänimallit ovat peräisin rhasspy/piper-voices-kokoelmasta, johon kuuluu käsin valittuja ääniä CC-BY 4.0 (LibriTTS-R, VCTK) ja CC0 / public domain (Joe) -lisensseillä. Lisenssien yksityiskohdat löytyvät kunkin äänen MODEL_CARD-tiedostosta piper-voices-repositoriossa.
- Transformers.js — kirjasto, joka mahdollistaa ML-mallien ajamisen selaimessa.
- vits-web — WASM-sidonnat VITS-perheen malleille, joilla Piper ajetaan selaimessa.
- Web Speech API — hiljainen työjuhta, joka on ollut selaimissa yli vuosikymmenen ilman kiitosta.
Kuka tämän teki
Quick TTS:n rakensi pieni tiimi Next Now Agencysta sisarprojektina WSBSynthille (palvelu, joka lukee r/wallstreetbets-kommentteja ääneen reaaliajassa). Suurin osa TTS-arkkitehtuurista on jaettu näiden kahden kesken — WSBSynth oli koekenttä, ja Quick TTS on siitä syntynyt yleiskäyttäjäystävällinen versio.
Ota yhteyttä
Bugit, palaute, ominaisuustoiveet, lehdistökyselyt: hello@quick-tts.com. Katso lisätietoja yhteystietosivulta.