Întrebări frecvente
Răspunsuri scurte la întrebările frecvente.
Este chiar gratuit, fără limită de caractere?
Da. Fără cont, fără limită de caractere, fără niveluri plătite. Fie că lipești un tweet, fie că lipești un roman, e același instrument. Reclamele îl mențin gratuit.
Stocați textul pe care îl lipesc?
Nu. Quick TTS funcționează în întregime pe partea de client. Textul lipit este procesat în browser și nu este trimis către serverele noastre. Nici măcar nu ajunge la noi, deci nu există jurnale.
Cel mai recent text este salvat în localStorage-ul browserului, ca să nu se piardă dacă închizi accidental fila, dar rămâne doar pe dispozitivul tău. Pentru a-l șterge, curăță datele site-ului din browser.
Care este diferența dintre vocea implicită și „AI Voice”?
Implicit (Browser TTS): motorul de voce nativ al browserului (Web Speech API). Funcționează instantaneu, pe orice dispozitiv, și sună ca o voce TTS obișnuită. Vocile exacte disponibile depind de sistemul de operare — pe Windows apar de obicei vocile Azure Online „Alina” și „Emil” în Edge, pe macOS și iOS vocea „Ioana”, iar Android are propria voce Google.
AI Voice reprezintă trei motoare neuronale opționale, dintre care pe pagina în română sunt afișate două. Ambele rulează local, pe dispozitivul tău, după o descărcare unică — textul nu părăsește browserul.
- Piper — descărcare de aproximativ 60MB, rulează prin WebAssembly. Funcționează pe orice browser desktop și acum și pe telefon, dar nu oferă o voce în română.
- Supertonic HD — singurul motor de înaltă calitate care sintetizează română local, în browser. Rulează la 44,1 kHz pe placa video, prin WebGPU, cu o descărcare unică de aproximativ 380 MB, apoi disponibil offline. Necesită WebGPU, fără cale alternativă prin WebAssembly, deci nu apare deloc în meniu pe dispozitivele fără el.
- Kokoro HQ — aproximativ 80MB, rulează prin WebGPU, dar este doar în engleză (atât lista de voci, cât și fonemizarea). De aceea acest motor nu apare pe pagina în română.
Vocile AI trimit textul către un server?
Nu. Atât Piper, cât și Supertonic HD rulează exclusiv în browser — Piper prin WebAssembly, Supertonic HD prin WebGPU. Singurele cereri de rețea sunt descărcarea inițială a bibliotecilor și modelelor de pe jsDelivr și Hugging Face; după aceea, transformarea textului în vorbire are loc integral pe dispozitivul tău.
Funcționează pe mobil?
Pe telefon poți folosi Browser TTS — funcționează oriunde, pentru că folosește vocile native ale dispozitivului. Piper funcționează acum și pe telefon. Problemele mai vechi de pe iOS au fost rezolvate prin actualizări la Safari și Chrome.
Kokoro HQ și Supertonic HD rămân doar pentru desktop — ambele necesită WebGPU, care nu este încă suportat stabil pe plăcile video mobile.
Pot folosi audio-ul generat comercial (YouTube, podcast, produs)?
Da, cu o singură condiție de bun-simț: este bine să menționezi vocea folosită în creditele sau descrierea proiectului.
- Browser TTS: folosește vocile native ale sistemului de operare. Microsoft, Apple și Google au fiecare propriii termeni pentru utilizarea comercială a vocilor de sistem; de regulă, utilizarea incidentală sau la scară mică este permisă, dar verifică documentația vocii pentru distribuții la scară mare.
- Piper: motorul are licență MIT. Vine cu voci selectate — LibriTTS-R și VCTK sunt CC-BY 4.0 (utilizare comercială permisă, cu atribuire), iar Joe este CC0 / domeniu public (fără restricții). Pentru vocile CC-BY, o atribuire de tipul „Voce de Piper TTS — LibriTTS-R / VCTK, CC-BY 4.0” în descrierea videoclipului sau a podcastului este suficientă.
- Kokoro HQ: modelul are licență Apache 2.0 — utilizare comercială permisă. Apache 2.0 nu cere strict atribuire, dar este o practică bună să menționezi Kokoro-82M în creditele proiectului.
- Supertonic HD: diferă de celelalte motoare — ponderile modelului sunt sub licența OpenRAIL-M de la BigScience, care nu este o licență permisivă. Utilizarea comercială este permisă și nu revendicăm drepturi asupra audio-ului generat, dar OpenRAIL-M impune restricții de utilizare pe care trebuie să le respecți și să le transmiți mai departe oricui împarți modelul sau rezultatele lui. Codul de inferență este MIT.
Nu revendicăm niciun drept asupra audio-ului pe care îl generezi. Respectarea licenței fiecărui model, pentru cazul tău concret de utilizare, rămâne responsabilitatea ta.
Există o limită a lungimii textului?
Poate fi oricât de lung dorești. Împărțim intrarea în bucăți și redăm în flux, deci lipirea unui document de 50.000 de cuvinte funcționează la fel ca o singură propoziție — pur și simplu durează mai mult. Pe calea vocii AI, generarea și redarea sunt suprapuse, deci nu aștepți mult la început.
De ce durează atât de mult prima redare cu AI Voice?
Prima dată când comuți pe un motor AI, browserul trebuie să descarce modelul — aproximativ 60MB pentru Piper, 80MB pentru Kokoro HQ. Poate dura de la câteva secunde până la un minut, în funcție de conexiune. După aceea rămâne în cache-ul browserului, deci este rapid la următoarele utilizări. Supertonic HD este excepția, cu o descărcare inițială de aproximativ 380MB. Ține cont de asta pe o conexiune cu date limitate.
AI Voice rămâne blocat pe „Se descarcă...” pe computerul de la serviciu
Unele rețele de firmă blochează jsDelivr sau Hugging Face, CDN-urile care găzduiesc Piper și Supertonic HD. Dacă niciunul dintre cele două motoare AI nu termină inițializarea, aceasta este aproape sigur cauza. Browser TTS funcționează fără nicio descărcare externă, deci este o alternativă bună într-un mediu restricționat.
De ce văd reclame?
Ca să acoperim costul domeniului, al găzduirii și al timpului de întreținere. Acesta este compromisul pentru a rămâne gratuit, nelimitat. Dacă chiar nu suporți reclamele, înțelegem — poți folosi liniștit un blocator de reclame în browser. Nu punem presiune pe conștiință în privința asta.
Îmi urmăriți apăsările de taste?
Nu. Nu operăm analiză de tip keylogging. Detalii în politica de confidențialitate.
Am o problemă / am feedback
Scrie-ne la hello@quick-tts.com. Include browserul și sistemul de operare.