FAQ
Risposte rapide alle domande più frequenti.
È davvero gratis e senza limite di parole?
Sì. Niente registrazione, niente tetto di caratteri, niente piano a pagamento. Incolla un tweet o incolla un romanzo: lo strumento è lo stesso. Lo manteniamo gratis con la pubblicità.
Salvate il testo che incollo?
No. Quick TTS funziona interamente lato client. Il testo che incolli è elaborato dal tuo browser e non viene mai inviato a nessun nostro server. Non ne abbiamo log perché non ci arriva mai.
Il tuo testo più recente viene salvato nel localStorage del browser per essere ancora lì se chiudi la scheda per sbaglio, ma resta solo sul tuo dispositivo. Per cancellarlo, svuota i dati del sito.
Qual è la differenza tra la voce predefinita e "AI Voice"?
Predefinita (Browser TTS): il motore vocale integrato del tuo browser (API Web Speech). Istantaneo, funziona su ogni dispositivo e suona come una voce TTS standard. Le voci esatte disponibili dipendono dal sistema operativo: Mac ha Samantha, Windows ha Zira e Natasha, Android e iOS hanno le proprie.
AI Voice sono tre motori neurali che puoi attivare; sulle pagine italiane ne sono visibili due. Entrambi girano in locale sul tuo dispositivo dopo un download iniziale — il tuo testo non lascia mai il browser.
- Piper — download di ~60MB, gira in WebAssembly. Funziona su
qualsiasi browser desktop e ormai anche su smartphone. Suona molto più naturale
di Browser TTS. Modello italiano:
it_IT-riccardo-x_low. - Supertonic HD — la migliore qualità locale per l'italiano: 44,1 kHz, gira sulla tua GPU tramite WebGPU. Circa 380 MB una sola volta, poi funziona offline. Richiede WebGPU — non esiste un ripiego in WebAssembly, quindi senza WebGPU l'opzione non compare proprio nel menu.
- Kokoro HQ — ~80MB, gira via WebGPU, ma è solo in inglese (sia il catalogo voci sia la fonemizzazione). Per questo sulle pagine italiane il motore non viene mostrato.
La voce IA invia il mio testo a un server?
No. Sia Piper che Supertonic HD girano interamente nel tuo browser — Piper tramite WebAssembly, Supertonic HD tramite WebGPU. Le uniche richieste di rete sono i download iniziali della libreria e del modello da jsDelivr e Hugging Face. Dopo, tutta la sintesi da testo ad audio avviene sul tuo dispositivo.
Funziona da cellulare?
Da cellulare hai Browser TTS — funziona ovunque usando le voci integrate del tuo telefono. Anche Piper ora gira da cellulare: i problemi che Piper-WASM aveva su iOS si sono risolti con gli aggiornamenti di Safari e Chrome.
Kokoro HQ e Supertonic HD restano esclusivi desktop — entrambi richiedono WebGPU, che le GPU mobili non eseguono ancora in modo affidabile.
Posso usare l'audio in ambito commerciale (YouTube, podcast, prodotti)?
Sì, con un'avvertenza: è buona prassi accreditare il modello vocale sottostante nei crediti o nella descrizione del tuo progetto.
- Voce del browser: usa le voci integrate del tuo sistema operativo. Microsoft, Apple e Google pubblicano i propri termini per l'uso commerciale delle voci di sistema — in genere è permesso per usi marginali e di piccola scala, ma controlla la loro documentazione per la voce di destinazione se distribuisci su larga scala.
- Piper: il motore ha licenza MIT. Distribuiamo un set selezionato di voci: LibriTTS-R e VCTK sono CC-BY 4.0 (uso commerciale consentito con attribuzione) e Joe è CC0 / pubblico dominio (senza restrizioni). L'attribuzione per le voci CC-BY si soddisfa di solito con una riga nella descrizione del tuo video/podcast del tipo "Voce di Piper TTS — LibriTTS-R / VCTK, CC-BY 4.0".
- Kokoro HQ: il modello è Apache 2.0 — l'uso commerciale è consentito. Apache 2.0 non richiede formalmente l'attribuzione, ma consigliamo di accreditare Kokoro-82M nei crediti come buona prassi.
- Supertonic HD: diverso dagli altri — i pesi del modello sono sotto OpenRAIL-M di BigScience, che non è una licenza permissiva. L'uso commerciale è consentito e non viene rivendicato alcun diritto sull'audio che generi, ma OpenRAIL-M aggiunge restrizioni d'uso che devi rispettare e trasmettere a chiunque condivida con te il modello o il suo output. Il codice di inferenza è MIT.
Non rivendichiamo alcun diritto sull'audio che generi. Spetta a te rispettare le licenze dei modelli sottostanti per il tuo specifico caso d'uso.
Quanto può essere lungo il mio testo?
Quanto vuoi. Spezziamo l'input e trasmettiamo la riproduzione in streaming, quindi incollare un documento da 50.000 parole funziona come incollare una frase: ci mette solo più tempo. Sul percorso AI Voice mettiamo in pipeline la generazione con la riproduzione, così non c'è una lunga attesa iniziale.
Perché la prima riproduzione con AI Voice ci mette tanto a partire?
La prima volta che attivi un motore IA, il browser deve scaricare il modello — ~60MB per Piper, ~80MB per Kokoro HQ. Ci vogliono da qualche secondo a un minuto a seconda della tua connessione. Dopo viene messo in cache nel browser e gli usi successivi partono all'istante. Supertonic HD è l eccezione: circa 380 MB al primo avvio — tienilo presente su una connessione a consumo.
Sono sul PC del lavoro e AI Voice resta bloccato su "Download..."
Alcune reti aziendali bloccano jsDelivr o Hugging Face — i CDN che ospitano Piper e Supertonic HD. Se nessuno dei motori IA termina l'inizializzazione, è quasi sempre questo il motivo. Browser TTS funziona senza alcun download esterno, quindi è un buon ripiego negli ambienti più chiusi.
Perché vedo gli annunci?
Gli annunci sono ciò che paga il dominio, l'hosting e il tempo di manutenzione dello strumento. È lo scambio per tenerlo gratis e senza limiti. Se odi gli annunci, hai tutto il nostro rispetto — e un blocco-pubblicità a portata di mano. Niente sensi di colpa.
Tracciate quello che digito?
No. Non usiamo analytics né registrazione delle digitazioni. Vedi l'informativa sulla privacy per il dettaglio completo.
Qualcosa si è rotto / ho un feedback
Scrivi a hello@quick-tts.com. Indica browser e sistema operativo.