Les meilleures voix TTS françaises 2026 : Hortense, Thomas et Edge Online comparées

Publié

Choisir une voix de synthèse vocale française en 2026 n'est plus le compromis qu'on a connu pendant quinze ans. Entre les voix neuronales d'Edge Online, le corpus Thomas/Aurélie d'Apple, la famille Piper et Kokoro qui vient d'arriver, l'écosystème français est devenu honnêtement compétitif. Cet article fait le tri par cas d'usage, sans gonfler le palmarès et sans cacher les manques.

L'écosystème TTS français en 2026

Trois constats orientent les choix actuels. Premièrement, les voix SAPI classiques (Hortense, Julie, Paul) restent partout sur Windows mais n'ont pas vraiment évolué depuis Windows 7 — elles servent surtout pour des messages courts et l'accessibilité hors ligne. Deuxièmement, Edge Online a élargi son catalogue à 11 voix françaises neuronales (4 France, 3 Québec, 2 Belgique, 2 Suisse), qui rivalisent avec les meilleures voix payantes d'il y a deux ans. Troisièmement, le projet Piper publie plusieurs voix françaises hors ligne, mais une seule tourne dans la version navigateur que nous servons : fr_FR-siwis-medium, qui tient largement la route pour de la lecture longue. Depuis le 27 juillet 2026 s'y ajoute Supertonic HD sur ordinateur de bureau, la meilleure qualité locale disponible aujourd'hui pour le français.

Microsoft Hortense, Julie, Paul : les voix classiques de Windows

Sur tout Windows 10/11, indépendamment du navigateur, trois voix SAPI françaises sont toujours disponibles :

Le bon usage de ces voix en 2026 : alertes courtes, accessibilité de base, environnements sans Internet. Elles s'allument instantanément, ne demandent aucun téléchargement de modèle, ne sollicitent ni GPU ni cloud. Pour tout ce qui dépasse trois phrases, les options ci-dessous sont meilleures.

Edge Online : Denise, Henri, Vivienne et 8 autres voix neurales

Le catalogue Azure Neural exposé via le navigateur Edge propose actuellement 11 voix françaises, réparties entre quatre variantes nationales :

France métropolitaine (4 voix) :

Canada (Québec, 3 voix) :

Belgique (2 voix) :

Suisse (2 voix) :

Top 3 personnel pour le français de France : Denise Online en défaut, Henri Online pour la voix masculine, Vivienne Online comme alternative quand Denise commence à se reconnaître. Limitation à connaître : ces voix fonctionnent uniquement dans Microsoft Edge et exigent une connexion Internet — la synthèse passe par Azure. Pour des textes confidentiels (RGPD, données médicales), Piper hors ligne est plus adapté.

Apple Thomas, Aurélie, Daniel : les voix Siri

Sur macOS et iOS, le catalogue français est plus restreint mais la qualité locale est élevée :

Apple est aussi le seul fournisseur OS à proposer un français canadien intégré : Amélie (féminine, par défaut au Québec) et Chantal (alternative féminine québécoise). Sur un Mac configuré en français canadien, ces voix s'exposent automatiquement via Web Speech dans tous les navigateurs.

Compromis Apple favorable : qualité quasi-Edge Online, mais sans envoi de texte vers le cloud. Pour des utilisateurs iPhone/Mac soucieux de confidentialité, Thomas Premium ou Aurélie sont le bon point d'équilibre.

Français canadien : Gabriel, Sylvie, Antoine, Jean Online

Le français du Québec est le parent pauvre de la plupart des catalogues, mais Quick TTS rassemble en pratique tout ce qui existe d'utilisable :

Limitation importante : ni Piper ni Kokoro ne proposent de voix française canadienne. Pour du fr-CA hors ligne, l'option la plus propre reste Apple Amélie sur macOS/iOS. Sur Windows hors ligne, c'est Caroline SAPI ou rien.

Piper en français : le catalogue du projet, et la voix réellement disponible ici

Pour de la synthèse française neuronale hors ligne, Piper est le bon choix. Les modèles tournent en WebAssembly dans le navigateur, ~60 Mo téléchargés une seule fois, puis fonctionnement totalement hors ligne.

Correction du 1er août 2026. Cette liste présentait tout le catalogue français de Piper comme s'il était sélectionnable ici. Ce n'est pas le cas : Quick TTS ne propose qu'une seule voix française Piper, fr_FR-siwis-medium. Le catalogue du projet Piper, annoté honnêtement :

Recommandation pratique : côté Piper il n'y a rien à arbitrer, c'est fr_FR-siwis-medium. Il n'y a donc pas de voix masculine Piper ici — pour un timbre masculin, passez par Edge Online (Henri Online) ou par les voix système. Autre lacune réelle de Piper : pas de voix française canadienne.

Supertonic HD en français (et pourquoi Kokoro est absent)

Mise à jour du 31 juillet 2026. Cette section présentait une voix française de Kokoro, ff_siwis. C'était faux et nous le retirons : le moteur Kokoro que nous servons est uniquement anglophone — catalogue de voix et phonémisation — et il est masqué sur toutes les pages non anglaises. Sur /fr/ il n'apparaît pas dans le menu, donc cette voix n'a jamais été sélectionnable.

La voix locale haut de gamme pour le français existe bel et bien, mais c'est une autre : Supertonic HD, ajoutée le 27 juillet 2026. L'exécution se fait via WebGPU sur la carte graphique (Chrome ou Edge desktop avec GPU récent), en 44,1 kHz et totalement en local.

Le premier téléchargement d'environ 380 Mo n'a lieu qu'une fois ; ensuite le modèle est mis en cache et utilisable hors ligne. Si votre navigateur ou appareil ne prend pas en charge WebGPU, le menu ne propose pas l'option — sur mobile, la recommandation reste Piper.

Quelle voix choisir ?

Décision rapide selon le cas d'usage :

À écouter

Ouvrez Quick TTS, collez un paragraphe en français et comparez le moteur du navigateur (Edge Online ou Apple), Piper et — sur ordinateur de bureau — Supertonic HD sur le même texte. Au sein d'un même moteur, vous pouvez changer de voix en cours de lecture : Quick TTS relit le passage en cours avec la nouvelle voix, ce qui permet de comparer la même phrase. En revanche, changer de moteur arrête la lecture — il faut relancer play. C'est la seule manière sérieuse de comparer les voix françaises : votre oreille tranchera mieux qu'un classement écrit, parce qu'un texte journalistique favorise Henri Online, un récit favorise Denise, un dialogue québécois favorise Sylvie.

Pour aller plus loin, le guide d'utilisation détaille dix cas pratiques de la synthèse vocale, la FAQ répond aux questions courantes, et la page À propos explique pourquoi Quick TTS exécute toute la synthèse localement (point clé pour la conformité RGPD).