BrowserTools
Accueil / Divers / Synthèse vocale, lecteur de texte en ligne gratuit

Synthèse vocale, lecteur de texte en ligne gratuit

Collez n'importe quel texte et écoutez-le lu à voix haute dans votre navigateur. Choisissez une voix, réglez la vitesse et la hauteur. Privé, gratuit, rien n'est envoyé nulle part.

Chargement de Synthèse vocale, lecteur de texte en ligne gratuit… Si rien ne se passe, activez JavaScript.

Cet outil gratuit de synthèse vocale transforme du texte écrit en audio parlé directement dans votre navigateur. Collez ou tapez n'importe quoi, un article que vous voulez écouter, un brouillon d'e-mail, des notes de cours, un chapitre de livre, puis appuyez sur Lecture pour l'entendre lu à voix haute avec une voix naturelle. Il n'y a rien à installer et aucun compte à créer : le lecteur fonctionne instantanément sur ordinateur et mobile, et il gère aussi bien une seule phrase que plusieurs pages de texte.

Questions fréquentes

Puis-je télécharger la lecture en fichier MP3 ou WAV ?
Non, et c'est une limite honnête de la technologie plutôt qu'une fonctionnalité manquante. La Web Speech API joue l'audio via le moteur vocal du système et n'expose pas le flux audio à la page, il n'y a donc rien que l'outil puisse capturer et enregistrer. Produire un MP3 ou un WAV téléchargeable exige un service de synthèse vocale côté serveur ou dans le cloud, ce qui impliquerait d'envoyer votre texte. Cet outil garde délibérément tout sur votre appareil.
Quelles voix sont disponibles ?
Celles que fournissent votre système d'exploitation et votre navigateur. Windows embarque des voix Microsoft, macOS et iOS des voix Apple, Android des voix Google, et Chrome sur ordinateur ajoute ses propres voix Google supplémentaires. Le sélecteur liste toutes les voix exposées par votre configuration, regroupées par langue, et affiche le nombre total. Vous pouvez ajouter des voix en installant des langues ou des voix supplémentaires dans les réglages de votre système d'exploitation.
Pourquoi les voix diffèrent-elles entre mes appareils ?
Parce que la parole est générée localement par le moteur propre à chaque appareil, et non par un serveur partagé. Votre ordinateur portable Windows, votre téléphone Android et votre iPad embarquent des jeux de voix différents de fournisseurs différents, si bien que le même texte peut sonner très différemment d'un appareil à l'autre. C'est la contrepartie d'un lecteur instantané, gratuit et entièrement privé.
Mon texte est-il envoyé à un serveur ?
Non. L'outil fonctionne entièrement en local dans votre navigateur. Votre texte est transmis au moteur vocal intégré à votre appareil et n'en sort jamais. Il n'y a ni serveur, ni journalisation, ni compte, ce qui rend l'outil sûr pour les notes privées, les brouillons non publiés et les documents confidentiels.
Comment l'outil gère-t-il les textes longs ?
Le texte long est automatiquement découpé en segments de la taille d'une phrase, mis en file d'attente et prononcés l'un après l'autre. C'est important, car beaucoup de moteurs vocaux coupent ou interrompent silencieusement les énoncés uniques très longs. Grâce à ce découpage, même les documents de plusieurs pages sont lus de manière fiable, et un indicateur de progression montre quel segment est en cours de lecture.
Comment fonctionne le surlignage des mots ?
Pendant la lecture, le navigateur peut émettre des événements de frontière indiquant la position du mot en train d'être prononcé, et l'outil s'en sert pour surligner ce mot dans le texte. Cependant, toutes les voix n'émettent pas ces événements ; certaines voix distantes ou neuronales ne le font tout simplement pas. Si la voix choisie ne signale pas la position des mots, l'outil s'en aperçoit et affiche une courte note au lieu de faire semblant de surligner.
À quoi servent les curseurs de vitesse, de hauteur et de volume ?
La vitesse contrôle le débit de parole, de 0.5 (demi-vitesse, idéale pour une écoute attentive ou l'apprentissage des langues) à 2 (vitesse double, idéale pour survoler). La hauteur rend la voix plus grave ou plus aiguë sur une échelle de 0 à 2 sans changer la vitesse. Le volume règle l'intensité de 0 à 1, indépendamment du volume de votre système. Un bouton de réinitialisation rétablit les valeurs par défaut de 1, 1 et 1 en un clic.
Quels navigateurs prennent en charge la synthèse vocale ?
Tous les navigateurs modernes prennent en charge la partie synthèse de la Web Speech API : Chrome, Edge, Safari et Firefox, sur ordinateur comme sur mobile. Les détails varient : Chrome charge sa liste de voix de manière asynchrone et propose des voix Google supplémentaires, Safari utilise les voix système d'Apple, et la prise en charge du surlignage par frontières de mots dépend de la voix choisie. Si votre navigateur n'offre aucune prise en charge, l'outil vous le dit au lieu d'échouer en silence.
Cet outil de synthèse vocale est-il gratuit ?
Oui, entièrement gratuit, sans limite de caractères, sans abonnement ni inscription. Comme l'audio est généré par votre propre appareil et non par un service cloud payant, il n'y a aucun coût au mot à répercuter. Vous pouvez lire autant de texte que vous voulez, aussi souvent que vous voulez.
Peut-il lire d'autres langues que l'anglais ?
Oui. La liste des voix est regroupée par langue, et choisir une voix correspondant à la langue de votre texte donne une prononciation correcte. La plupart des systèmes incluent d'origine des voix pour les grandes langues comme l'espagnol, le français, l'allemand, le portugais, l'italien, le chinois et le japonais. Lire un texte avec une voix inadaptée fonctionne techniquement mais sonne faux, alors choisissez une voix correspondante pour un meilleur résultat.

À propos de Synthèse vocale, lecteur de texte en ligne gratuit

Sous le capot, l'outil utilise la Web Speech API, le moteur de synthèse vocale déjà intégré à votre navigateur et à votre système d'exploitation. Cette conception offre un avantage majeur en matière de confidentialité : votre texte n'est jamais envoyé à aucun serveur. Les mots que vous collez restent sur votre appareil, sont prononcés par le moteur vocal local et disparaissent quand vous fermez la page. Il n'y a pas de limite de mots imposée par un service distant, pas de compte et pas de file d'attente de traitement, car il n'y a tout simplement aucun service distant.

Vous gardez le contrôle total sur le rendu du texte. Choisissez n'importe quelle voix installée sur votre système, regroupées par langue pour trouver rapidement l'anglais, l'espagnol, le français, l'allemand, le portugais et des dizaines d'autres options. Ajustez finement la vitesse de lecture, d'un lent 0.5x pour une écoute attentive jusqu'à un rapide 2x pour survoler, montez ou descendez la hauteur de la voix, et réglez le volume indépendamment du mixeur de votre système. Cela rend l'outil utile bien au-delà de la simple lecture : les auteurs relisent à l'oreille et repèrent les tournures maladroites que leurs yeux laissent passer, les apprenants en langues entendent la prononciation correcte d'un texte étranger, les personnes malvoyantes ou dyslexiques consomment confortablement du contenu écrit, et chacun peut transformer un long article en quelque chose à écouter en faisant autre chose.

Une réserve honnête : comme les voix proviennent de votre navigateur et de votre système d'exploitation, la sélection diffère d'un appareil à l'autre. Windows, macOS, Android et iOS embarquent chacun leurs propres jeux de voix, et Chrome ajoute ses propres voix Google, si bien que la même page peut sonner différemment sur votre téléphone et sur votre ordinateur portable. Certaines voix sont naturelles et agréables, d'autres nettement robotiques, et des fonctions comme le surlignage mot à mot dépendent de la quantité d'informations qu'une voix donnée renvoie. L'outil détecte ce que votre configuration prend en charge et s'adapte aux voix dont vous disposez, mais s'il manque une langue, la solution consiste à l'installer dans les réglages de votre système d'exploitation.

Du Voder aux voix neuronales : une brève histoire des machines qui parlent

La première machine à parler en public n'était pas du tout un ordinateur. À l'Exposition universelle de New York de 1939, les laboratoires Bell présentèrent le Voder, une imposante console électronique dont on jouait comme d'un instrument de musique. Une opératrice entraînée, généralement l'une des quelque vingt femmes qui s'étaient exercées pendant un an, appuyait sur des touches et une barre de poignet pour façonner des sources de bourdonnements et de sifflements en mots reconnaissables. Le Voder ne pouvait pas parler seul ; il prouvait que la parole humaine pouvait être assemblée à partir de briques électroniques, et les foules faisaient la queue pour l'entendre prononcer des phrases à la demande.

Les ordinateurs ont appris à parler dans les décennies suivantes, et deux jalons se détachent. En 1978, Texas Instruments mit la synthèse vocale dans un jouet : le Speak & Spell fit tenir un modèle complet du conduit vocal sur une seule puce, si bien qu'un jouet d'orthographe pour enfants pouvait prononcer des mots à voix haute, un jalon de l'électronique grand public. Pendant ce temps, au MIT, Dennis Klatt passa des années à peaufiner la synthèse par formants, un travail qui devint DECtalk en 1984. L'utilisateur le plus célèbre de DECtalk fut le physicien Stephen Hawking, qui parla pendant des décennies avec une voix dérivée des propres enregistrements de Klatt. Quand on lui proposa des voix plus récentes et plus fluides, Hawking refusa : la voix robotique de DECtalk était devenue sa voix, et il la garda jusqu'à sa mort en 2018.

La synthèse vocale moderne a pris un tournant brutal dans les années 2010, quand les réseaux de neurones ont remplacé les règles acoustiques construites à la main. Des systèmes comme WaveNet, publié par DeepMind en 2016, généraient des formes d'onde audio brutes échantillon par échantillon et sonnaient soudain étonnamment humains, avec un rythme de respiration et une intonation naturels. Les systèmes d'exploitation actuels embarquent des dizaines de voix neuronales dans de nombreuses langues, et la même technologie alimente les lecteurs d'écran, les instructions de navigation et les assistants virtuels. Les voix que vous entendez dans cet outil reposent sur toute cette lignée, d'une console jouée à la main lors d'une Exposition universelle jusqu'à des réseaux qui ont appris la parole à partir de milliers d'heures d'enregistrements.

Soutenir