Exposants, indices et notation scientifique : ce qu'une voix de synthèse en fait
m2, H2O, 10 puissance 6, 1er, XIXe : ces formes portent une dimension que le texte brut perd. Voici ce qu'une synthèse vocale en lit correctement, ce qu'elle rate, et comment reprendre la main.
Un article de fond, une fiche technique, un dossier santé ou un billet de recherche contiennent presque toujours des formes qui ne sont pas de simples mots : une surface en mètres carrés, une formule chimique, une puissance de dix, un ordinal, une température. À l'écrit, ces formes se comprennent d'un coup d'œil. À l'oral, elles obligent la machine à trancher : faut-il lire un chiffre, l'épeler, ou l'ignorer ? Et c'est là que beaucoup de textes trahissent leur auteur, parce que la lecture attendue et la lecture obtenue divergent.
Une chaîne de caractères a perdu ce que la mise en forme disait
Quand vous tapez « m² », votre œil voit une unité : le mètre carré. Mais pour un moteur de lecture, « m² » est la suite de deux caractères, une lettre et un symbole d'exposant Unicode. Rien, dans cette suite, ne dit que le « 2 » est une puissance et pas une note de bas de page ou un numéro. La mise en forme, elle, avait cette information : elle plaçait le 2 en petit et en haut. Le texte transmis à la synthèse, lui, l'a souvent perdue en route, surtout s'il a transité par un copier-coller, un export ou un flux RSS qui aplatit tout.
Le résultat n'est donc pas une question de qualité de voix. C'est une question d'information disponible. Une voix ne peut lire correctement que ce que le texte lui donne à lire.
Ce qui passe, et ce qui coince
Certaines formes sont si courantes qu'elles sont apprises et lues sans effort. Les unités écrites en toutes lettres, ou les abréviations très répandues comme « km » ou « kg », posent rarement problème. Les difficultés commencent avec les exposants, les indices et les notations condensées.
Voici les cas qui reviennent le plus souvent, avec la lecture qu'un lecteur humain attend et l'erreur fréquente d'un outil qui n'a pas été réglé pour :
- 120 m² : attendu « cent vingt mètres carrés » ; erreur fréquente « cent vingt m deux » ou « cent vingt mètres deux ».
- H2O : attendu « H deux O » (ou « eau » selon le contexte) ; erreur fréquente « h vingt » quand le 2 est collé.
- CO2 : attendu « C O deux » ; erreur fréquente « co deux » lu comme un mot.
- 10^6 ou 10⁶ : attendu « dix puissance six » ou « un million » ; erreur fréquente « dix six » ou « dix accent circonflexe six ».
- 20 °C : attendu « vingt degrés Celsius » ; erreur fréquente « vingt degré C » ou l'oubli pur du symbole.
- x² : attendu « x au carré » ; erreur fréquente « x deux ».
- 1er, 2e, XIXe : attendu « premier », « deuxième », « dix-neuvième » ; erreur fréquente « un e r », « deux e », « X I X e ».
Le point commun est simple : le chiffre en exposant ou en indice a deux interprétations possibles, et sans indice de contexte, l'outil prend la plus littérale. C'est prudent, mais à l'oreille c'est une faute.
Pourquoi le « 2 » est un piège particulier
Le carré et le cube dominent nos textes courants, or ils s'écrivent avec les mêmes chiffres que n'importe quelle quantité. Quand vous lisez « surface de 50 m² », votre cerveau sait que le 2 se rapporte à l'unité. Une machine, elle, voit un 50, un espace, un m, et un 2. Si ce 2 est un vrai caractère d'exposant Unicode (²), un bon prétraitement peut le reconnaître ; s'il a été aplati en un 2 ordinaire par une conversion, l'information est définitivement perdue et aucune lecture ne peut la deviner à coup sûr. La même quantité écrite « 50 m2 » et « 50 m² » ne se lit donc pas pareil, alors qu'elle se voit pareil.
C'est exactement la logique que nous détaillons pour les nombres en général dans notre article sur la lecture des nombres à voix haute, et pour les ordinaux dans celui sur les chiffres romains : la forme écrite décide de la lecture, pas l'intention.
Reprendre la main quand la lecture par défaut ne suffit pas
Notre parti pris est de bien lire le français plutôt que d'en lire trente approximativement, et cela se joue précisément sur ces cas limites. Deux leviers existent, et ils sont complémentaires.
Le premier est éditorial et gratuit : écrivez la forme lisible quand l'exactitude compte. « mètre carré » plutôt que « m² » dans un texte destiné avant tout à l'écoute, « dioxyde de carbone » plutôt que « CO2 » dans un article grand public. Ce n'est pas toujours souhaitable (une fiche technique perd en densité), mais c'est le réglage le plus fiable, car il ne dépend d'aucun outil.
Le second est le lexique de prononciation : vous déclarez une fois comment doit se lire une forme récurrente, et l'outil l'applique partout. Une revue scientifique qui écrit « CO2 » cent fois par mois n'a pas à réécrire son texte : elle règle la lecture une seule fois. Le geste exact, et ses limites, sont décrits dans notre guide sur la correction ciblée de prononciation. C'est aussi le bon endroit pour vérifier ce que la synthèse vocale française sait faire par défaut avant d'ajouter une règle.
En pratique, pour une rédaction
Trois habitudes suffisent à éviter presque toutes les mauvaises surprises. D'abord, préférez les vrais caractères d'exposant et d'indice à un simple chiffre collé quand votre éditeur le permet, car ils donnent à l'outil une chance de reconnaître la forme. Ensuite, écoutez systématiquement les passages qui contiennent des formules, des unités ou des ordinaux : ce sont eux qui cassent, jamais les phrases ordinaires. Enfin, pour les formes que vous employez souvent, déclarez-les une fois dans le lexique plutôt que de les corriger à la main article après article.
L'exponentiel et l'indice ne sont pas un défaut de la voix : ce sont des endroits où le texte doit dire ce qu'il veut. Une fois qu'il le dit, la lecture suit.
Écoutez vos propres formules
Prenez un de vos articles les plus techniques, celui qui contient des unités, des formules ou des pourcentages, et faites le test. Vous saurez en deux minutes lesquelles de vos habitudes d'écriture s'entendent bien, et lesquelles méritent une règle de lecture.
Sonorisez vos articles avec WeDispatch
Ce blog sera lui-même sonorisé par WeDispatch. Envie de voir ce que ça donne sur vos contenus ?
Demandez une démo