Sous-titres automatiques
Les sous-titres automatiques sont des fichiers SRT ou VTT générés depuis l'audio, qui affichent le texte au bon moment dans les vidéos et players.
Les sous-titres automatiques sont des fichiers de sous-titrage générés sans saisie manuelle, qui associent chaque segment de texte à un intervalle de temps dans l'audio. Les deux formats standards sont le SRT (le plus ancien, universellement accepté) et le VTT (son équivalent pour le web, lu nativement par les navigateurs via la balise track de HTML5).
Deux chemins de génération
Il existe deux manières de produire des sous-titres automatiquement. La première part d'un enregistrement audio ou vidéo et le transcrit par reconnaissance vocale : c'est l'approche de YouTube, avec les erreurs de transcription que chacun connaît sur les noms propres et les termes techniques.
La seconde part du texte : quand l'audio est généré par synthèse vocale depuis un article, le texte exact est connu d'avance et chaque mot est daté grâce à l'horodatage mot à mot. Les sous-titres sont alors une simple mise en forme de données déjà exactes : découpage en lignes de longueur raisonnable, calage sur les temps de parole. Pas d'erreur de transcription possible, puisque rien n'est transcrit.
À quoi servent-ils pour un éditeur de presse
Trois usages principaux. La vidéo sociale d'abord : un article audio décliné en format vidéo pour les réseaux sociaux doit être sous-titré, car une grande partie des vidéos y sont regardées sans le son. L'accessibilité ensuite : le sous-titrage rend le contenu audio utilisable par les personnes sourdes ou malentendantes, et il fait partie des exigences classiques des référentiels d'accessibilité pour tout média temporel. La souplesse d'usage enfin : dans un environnement bruyant ou silencieux (transports, open space), le sous-titre remplace le son.
Pour une rédaction, l'intérêt de l'automatisation est le même que pour l'audio : couvrir toute la production, pas seulement les contenus vedettes. La fonctionnalité de sous-titres de WeDispatch génère les fichiers SRT et VTT pour chaque article audio, prêts à être attachés à une vidéo ou à un player.
Termes liés
- Horodatage mot à mot : L'horodatage mot à mot associe chaque mot du texte à sa position exacte dans l'audio. C'est la base du surlignage, des citations et des chapitres.
- Accessibilité numérique de la presse : L'accessibilité numérique rend un site de presse utilisable par tous. Le cadre : RGAA en France, acte européen d'accessibilité depuis juin 2025.
- Texte synchronisé : Le texte synchronisé surligne chaque mot de l'article au moment où la voix le prononce. L'utilisateur lit et écoute en même temps.
Donnez une voix à vos articles
WeDispatch transforme automatiquement vos articles en version audio, dès la publication. Essayez gratuitement sur vos propres articles : tester sans carte bancaire.
Demander une démo