Comment rendre vos vidéos accessibles grâce aux sous-titres (guide 2026)
sous-titresaccessibilitévidéo

Comment rendre vos vidéos accessibles grâce aux sous-titres (guide 2026)

BMMamane B. MoussaApril 14, 2026Updated July 2, 202613 min read

Summarize this article with:

TL;DR

Les sous-titres rendent votre vidéo accessible aux plus de 430 millions de personnes atteintes d'une perte auditive invalidante, ainsi qu'à tous ceux qui regardent sans le son. Le processus comporte quatre étapes : générer les sous-titres avec un outil d'IA, les corriger selon les normes d'accessibilité (dialogue verbatim, événements sonores, identification des locuteurs), choisir le bon format pour chaque plateforme et tester avant publication. La plupart des plateformes acceptent l'import de fichiers SRT ; les flux sociaux exigent des sous-titres incrustés. Les obligations légales s'appliquent désormais à un ensemble d'organisations plus large que la plupart des gens ne l'imaginent, et le seuil de précision exigé pour la conformité dépasse ce qu'aucun sous-titrage automatique de plateforme n'atteint de manière fiable.

Les sous-titres constituent l'amélioration d'accessibilité la plus impactante que vous puissiez apporter à une vidéo. Ils servent les 430 millions de personnes dans le monde atteintes d'une perte auditive invalidante (estimation de l'OMS), tous les spectateurs qui regardent sans le son en public, et toute personne dont la langue maternelle n'est pas celle parlée dans la vidéo. Les vidéos sous-titrées obtiennent aussi des taux de visionnage complet supérieurs de 40 % à ceux des vidéos sans sous-titres, et sur Facebook environ 85 % des vidéos sont regardées sans le son.

Ce guide parcourt l'intégralité du processus de sous-titrage : générer, corriger selon la norme, mettre en forme pour chaque plateforme et vérifier. Pour approfondir la conformité, consultez conformité ADA des sous-titres accessibles.

Comprendre les trois types de sous-titres

Les sous-titres codés sont des pistes de texte distinctes que les spectateurs peuvent activer ou désactiver. Ils contiennent le dialogue, l'identification des locuteurs et les descriptions des sons non vocaux. SRT, VTT, SBV et TTML sont tous des formats de sous-titres codés. Ce sont eux la référence en matière de conformité à l'accessibilité.

Les sous-titres incrustés sont définitivement gravés dans la vidéo. Les spectateurs ne peuvent pas les retirer. C'est la norme pour les contenus de réseaux sociaux (Instagram Reels, TikTok, fil Facebook) où la lecture automatique se fait sans son.

Les sous-titres (de traduction) traduisent le dialogue dans une autre langue. Ils partent du principe que le spectateur entend l'audio et omettent généralement les sons non vocaux. Pour l'accessibilité, les sous-titres ne remplacent pas les sous-titres codés.

La base de toute exigence d'accessibilité, ce sont les sous-titres codés, pas les sous-titres de traduction. Les sous-titres incrustés satisfont la même exigence uniquement lorsque le spectateur n'a aucun moyen de les désactiver.

Étape 1 : Générer les sous-titres

Importez votre vidéo dans le générateur de sous-titres. Il accepte les formats MP4, MOV, AVI, MKV, WebM et autres formats courants. Sélectionnez la langue parlée et lancez le traitement. Une vidéo de 10 minutes prend généralement moins de 90 secondes.

Générateur de sous-titres IA en train de traiter un fichier vidéo
Générateur de sous-titres IA en train de traiter un fichier vidéo

Les sous-titres générés par IA atteignent une précision de 95 à 98 % sur un audio propre avec une parole claire. La précision chute en cas de locuteurs qui se chevauchent, d'accents prononcés, de musique de fond ou de discours technique rapide. Le générateur vous donne un point de départ ; c'est la relecture humaine qui vous amène au niveau de conformité.

Si vous avez seulement besoin d'une transcription sans mise en forme spécifique à une plateforme, ConvertAudioToText produit un texte verbatim propre à partir d'un fichier audio ou vidéo en une seule étape.

Étape 2 : Corriger selon les normes d'accessibilité

Le résultat brut de l'IA n'est pas prêt pour l'accessibilité. Relisez et corrigez :

Exactitude verbatim. Chaque mot prononcé doit apparaître, dans le bon ordre. Ne paraphrasez pas, ne résumez pas et n'omettez pas les mots de remplissage si l'expérience du spectateur en dépend. Les noms propres, les marques et les termes techniques sont les erreurs les plus fréquentes de l'IA.

Événements sonores. Selon les normes de sous-titrage DCMP et WCAG 1.2.2, les sous-titres doivent inclure les informations audio non vocales qui affectent le sens. Utilisez des crochets : [le téléphone sonne], [musique jazz entraînante], [la porte claque]. Omettez les bruits ambiants dépourvus d'information utile. Lorsqu'un événement sonore se produit en même temps que le dialogue, placez le sous-titre de l'événement sonore en haut de l'écran.

Identification des locuteurs. Quand plusieurs personnes parlent, étiquetez chaque sous-titre avec le nom du locuteur ou une étiquette de rôle cohérente (NARRATEUR, INTERVIEWEUR, DR CHEN). Utilisez des majuscules ou une notation entre parenthèses cohérente. Ce n'est pas facultatif pour le contenu multi-locuteurs selon les normes d'accessibilité.

Synchronisation. Les sous-titres doivent apparaître au moment où les mots sont prononcés et disparaître dans la foulée. Des sous-titres trop tôt ou trop tard nuisent à la compréhension. Portez une attention particulière aux pauses, aux limites de phrases et aux passages rapides.

Longueur de ligne et vitesse de lecture. Les recommandations DCMP et Section 508 préconisent deux lignes maximum par sous-titre, 32 à 42 caractères par ligne, et une vitesse de lecture inférieure à 180 mots par minute (soit environ 17 à 22 caractères par seconde pour la diffusion télévisée). Coupez les lignes aux frontières linguistiques naturelles, pas en pleine phrase ni en plein mot.

Étape 3 : Choisir le bon format pour chaque plateforme

Toutes les plateformes ne gèrent pas les sous-titres de la même façon.

PlateformeMéthode préféréeFichier pris en chargeRemarques
YouTubeImporter un SRTSRT, VTT, SBVÀ importer systématiquement ; les sous-titres automatiques atteignent 78 à 96 % de précision, bien en dessous du seuil de conformité
VimeoImporter un VTT ou un SRTSRT, VTTPrend en charge plusieurs pistes de langues
LinkedInImporter un SRT au moment de la publicationSRTImpossible d'ajouter ou de modifier les sous-titres après publication
FacebookImporter un SRTSRTSous-titres automatiques disponibles mais à relire
Instagram ReelsIncruster les sous-titresN/ALes sous-titres automatiques de la plateforme sont irréguliers ; les sous-titres incrustés sont plus fiables
TikTokIncruster les sous-titres ou utiliser l'outil intégréSRT limitéLes sous-titres automatiques de TikTok s'améliorent constamment mais font encore des erreurs sur les noms et les termes techniques
Votre site webRéférencer un VTT via l'élément track HTML5VTTUtilisez l'élément track avec kind="captions"

Pour YouTube, les étapes d'import sont : YouTube Studio, puis Sous-titres, sélectionnez votre vidéo, cliquez sur « Ajouter une langue », puis « Ajouter » et importez le fichier SRT. Ne comptez jamais sur les sous-titres générés automatiquement par YouTube pour la conformité à l'accessibilité.

Pour Instagram et TikTok, incrustez les sous-titres dans la vidéo avant l'import à l'aide de Ajouter des sous-titres à une vidéo. Sur TikTok, gardez les sous-titres dans le tiers supérieur de l'image pour éviter tout chevauchement avec les éléments d'interface de la plateforme.

Pour votre propre site web, le code HTML ressemble à ceci :

<video>
  <track kind="captions" src="captions.vtt" srclang="en" label="English" default>
</video>

Si vous devez convertir entre SRT et VTT, le Générateur de sous-titres exporte les deux formats.

Étape 4 : Tester avant de publier

Visionnez la vidéo complète avec les sous-titres activés. Vérifiez :

  • Les sous-titres apparaissent et disparaissent en synchronisation avec la parole
  • Les étiquettes de locuteurs sont présentes et cohérentes sur tout le contenu multi-locuteurs
  • Les événements sonores sont capturés et correctement synchronisés
  • Aucune longue ligne qui défile hors de l'écran ou masque du contenu visuel essentiel
  • La taille de police est lisible à la taille de visionnage habituelle (équivalent minimum 18 px pour une résolution vidéo standard, texte blanc avec ombre portée sombre ou encadré)

Testez sur mobile. La plupart des spectateurs sont sur téléphone et la lisibilité des sous-titres est plus difficile à évaluer sur un aperçu bureau.

Obligations légales

Le paysage réglementaire s'est nettement durci ces deux dernières années.

WCAG 2.1 niveau AA exige des sous-titres pour tous les médias synchronisés préenregistrés (critère de succès 1.2.2, niveau A) et pour toutes les vidéos en direct (1.2.4, niveau AA). WCAG 2.2 n'a pas modifié ces critères. La plupart des organisations visent le niveau AA.

ADA Titre II (États-Unis) : la règle finale d'avril 2024 du DOJ a inscrit WCAG 2.1 niveau AA pour les services numériques des gouvernements étatiques et locaux. L'échéance de conformité a été repoussée en avril 2026 : les entités desservant plus de 50 000 habitants doivent être conformes au 26 avril 2027 ; les entités plus petites et les districts spéciaux disposent jusqu'au 26 avril 2028.

Section 508 (fédéral américain) : les agences fédérales et leurs prestataires doivent sous-titrer toutes les vidéos accessibles au public. Les sous-titres générés automatiquement ne satisfont pas le seuil de précision de la Section 508 pour le contenu préenregistré.

European Accessibility Act (EAA) : entré en vigueur le 28 juin 2025. Les vidéos destinées au public publiées après cette date doivent inclure des sous-titres codés exacts et synchronisés dans le temps. Les vidéos publiées avant le 28 juin 2025 devront être rendues accessibles d'ici le 28 juin 2030. Les sanctions vont de 5 000 à 100 000 euros en cas de non-conformité.

Le critère 1.2.2 est une exigence de niveau A, c'est-à-dire le seuil minimal, pas un objectif avancé. Toute organisation revendiquant une conformité WCAG doit le satisfaire.

Mon avis : la plupart des organisations sont plus loin de la conformité qu'elles ne le croient, parce qu'elles comptent les sous-titres générés automatiquement comme des « vidéos sous-titrées ». Les sous-titres automatiques des plateformes ne cochent la case que lorsqu'ils sont relus et corrigés. Un taux de précision de 85 % non corrigé, ce n'est pas du sous-titrage accessible ; c'est un brouillon de départ.

Référence de mise en forme des sous-titres

Suivre ces conventions garde les sous-titres lisibles et satisfait la plupart des organismes de normalisation :

  • Deux lignes maximum par sous-titre
  • 32 à 42 caractères par ligne (32 pour la diffusion télévisée, jusqu'à 42 pour la vidéo en ligne)
  • Casse mixte (pas tout en MAJUSCULES pour des sous-titres entiers)
  • Vitesse de lecture : 17 à 22 caractères par seconde
  • Événements sonores entre crochets : [le téléphone sonne]
  • ID de locuteur en majuscules avant les deux-points : ANNA : Il faut partir maintenant.
  • Placement en bas au centre de l'image, sauf si cela masque du contenu essentiel
  • Minimum 1 seconde à l'écran ; pas d'apparition/disparition éclair
  • Coupez les lignes aux limites de propositions, jamais en pleine phrase

Pour les sous-titres incrustés sur vidéo sociale, l'épaisseur de police compte davantage que dans les systèmes de sous-titres codés. Utilisez une police sans-serif grasse et épurée avec un contour ou une ombre portée très contrastée. Le sous-titre doit rester lisible aussi bien sur fond clair que sur fond sombre.

L'argument économique, en bref

L'accessibilité ne devrait pas avoir besoin d'une justification financière, mais les chiffres sont là. Les publicités vidéo sous-titrées affichent un taux de saut de 18 % contre 41 % pour les versions sans sous-titres. Les vidéos YouTube avec sous-titres enregistrent environ 7 % d'engagement en plus. Les contenus TikTok avec sous-titres montrent une hausse mesurable de la mémorisation de la marque. Les 85 % de vidéos Facebook regardées sans le son, c'est la statistique la plus ancienne du secteur, mais elle n'a pas cessé d'être vraie.

Les fichiers de sous-titres sont aussi l'outil de réutilisation de contenu le moins coûteux dont vous disposez. Un fichier SRT propre devient une transcription, un brouillon d'article de blog et des notes d'émission sans aucun travail supplémentaire. Consultez meilleure transcription pour podcasts 2026 pour voir comment cela s'applique au contenu audio.

FAQ

Quelle est la différence entre les sous-titres codés et les sous-titres pour l'accessibilité ?

Les sous-titres codés incluent le dialogue, l'identification des locuteurs et les descriptions des sons non vocaux comme les effets sonores et les indications musicales. Les sous-titres se contentent de traduire le dialogue parlé pour les spectateurs qui entendent l'audio mais ont besoin d'une autre langue. Pour l'accessibilité, ce sont les sous-titres codés qui sont requis ; les sous-titres seuls ne satisfont pas la norme.

Les sous-titres générés automatiquement sur YouTube ou TikTok répondent-ils aux exigences d'accessibilité ?

Non, pas tels qu'ils sont livrés. Les sous-titres automatiques des plateformes affichent une précision de 78 % à 96 % selon la qualité audio et la clarté du locuteur. Les normes d'accessibilité, notamment WCAG 1.2.2 et la Section 508, exigent des sous-titres exacts. Les pratiques du secteur et les recommandations du DOJ considèrent les sous-titres automatiques non corrigés comme insuffisants pour le contenu préenregistré. Vous devez générer, relire et corriger les sous-titres avant de les importer.

Que doivent inclure les sous-titres accessibles au-delà des mots prononcés ?

Conformément aux normes WCAG 1.2.2 et DCMP, les sous-titres accessibles doivent inclure tout son non vocal porteur de sens : les effets sonores qui transmettent une information (indiqués entre crochets), les descriptions musicales quand c'est pertinent, l'identification des locuteurs quand plusieurs personnes parlent, et les vocalisations non verbales comme les rires ou les soupirs quand elles ont un sens. Le silence et le bruit ambiant ne doivent être signalés que si leur absence risquerait de troubler le spectateur.

Quelles organisations sont légalement tenues de sous-titrer leurs vidéos ?

Aux États-Unis, la Section 508 couvre les agences fédérales et leurs prestataires. L'ADA Titre II couvre les entités gouvernementales étatiques et locales (échéance repoussée à 2027-2028). L'ADA Titre III s'applique de plus en plus aux entreprises exploitant des établissements ouverts au public, y compris leurs sites web. Le European Accessibility Act concerne les entreprises qui vendent à des clients de l'UE, avec une échéance en juin 2025 pour les nouveaux contenus. Les établissements d'enseignement recevant des fonds fédéraux font face à des exigences supplémentaires au titre de la Section 504. En cas de doute, sous-titrer toutes les vidéos destinées au public reste l'approche la plus sûre.

Comment sous-titrer un direct ou un événement en temps réel ?

Le sous-titrage en direct nécessite une transcription vocale en temps réel. Les options incluent les prestataires CART professionnels (Communication Access Realtime Translation) pour les événements à forts enjeux, les sous-titres en direct natifs de YouTube Live et Microsoft Teams, et les outils de transcription en temps réel propulsés par l'IA. Les attentes de précision pour les sous-titres en direct sont inférieures à celles du contenu préenregistré au titre de WCAG 1.2.4, mais les sous-titres doivent rester synchronisés et substantiellement exacts. Pour les réunions et les sessions enregistrées, transcrire après coup avec la transcription de réunions et ajouter des sous-titres à l'enregistrement est souvent plus pratique.

Sources

Try transcription free

Convert any audio or video to clean, unwatermarked text — speaker labels, timestamps, and AI summaries included. First 10 minutes free, no account.

Related Articles