
Transcription néerlandais vs flamand : le fossé entre les variantes
Summarize this article with:
Le néerlandais standard des Pays-Bas se transcrit proprement avec Whisper Large-v3, environ 5% de taux d'erreur sur de l'audio formel. Le flamand de Belgique vous coûte 3 à 8 points de pourcentage d'erreur en plus, et le tussentaal informel (ce registre intermédiaire du quotidien qui mélange standard et dialecte) coûte encore plus. L'écart est structurel : la plupart des données d'entraînement des systèmes de reconnaissance vocale penchent vers la parole diffusée aux Pays-Bas, pas vers les conversations de table à Anvers. Otter.ai ne prend pas du tout en charge le néerlandais. Les outils qui le font incluent TurboScribe, Happy Scribe, Amberscript (natif néerlandais) et CATT.
Le problème fondamental de la transcription du néerlandais et du flamand ne vient pas de la langue en elle-même : le néerlandais est bien pris en charge par tous les grands moteurs de reconnaissance vocale. Le vrai souci, c'est que le néerlandais standard des Pays-Bas et le flamand belge de tous les jours divergent suffisamment sur les plans phonologique et lexical pour donner des taux de précision nettement différents, et que la plupart des outils sont entraînés en grande partie sur des données de diffusion néerlandaises.
Savoir quel registre et quelle région correspondent à votre audio avant de choisir un outil ou d'organiser votre flux de travail vous fera gagner plus de temps que toute autre décision.
L'écart entre variantes : ce que disent vraiment les chiffres
Whisper Large-v3 atteint environ 5 % de WER sur de l'audio néerlandais formel et propre, ce qui le place presque au niveau de ses performances en anglais. Sur le néerlandais standard belge formel (celui des salles de rédaction de la VRT), l'écart reste modeste : les chercheurs qui travaillent avec le Corpus Gesproken Nederlands rapportent environ 1 à 3 points de pourcentage de WER en plus par rapport à la parole standard néerlandaise.
L'écart se creuse rapidement dès qu'on passe aux registres informels :
- Le tussentaal (le registre intermédiaire courant en Belgique) : un WER de 10 à 15 % est une attente raisonnable sur de l'audio conversationnel typique.
- Les dialectes périphériques : le flamand occidental et le limbourgeois belge montrent systématiquement un biais documenté des systèmes de reconnaissance. Une étude ESSV de 2023 a confirmé les mauvaises performances pour les locuteurs de Flandre occidentale et du Limbourg. Les benchmarks du corpus CGN ont montré un WER atteignant 25 % sur le flamand dialectal et jusqu'à 66 % sur les variétés locales les plus marquées.
- Le frison (parlé dans la province néerlandaise de Frise) : c'est une langue germanique occidentale distincte, pas du néerlandais. Aucun outil de transcription en production ne le traite comme une langue de premier rang ; attendez-vous à un WER de 60 à 70 % ou pire si vous transcrivez du frison via un pipeline néerlandais.
Le code de langue unique "nl" accepté par Whisper ne fait pas la distinction entre nl-NL et nl-BE. OpenAI a entraîné le modèle sur une majorité de données néerlandaises, donc les a priori du modèle tirent vers la prononciation des Pays-Bas, même quand vous travaillez avec de l'audio belge.
Pourquoi le flamand sonne différemment pour un modèle de reconnaissance vocale
Trois caractéristiques phonologiques expliquent l'essentiel de l'écart de précision.
Le G dur et le G doux. Le néerlandais des Pays-Bas septentrionaux utilise le G dur, une fricative uvulaire ou vélaire, rugueuse. La Belgique emploie le G doux, un son plus doux et plus avancé. Ces deux réalisations sont phonétiquement assez distinctes pour qu'un modèle calibré sur le G dur du nord mal classe ou sous-pondère le même phonème dans la parole belge. Comme la lettre G apparaît dans presque chaque phrase en néerlandais, ce seul trait s'accumule sur l'ensemble d'une transcription.
L'intonation mélodique. Le flamand présente un schéma intonatif nettement plus musical, avec des montées marquées. Le néerlandais des Pays-Bas tend vers des contours plus plats et descendants. Les modèles de reconnaissance vocale infèrent en partie les frontières de mots et la structure des propositions à partir de la prosodie, si bien que les variations de hauteur du flamand introduisent une incertitude systématique à ces frontières.
Longueur et arrondissement des voyelles. Les voyelles flamandes sont souvent plus arrondies et allongées que leurs équivalents néerlandais. Le /a:/ long du néerlandais belge se situe dans un espace acoustique légèrement différent de celui produit par un locuteur d'Amsterdam. Les modèles néerlandais finement ajustés sur des données belges surpassent les modèles généralistes précisément pour cette raison.
Tussentaal : le registre sur lequel personne n'a entraîné
La tussentaal est le néerlandais belge familier : ni un dialecte, ni le néerlandais standard, mais un registre intermédiaire fluide que la plupart des locuteurs flamands utilisent dans tout contexte informel. Elle se caractérise par des traits précis :
- Le pronom de deuxième personne : "gij/ge" au lieu du standard "jij/je", avec les formes verbales associées ("gij zijt" et non "jij bent").
- Des emprunts au français intégrés : "merci", "allez", "kot" (chambre d'étudiant), "schoon" (beau, en usage informel), "GSM" plutôt que "mobiel".
- Des belgicismes lexicaux : "goesting hebben" (avoir envie de faire quelque chose), "amai" comme exclamation, "frigo" pour réfrigérateur.
- Une prononciation mêlant dialecte régional et norme des médias.
Un modèle ASR qui n’a jamais vu « gij zijt » à l’entraînement produira « jij bent » ou déformera complètement l’expression. Pour l’audio de podcasts et d’interviews venant de Flandre, partez du principe que vous travaillez en tussentaal et prévoyez du temps de relecture en conséquence.
Alternance codique : anglais et français
L’audio néerlandais d’affaires et technique alterne fortement avec l’anglais, surtout dans les environnements professionnels d’Amsterdam, Utrecht et Anvers. Whisper Large-v3 gère bien l’alternance en début de phrase. En revanche, l’alternance en milieu de phrase produit parfois des approximations phonétiques de mots anglais qui nécessitent une correction en une passe.
Le néerlandais belge alterne aussi avec le français, notamment à Bruxelles et chez les locuteurs flamands plus âgés. Des mots comme « allez », « merci », « voilà » et « bonjour » apparaissent dans des phrases par ailleurs néerlandaises. Ces fragments français sont généralement transcrits correctement, car ils figurent dans les données d’entraînement de Whisper, mais surveillez les noms propres français dont la prononciation est néerlandisée.
Écriture néerlandaise et diacritiques
Le néerlandais utilise l’alphabet latin. Les principaux problèmes spécifiques à la transcription :
- Le digramme ij fonctionne comme une seule voyelle en néerlandais et est parfois rendu par un caractère unique sur les claviers néerlandais. Une transcription correcte écrit « ij » de façon cohérente (pas « IJ » ni « y »).
- Le tréma marque la séparation des voyelles : « België » s’écrit correctement avec un tréma (pas « Belgie »), « geïnteresseerd » avec un tréma sur le deuxième e. Si votre outil supprime le tréma, vous perdez une précision orthographique qui compte dans les documents formels.
- Les accents aigus apparaissent dans les emprunts et les mises en valeur : « café », « résumé ».
- Les mots composés néerlandais s’écrivent en un seul bloc : « autoverzekering » (assurance auto), pas « auto verzekering ». Les modèles ASR entraînés sur des textes qui séparent les composés néerlandais de manière incohérente produisent une sortie fragmentée.

Comparer les outils qui prennent réellement en charge le néerlandais
Une correction d'abord : Otter.ai ne prend pas en charge le néerlandais. Depuis mi-2026, la liste des langues d'Otter couvre l'anglais, le français, l'espagnol, l'allemand, le japonais et le chinois. Son nom ne devrait apparaître dans aucune comparaison de transcription en néerlandais.
| Outil | Prise en charge du néerlandais | Flamand nl-BE | Offre gratuite | Prix de départ |
|---|---|---|---|---|
| TurboScribe | Oui (basé sur Whisper) | Via le nl général | 3 fichiers/jour (30 min max chacun) | 10 $/mois (annuel) |
| Happy Scribe | Oui | Non listé séparément | Essai de 10 minutes uniquement | 17 €/mois (120 min IA) |
| Amberscript | Oui, natif néerlandais | Prise en charge explicite nl-BE | Aucune | ~0,25 €/min à la carte |
| Trint | Oui | Pas de variante BE distincte | Essai 7 jours, max 3 fichiers | ~52 $/siège/mois (annuel) |
| CATT | Oui (Whisper + AssemblyAI) | Via le nl général | 10 min gratuites, une fois | 9,99 $/mois illimité |
Les tarifs de Happy Scribe sont en euros (17 €/mois pour Basic, 29 €/mois pour Pro, 0,20 €/min en dépassement). Trint est facturé par siège, environ 52 $/siège/mois en facturation annuelle, et il est conçu pour les salles de rédaction plutôt que pour les utilisateurs individuels. Amberscript est le seul outil ici avec une équipe dédiée au néerlandais et une reconnaissance explicite du nl-BE, ce qui compte pour un travail flamand haut de gamme.
Mon avis : pour les podcasts et enregistrements d'interviews en néerlandais où vous voulez un résumé IA en néerlandais plutôt qu'en anglais, l'outil audio-texte de CATT gère les deux variantes sans plafond par minute. Pour le contenu d'entreprise flamand où la précision sur le discours formel belge est prioritaire et le coût secondaire, le pipeline natif néerlandais d'Amberscript justifie son prix premium. Pour l'audio avec dialecte prononcé (conversations villageoises en flamand occidental, parlers influencés par le limbourgeois), prévoyez un temps de relecture humaine conséquent, quel que soit l'outil.
Diarisation des locuteurs dans l'audio néerlandais
La conversation d'affaires en néerlandais est généralement structurée et les tours de parole sont clairs, ce qui aide la diarisation. Attentes réalistes :
- Entretien formel à deux intervenants : 92 à 96 % de précision de diarisation.
- Podcast à trois ou quatre intervenants : 80 à 88 %.
- Discussion de groupe (5 intervenants ou plus, avec chevauchements) : 70 à 82 %.
La tendance flamande à se couper la parole dans les contextes de groupe informels (plus courante dans les normes conversationnelles belges que néerlandaises) dégrade la diarisation plus que tout problème de précision de l'ASR.
Gestion des mots composés en ASR
La composition productive du néerlandais est un défi constant. « Arbeidsongeschiktheidsverzekering » (assurance invalidité), « zorgverzekeringstelsel » (système d'assurance soins de santé) ou des expressions courantes comme « overheidsorganisatie » (organisation gouvernementale) apparaissent dans les données d'entraînement à une fréquence plus faible que leurs mots composants. Les modèles sans un vocabulaire néerlandais solide coupent ces mots aux frontières ou produisent des erreurs au milieu.
Pour du contenu néerlandais spécialisé (juridique, médical, financier), fournissez un vocabulaire personnalisé ou un glossaire si votre outil le permet. Cette seule étape réduit plus d'erreurs sur les mots composés que tout autre changement de configuration.
Configuration pratique pour le contenu flamand
- Réglez la langue sur le néerlandais (« nl »). La plupart des outils ne proposent pas de sélection distincte pour le nl-BE ; Amberscript fait figure de principale exception.
- Pour le néerlandais standard formel de Belgique (actualités, communications d'entreprise, réunions officielles), attendez-vous à une précision proche de la référence NL. La passe de relecture devrait prendre moins de 10 minutes par heure.
- Pour les interviews et podcasts flamands décontractés en tussentaal, prévoyez une passe de relecture de 15 à 25 minutes par heure enregistrée.
- Pour les contenus en dialecte flamand occidental ou limbourgeois, un relecteur humain avec une connaissance native du dialecte est indispensable. Aucun outil de production actuel ne gère proprement ces variantes.
- Enregistrez avec une capture par microphone quand c'est possible. La précision de la diarisation sur les appels multiparticipants s'améliore nettement par rapport à un audio capté en salle commune.
- Le néerlandais comporte de nombreuses consonnes fricatives qui perdent en netteté dans les espaces réverbérants. Un environnement d'enregistrement à faible réverbération ou un micro directionnel améliore davantage les performances de la reconnaissance vocale pour le néerlandais que pour des langues riches en voyelles comme l'espagnol ou l'italien.
Travailler avec le néerlandais du Suriname et des Caraïbes
Le néerlandais du Suriname et les variétés néerlandaises d'Aruba, de Curaçao, de Bonaire et de Sint Maarten sont du néerlandais de statut officiel, avec un vocabulaire régional et des influences de contact du sranan tongo et du papiamento. Le pipeline standard en néerlandais produit une précision de 88 à 92 % sur le néerlandais formel du Suriname. Certains éléments de vocabulaire locaux (notamment les noms de lieux et les termes spécifiques à la culture) peuvent ne pas figurer dans le dictionnaire du modèle de base et nécessiteront une correction manuelle. Le sranan tongo et le papiamento sont des langues distinctes que le pipeline néerlandais ne prend pas en charge.
FAQ
Est-ce que Whisper gère aussi bien le néerlandais flamand de Belgique que le néerlandais des Pays-Bas ?
Non. Sur de la parole formelle et soignée, l’écart reste modeste (environ 1 à 3 points de WER). Sur le flamand informel, le tussentaal et les dialectes profonds comme le west-flamand ou le limbourgeois, l’écart se creuse nettement. Les recherches sur le corpus CGN montrent un WER qui passe d’environ 7 % sur la parole standard à 25 % ou plus sur le flamand dialectal, et jusqu’à 66 % sur les variétés locales les plus marquées. Le code de langue unique « nl » de Whisper ne distingue pas nl-NL de nl-BE, il applique donc un seul modèle entraîné principalement sur des données néerlandaises.
Qu’est-ce que le tussentaal et pourquoi est-ce important pour la transcription ?
Le tussentaal (littéralement « langue intermédiaire ») est le registre oral informel utilisé dans la vie quotidienne en Flandre. Il se situe entre le néerlandais standard formel enseigné à l’école et les dialectes locaux profonds, et c’est ce que l’on entend réellement dans la plupart des conversations belges. Les systèmes de reconnaissance vocale entraînés sur le néerlandais de diffusion traitent le tussentaal comme du bruit, car sa prononciation, ses formes verbales et son vocabulaire s’écartent de la norme écrite. Pour la transcription, attendez-vous à devoir relire plus attentivement tout entretien ou podcast belge informel par rapport à une parole de type journal télévisé.
Est-ce qu’Otter.ai prend en charge le néerlandais ?
Non. À la mi-2026, Otter.ai prend en charge l’anglais, le français, l’espagnol, l’allemand, le japonais et le chinois. Le néerlandais n’en fait pas partie. Si vous avez besoin d’une transcription en néerlandais ou en flamand, Otter.ai n’est pas une option.
Quel outil de transcription fonctionne le mieux spécifiquement pour le contenu flamand ?
Amberscript a son siège à Amsterdam, emploie des relecteurs humains néerlandophones et indique explicitement la prise en charge de nl-NL et nl-BE. C’est le choix le plus solide lorsque la précision sur du contenu flamand d’entreprise ou médiatique est cruciale et que le budget le permet (à partir d’environ 0,25 EUR par minute en paiement à l’usage). TurboScribe et CATT sont de bonnes options basées sur Whisper pour du travail flamand à moindre coût, CATT offrant des résumés IA en néerlandais et sans limite de minutes sur les forfaits payants.
Sources
- Tarifs d'Otter.ai - vérifié en juillet 2026
- Centre d'aide sur les langues prises en charge par Otter.ai
- Tarifs de Happy Scribe - vérifié en juillet 2026
- Tarifs d'Amberscript - vérifié en juillet 2026
- Tarifs de TurboScribe - vérifié en juillet 2026
- Deepgram : les 6 principaux défis de la reconnaissance vocale néerlandaise
- ESSV 2023 : biais dans la reconnaissance vocale automatique en flamand
- Améliorer l'inclusivité de la reconnaissance vocale néerlandaise en affinant Whisper sur JASMIN-CGN
- Wikipédia : le G dur et le G doux en néerlandais
- Frontiers : lever l'obstacle de la transcription dans la construction de corpus dialectaux
Try transcription free
Convert any audio or video to clean, unwatermarked text — speaker labels, timestamps, and AI summaries included. First 10 minutes free, no account.
Related Articles

Best Transcription Tool Alternatives, Honestly Compared (2026)
Leaving Otter, Descript, Transkriptor, Rev, or TurboScribe? Honest, sourced comparisons of every major transcription tool: real limits, verified pricing, and where each one genuinely wins.

Looking for a Transkriptor Alternative? Here's the Honest Math (2026)
Transkriptor meters your minutes and lets unused ones expire monthly. Here is its real 2026 pricing decoded, when staying is rational, and the unlimited alternatives at the same sticker price.