Transcription en portugais brésilien : BR contre UE, les vraies différences
transcriptionportugaislangues

Transcription en portugais brésilien : BR contre UE, les vraies différences

BMMamane B. MoussaMay 26, 2026Updated July 2, 202615 min read

Summarize this article with:

TL;DR

Le portugais brésilien domine les données d'entraînement des systèmes de reconnaissance vocale, donc le pt-BR obtient une excellente précision avec Deepgram Nova-3, Whisper et AssemblyAI, tandis que le portugais européen reste à la traîne sur ces mêmes modèles. Les deux variantes divergent assez en phonologie, vocabulaire et même orthographe depuis 2009, donc un mauvais code dialectal ou un moteur sans sélection de variante nuira à votre transcription. La scène podcast brésilienne est la deuxième plus grande au monde, et la plupart des créateurs y glissent des termes anglais en plein milieu de phrase, ce qui ajoute une dimension de changement de code que la plupart des outils ignorent. Les outils à tarif fixe battent les services à la minute pour quiconque transcrit plus de quelques heures par mois.

La chose la plus importante à savoir sur la transcription du portugais : le portugais brésilien et le portugais européen sont suffisamment différents au niveau des phonèmes pour qu'un mauvais réglage du moteur nuise sérieusement à votre résultat. Les deux partagent la grammaire et le vocabulaire de base, mais divergent dans la prononciation, les conventions orthographiques et le lexique, au point de faire échouer les modèles entraînés sur une variante lorsqu'ils rencontrent l'autre.

Le portugais brésilien est la variante la mieux prise en charge par la plupart des moteurs
Le portugais brésilien est la variante la mieux prise en charge par la plupart des moteurs

Le Brésil est le deuxième marché mondial de podcasts après les États-Unis. Plus de la moitié des Brésiliens écoutent des podcasts, avec une moyenne de 11 heures par semaine. Quatre-vingt-deux pour cent préfèrent les podcasts en portugais, et 81 % découvrent de nouvelles émissions via YouTube. Cette ampleur crée une demande énorme pour une transcription précise en portugais brésilien, à des prix qui suivent le volume de sortie.

Pourquoi pt-BR et pt-PT cassent différemment en ASR

L'écart phonologique entre les deux variantes est assez grand pour tromper les modèles ASR entraînés sur les mauvaises données.

Le portugais brésilien maintient les voyelles non accentuées pleinement voisées. Le portugais européen les réduit ou les supprime. Le mot « esperança » au Brésil sonne comme « es-pe-RAN-sa », avec toutes les syllabes présentes. À Lisbonne, il se réduit à quelque chose comme « shpRANsa ». Un modèle entraîné sur des données brésiliennes tentera de transcrire cette énonciation européenne réduite comme un mot complètement différent.

La différence consonantique clé pour la transcription est la palatalisation brésilienne du « t » et du « d » devant « i » ou « e » final. Dans la prononciation brésilienne standard, « bom dia » est phonétiquement [bõ dʒia], avec le /d/ devenant une affriquée. En portugais européen, le même mot est [bõ dia], une occlusive dentale propre. Les modèles doivent apprendre à associer un phonème à la lettre « d » sous deux formes acoustiques très différentes.

À la fin des syllabes, le portugais européen transforme le « s » en un son chuintant proche du « sh » anglais. Le portugais brésilien, lui, garde une sifflante nette. Le mot « estas » au Portugal sonne comme « eshtash ». Le même mot à Rio ou à São Paulo sonne comme « estas ». Un moteur entraîné sur l’une des variantes lira mal l’autre.

La divergence du vocabulaire aggrave le problème. Des mots courants comme « bus » (ônibus au BR, autocarro au PT) et « téléphone portable » (celular au BR, telemóvel au PT) ne sont pas de simples variantes orthographiques d’une même racine ; ils n’ont aucune ressemblance. Si un modèle choisit la mauvaise variante, il peut produire un mot correctement orthographié, mais issu du mauvais pays.

Le biais des données d’entraînement qui oriente chaque moteur vers le BR

Les recherches sur les modèles ASR multilingues constatent systématiquement un fort biais en faveur du portugais brésilien, en raison de données de pré-entraînement plus abondantes. Lorsqu’on teste des modèles zero-shot sur les deux variantes, ils performent systématiquement mieux sur le pt-BR. Quand les chercheurs affinent un modèle avec de l’audio en portugais européen, la performance sur le BP se dégrade souvent, au lieu d’améliorer les deux ensemble.

Cela signifie que les utilisateurs de portugais européen subissent la pénalité de précision pour un déséquilibre dont ils ne sont pas responsables. L’implication pratique : si vous transcrivez du portugais européen, il vous faut un moteur explicitement entraîné sur le pt-PT, pas un qui prétend simplement offrir un « support du portugais ».

Le modèle Nova-3 de Deepgram accepte trois codes de langue distincts : pt, pt-BR et pt-PT. Depuis mai 2026, Deepgram documente une précision améliorée sur les deux variantes du portugais pour Nova-3. Ce routage explicite par variante compte, car le modèle ne se contente pas d’appliquer une étiquette après coup ; le code de langue détermine les schémas acoustiques qu’il écoute.

Whisper Large-v3 prend également en charge le portugais avec un indice de langue, mais son biais de données d'entraînement penche vers le pt-BR. Définir language=pt sur un enregistrement de Lisbonne fera tourner le modèle, mais la précision sur les voyelles réduites et les sibilantes chuintantes en souffrira davantage que sur un audio brésilien équivalent. Consultez l'architecture Whisper et les compromis linguistiques pour une analyse plus approfondie.

Le modèle Universal-3 Pro d'AssemblyAI prend en charge le portugais, mais ne propose pas de distinction pt-BR ou pt-PT dans le paramètre de langue. Vous indiquez « portugais » et le modèle le traite. Cela fonctionne pour le contenu brésilien, où l'avantage des données d'entraînement joue en votre faveur, mais c'est un outil plus grossier pour le portugais européen.

L'accord orthographique de 2009 et pourquoi il continue de piéger les moteurs

L'Acordo Ortográfico est entré en vigueur en 2009 avec pour objectif d'unifier l'orthographe du portugais à travers les pays lusophones. Il n'a pas pleinement réussi : des différences persistent, et les moteurs d'IA entraînés sur des textes antérieurs à 2009 ou de millésimes mélangés peuvent produire des orthographes techniquement correctes pour un contexte, mais erronées pour un autre.

Les principaux changements post-2009 incluent la suppression des consonnes muettes en portugais européen : « acção » est devenu « ação », « óptimo » est devenu « ótimo ». Les deux correspondent désormais à l'orthographe brésilienne. Mais les différences d'accent tonique subsistent. Le portugais brésilien utilise « gênero » et « tônico » là où le portugais européen écrit les mêmes mots « género » et « tónico ». Un modèle qui génère un mauvais placement d'accent sur un mot comme celui-ci ne produit pas du bruit ; il produit l'orthographe de l'autre variante.

Pour la transcription, cela compte surtout en post-traitement. Si vous envoyez la sortie vers un correcteur orthographique ou un formateur de documents calibré sur une norme orthographique unique, une sortie à variantes mélangées générera des faux positifs partout.

Ce que les signes diacritiques doivent préserver

Un transcript portugais correct doit conserver : le tilde (ã, õ), la cédille (ç), l'accent aigu (á, é, í, ó, ú), l'accent circonflexe (â, ê, ô) et l'accent grave (à). Les caractères les plus sujets aux erreurs sont le tilde et la cédille. Un moteur qui renvoie « nao » au lieu de « não », « voce » au lieu de « você » ou « acao » au lieu de « ação » se trompe au niveau du caractère, pas seulement par une imprécision de style. Un texte portugais sans diacritiques casse les systèmes en aval qui l'analysent pour en extraire le sens, et génère des reprises qui annulent tout gain de temps lié à l'automatisation.

Whisper Large-v3 préserve les diacritiques de façon fiable sur un audio propre. Deepgram Nova-3 les gère aussi correctement. Les modèles plus légers et moins chers ont tendance à supprimer les accents, surtout sur les voyelles nasales.

Alternance codique dans l'audio tech et business brésilien

Les locuteurs du portugais brésilien, surtout dans les contextes technologiques, médiatiques et professionnels, insèrent régulièrement des mots anglais en pleine phrase sans changer de script. Ce n'est pas un usage négligé de la langue ; cela reflète la façon dont le portugais a absorbé le vocabulaire anglais dans des domaines précis.

Schémas courants : « vou fazer um deploy antes da reunião », « precisamos dar um upgrade no servidor », « o pull request foi aprovado ontem. » La structure de la phrase portugaise reste intacte ; les noms et verbes anglais sont insérés sous leur forme originale, souvent conjugués selon la morphologie portugaise (« deployar », « stackear »).

Les emprunts bien établis comme « internet », « site », « startup », « webinar » sont totalement assimilés et se transcrivent correctement avec n'importe quel bon moteur. La difficulté vient des phrases anglaises moins courantes ou spécifiques au contexte, insérées dans une phrase par ailleurs portugaise. Les moteurs peuvent produire une approximation phonétique, omettre le mot ou sortir un mot portugais aux sonorités proches.

L'approche la plus fiable consiste à utiliser un vocabulaire personnalisé ou une liste de termes clés pour les noms propres récurrents, les marques et les termes techniques. Consultez le guide sur la correction de l'alternance codique multilingue pour un flux de travail structuré.

Comparaison moteur par moteur pour le portugais

MoteurSupport pt-BRSupport pt-PTSéparation des variantesBiais des données d'entraînementOffre gratuite
Deepgram Nova-3Oui (pt-BR)Oui (pt-PT)Codes de langue explicitesPlus faible pour le PT, corrigé dans la mise à jour de nov. 2026Paiement à la minute, pas d'offre gratuite
Whisper Large-v3Oui (solide)Oui (plus faible)Indication pt uniqueFort biais BR dans les données d'entraînementOpen-source, auto-hébergé
AssemblyAI Universal-3OuiOui (via un seul pt)Aucune, un seul modèle portugaisBiais BR, aucune séparation des variantesTarification à la minute
Happy ScribeOuiOui (niveau relecture humaine)Disponible pour la transcription humaineIncertain pour le niveau IAEssai IA de 10 min
Otter.aiNonNonSans objetAucun support du portugaisN/A
TurboScribeOui (via Whisper)PartielPas de séparation expliciteHérite du biais BR de Whisper3 fichiers/jour gratuits

À noter : les chiffres de précision de chaque moteur varient selon la qualité audio, l'accent des locuteurs et le vocabulaire du domaine. Le tableau reflète le statut vérifié du support linguistique, pas les affirmations de précision des fournisseurs.

Aperçu des tarifs (juillet 2026)

Les outils facturés à la minute deviennent vite coûteux pour les créateurs brésiliens qui transcrivent de longs épisodes de podcast. Le marché des créateurs et des entreprises au Brésil, où 81 % des auditeurs hebdomadaires de podcasts utilisent YouTube comme plateforme de découverte principale et où le format vidéo est la norme, génère une demande de transcription à très haut volume.

Le niveau IA de Happy Scribe va d'environ 17 $/mois pour 120 minutes à 89 $/mois pour 6 000 minutes de crédits IA. Trint démarre à environ 80 $/siège par mois avec un plafond de 7 fichiers mensuels, ce qui le limite à un usage professionnel ponctuel plutôt qu'à une production continue. TurboScribe Unlimited coûte 10 $/mois en facturation annuelle, ou 20 $/mois autrement, sans plafond de fichiers ni de minutes.

Si vous avez simplement besoin de transcriptions propres en portugais, sans bot de réunion ni flux de travail éditorial, ConvertAudioToText propose une transcription illimitée avec le plan Pro à 9,99 $/mois, avec un essai gratuit de 10 minutes pour tester la qualité du rendu sur votre propre audio. Pour la production de podcasts brésiliens à fort volume, le tarif forfaitaire s'avère systématiquement plus avantageux que la facturation à la minute dès que vous dépassez quelques heures par mois. Consultez la comparaison des tarifs de transcription pour un panorama plus large.

Flux de travail pour les producteurs de podcasts brésiliens

Le marché du podcast au Brésil repose sur une production pensée d'abord pour la vidéo. La plupart des podcasteurs brésiliens enregistrent en MP4 ou diffusent en direct, puis distribuent l'audio séparément. La transcription sert à plusieurs usages en aval : notes d'émission, repères de chapitres YouTube, extraits pour les réseaux sociaux et référencement.

Un flux de travail efficace :

  1. Enregistrez l'épisode dans le format de votre choix (MP4 pour un podcast vidéo, MP3 pour l'audio seul).
  2. Réglez explicitement la langue sur pt-BR. La détection automatique fonctionne la plupart du temps, mais échoue sur les extraits courts, les locuteurs avec accent et l'audio avec bruit de fond.
  3. Activez les étiquettes de locuteur. Les podcasts à deux intervenants obtiennent une attribution fiable et propre ; trois intervenants ou plus dans un format de table ronde informelle bénéficient d'une relecture de post-traitement.
  4. Créez un vocabulaire personnalisé pour les termes récurrents : le nom de votre émission, les noms des invités, les sponsors et tout terme technique anglais que vous utilisez régulièrement en contexte portugais.
  5. Exportez le fichier SRT pour les sous-titres YouTube et le texte brut pour les notes d'émission.

La différence clé par rapport à la production de podcasts en anglais réside à l'étape 4. Les podcasts brésiliens tech et business présentent un taux plus élevé d'alternance codique et une densité de noms propres plus forte que les émissions anglophones comparables, et le vocabulaire personnalisé porte ses fruits plus rapidement.

Pour des interviews en portugais européen avec des invités venant de différentes régions lusophones (Angola, Mozambique, Cap-Vert), le tableau dialectal se complique. Les variétés africaines du portugais se rapprochent souvent du portugais européen sur le plan phonologique, mais avec un vocabulaire distinct. Voir pourquoi l'IA galère avec les langues peu dotées pour comprendre ce qu'on peut attendre de ces enregistrements.

Conseils pour une meilleure précision sur les deux variantes

  1. Définissez explicitement le code de langue. pt-BR et pt-PT mènent à des configurations de modèle différentes dans les moteurs qui prennent en charge cette distinction. Laisser en détection automatique ajoute une étape d'inférence et peut parfois mal étiqueter de courts extraits.
  2. Enregistrez chaque intervenant avec un micro rapproché ou séparé. Le style conversationnel brésilien comporte plus d'interruptions et de chevauchements que les formats d'interview en portugais européen. La parole superposée est la première cause d'erreurs d'attribution dans la diarisation.
  3. Pour les noms propres liés à la géographie ou à la culture brésilienne, utilisez un glossaire. Les noms de villes finissant en "-aço" ou des noms d'États comme "Ceará" présentent des schémas de fautes d'orthographe courants. Cela vaut aussi pour les noms de lieux et les patronymes portugais.
  4. Un enregistrement à faible réverbération améliore la précision sur les deux variantes, mais c'est surtout crucial pour le portugais européen, où la réduction des voyelles atones rend les frontières phonémiques plus difficiles à distinguer dans les pièces qui résonnent.
  5. Vérifiez la préservation des diacritiques avant d'adopter un outil. Faites un test court sur un audio contenant "ação", "não" et "você". Si la sortie supprime l'un de ces caractères, changez d'outil avant de vous lancer dans un fichier plus long.

FAQ

Pourquoi le portugais européen est-il moins bien transcrit que le portugais brésilien avec la plupart des moteurs d'IA ?

Les modèles ASR apprennent à partir de l’audio sur lequel ils sont entraînés, et le portugais brésilien dépasse largement le portugais européen dans les jeux de données publics. Les recherches confirment que les modèles zero-shot performent systématiquement mieux sur le pt-BR, et qu’un fine-tuning sur des données de portugais européen dégrade souvent les performances en pt-BR au lieu d’améliorer les deux de manière équilibrée. Les moteurs conçus explicitement pour le pt-PT, ou le modèle Deepgram Nova-3 avec le code de langue pt-PT, réduisent cet écart.

Est-ce que le code de langue que je définis (pt, pt-BR ou pt-PT) a une importance ?

Oui. Deepgram Nova-3 prend en charge les trois codes et achemine votre audio vers le modèle de variante approprié. Whisper Large-v3 accepte une indication de langue et performe mieux sur le pt-BR par défaut, en raison du déséquilibre des données d’entraînement. Le modèle Universal d’AssemblyAI propose une seule option « portugais », sans distinction régionale. Définir le mauvais code ou utiliser un modèle sans support des variantes risque d’entraîner des erreurs au niveau des phonèmes, des conventions de ponctuation incorrectes et des écarts d’orthographe introduits par l’Accord orthographique de 2009.

Est-ce qu’Otter.ai prend en charge la transcription en portugais ?

Non. Depuis mi-2026, Otter.ai prend en charge l’anglais, l’espagnol, le français, l’allemand, le japonais et le chinois simplifié. Le portugais n’en fait pas partie. Les créateurs brésiliens et les utilisateurs de portugais européen doivent donc se tourner vers un autre outil.

Comment gérer les mots anglais mélangés dans un enregistrement en portugais brésilien ?

Les locuteurs brésiliens intègrent régulièrement des termes techniques et commerciaux anglais en plein milieu d’une phrase, sans changer de script : « vou fazer um deploy », « temos que dar um upgrade ». La plupart des moteurs modernes gèrent correctement les emprunts bien établis, mais le mélange en cours de phrase de locutions anglaises moins courantes peut produire des fautes d’orthographe ou des mots omis. Une relecture rapide après transcription et la création d’un glossaire personnalisé pour les noms propres ou marques récurrents constituent la solution la plus pratique.

Quels signes diacritiques un transcript en portugais doit-il préserver, et lesquels les moteurs ont-ils tendance à omettre ?

Une transcription correcte en portugais doit conserver le tilde (ã, õ), la cédille (ç), l'accent aigu (á, é, í, ó, ú), l'accent circonflexe (â, ê, ô) et l'accent grave (à). Les caractères les plus souvent supprimés sont le tilde et la cédille, qui transforment « não » en « nao » et « ação » en « acao ». Si votre outil renvoie un texte sans ces signes, considérez-le comme un motif d'élimination direct : un portugais sans diacritiques est incorrect au niveau des caractères et provoque des erreurs en aval dans tout système qui analyse le texte.

Sources

Try transcription free

Convert any audio or video to clean, unwatermarked text — speaker labels, timestamps, and AI summaries included. First 10 minutes free, no account.

Related Articles