
Transcrição de Francês: Diferença de Precisão entre Quebequense e Francês da França
Summarize this article with:
A Resposta Curta
A diferença dialetal entre o francês quebequense e o francês da França é o maior abismo de precisão na transcrição de francês. Um motor bem configurado, em áudio limpo de noticiário parisiense, superará o mesmo motor na fala de rua de Montreal por uma margem considerável, e as razões são fonológicas, não apenas uma questão de vocabulário. Configure o código de idioma corretamente, escolha um motor que diferencie fr de fr-CA e planeje uma rodada de revisão para conteúdo carregado de joual.

Por Que o Francês Quebequense É um Problema Diferente do "Francês"
A Organização Internacional da Francofonia contabilizou 396 milhões de falantes de francês em 2026. A maioria dos pipelines de treinamento de IA dá peso muito maior ao francês da França, a variedade falada na França, porque ela domina a mídia broadcast, os datasets disponíveis e o conteúdo legendado na web aberta. O francês quebequense representa menos de 5% das gravações em francês do CommonVoice, o maior dataset de fala de origem pública. Esse desequilíbrio de treinamento é a causa raiz da diferença de precisão.
Mas a diferença não é apenas um problema de dados. A fonologia realmente diverge.
O Que a Africação Faz com o ASR
A característica mais desorientadora para um modelo treinado com francês da França é a africação. No francês quebequense, as oclusivas dentais /t/ e /d/ tornam-se africadas antes de vogais frontais altas e semivogais:
- /ty/ (tu) pronuncia-se [t͡sy]
- /ti/ (petit) pronuncia-se [pəˈt͡si]
- /dy/ (du) pronuncia-se [d͡zy]
- /di/ (dire) pronuncia-se [d͡ziʁ]
Um modelo treinado com entrada parisiense /ty/ espera essa sequência de fones. Quando recebe [t͡sy] em vez dela, pode alucinar outra palavra, descartar o morfema ou desalinhar silenciosamente o restante da fala. Não é uma questão de tolerância a sotaques, é uma questão de inventário de fonemas diferente.
Vogais: Distinções Preservadas e Ditongação
O francês da França fundiu vários pares de vogais que o francês quebequense mantém separados. A distinção entre /a/ e /ɑ/, mantida no Quebec, desapareceu da fala parisiense. As vogais fechadas (/i/, /y/, /u/) sofrem relaxamento em sílabas fechadas, tornando-se [ɪ], [ʏ], [ʊ]. Vogais longas em sílabas fechadas se ditongam: /ɛː/ pode surgir como [ɛɪ̯], /ɑː/ como [ɑʊ̯]. Nenhum desses ditongos existe no francês padrão da França, então um modelo sem exposição a eles segmenta mal ou rotula incorretamente o núcleo vocálico.
Joual: O Basileto que Quebra a Maioria das Ferramentas
Joual é a variedade montrealense da classe trabalhadora, no extremo mais coloquial do contínuo do francês quebequense. A própria palavra vem de uma pronúncia rural/da classe trabalhadora de cheval. Além da africação e da ditongação, o joual tem:
- Negação bipartite omitida: "je sais pas" substitui "je ne sais pas" numa taxa tão consistente que a forma padrão soa formal
- O tu interrogativo: "Il veut-tu manger?" (Ele quer comer?) em que tu é uma partícula interrogativa, não o pronome de segunda pessoa
- Sacrés como marcadores discursivos: termos religiosos usados como palavrões (tabernak, câlice, crisse, osti) que aparecem na fala espontânea cotidiana e raramente estão nos dados de treinamento
- Reduções como m'as no lugar de je vais, mé no lugar de mais, pis no lugar de puis
Um modelo que nunca encontrou essas formas não vai apenas transcrevê-las errado: ele frequentemente produzirá uma saída que soa fluente, mas está errada, e que fica ainda mais difícil de detectar na revisão.
A Camada dos Anglicismos: Diferente no Quebec do Que na França
Tanto o francês da França quanto o quebequense absorvem empréstimos do inglês, mas os mecanismos diferem de formas que afetam a precisão da transcrição.
No Quebec, a fonologia inglesa é adaptada ao francês. Uma palavra como fun é pronunciada com uma vogal francesa [œ̃]. Gang rima com o rang francês. Chum (namorado/amigo) soa como a palavra francesa em que se transformou. A palavra emprestada é domesticada fonologicamente, então o motor precisa reconhecê-la como saída francesa, não marcá-la como alternância de código.
No francês da França, os anglicismos costumam ficar mais próximos da pronúncia inglesa. Le week-end preserva algo mais próximo das vogais inglesas. A mesma palavra pode soar de forma diferente em Paris e Montreal, e um motor que espera uma pode segmentar errado a outra.
Algumas palavras que parecem anglicismos no Quebec, na verdade, nem vêm do inglês. Char (carro) deriva de charette, não do inglês. Magasiner (fazer compras) é uma criação quebequense, não um empréstimo. Confundir essas palavras com anglicismos ao revisar transcrições leva a correções desnecessárias.
Vocabulário típico do Quebec que confunde motores treinados com francês da França:
| Termo quebequense | Equivalente no francês da França | Significado |
|---|---|---|
| char | voiture | carro |
| magasiner | faire du shopping | fazer compras |
| courriel | mail / e-mail | |
| fin de semaine | week-end | fim de semana |
| dépanneur | épicerie de quartier | mercearia de bairro |
| piton | bouton | botão |
| bienvenue | de rien | de nada |
| tuque | bonnet | gorro de inverno |
Quando um modelo treinado com francês da França ouve "fin de semaine", ele pode reconhecer as palavras individualmente, mas falhar em interpretar o sentido composto. Quando ouve "bienvenue" como resposta a um agradecimento, pode marcá-la como fora de lugar quando se trata de um uso quebequense perfeitamente correto.
Suporte a Dialetos do Francês, Motor por Motor
Deepgram Nova-3
O Deepgram é a única grande API que diferencia fr de fr-CA como códigos de idioma separados. Especificar fr-CA direciona o áudio para uma variante do modelo treinada com dados de francês canadense. Para podcasts, transmissões e entrevistas da Radio-Canada ou CJAD, fr-CA superará fr. O modelo suporta detecção de alternância de código em 10 idiomas, incluindo francês. Os benchmarks do próprio Deepgram mostram uma redução relativa de aproximadamente 34% no WER dos modelos multilíngues em comparação com os antecessores, embora números comparativos específicos de francês versus francês canadense não sejam divulgados publicamente.
Whisper Large-v3
O Whisper usa fr como seu único código de idioma francês. Ele não diferencia o francês canadense do francês da França no nível da API. Um benchmark acadêmico de 2025 no dataset CommissionsQC (fala legislativa quebequense espontânea) mediu o Whisper-large-v3 em 8,4% de WER e o Whisper-large-v3-turbo em 8,2% de WER no francês quebequense. Mais crucial ainda: variantes do Whisper ajustadas especificamente para francês (treinadas exclusivamente com dados de francês da França) tiveram desempenho pior que o Whisper multilíngue base no francês quebequense. Isso confirma que o ajuste fino com francês da França degrada ativamente a precisão no francês quebequense, porque estreita a distribuição fonológica que o modelo consegue tratar.
AssemblyAI Universal-3
O AssemblyAI usa um único código de idioma fr e afirma que seu modelo Universal-3 Pro detecta automaticamente padrões de fala regionais, incluindo o quebequense, sem exigir um código de dialeto separado. Ele lista explicitamente o vocabulário quebequense e a pronúncia específica do sotaque como tratados automaticamente. Essa abordagem é conveniente, mas significa que você não pode forçar um caminho de modelo específico para o Quebec.
Otter.ai
O Otter oferece transcrição de francês em todos os seus planos. É principalmente uma ferramenta de bot de reuniões (entrando em chamadas de Zoom, Meet e Teams via bot). O suporte a francês cobre os idiomas que seu mecanismo de fala processa, mas ele não publica dados de precisão específicos por dialeto para o francês quebequense, e seu recurso de resumo gera saída em inglês independentemente do idioma do áudio. Se você está transcrevendo reuniões em francês e precisa de resumos em francês, essa é uma limitação real.
Happy Scribe
A Happy Scribe anuncia suporte a mais de 150 idiomas via transcrição por IA. Seus planos de transcrição por IA têm preços em euros: Basic a €8,50/mês (cobrado anualmente, 120 minutos de IA), Pro a €19/mês (cobrado anualmente, 600 minutos de IA), Business a €59/mês (cobrado anualmente, 6.000 minutos de IA). A revisão humana está disponível a partir de €1,75/minuto. A Happy Scribe não publica dados de precisão específicos por dialeto para francês quebequense versus francês da França.
Trint
O Trint tem preço por assento e mira fluxos de trabalho de jornalismo e mídia. O Starter custa cerca de US$ 80 por assento/mês na cobrança anual (7 arquivos por assento por mês); o Advanced fica em torno de US$ 100 por assento/mês (arquivos ilimitados). Sem plano gratuito permanente. O Trint não publica dados de precisão específicos para o Quebec.
Francês Belga e Suíço: Uma Diferença Menor, Mas Real
Bélgica e Suíça, juntas, acrescentam dois pontos específicos de atrito para o ASR:
Números. O francês belga usa septante (70) e nonante (90). O francês suíço usa septante e nonante universalmente, além de huitante (80) em Vaud, Valais e Friburgo (Genebra usa quatre-vingts). Um modelo que espera o francês da França ouvirá "septante-cinq" e não terá representação treinada para aquela sequência de tokens, já que o equivalente metropolitano é "soixante-quinze". Dependendo do motor, ele pode produzir a sequência correta de dígitos mesmo assim (75) por meio de uma camada de normalização numérica, ou pode produzir uma saída embaralhada.
Ritmo de fala. O francês belga tende a um ritmo ligeiramente mais lento e a uma ênfase mais silábica do que o francês parisiense. O francês suíço em contextos formais é pausado e claro, o que geralmente ajuda o ASR em vez de atrapalhá-lo. A precisão nas duas variedades fica mais próxima da do francês da França do que a do francês quebequense, desde que o problema dos números seja tratado.
Ortografia: De Onde Vêm os Diacríticos na Transcrição
O francês usa cinco tipos de diacríticos e duas ligaduras: acento agudo (é), acento grave (à, è, ù), circunflexo (â, ê, î, ô, û), trema (ï, ü, ë), cedilha (ç) e as ligaduras œ e æ.
O problema para o speech-to-text é que os diacríticos ajudam na direção grafia-para-som, não no sentido contrário. Ao ouvir /o/, você não sabe se deve escrever o, au, eau ou ô. O modelo ASR precisa aprender o mapeamento da entrada acústica para a ortografia corretamente acentuada por meio da cobertura dos dados de treinamento. Motores treinados intensivamente com francês escrito parisiense geralmente restauram bem os diacríticos no vocabulário da França. No vocabulário quebequense, com convenções ortográficas diferentes, a qualidade da restauração varia.
Verifique sua saída procurando: ecole vs école, francais vs français, fete vs fête e o raro oeuf vs œuf. Diacríticos removidos em nomes próprios são especialmente comuns e os mais difíceis de detectar na revisão.
Configuração Prática para Áudio em Francês
Defina o código de idioma antes de enviar, não depois. Para conteúdo em francês da França, use fr. Para conteúdo do Quebec, incluindo transmissões da Radio-Canada, gravações legislativas e podcasts de Montreal, use fr-CA se seu motor oferecer suporte (Deepgram), ou fr contando com a adaptação automática do motor (AssemblyAI, Whisper).
Para conteúdo carregado de joual, planeje uma rodada de revisão independentemente do motor. A combinação de africação, sacrés e padrões de tu interrogativo produz grupos de erros que não podem ser recuperados apenas com pós-processamento.
Fornecer um glossário de nomes próprios ajuda significativamente: nomes de bairros de Montreal (Rosemont, Hochelaga), pontos de referência da cidade de Quebec e nomes de políticos e jornalistas quebequenses estão sistematicamente sub-representados nos dados de treinamento e frequentemente transcritos errado.
Para diarização de falantes em conteúdo em francês, quanto mais formal o registro, melhor a precisão da diarização. Programas de rádio quebequenses com cruzamentos frequentes de falas e falantes sobrepostos são mais difíceis que entrevistas estruturadas entre duas pessoas. Se você quiser entender melhor a diarização de falantes, aquele post cobre como os modelos subjacentes funcionam.
Especificamente para conteúdo de reuniões, a ferramenta de transcrição de reuniões lida com francês nativamente. Para gravações de entrevistas, veja como transcrever uma gravação de entrevista.
Comparando Opções de Transcrição de Francês
| Otter.ai | Happy Scribe | Trint | ConvertAudioToText | |
|---|---|---|---|---|
| fr-CA como código de idioma distinto | Não | Não divulgado | Não | Sim (via Deepgram Nova-3) |
| Caminho de treinamento específico para Quebec | Não | Não divulgado | Não | Sim |
| Resumo por IA em francês | Não (apenas inglês) | Parcial | Não | Sim |
| Diacríticos preservados | Sim | Sim | Sim | Sim |
| Plano gratuito | 300 min/mês | Apenas teste de 10 minutos | Teste de 7 dias, 3 arquivos | 10 min uma vez, mais prévia de 10 min sem cadastro |
| Preço pago inicial | US$ 8,33/mês anual | €8,50/mês anual (120 min de IA) | ~US$ 80/assento/mês anual | US$ 9,99/mês, ilimitado |
Minha opinião: para o francês quebequense especificamente, a escolha do motor importa mais do que a interface. O código de idioma fr-CA do Deepgram é o sinal mais claro, em nível de produção, de que um modelo foi treinado com dados do Quebec em escopo. O valor do Otter está no fluxo de trabalho de bot de reuniões, não na precisão dialetal. O preço por assento do Trint, dentro de orçamentos de escala jornalística, é difícil de justificar quando a qualidade do ASR subjacente no francês regional não apresenta diferenciação.
Se você trabalha com conteúdo de transmissão em francês da França, a maioria dos motores entregará precisão aceitável. Se seu conteúdo é do Quebec, a escolha do motor e do código de idioma é decisiva.
Dicas Antes de Transcrever
- Use
fr-CAquando seu motor oferecer suporte, para qualquer conteúdo do Quebec. - Inclua um glossário de nomes próprios quebequenses e vocabulário especializado.
- Para áudio carregado de joual (entrevistas de rua, comédia, podcasts informais), reserve tempo de revisão proporcional à duração do áudio.
- Verifique se os diacríticos estão intactos numa amostra curta antes de processar um lote.
- Para conteúdo belga ou suíço, confira se os números são renderizados como dígitos corretamente, já que septante, nonante e huitante podem confundir modelos treinados com francês da França.
Para uma visão mais ampla de como escolher uma ferramenta de transcrição pelo modelo de custo, veja a comparação de preços de transcrição. Se você quer entender o que as métricas de precisão realmente medem para áudio do mundo real, precisão de transcrição explicada cobre o WER e seus limites.
Se você só precisa de uma transcrição limpa em francês, sem bot de reunião, a ferramenta de áudio para texto do ConvertAudioToText processa fr e fr-CA, preserva todos os diacríticos e gera resumos em francês, e não em inglês.
Perguntas Frequentes
O Whisper suporta o francês quebequense separadamente do francês da França?
O Whisper usa um único código de idioma fr, sem distinção de dialeto no nível da API. Ele não possui um caminho fr-CA separado. Benchmarks de pesquisa sobre francês quebequense espontâneo (dataset CommissionsQC) mostram o Whisper-large-v3 alcançando 8,4% de WER, o que é competitivo. Mais importante ainda: versões ajustadas do Whisper treinadas exclusivamente com francês da França têm desempenho pior no francês quebequense do que o modelo multilíngue base, porque o ajuste fino com dados da França estreita a gama fonológica que o modelo consegue tratar.
O que torna o francês quebequense mais difícil para transcrição por IA do que o francês da França?
Duas características fonológicas explicam a maior parte da diferença de precisão. Primeiro, a africação: as oclusivas dentais /t/ e /d/ tornam-se [t͡s] e [d͡z] antes de vogais frontais altas, de modo que tu soa como tsu e dire soa como dzire. Segundo, a ditongação vocálica em sílabas fechadas, produzindo sons como [ɛɪ̯] e [ɑʊ̯] que não existem no francês da França. Um modelo treinado com francês da França encontra esses fones como entrada fora da distribuição. O registro joual acrescenta negação omitida, o tu interrogativo e os sacrés como marcadores discursivos, nada disso presente nos corpora de treinamento padrão.
O que são os sacrés e por que eles importam para a transcrição?
Sacrés são palavrões do francês quebequense derivados de termos religiosos católicos: tabernak, câlice, crisse, osti e cerca de 2.000 variantes registradas. No joual e na fala informal de Montreal, eles aparecem como intensificadores e marcadores discursivos com alta frequência em conversas espontâneas. Como estão ausentes ou são raros nos dados de treinamento da maioria dos modelos ASR, muitas vezes são transcritos como palavras não relacionadas de som parecido, gerando erros difíceis de detectar sem conhecimento do registro.
O francês belga causa os mesmos problemas que o francês quebequense para o ASR?
Não, a diferença é muito menor. A fonologia do francês belga permanece próxima à do francês da França. O principal problema prático é o vocabulário dos números: septante (70) e nonante (90) na Bélgica, e septante, nonante, huitante (80 em alguns cantões) na Suíça. Um modelo treinado com francês da França nunca viu "septante-cinq" como uma sequência de tokens para 75. Se isso gera um erro no nível do dígito depende de como o motor trata a normalização numérica. No geral, a precisão no francês belga e suíço fica próxima da precisão no francês da França, enquanto o francês quebequense é um desafio genuinamente distinto.
Devo usar o código de idioma fr ou fr-CA para conteúdo em francês canadense?
Use fr-CA sempre que seu motor oferecer suporte. O Deepgram Nova-3 distingue esses códigos como idiomas separados que direcionam para variantes de modelo diferentes. O AssemblyAI e o Whisper usam um único código fr e aplicam tratamento de dialeto internamente. Para conteúdo misto (uma gravação de central de atendimento com falantes de francês quebequense e um roteiro em francês da França), fr-CA é a escolha mais segura, já que a divergência fonológica do Quebec é maior e mais difícil de ser tratada por um modelo treinado com dados da França quando ele a encontra inesperadamente.
Fontes
- Visão geral de modelos e idiomas do Deepgram: https://developers.deepgram.com/docs/models-languages-overview
- Expansão do Deepgram Nova-3 para francês, espanhol e português: https://deepgram.com/learn/deepgram-expands-nova-3-with-spanish-french-and-portuguese-support
- Melhorias de WER multilíngue do Deepgram Nova-3: https://deepgram.com/learn/nova-3-multilingual-major-wer-improvements-across
Try transcription free
Convert any audio or video to clean, unwatermarked text — speaker labels, timestamps, and AI summaries included. First 10 minutes free, no account.
Related Articles
How to Add Timestamps to a Transcript
Learn how to add timestamps to a transcript with an audio-to-text tool, then export timestamped SRT or VTT subtitle files for easy navigation and editing.
How to Transcribe a Conference Talk to Text
Learn how to transcribe a conference talk or keynote to text, label speakers, and export SRT, VTT, or TXT using a straightforward upload or URL workflow.