
Transcription du tagalog et du filipino en 2026, le casse-tête du taglish
Summarize this article with:
Le tagalog pur est maintenant bien pris en charge en production, Deepgram Nova-3 a ajouté le tagalog en janvier 2026, AssemblyAI le couvre, et Google Cloud supporte fil-PH depuis Chirp. Le problème restant, c'est le taglish, ce mélange omniprésent de tagalog et d'anglais qui fait encore trébucher les moteurs verrouillés sur une seule langue par segment. Pour l'audio mixte, utilisez un moteur avec support du mélange de codes et prévoyez de corriger les erreurs de frontière linguistique, les équipes de centres d'appels devraient tester sur leur propre audio taglish.
Réponse rapide
Les grands moteurs de transcription IA prennent désormais en charge le tagalog en production. Deepgram Nova-3 a ajouté le tagalog (tl) en janvier 2026, AssemblyAI's Universal-2 le couvre, et Google Cloud Speech-to-Text prend en charge fil-PH depuis le déploiement de Chirp. La précision en tagalog pur n'est plus le problème principal. Le défi qui reste, c'est le taglish, ce mélange omniprésent entre tagalog et anglais qui caractérise la façon dont la plupart des Philippins urbains parlent réellement, et qui fait encore trébucher les moteurs IA de manière prévisible.
Filipino vs. Tagalog : bien nommer les choses d'abord
Le tagalog est la langue maternelle d'environ 28 à 33 millions de Philippins, principalement à Metro Manila, Batangas, Bulacan, Laguna et Cavite. Le filipino, la langue nationale standardisée codifiée dans la Constitution de 1987, est basé sur le tagalog mais puise officiellement son vocabulaire dans toutes les langues philippines, ainsi que dans les emprunts à l'espagnol et à l'anglais.
Pour la transcription pratique, la distinction importe peu : le filipino et le tagalog sont mutuellement intelligibles, la grammaire et la phonologie sont identiques, et le modèle IA que vous utilisez sert les deux. L'incohérence de nommage compte davantage au niveau de l'API. Google Cloud utilise fil-PH (filipino, Philippines). Deepgram utilise tl (tagalog, ISO 639-1). AssemblyAI documente la langue comme "Tagalog". Vous devrez peut-être expérimenter avec les deux codes selon le moteur.
Une autre clarification de nom : le cebuano (bisaya), l'ilocano et l'hiligaynon sont des langues philippines distinctes, pas des dialectes du tagalog. Les dialectes du tagalog, au sens strict, sont des variantes régionales du tagalog lui-même : Manila, Batangas, Bulacan et Marinduque. Cela compte parce que les modèles IA entraînés sur le tagalog de Manila dérivent avec les locuteurs de Batangas (connus pour leur schéma d'intonation distinctif), et échouent complètement sur le cebuano ou l'ilocano, qui sont des langues entièrement différentes.
L'écriture : latin uniquement, avec une note sur le baybayin
Le filipino et le tagalog modernes utilisent l'alphabet latin. Les mots d'origine espagnole conservent leur orthographe espagnole (Niño, mañana). Les emprunts à l'anglais gardent leur orthographe anglaise. Tous les grands moteurs de transcription IA produisent du texte en alphabet latin pour le tagalog, ce qui correspond au filipino écrit standard.
Le baybayin, l'écriture syllabique précoloniale, refait surface dans des contextes culturels : les écharpes de remise de diplôme à l'UP Diliman, l'art du tatouage et quelques poésies contemporaines. La loi de 2018 sur le système d'écriture national a encouragé sa préservation. Rien de tout cela ne crée un cas d'usage pratique pour la transcription. Aucun moteur ASR de production ne gère l'audio en baybayin, et presque aucun contenu audio ne l'utilise comme écriture principale.
Où en sont les moteurs en 2026
Deepgram Nova-3 a ajouté le tagalog (tl) comme langue monolingue prise en charge en production en janvier 2026. L'offre comprend la diarisation des locuteurs, le streaming en temps réel avec une latence inférieure à 300 ms, la suggestion de mots-clés pour les noms de marques et les termes spécialisés, la ponctuation intelligente et la segmentation par énoncé. Le modèle tarifaire est à l'usage, sans surcoût spécifique au tagalog : l'audio préenregistré tourne autour de 0,0048 $/min et le streaming autour de 0,0077 $/min aux tarifs standards, avec un crédit de 200 $ offert pour les nouveaux comptes.
AssemblyAI Universal-2 couvre le tagalog dans ce que l'entreprise documente comme son niveau de « bonne précision », soit un taux d'erreur sur les mots entre 10 % et 25 % sur un audio typique. Le tarif de base est de 0,15 $/heure pour la transcription préenregistrée, avec des options payantes pour la diarisation des locuteurs, l'analyse des sentiments et le résumé. Le tagalog est éligible au support multilingue d'AssemblyAI au même tarif de base.
Google Cloud Speech-to-Text prend en charge le filipino via le code de langue fil-PH sur les modèles Chirp et Chirp_2. Le tarif standard démarre à 0,016 $/minute (soit environ 0,96 $/heure), avec une option Dynamic Batch à environ un quart de ce prix pour les charges non urgentes. Les nouveaux comptes GCP reçoivent 300 $ de crédits gratuits.
Speechmatics revendique jusqu'à 96 % de précision au niveau des mots pour le tagalog, s'entraîne sur les dialectes et les accents, et reconnaît explicitement « les changements de code fréquents avec l'anglais » dans l'entraînement de ses modèles, bien qu'aucun benchmark WER spécifique au taglish ne soit publié.
| Moteur | Code de langue | Fonctionnalités | Prix approximatif |
|---|---|---|---|
| Deepgram Nova-3 | tl | Streaming, diarisation, mots-clés | 0,0048 $/min en pré-enregistré |
| AssemblyAI Universal-2 | tl | Diarisation, sentiment, résumés | 0,15 $/h de base |
| Google Cloud (Chirp) | fil-PH | Streaming, diarisation | 0,016 $/min standard |
| Speechmatics | Tagalog | Diarisation, accents | Contact pour les tarifs |
| OpenAI Whisper Large-v3 | tl | Local/auto-hébergé | Coût de calcul uniquement |
Pour une vue d'ensemble de la comparaison des coûts de ces moteurs, consultez la tarification des API de reconnaissance vocale en 2026 et Deepgram Nova-3 expliqué.
Le vrai problème : le taglish
La prise en charge du tagalog par les moteurs est désormais solide. Le problème, c'est que la plupart des discours philippins ne sont pas du tagalog pur. C'est du taglish.
Le taglish (parfois appelé englog) est un changement de code intraphrastique entre le tagalog et l'anglais, et chez les Philippins urbains éduqués, ce n'est pas un choix stylistique ni un signe de maîtrise incomplète. C'est le registre normal. Un journaliste pourrait écrire : « Sa GMA 'yung objectivity has become part na of the culture. » Un participant à une réunion dit : « Yung deliverable natin ngayon, can we move it to Friday? » Un parent dit à son enfant : « Mommy, I don't want to. It's so hirap eh. »
Le défi plus profond est morphologique. Le tagalog est une langue agglutinante : son système verbal repose sur un ensemble dense de préfixes, suffixes, infixes et circonfixes (mag-, nag-, -in-, -an, pag-...-an, -um-) pour encoder le focus, l'aspect et la voix. Quand des verbes anglais entrent dans ce système, ils se fléchissent :
- "Nag-meeting kami" (Nous avons eu une réunion)
- "I-submit mo na" (Soumets-le maintenant)
- "Magda-drive siya bukas" (Elle conduira demain)
- "Nagse-sweat na ako" (Je transpirais déjà)
- "The meeting will start na" (une particule tagalog ajoutée à une phrase en anglais)
Pour un moteur de reconnaissance vocale, chacune de ces formes hybrides est un jeton inédit qui peut ou non figurer dans son vocabulaire d'entraînement. Un modèle entraîné sur un corpus tagalog monolingue peut traiter "mag-meeting" comme deux jetons distincts, ou mal transcrire la racine anglaise. Un modèle entraîné principalement sur l'anglais peut carrément omettre le préfixe tagalog. Aucune des deux options n'est correcte.

C'est là que l'enjeu est le plus critique pour le secteur qui emploie le plus de Philippins dans le travail audio : le BPO et les centres d'appels.
Le point de vue des centres d'appels
L'industrie BPO philippine a généré environ 38 milliards de dollars de revenus en 2025 et emploie plus de 1,5 million de personnes, dont une part significative dans le support client vocal pour des clients américains, australiens et britanniques. Ces agents parlent ce qu'on pourrait appeler un "anglais philippin professionnel" au téléphone, mais leurs sessions de formation internes, leurs réunions d'équipe, leurs enregistrements d'assurance qualité et leurs débriefings d'escalade se déroulent en taglish.
Cela crée un écart de transcription considérable. Les appels entrants en anglais sont transcrits avec précision par n'importe quel moteur moderne. L'audio opérationnel interne, là où réside la véritable connaissance institutionnelle, est en taglish et beaucoup plus difficile à transcrire correctement. Les services de transcription humaine aux Philippines facturent entre 0,50 et 1,20 dollar par minute audio pour ce travail, avec des opérateurs natifs du taglish qui relisent les sorties de l'IA.
Pour le contrôle qualité des centres d'appels et la documentation des réunions à grande échelle, consultez les outils de transcription de réunions et comment créer des comptes rendus de réunions à partir d'un audio. L'article la diarisation des locuteurs expliquée couvre pourquoi l'étiquetage des locuteurs est particulièrement précieux pour les enregistrements d'appels multi-agents.
Ce qui casse et ce qui tient
Sur la base des défis structurels ci-dessus, voici ce que vous pouvez attendre des moteurs actuels sur différents types de contenus en tagalog :
Tagalog formel (délivrance des journaux télévisés, discours politiques, conférences académiques) : Les moteurs actuels donnent leur meilleur rendement ici. Le vocabulaire est plus standardisé, le rythme est maîtrisé et l'alternance codique est minimale. Attendez-vous à une sortie précise avec une légère révision.
Tagalog urbain décontracté/Taglish (vlogs YouTube, podcasts, contenus sociaux) : Une densité d'alternance codique plus élevée signifie plus de tokens hybrides. Les segments en anglais se transcrivent bien ; les constructions anglaises à affixes tagalog sont là où les erreurs se concentrent. Prévoyez plus de révision.
Tagalog à accent régional (Batangas, Bulacan, Cavite) : Ce sont des dialectes du tagalog avec des schémas d'intonation distincts. Les données d'entraînement des moteurs penchent vers le tagalog de Manille (les médias du Grand Manille dominent). La précision se dégrade quelque peu sur les accents régionaux forts.
Audio interne des centres d'appels (réunions d'équipe, revues de contrôle qualité, formations) : Taglish dense, rythme rapide, locuteurs qui se chevauchent, jargon industriel. C'est la catégorie la plus difficile. La précision des moteurs actuels n'est pas vérifiée par des benchmarks publiés ; la revue humaine reste la norme pour tout ce qui a des conséquences.
Pour une comparaison avec une autre langue d'Asie du Sud-Est confrontée à des dynamiques d'alternance codique similaires, voir la transcription du bahasa indonésien, où le discours mixte jakartanais présente des défis parallèles.
Mon avis
L’histoire a changé en 2026. Il y a un an, la réponse pratique à « peut-on transcrire le tagalog ? » était « avec des réserves importantes ». Aujourd’hui, des moteurs comme Deepgram Nova-3 et AssemblyAI Universal-2 prennent en charge le tagalog en production, avec diarisation et streaming en temps réel. L’amélioration du support du tagalog pur est réelle.
Ce qui n’a pas changé : le taglish reste vraiment difficile, pour des raisons structurelles de linguistique qui ne se règlent pas en ajoutant le tagalog à la liste des langues d’un modèle. L’intégration morphologique de l’anglais dans la grammaire tagalog crée une ambiguïté au niveau des tokens qui casse les systèmes de reconnaissance entraînés séparément sur chaque langue. Tout contenu majoritairement taglish doit être traité comme nécessitant une relecture humaine légère, quel que soit le moteur utilisé.
Si vous avez besoin d’une transcription propre pour de l’audio en tagalog ou en taglish sans construire votre propre pipeline API, ConvertAudioToText gère les téléversements audio avec étiquetage des locuteurs et produit une transcription corrigée et mise en forme que vous pouvez télécharger directement.
Pour du contenu très taglish où la précision est cruciale (juridique, médical ou archives publiques), associez la sortie de l’IA à un relecteur natif parlant taglish.
FAQ
Quelle est la différence entre le filipino et le tagalog pour la transcription ?
Le filipino est la langue nationale standardisée des Philippines, officiellement basée sur le tagalog avec un vocabulaire emprunté à d’autres langues philippines, à l’espagnol et à l’anglais. En pratique, les deux sont fonctionnellement identiques pour la transcription. La principale différence se situe au niveau de l’API : Google Cloud utilise le code fil-PH, tandis que Deepgram et OpenAI Whisper utilisent tl. Testez les deux codes avec votre moteur ; les résultats sont généralement identiques.
Quel moteur d’IA est le meilleur pour la transcription en tagalog en 2026 ?
Deepgram Nova-3 (code tl) a ajouté le tagalog en janvier 2026 avec le support du streaming et la suggestion de mots-clés. AssemblyAI Universal-2 couvre aussi le tagalog et inclut des fonctions de résumé. Google Cloud Speech-to-Text prend en charge fil-PH sur Chirp et Chirp_2. Ces trois moteurs sont prêts pour la production sur de l'audio tagalog propre et clair. Pour du contenu fortement taglish, aucun moteur n'a publié de comparaison directe, donc prévoyez d'évaluer sur votre propre audio.
Pourquoi le taglish fait-il trébucher la transcription IA ?
Le taglish combine la morphologie agglutinante du tagalog avec le vocabulaire anglais. Les locuteurs philippins attachent des préfixes et infixes verbaux du tagalog à des racines anglaises : « nag-meeting », « i-submit », « magda-drive ». Chacune de ces formes hybrides est un jeton inédit. Un modèle entraîné principalement sur le tagalog peut mal segmenter la racine anglaise ; un modèle entraîné principalement sur l'anglais peut laisser tomber le préfixe tagalog. Le résultat, ce sont des erreurs de substitution concentrées précisément sur les constructions taglish à forte valeur informative.
Le cebuano, l'ilocano et les autres langues philippines sont-ils identiques au tagalog pour la transcription ?
Non. Le cebuano (bisaya), l'ilocano, l'hiligaynon et les autres langues régionales des Philippines sont des langues distinctes, pas des dialectes du tagalog. Sélectionner tl ou fil-PH dans un moteur ne donnera pas de résultats utilisables pour de l'audio en cebuano. Ces langues disposent d'un support de transcription IA beaucoup plus limité que le tagalog et relèvent de la catégorie des langues véritablement sous-représentées. Voyez pourquoi l'IA peine avec les langues sous-représentées pour les raisons structurelles derrière cet écart.
Sources
- Deepgram : Transcription vocale en tagalog
- Deepgram : Nova-3 ajoute 12 nouvelles langues
- Deepgram : Tarifs
- AssemblyAI : Langues prises en charge
- AssemblyAI : Tarifs
- Google Cloud : Langues prises en charge pour Speech-to-Text (V2)
- Google Cloud : Tarifs de Speech-to-Text
- Speechmatics : Transcription vocale en tagalog
- Otter.ai : Tarifs
- Wikipédia : Taglish
- Wikipédia : Langue tagalog
Try transcription free
Convert any audio or video to clean, unwatermarked text — speaker labels, timestamps, and AI summaries included. First 10 minutes free, no account.
Related Articles

Best Transcription Tool Alternatives, Honestly Compared (2026)
Leaving Otter, Descript, Transkriptor, Rev, or TurboScribe? Honest, sourced comparisons of every major transcription tool: real limits, verified pricing, and where each one genuinely wins.

Looking for a Transkriptor Alternative? Here's the Honest Math (2026)
Transkriptor meters your minutes and lets unused ones expire monthly. Here is its real 2026 pricing decoded, when staying is rational, and the unlimited alternatives at the same sticker price.