Traduction en direct dans Google Meet : comment ça marche, et où ça s'arrête
Si vous avez cherché « traduction en direct dans Google Meet », la réponse honnête et courte est : oui, Meet peut traduire une réunion en direct — de deux façons différentes — et celle que vous obtenez dépend de votre offre. Les deux existent vraiment et chacune excelle à une tâche précise. Aucune n'est conçue pour une salle où quatre nationalités doivent chacune entendre la réunion dans leur propre langue en même temps. Ce billet explique comment chacune fonctionne, comment l'activer, et où se situe exactement le plafond — pour que vous puissiez dire de quel côté votre réunion se situe.
Il s'agit du guide pratique par plateforme, en complément de notre guide de référence, Traduction de réunion en temps réel : comment ça marche, et comment l'évaluer. Si vous voulez la version valable pour toute la catégorie sur « comment cela devrait fonctionner », commencez par là. Pour les versions Zoom et Microsoft Teams de ce billet, voir Zoom et Teams. Nouveau dans l'interprétation en tant que catégorie ? Commencez par Interprétation simultanée : cabine, RSI ou IA.
Les deux fonctionnalités, et pourquoi ce n'est pas la même chose
Google Meet a livré la traduction en direct sous deux formes distinctes. On les confond tout le temps, alors distinguons-les d'abord :
1. Sous-titres traduits (texte)
La fonctionnalité la plus ancienne. Le locuteur parle ; Meet affiche le texte des sous-titres à l'écran traduit dans une autre langue. C'est une expérience de lecture — des sous-titres, pas de l'audio. Disponible sur les éditions Workspace Business Standard, Business Plus, Enterprise Standard et Enterprise Plus. Utile quand une personne présente et que les autres suivent en texte, ou pour l'accessibilité. Cela ne change pas ce que chacun entend.
2. Traduction vocale (audio)
La fonctionnalité plus récente, propulsée par Gemini, déployée au fil de 2025–2026. Celle-ci traduit l'audio parlé lui-même, en quasi temps réel, « dans une voix semblable à la vôtre » — de sorte qu'un auditeur entend les mots du locuteur dans sa propre langue, dans une voix qui ressemble à celle du locuteur. C'est la fonctionnalité phare, et elle est réellement impressionnante. C'est aussi là que se trouvent les limites, donc ça vaut la peine d'être précis à leur sujet.
Comment activer la traduction vocale dans Google Meet
- Vous (et la fonctionnalité) devez être sur une offre éligible : Google AI Pro ou Ultra, ou Workspace Business Standard/Plus, Enterprise Standard/Plus, Frontline Plus, ou AI Pro for Education. Sur Workspace, un administrateur peut devoir l'activer.
- Dans une réunion, ouvrez les contrôles de sous-titres/traduction et activez la traduction vocale, puis choisissez la paire de langues.
- Attendez que l'indicateur de traduction sur la vignette du locuteur disparaisse avant de répondre — il y a un délai intégré de quelques secondes pour que la traduction soit terminée.
C'est toute la configuration. La friction n'est pas l'interrupteur ; c'est ce que l'interrupteur peut et ne peut pas faire.
Les limites qui déterminent réellement si ça vous convient
C'est la partie que les annonces de fonctionnalités ne mettent pas en avant. Au mois d'août 2026, la traduction vocale de Meet est, selon la documentation de Google elle-même :
- Ancré à l'anglais. La traduction fonctionne entre l'anglais et le français, l'allemand, l'italien, le portugais ou l'espagnol — et c'est la liste complète. Chaque paire inclut l'anglais. Il n'y a pas d'allemand↔japonais, pas d'espagnol↔arabe, aucun chemin qui ne passe par l'anglais. Si les langues de votre réunion ne sont pas « l'anglais plus une de ces cinq », la traduction vocale ne le couvre pas.
- Une seule paire de langues par réunion. Toute la réunion fonctionne sur une seule paire à la fois. Une salle avec un anglophone, un hispanophone et un germanophone ne peut pas permettre à chacun d'entendre sa propre langue simultanément — vous choisissez une paire, et c'est la réunion.
- Bêta, avec des limites strictes. C'est une fonctionnalité bêta : 90 minutes par réunion, non disponible dans les diffusions en direct ni les enregistrements, les participants de moins de 18 ans ne peuvent pas l'utiliser, et le matériel de salle de réunion peut seulement écouter, pas traduire.
- Quelques secondes de délai. Google demande aux utilisateurs d'attendre que le symbole de traduction disparaisse avant de répondre. C'est suffisant pour des tours de parole ; ce n'est pas la latence sub-seconde permettant les chevauchements dont a besoin un échange rapide.
Sur la confidentialité, Google est clair et correct ici : aucun audio n'est enregistré, et aucun modèle n'est entraîné sur votre voix.
Rien de tout cela ne rend la fonctionnalité mauvaise. Cela en fait un outil bilingue, ancré à l'anglais — conçu pour un anglophone et un hispanophone qui prennent la parole à tour de rôle, pas pour une salle réellement multilingue.
Le plafond structurel, en une phrase
Google Meet traduit une paire de langues, ancrée sur l'anglais, une à la fois. Une réunion réellement multilingue nécessite chaque participant dans sa propre langue, en même temps. Ce sont des architectures différentes, pas des réglages différents — c'est pourquoi « plus de langues » ne peut pas être un futur interrupteur sur le modèle une-paire-à-la-fois ; c'est une autre façon de construire la salle.
Si vos réunions sont « l'anglais plus une autre langue, deux parties, moins de 90 minutes », la traduction vocale de Meet peut être tout ce dont vous avez besoin, et elle est intégrée dans un outil que vous avez déjà. Si vos réunions comportent trois langues ou plus dans la salle — ou deux qui ne sont pas l'anglais — vous avez atteint le plafond, et la question devient de savoir quel outil a été conçu pour l'autre côté.
Quand vous avez dépassé le modèle une-paire-à-la-fois
C'est la tâche pour laquelle nous avons construit InterMIND : pas du bilingue-avec-anglais, mais chaque participant dans sa propre langue, simultanément, en direct. Concrètement, là où la traduction vocale de Meet fait une paire ancrée à l'anglais, InterMIND fait :
- 24 langues en direct, sur la voix, le chat et les notes partagées — sans exigence que l'anglais en fasse partie. Un francophone et un japonophone peuvent se réunir sans que personne ne touche à l'anglais. (La pile de traduction complète de bout en bout a sa propre page.)
- Audio par auditeur. Chaque participant entend la réunion dans sa propre langue choisie en même temps — cinq personnes, cinq langues, une salle. (Comment cela fonctionne réellement sous le capot est dans À l'intérieur des quatre pipelines de traduction.)
- Un budget de latence sub-seconde, parce que l'objectif de conception est une conversation qui s'écoule, pas des tours de parole autour d'un indicateur de traduction.
- Traduction de documents, de chat et de notes aussi — 30 langues pour les fichiers déposés dans le chat — pas seulement l'audio parlé.
- Une qualité que vous pouvez auditer. Nous publions des scores par paire de langues sur du trafic réel sur
/benchmark, plutôt que de vous demander de croire un billet de lancement sur parole.
Nous ne prétendons pas que Meet est mauvais — pour son cas bilingue, la traduction vocale préservant la voix est une fonctionnalité solide. Nous prétendons que c'est une autre forme de réunion. La comparaison honnête se trouve dans Traduction de réunion en temps réel et dans nos comparaisons de plateformes.
Essayez l'autre côté du plafond
- Essayez la démo en direct — exécutez notre pipeline vocal en direct sur votre propre audio, dans l'une des 24 langues, et entendez une traduction par auditeur au lieu d'une paire ancrée à l'anglais.
- Voir le benchmark — qualité de traduction par paire, par mois, sur du trafic réel, avec la méthodologie écrite.
- InterMIND vs. les plateformes que vous connaissez — honnête, fonctionnalité par fonctionnalité.
- Vous organisez un webinaire ou une formation multilingue ? Le workflow d'événement : événements & webinaires.
- Besoin seulement d'un compte-rendu, pas de traduction en direct ? Le face-à-face des assistants de prise de notes : Otter vs Fireflies.
La traduction en direct dans Google Meet est une fonctionnalité réelle et utile, avec une limite clairement tracée. Savoir où se trouve cette limite — ancré à l'anglais, une paire, 90 minutes — c'est toute la décision.
FAQ
Google Meet traduit-il l'audio ou seulement les sous-titres ?
Les deux, selon différentes offres. Les sous-titres traduits affichent le discours sous forme de texte dans votre langue (Business Standard/Plus, Enterprise Standard/Plus). La traduction vocale — la fonctionnalité propulsée par Gemini — traduit l'audio parlé lui-même, dans une voix ressemblant à celle du locuteur, sur Google AI Pro/Ultra et les éditions Workspace éligibles.
Quelles langues la traduction vocale de Google Meet prend-elle en charge ?
Au mois d'août 2026 : entre l'anglais et le français, l'allemand, l'italien, le portugais ou l'espagnol. Chaque paire inclut l'anglais, et une réunion fonctionne sur une seule paire de langues à la fois.
La traduction vocale de Google Meet est-elle gratuite ?
Non. Elle nécessite Google AI Pro ou Ultra, ou une édition Workspace éligible (Business Standard/Plus, Enterprise Standard/Plus, Frontline Plus, ou AI Pro for Education), et sur Workspace un administrateur peut devoir l'activer.
Combien de temps une réunion traduite sur Google Meet peut-elle durer ?
La traduction vocale est une bêta plafonnée à 90 minutes par réunion. Elle ne fonctionne pas non plus dans les diffusions en direct ni les enregistrements, et les participants de moins de 18 ans ne peuvent pas l'utiliser.
— L'équipe Mind.com
Sources : Google Meet — En savoir plus sur la traduction vocale, Google Workspace — Mises à jour Gemini, Google Meet — Utiliser les sous-titres traduits. Google étend les langues prises en charge au fil du temps ; consultez les pages d'aide pour la liste à jour. Tous les faits vérifiés en août 2026.