Comment la traduction en direct, les sous-titres et une transcription consultable fonctionnent ensemble dans une réunion InterMIND
Une équipe répartie sur quatre fuseaux horaires n'a pas de problème de langue dans l'invitation du calendrier — elle en a un dès que quelqu'un commence à parler. La traduction en direct, les sous-titres en direct et une transcription à laquelle on peut revenir sont les trois choses qui, en pratique, suppriment cette friction, et on les voit de plus en plus apparaître ensemble sur une seule page produit, décrites comme un ensemble unique plutôt que comme trois modules distincts.
Un exemple récent : un billet de septembre 2026 publié par la plateforme de travail NexGen Virtual Workplace s'ouvre sur « Traduction vocale en direct, sous-titres de réunion et transcriptions consultables, intégrés à la journée de travail plutôt qu'ajoutés à la réunion », et indique que « ces fonctionnalités sont disponibles dans la plateforme NexGen Virtual Workplace pour que les abonnés les utilisent ». Voilà toute la spécification proposée — le billet ne mentionne pas le nombre de langues prises en charge, ne précise pas quel niveau d'abonnement débloque les trois fonctionnalités, et ne décrit pas ce que « consultable » signifie au-delà de « les utilisateurs peuvent également rechercher d'anciennes transcriptions... pour faire référence » (vérifié en septembre 2026, source liée à la fin). Aucune de ces absences n'est une critique du fournisseur ; c'est simplement ce qu'un lecteur doit aller vérifier ailleurs, ou accepter sur parole, avant de savoir si l'ensemble convient à son équipe.
Puisque les mêmes trois mots — traduction, sous-titres, transcription — sont employés pour des mécaniques sensiblement différentes selon les produits, voici la version précise et vérifiable de chacun, telle qu'elle fonctionne dans InterMIND aujourd'hui.
Traduction : vous l'activez, et c'est votre propre voix
La traduction n'est pas ambiante — vous l'activez délibérément, par réunion, depuis le menu More dans la barre de contrôle (ou le raccourci Alt+T), disponible dès que la salle compte au moins deux langues. À partir de là, chaque participant définit sa propre langue de traduction indépendamment ; dans un appel à cinq avec cinq langues, chacun entend tous les autres traduits dans la sienne, simultanément.
Le résultat n'est pas une voix de narrateur générique. La reconnaissance vocale, la segmentation des phrases, la traduction et la synthèse vocale s'enchaînent comme un pipeline, et la dernière étape resynthétise la phrase traduite dans une version de la voix propre du locuteur original — reconnaissable comme étant lui, et non une lecture plate en synthèse vocale. La décomposition technique du fonctionnement de ce pipeline fait l'objet d'un billet distinct ; le résumé ici est qu'une fois la traduction activée, « qui l'a dit » survit à la traduction, pas seulement « ce qui a été dit ». La couverture est de 23 langues pour la voix, le chat et les notes partagées, et de 30 pour la traduction de documents entiers — la répartition et les raisons qui la justifient se trouvent dans la décomposition par langue.