Jouw eigen stem
Je Eigen Stem
Wanneer InterMIND jouw spraak voor een andere deelnemer vertaalt, horen zij geen robotachtige text-to-speech-verteller. Ze horen een stem die herkenbaar van jou is — met jouw klankkleur en manier van spreken — die nu de woorden in hun taal uitspreekt.
Dit werkt in beide richtingen en onafhankelijk voor elke deelnemer. In een meeting waar vijf mensen vijf talen spreken, hoort iedereen de andere vier in zijn eigen taal, en elk van die vier klinkt nog steeds als zichzelf.
Hoe het klinkt
De meeste tools voor live-vertaling vervangen de spreker door één enkele generieke synthetische stem. Het resultaat is verstaanbaar, maar vlak — je verliest wie er spreekt, de nadruk, de persoonlijkheid. InterMIND behoudt de stem van de spreker, waardoor een vertaalde meeting aanvoelt als een gesprek tussen de mensen die er echt in zitten, niet een rij aankondigingen die door een machine worden voorgelezen.
Hoe het werkt
InterMIND gebruikt een getrapte pipeline, en de spraakstap is de laatste fase:
- Spraakherkenning — jouw woorden worden in je eigen taal getranscribeerd terwijl je spreekt.
- Segmentatie — het transcript wordt gegroepeerd in stabele zinsfragmenten (bijzinnen), zodat de vertaling kan beginnen voordat je de zin afmaakt.
- Vertaling — elk fragment wordt progressief vertaald naar de taal van de luisteraar.
- Spraaksynthese — elk vertaald fragment wordt uitgesproken met behulp van een sample van jouw eigen stem, en naar de luisteraar gestuurd.
Terwijl de meeting nog genoeg van jouw spraak verzamelt om je stem te modelleren (ongeveer de eerste 5–10 seconden), gebruikt de synthese het audiofragment dat overeenkomt met wat je zojuist in je brontaal hebt gezegd. Zodra er een lang genoeg sample is, schakelt het over op het gebruik van dat sample voor alles daarna. In de praktijk merk je geen overstap — de vertaling klinkt steeds meer zoals jij naarmate het gesprek vordert. Het zal geen vlekkeloze imitatie van je stem zijn, maar het is herkenbaar jij, in plaats van een generieke verteller — en het blijft verbeteren naarmate het model meer van je hoort.
Talen
Vertaling in je-eigen-stem is beschikbaar voor alle 23 spraaktalen — dezelfde set die staat in Talen kiezen. Er hoeft niets apart te worden ingeschakeld: als vertaling aan staat, horen deelnemers je automatisch in je eigen stem.
Jouw opgeslagen stem-sample (optioneel)
Aangemelde gebruikers kunnen de opwarmfase overslaan door één keer een stem-sample op te nemen in Instellingen → Je stem in vertaling: druk op Mijn stem opnemen, zeg de cijfers van één tot tien in willekeurige volgorde, en het sample wordt automatisch opgeslagen wanneer alle tien oplichten. Vanaf je volgende meeting wordt je vertaalde spraak vanaf de eerste zin daarmee uitgesproken.

Privacy
Twee samples, twee levensduren. Het live sample dat wordt gebruikt voor het opwarmen tijdens de meeting is vluchtig: het bestaat alleen gedurende de live meeting en wordt nergens opgeslagen; de Mind API en SDK die de realtime-sessie aandrijven bewaren geen gegevens nadat de conferentiesessie is beëindigd. Het opgeslagen sample uit Instellingen wordt bij je account bewaard voor één doel — het uitspreken van je vertaalde spraak — wordt elke keer dat je deelneemt aan een meeting naar de vertaal-engine gestuurd, en wordt verwijderd op het moment dat je het verwijdert of je account verwijdert. Geen van beide is een van InterMIND's video-en-spraak opname-functies, die afzonderlijke, expliciete opnames zijn die je bewust start.
Op de roadmap: lip-sync
De vertaling in je eigen stem horen is de eerste helft van een groter doel. De volgende stap waaraan we werken is lip-sync — de mond van de spreker op de camera opnieuw timen zodat deze overeenkomt met de vertaalde audio, waardoor elke deelnemer lijkt de taal van de ander te spreken. Gecombineerd met vertaling in je-eigen-stem is het doel een call waarin mensen die geen gemeenschappelijke taal delen elkaar zien en horen alsof ze elkaars taal van nature spreken.
Dit is een roadmap-item, nog geen uitgebracht functie — vertaling in je-eigen-stem hierboven is vandaag live.