Benchmark de qualité de la traduction par IA
Dans quelle mesure InterMIND traduit réellement bien — mesuré par notre suite de tests automatisés sur un jeu de référence FLORES-200 fixe, par paire de langues, chaque mois. Synthétique et reproductible, sans moyennes sélectionnées à dessein.
messages saisis, traduits en ligne
un seul score pour la reconnaissance vocale + la traduction, de bout en bout
Score = fidélité sémantique à une traduction de référence (0–100). Plus le score est élevé, mieux c'est.
Traduction du chat textuel
Les messages saisis sont traduits en ligne dès leur envoi.
Qualité moyenne par langue · Q4 2026vs Q3 2026
Chaque barre regroupe toutes les exécutions traduisant vers ou depuis cette langue ce trimestre. L'encoche en pointillés indique le trimestre précédent.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Traduction vocale
Parole en direct, transcrite et traduite en temps réel — le problème de bout en bout le plus difficile.
Qualité moyenne par langue · Q4 2026vs Q3 2026
Chaque barre regroupe toutes les exécutions traduisant vers ou depuis cette langue ce trimestre. L'encoche en pointillés indique le trimestre précédent.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Évolution de la qualité dans le temps
Médiane mensuelle par modalité, depuis le début de notre publication.
Ces chiffres proviennent de sessions réelles
Chaque exécution de la démo en direct est notée automatiquement et intégrée au benchmark du mois suivant. Voici à quoi ressemble une session :
Tableau de données complet
Chaque paire et chaque mois publiés — médiane, plage et taille d'échantillon. Triable selon n'importe quelle colonne.