AI-vertaling Kwaliteit Benchmark
Hoe goed InterMIND daadwerkelijk vertaalt — gemeten met onze geautomatiseerde testsuite op een vaste FLORES-200-benchmarkset, per talenpaar, elke maand. Synthetisch en reproduceerbaar, geen uitgekozen gemiddelden.
getypte berichten, direct inline vertaald
één score voor spraakherkenning + vertaling, end-to-end
Score = semantische getrouwheid ten opzichte van een referentievertaling (0–100). Hoger is beter.
Vertaling van tekstchat
Getypte berichten worden direct inline vertaald zodra ze worden verzonden.
Gemiddelde kwaliteit per taal · Q4 2026t.o.v. Q3 2026
Elke balk bundelt alle runs die dit kwartaal naar of vanuit die taal vertalen. De gestippelde markering geeft het vorige kwartaal aan.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Spraakvertaling
Live spraak, getranscribeerd en in real-time vertaald — het moeilijkere end-to-end-probleem.
Gemiddelde kwaliteit per taal · Q4 2026t.o.v. Q3 2026
Elke balk bundelt alle runs die dit kwartaal naar of vanuit die taal vertalen. De gestippelde markering geeft het vorige kwartaal aan.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Kwaliteit in de loop van de tijd
Maandelijkse mediaan per modaliteit, sinds we zijn begonnen met publiceren.
Deze cijfers komen uit echte sessies
Elke run op de live demo wordt automatisch beoordeeld en opgenomen in de benchmark van volgende maand. Een sessie ziet er zo uit:
Volledige gegevenstabel
Elk gepubliceerd paar en elke maand — mediaan, bereik en steekproefgrootte. Sorteerbaar op elke kolom.