Benchmark della Qualità della traduzione AI
Quanto bene InterMIND traduce davvero — misurato dalla nostra suite di test automatizzati su un set di benchmark FLORES-200 fisso, per coppia di lingue, ogni mese. Sintetico e riproducibile, non medie scelte ad hoc.
messaggi digitati, tradotti direttamente nella conversazione
un unico punteggio per riconoscimento vocale + traduzione, end-to-end
Punteggio = fedeltà semantica rispetto a una traduzione di riferimento (0–100). Più alto è meglio.
Traduzione della chat di testo
Messaggi digitati, tradotti direttamente nella conversazione mentre vengono inviati.
Qualità media per lingua · Q4 2026rispetto a Q3 2026
Ogni barra raggruppa tutte le esecuzioni di traduzione da e verso quella lingua in questo trimestre. La tacca tratteggiata indica il trimestre precedente.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Traduzione vocale
Parlato in diretta, trascritto e tradotto in tempo reale — il problema end-to-end più difficile.
Qualità media per lingua · Q4 2026rispetto a Q3 2026
Ogni barra raggruppa tutte le esecuzioni di traduzione da e verso quella lingua in questo trimestre. La tacca tratteggiata indica il trimestre precedente.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Qualità nel tempo
Mediana mensile per modalità, da quando abbiamo iniziato a pubblicare.
Questi numeri provengono da sessioni reali
Ogni esecuzione della demo live viene valutata automaticamente e inclusa nel benchmark del mese successivo. Una sessione si presenta così:
Tabella completa dei dati
Ogni coppia e mese pubblicati — mediana, intervallo e dimensione del campione. Ordinabile per qualsiasi colonna.