Benchmark de traducción con IA Benchmark
Cómo traduce realmente InterMIND: medido por nuestra suite de pruebas automatizada sobre un conjunto de referencia fijo de FLORES-200, por par de idiomas, cada mes. Sintético y reproducible, sin promedios escogidos a conveniencia.
mensajes escritos, traducidos en línea
una sola puntuación para el reconocimiento de voz y la traducción, de extremo a extremo
Puntuación = fidelidad semántica respecto a una traducción de referencia (0–100). Cuanto más alto, mejor.
Traducción de chat de texto
Mensajes escritos traducidos en línea en el momento de enviarse.
Calidad media por idioma · Q4 2026vs Q3 2026
Cada barra agrupa todas las ejecuciones de traducción hacia o desde ese idioma en este trimestre. La marca discontinua indica el trimestre anterior.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Traducción de voz
Voz en directo, transcrita y traducida en tiempo real: el problema de extremo a extremo más difícil.
Calidad media por idioma · Q4 2026vs Q3 2026
Cada barra agrupa todas las ejecuciones de traducción hacia o desde ese idioma en este trimestre. La marca discontinua indica el trimestre anterior.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Calidad a lo largo del tiempo
Mediana mensual por modalidad, desde que empezamos a publicar.
Estas cifras provienen de sesiones reales
Cada ejecución de la demo en vivo se puntúa automáticamente y se incorpora al benchmark del mes siguiente. Así es una sesión:
Tabla de datos completa
Todos los pares y meses publicados: mediana, rango y tamaño de muestra. Se puede ordenar por cualquier columna.