Por qué el marketing de calidad de traducción está roto — y qué publicamos en su lugar
Abra el sitio de cualquier proveedor de traducción en vivo. Verá el mismo tipo de números:
- "200+ idiomas"
- "6.000+ pares de idiomas"
- "El primero del mundo" / "La máxima precisión"
- "99% de precisión"
Ahora intente encontrar — en cualquiera de esas páginas de proveedores — qué significan esos números para una reunión que está a punto de realizar. Calidad por idioma. Metodología reproducible. Tamaño de muestra. Puntuación a lo largo del tiempo. Divulgación honesta de dónde el modelo es débil.
No lo encontrará. No en los textos de marketing, y rara vez en la documentación.
Este es el equilibrio de la categoría. Existe por tres razones:
- La mayoría de los proveedores no son dueños de su motor de traducción. Enrutan a través de OpenAI, Google, DeepL, Microsoft, o alguna combinación. Publicar datos de calidad por par sería hacer benchmarking del modelo de otra persona — no hay valor de marketing en eso.
- Los datos honestos de calidad son difíciles de poner en una valla publicitaria. Una sola puntuación es ruidosa. Una distribución es más útil pero más difícil de comprimir. Una
tendencia de los últimos seis meseses aún más útil, y aún más difícil. - Los equipos de compras aún no han presionado. Los compradores aceptan los números de marketing al pie de la letra, y así el equilibrio se mantiene.
El equilibrio no se mantendrá. La próxima clase de comprador — farmacéutica, legal, financiera, auditoría, sector público — va a hacer preguntas más difíciles que "cuántos idiomas". Construimos /benchmark porque creemos que no deberían tener que creer en la palabra de un proveedor.
Lo que los números de marketing no le dicen
"200+ idiomas" significa que un proveedor tiene un modelo que emite texto en 200 idiomas. La calidad en esos idiomas varía desde nivel de producción para los pares principales (EN↔DE, EN↔ES, EN↔FR) hasta apenas utilizable para pares de bajos recursos. Sin un desglose por par, no puede saber en qué lado de esa línea caerá su reunión.
"6.000+ pares de idiomas" es combinatoria de N × N sobre 80 idiomas de origen. Decir que se soportan 6.000 pares es la parte fácil. Decir que un par específico es suficientemente bueno para una revisión CAPA, una negociación de contrato, o una llamada de resultados — esa es la parte que no está en el folleto.
"99% de precisión", sin especificar qué se midió, contra qué referencia, en qué muestra, por qué juez — no aporta contenido. La calidad de traducción no tiene un escalar universal. Tiene una distribución que depende del par de idiomas, dominio del contenido, calidad del audio (para voz), presupuesto de latencia, y qué significa "suficientemente bueno" para el caso de uso específico.