Terjemahan AI Kualitas Benchmark
Seberapa baik InterMIND benar-benar menerjemahkan — diukur oleh rangkaian pengujian otomatis kami melalui set benchmark FLORES-200 yang tetap, per pasangan bahasa, setiap bulan. Sintetis dan dapat direproduksi, bukan rata-rata yang dipilih secara selektif.
pesan yang diketik, diterjemahkan secara inline
satu skor untuk pengenalan suara + terjemahan, end-to-end
Skor = kesetiaan semantik terhadap terjemahan referensi (0–100). Semakin tinggi semakin baik.
Terjemahan chat teks
Pesan yang diketik diterjemahkan secara inline saat dikirim.
Kualitas rata-rata per bahasa · Q4 2026dibanding Q3 2026
Setiap batang menggabungkan semua pengujian yang menerjemahkan ke atau dari bahasa tersebut pada kuartal ini. Tanda putus-putus menunjukkan kuartal sebelumnya.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Terjemahan suara
Ucapan langsung, ditranskripsikan dan diterjemahkan secara real-time — masalah end-to-end yang lebih sulit.
Kualitas rata-rata per bahasa · Q4 2026dibanding Q3 2026
Setiap batang menggabungkan semua pengujian yang menerjemahkan ke atau dari bahasa tersebut pada kuartal ini. Tanda putus-putus menunjukkan kuartal sebelumnya.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Kualitas dari waktu ke waktu
Median bulanan per modalitas, sejak kami mulai mempublikasikan.
Angka-angka ini berasal dari sesi nyata
Setiap pengujian pada demo langsung diberi skor secara otomatis dan dimasukkan ke dalam benchmark bulan berikutnya. Sebuah sesi tampak seperti ini:
Tabel data lengkap
Setiap pasangan dan bulan yang dipublikasikan — median, rentang, dan ukuran sampel. Dapat diurutkan menurut kolom apa pun.