Benchmark Chất lượng dịch thuật AI
InterMIND thực sự dịch tốt đến mức nào — được đo bằng bộ kiểm thử tự động của chúng tôi trên bộ benchmark FLORES-200 cố định, theo từng cặp ngôn ngữ, mỗi tháng. Dữ liệu tổng hợp và có thể tái lập, không phải các giá trị trung bình được chọn lọc.
tin nhắn được gõ, dịch ngay trong dòng
một điểm số cho nhận dạng giọng nói + dịch thuật, từ đầu đến cuối
Điểm số = mức độ trung thực về ngữ nghĩa so với bản dịch tham chiếu (0–100). Điểm càng cao càng tốt.
Dịch chat văn bản
Tin nhắn được gõ sẽ được dịch ngay trong dòng khi gửi đi.
Chất lượng trung bình theo từng ngôn ngữ · Q4 2026so với Q3 2026
Mỗi thanh tổng hợp mọi lượt chạy dịch sang hoặc từ ngôn ngữ đó trong quý này. Vạch đứt nét đánh dấu quý trước.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Dịch giọng nói
Lời nói trực tiếp, được phiên âm và dịch theo thời gian thực — bài toán từ đầu đến cuối khó hơn.
Chất lượng trung bình theo từng ngôn ngữ · Q4 2026so với Q3 2026
Mỗi thanh tổng hợp mọi lượt chạy dịch sang hoặc từ ngôn ngữ đó trong quý này. Vạch đứt nét đánh dấu quý trước.
Faded bars have a thin sample (<3 runs) — read them as provisional.
Chất lượng theo thời gian
Trung vị hằng tháng theo từng phương thức, kể từ khi chúng tôi bắt đầu công bố.
Những con số này đến từ các phiên thực tế
Mỗi lượt chạy trên bản demo trực tiếp đều được chấm điểm tự động và đưa vào benchmark của tháng sau. Một phiên trông như thế này:
Bảng dữ liệu đầy đủ
Mọi cặp ngôn ngữ và tháng đã công bố — trung vị, khoảng giá trị và kích thước mẫu. Có thể sắp xếp theo bất kỳ cột nào.