การแปลด้วย AI คุณภาพ เบนช์มาร์ก
InterMIND แปลได้ดีเพียงใดจริง ๆ วัดด้วยชุดทดสอบอัตโนมัติของเราบนชุดเบนช์มาร์ก FLORES-200 ที่คงที่ แยกตามคู่ภาษา ทุกเดือน เป็นการทดสอบสังเคราะห์ที่ทำซ้ำได้ ไม่ใช่ค่าเฉลี่ยที่เลือกเฉพาะผลดี
ข้อความที่พิมพ์ แปลในบรรทัดเดียวกัน
คะแนนเดียวสำหรับการรู้จำเสียงพูดและการแปล แบบครบวงจร
คะแนน = ความตรงของความหมายเมื่อเทียบกับคำแปลอ้างอิง (0–100) ยิ่งสูงยิ่งดี
การแปลแชทข้อความ
ข้อความที่พิมพ์จะถูกแปลในบรรทัดเดียวกันทันทีที่ส่ง
คุณภาพเฉลี่ยของแต่ละภาษา · Q4 2026เทียบกับ Q3 2026
แต่ละแท่งรวมทุกการทดสอบที่แปลไปหรือมาจากภาษานั้นในไตรมาสนี้ รอยบากเส้นประแสดงไตรมาสก่อนหน้า
Faded bars have a thin sample (<3 runs) — read them as provisional.
การแปลเสียง
เสียงพูดสด ถอดเสียงและแปลแบบเรียลไทม์ ซึ่งเป็นโจทย์แบบครบวงจรที่ยากกว่า
คุณภาพเฉลี่ยของแต่ละภาษา · Q4 2026เทียบกับ Q3 2026
แต่ละแท่งรวมทุกการทดสอบที่แปลไปหรือมาจากภาษานั้นในไตรมาสนี้ รอยบากเส้นประแสดงไตรมาสก่อนหน้า
Faded bars have a thin sample (<3 runs) — read them as provisional.
คุณภาพตามช่วงเวลา
ค่ามัธยฐานรายเดือนแยกตามรูปแบบ นับตั้งแต่เราเริ่มเผยแพร่
ตัวเลขเหล่านี้มาจากเซสชันจริง
ทุกการทดสอบบนเดโมสดจะได้รับคะแนนโดยอัตโนมัติและรวมอยู่ในเบนช์มาร์กของเดือนถัดไป หน้าตาของเซสชันเป็นดังนี้:
ตารางข้อมูลทั้งหมด
ทุกคู่ภาษาและทุกเดือนที่เผยแพร่ ได้แก่ ค่ามัธยฐาน ช่วง และขนาดตัวอย่าง เรียงลำดับได้ตามทุกคอลัมน์