अनुवाद-गुणवत्ता की मार्केटिंग क्यों विफल है — और हम इसके बदले क्या प्रकाशित करते हैं
किसी भी लाइव-अनुवाद विक्रेता की साइट खोलिए। आपको हर जगह एक जैसे आँकड़े दिखेंगे:
- "200+ भाषाएँ"
- "6,000+ भाषा जोड़ियाँ"
- "दुनिया का पहला" / "सर्वोच्च सटीकता"
- "99% सटीक"
अब इनमें से किसी भी विक्रेता के पेज पर यह खोजने की कोशिश कीजिए कि इन आँकड़ों का आपकी आने वाली किसी मीटिंग के लिए क्या अर्थ है। प्रति-भाषा गुणवत्ता। दोहराई जा सकने वाली कार्यप्रणाली। नमूने का आकार। समय के साथ स्कोर। मॉडल कहाँ कमज़ोर है, इसका ईमानदार खुलासा।
आपको यह नहीं मिलेगा। न मार्केटिंग सामग्री में, और दस्तावेज़ों में भी कम ही।
यह इस श्रेणी का एक स्थापित संतुलन है। यह तीन कारणों से बना हुआ है:
- अधिकांश विक्रेता अपना अनुवाद इंजन खुद नहीं चलाते। वे OpenAI, Google, DeepL, Microsoft या इनके किसी संयोजन से अनुवाद करवाते हैं। प्रति-जोड़ी गुणवत्ता का डेटा प्रकाशित करना किसी और के मॉडल की बेंचमार्किंग करना होगा — उसमें मार्केटिंग का कोई लाभ नहीं है।
- ईमानदार गुणवत्ता डेटा को होर्डिंग पर लगाना कठिन है। एक अकेला स्कोर अस्थिर होता है। वितरण ज़्यादा उपयोगी है, पर उसे संक्षेप में कहना कठिन है।
last-six-months trend(पिछले छह महीनों का रुझान) और भी उपयोगी है, और उसे संक्षेप में कहना और भी कठिन। - ख़रीद-प्रक्रिया ने अब तक सवाल नहीं उठाए हैं। ख़रीदार मार्केटिंग के आँकड़ों को ज्यों का त्यों मान लेते हैं, और इसलिए यह संतुलन बना रहता है।
यह संतुलन टिकेगा नहीं। ख़रीदारों की अगली पीढ़ी — फ़ार्मा, कानूनी, वित्तीय, ऑडिट, सार्वजनिक क्षेत्र — "कितनी भाषाएँ" से कहीं कठिन सवाल पूछेगी। हमने /benchmark इसलिए बनाया क्योंकि हमारा मानना है कि उन्हें किसी विक्रेता की बात पर आँख मूँदकर भरोसा नहीं करना पड़ना चाहिए।
मार्केटिंग के आँकड़े आपको क्या नहीं बताते
"200+ भाषाएँ" का मतलब सिर्फ़ इतना है कि विक्रेता के पास ऐसा मॉडल है जो 200 भाषाओं में टेक्स्ट बना सकता है। इन भाषाओं में गुणवत्ता प्रमुख जोड़ियों (EN↔DE, EN↔ES, EN↔FR) के लिए प्रोडक्शन-स्तर की होती है, जबकि कम-संसाधन वाली जोड़ियों के लिए मुश्किल से उपयोग लायक। प्रति-जोड़ी विश्लेषण के बिना आप नहीं जान सकते कि आपकी मीटिंग उस रेखा के किस ओर पड़ेगी।
"6,000+ भाषा जोड़ियाँ" 80 स्रोत भाषाओं पर N × N का साधारण गणित है। 6,000 जोड़ियों के समर्थन का दावा करना आसान हिस्सा है। यह कहना कि कोई विशेष जोड़ी CAPA समीक्षा, अनुबंध वार्ता या अर्निंग्स कॉल के लिए पर्याप्त अच्छी है — यही वह हिस्सा है जो ब्रोशर में नहीं मिलता।
"99% सटीक" — यदि यह न बताया जाए कि क्या मापा गया, किस संदर्भ के विरुद्ध, किस नमूने पर, किस जज द्वारा — तो यह सारहीन है। अनुवाद गुणवत्ता का कोई सार्वभौमिक एकल मान नहीं होता। उसका एक वितरण होता है, जो भाषा जोड़ी, सामग्री के क्षेत्र, ऑडियो गुणवत्ता (वॉइस के लिए), लेटेंसी बजट, और विशिष्ट उपयोग के लिए "पर्याप्त अच्छा" के अर्थ पर निर्भर करता है।