बेंगलुरु स्थित स्टार्टअप Sarvam AI ने अपना नया AI मॉडल 'Vision 2.1' लॉन्च किया है, जो जटिल भारतीय भाषाओं के दस्तावेजों को डिजिटाइज करने में मदद करेगा। हालांकि, **87.3%** की औसत एक्यूरेसी के बावजूद, संथाली और कश्मीरी जैसी भाषाओं में प्रदर्शन अभी भी एक बड़ी चुनौती बना हुआ है।
बेंगलुरु के स्टार्टअप Sarvam AI ने भारतीय भाषाओं के दस्तावेजों को डिजिटल रूप में बदलने के लिए अपना नया मॉडल 'Vision 2.1' पेश किया है। यह टूल खासतौर पर उन कंपनियों के लिए है जो पुराने मैन्युस्क्रिप्ट और हस्तलिखित टेबल्स के काम को ऑटोमेट करना चाहती हैं। फरवरी में आए पिछले वर्जन में रिलायबिलिटी और खर्चों को लेकर जो शिकायतें आई थीं, कंपनी ने इस बार उन्हीं पर काम करने की कोशिश की है।
परफॉर्मेंस का लेखा-जोखा
कंपनी ने दावा किया है कि 22 भारतीय भाषाओं में मॉडल की औसत एक्यूरेसी 87.3% है। जहां हिंदी, कन्नड़ और तेलुगु जैसी प्रमुख भाषाओं में यह प्रदर्शन 90% से ज्यादा है, वहीं संथाली और कश्मीरी जैसी लो-रिसोर्स भाषाओं में यह गिरकर केवल 54% के आसपास रह जाता है। एंटरप्राइज एडॉप्शन के लिए यह बड़ा सवाल है, क्योंकि कंपनियों को हर भाषा में एक जैसी सटीकता की जरूरत होती है।
मार्केट में प्रतिस्पर्धा
Sarvam AI इसे एक कॉस्ट-इफेक्टिव समाधान के तौर पर देख रहा है। कंपनी ने अपने आंतरिक टेस्ट में इसे Bodhan Indic-OCR से बेहतर बताया है। हालांकि, बाजार में PaddleOCR जैसे ग्लोबल दिग्गजों से इसे कड़ी टक्कर मिल रही है। अपनी विश्वसनीयता साबित करने के लिए कंपनी ने 6,909 टेस्ट सैंपल जारी किए हैं, ताकि एक नया स्टैंडर्ड बेंचमार्क सेट किया जा सके। भविष्य में इस मॉडल की सफलता इस बात पर निर्भर करेगी कि कंपनी कैसे लो-रिसोर्स भाषाओं में सटीकता का अंतर कम करती है और ग्लोबल प्रतिस्पर्धियों को मात देती है।
