Bengaluru-based Sarvam AI ਨੇ ਆਪਣਾ ਨਵਾਂ ਮਾਡਲ Vision 2.1 ਲਾਂਚ ਕੀਤਾ ਹੈ, ਜੋ ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਦੇ ਦਸਤਾਵੇਜ਼ਾਂ ਨੂੰ ਡਿਜੀਟਾਈਜ਼ ਕਰਨ ਲਈ ਤਿਆਰ ਕੀਤਾ ਗਿਆ ਹੈ। ਇਹ ਮਾਡਲ ਬਿਜ਼ਨਸਾਂ ਦੇ ਕੰਮ ਨੂੰ ਸੌਖਾ ਬਣਾਉਣ ਅਤੇ ਖਰਚਿਆਂ ਨੂੰ ਘਟਾਉਣ ਦਾ ਵਾਅਦਾ ਕਰਦਾ ਹੈ, ਹਾਲਾਂਕਿ ਕੁਝ ਖਾਸ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ ਇਸਦੀ ਸਫਲਤਾ ਅਜੇ ਵੀ ਇੱਕ ਚੁਣੌਤੀ ਬਣੀ ਹੋਈ ਹੈ।
ਡਿਜੀਟਾਈਜ਼ੇਸ਼ਨ ਵਿੱਚ ਨਵੀਂ ਕ੍ਰਾਂਤੀ
Bengaluru-based ਸਟਾਰਟਅੱਪ Sarvam AI ਨੇ ਆਪਣੇ ਨਵੇਂ AI ਮਾਡਲ Vision 2.1 ਨਾਲ ਦਸਤਾਵੇਜ਼ਾਂ ਨੂੰ ਡਿਜੀਟਾਈਜ਼ ਕਰਨ ਦੀ ਪ੍ਰਕਿਰਿਆ ਨੂੰ ਬਦਲਣ ਦੀ ਕੋਸ਼ਿਸ਼ ਕੀਤੀ ਹੈ। ਇਹ ਟੈਕਨਾਲੋਜੀ ਖਾਸ ਤੌਰ 'ਤੇ ਪੁਰਾਣੇ ਹੱਥ ਲਿਖਤ ਰਿਕਾਰਡਾਂ ਅਤੇ ਗੁੰਝਲਦਾਰ ਟੇਬਲਾਂ ਨੂੰ ਆਸਾਨੀ ਨਾਲ ਪੜ੍ਹਨ ਲਈ ਬਣਾਈ ਗਈ ਹੈ, ਜਿਸ ਨਾਲ ਕੰਪਨੀਆਂ ਆਪਣੇ ਪੇਪਰ-ਹੈਵੀ ਕੰਮਕਾਜ ਨੂੰ ਤੇਜ਼ ਕਰ ਸਕਦੀਆਂ ਹਨ।
ਪਰਫਾਰਮੈਂਸ ਅਤੇ ਚੁਣੌਤੀਆਂ
ਕੰਪਨੀ ਮੁਤਾਬਕ, ਇਹ ਮਾਡਲ 22 ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ 87.3% ਦੀ ਔਸਤ accuracy ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ। ਹਾਲਾਂਕਿ ਹਿੰਦੀ, ਕੰਨੜ ਅਤੇ ਤੇਲਗੂ ਵਰਗੀਆਂ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ ਇਹ ਮਾਡਲ 90% ਤੋਂ ਵੱਧ ਸਕੋਰ ਕਰ ਰਿਹਾ ਹੈ, ਪਰ ਸੰਥਾਲੀ (Santali) ਅਤੇ ਕਸ਼ਮੀਰੀ (Kashmiri) ਵਰਗੀਆਂ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ accuracy ਦਾ ਪੱਧਰ ਸਿਰਫ 54% ਦੇ ਆਸ-ਪਾਸ ਹੈ। ਐਂਟਰਪ੍ਰਾਈਜ਼ ਗਾਹਕਾਂ ਲਈ ਇਹ ਅੰਤਰ ਇੱਕ ਵੱਡੀ ਚਿੰਤਾ ਦਾ ਵਿਸ਼ਾ ਹੋ ਸਕਦਾ ਹੈ।
ਮੁਕਾਬਲਾ ਅਤੇ ਭਵਿੱਖ
Sarvam AI ਹੁਣ ਇਸ ਖੇਤਰ ਵਿੱਚ Bodhan Indic-OCR ਨੂੰ ਟੱਕਰ ਦੇ ਰਿਹਾ ਹੈ ਅਤੇ PaddleOCR ਵਰਗੇ ਗਲੋਬਲ ਖਿਡਾਰੀਆਂ ਨਾਲ ਮੁਕਾਬਲਾ ਕਰ ਰਿਹਾ ਹੈ। ਕੰਪਨੀ ਨੇ 6,909 ਟੈਸਟ ਸੈਂਪਲ ਵੀ ਜਾਰੀ ਕੀਤੇ ਹਨ ਤਾਂ ਜੋ Indic-OCR ਲਈ ਇੱਕ ਸਟੈਂਡਰਡ ਬੈਂਚਮਾਰਕ ਸੈੱਟ ਕੀਤਾ ਜਾ ਸਕੇ। ਆਉਣ ਵਾਲੇ ਸਮੇਂ ਵਿੱਚ ਇਹ ਦੇਖਣਾ ਦਿਲਚਸਪ ਹੋਵੇਗਾ ਕਿ ਕੀ ਕੰਪਨੀ ਆਪਣੀ ਇਸ ਟੈਕਨਾਲੋਜੀ ਨੂੰ ਵਪਾਰਕ ਪੱਧਰ 'ਤੇ ਵੱਡੇ ਪੈਮਾਨੇ 'ਤੇ ਸਫਲ ਬਣਾ ਪਾਉਂਦੀ ਹੈ ਜਾਂ ਨਹੀਂ।
