IIT Madras-incubated non-profit ਸੰਸਥਾ Bodhan AI ਨੇ ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਨੂੰ ਸਮਰਥਨ ਦੇਣ ਲਈ ਚਾਰ ਨਵੇਂ AI ਮਾਡਲ ਪੇਸ਼ ਕੀਤੇ ਹਨ। 'Bharat EduAI Stack' ਦਾ ਹਿੱਸਾ ਇਹ ਟੂਲ ਹੁਣ ਐਡਟੈਕ ਕੰਪਨੀਆਂ ਅਤੇ ਸਟਾਰਟਅੱਪਸ ਲਈ ਮੁਫਤ ਉਪਲਬਧ ਹੋਣਗੇ।
ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਲਈ ਨਵੀਂ ਕ੍ਰਾਂਤੀ
IIT Madras ਵਿੱਚ ਇਨਕਿਊਬੇਟਿਡ Bodhan AI ਨੇ ਚਾਰ ਖਾਸ ਮਾਡਲ ਲਾਂਚ ਕੀਤੇ ਹਨ ਜੋ ਖਾਸ ਤੌਰ 'ਤੇ ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਲਈ ਤਿਆਰ ਕੀਤੇ ਗਏ ਹਨ। ਇਹ ਮਾਡਲ 'Bharat EduAI Stack' ਦਾ ਹਿੱਸਾ ਹਨ ਅਤੇ ਇਹ ਡਿਜੀਟਲ ਪਬਲਿਕ ਗੁੱਡਜ਼ ਵਜੋਂ ਕੰਮ ਕਰਨਗੇ। ਇਸ ਪਹਿਲਕਦਮੀ ਦਾ ਮੁੱਖ ਉਦੇਸ਼ ਮਹਿੰਗੀਆਂ ਅਤੇ ਅੰਗਰੇਜ਼ੀ-ਕੇਂਦਰਿਤ AI ਪ੍ਰਣਾਲੀਆਂ 'ਤੇ ਨਿਰਭਰਤਾ ਨੂੰ ਘਟਾਉਣਾ ਹੈ।
ਕਿਹੜੇ ਮਾਡਲ ਹੋਏ ਲਾਂਚ?
ਇਹ ਮਾਡਲ AI4Bharat ਦੇ ਸਹਿਯੋਗ ਅਤੇ NVIDIA ਦੇ NeMo ਫਰੇਮਵਰਕ ਦੀ ਵਰਤੋਂ ਕਰਕੇ ਬਣਾਏ ਗਏ ਹਨ। ਇਨ੍ਹਾਂ ਵਿੱਚ ਸ਼ਾਮਲ ਹਨ:
- Indic-Transcribe: ਆਟੋਮੈਟਿਕ ਸਪੀਚ ਰਿਕੋਗਨੀਸ਼ਨ ਲਈ।
- Indic-Speak: ਟੈਕਸਟ-ਟੂ-ਸਪੀਚ ਫੀਚਰ।
- Indic-Translate: ਮਸ਼ੀਨ ਅਨੁਵਾਦ ਲਈ।
- Indic-OCR: ਆਪਟੀਕਲ ਕਰੈਕਟਰ ਰਿਕੋਗਨੀਸ਼ਨ।
ਇਨ੍ਹਾਂ 'Open-Weight' ਮਾਡਲਾਂ ਨਾਲ ਹੁਣ ਛੋਟੀਆਂ ਕੰਪਨੀਆਂ ਨੂੰ ਆਪਣੀ ਤਕਨਾਲੋਜੀ ਸ਼ੁਰੂ ਤੋਂ ਬਣਾਉਣ ਦੀ ਲੋੜ ਨਹੀਂ ਪਵੇਗੀ, ਜਿਸ ਨਾਲ ਡਿਜੀਟਲ ਸਿੱਖਿਆ ਦੀ ਪਹੁੰਚ ਪੇਂਡੂ ਅਤੇ ਅਰਧ-ਸ਼ਹਿਰੀ ਇਲਾਕਿਆਂ ਤੱਕ ਵਧੇਗੀ।
ਚੁਣੌਤੀਆਂ ਅਤੇ ਸਾਵਧਾਨੀ
ਹਾਲਾਂਕਿ ਇਹ ਇੱਕ ਵੱਡੀ ਸਫਲਤਾ ਹੈ, ਪਰ ਮਾਹਿਰਾਂ ਨੇ ਚੇਤਾਵਨੀ ਦਿੱਤੀ ਹੈ ਕਿ AI ਦੁਆਰਾ ਤਿਆਰ ਕੀਤੀ ਜਾਣਕਾਰੀ ਵਿੱਚ ਗਲਤੀਆਂ (Hallucinations) ਜਾਂ ਪੱਖਪਾਤ ਹੋ ਸਕਦਾ ਹੈ। ਇਸ ਲਈ ਵਿਦਿਅਕ ਖੇਤਰ ਵਿੱਚ ਅਧਿਆਪਕਾਂ ਦੀ ਨਿਗਰਾਨੀ ਬਹੁਤ ਜ਼ਰੂਰੀ ਹੈ। ਨਾਲ ਹੀ, Bodhan AI ਦੀ ਲੰਬੇ ਸਮੇਂ ਦੀ ਸਫਲਤਾ ਸਰਕਾਰੀ ਫੰਡਿੰਗ ਅਤੇ ਲਗਾਤਾਰ ਡਾਟਾ ਅਪਡੇਟਸ 'ਤੇ ਨਿਰਭਰ ਕਰੇਗੀ।
