IIT Madras દ્વારા ઇન્ક્યુબેટેડ Bodhan AI એ ભારતીય ભાષાઓને સમર્થન આપવા માટે 4 નવા ફાઉન્ડેશનલ AI મોડેલ્સ રજૂ કર્યા છે. 'Bharat EduAI Stack' નો ભાગ એવા આ મોડેલ્સ એડટેક કંપનીઓ અને સ્ટાર્ટઅપ્સ માટે ડિજિટલ પબ્લિક ગુડ્સ તરીકે કામ કરશે.
ભારતીય ભાષાઓ માટે નવી ટેક ક્રાંતિ
IIT Madras ના 'સેન્ટર ઓફ એક્સિલન્સ ઇન AI ફોર એજ્યુકેશન' Bodhan AI એ ખાસ ભારતીય ભાષાઓ માટે 4 પાવરફુલ ઓપન-વેઇટ મોડેલ્સ લોન્ચ કર્યા છે. 'Bharat EduAI Stack' હેઠળ આવેલી આ પહેલનો મુખ્ય હેતુ એડ્યુકેશન સેક્ટરમાંથી મોંઘી અને ઇંગ્લિશ-કેન્દ્રિત AI સિસ્ટમ પરની નિર્ભરતા ઘટાડવાનો છે.
આ મોડેલ્સ શું કામ કરશે?
આ પ્રોજેક્ટ AI4Bharat ના સહયોગથી અને NVIDIA ના NeMo ફ્રેમવર્ક પર તૈયાર કરવામાં આવ્યો છે. તેમાં મુખ્યત્વે:
- Indic-Transcribe: ઓટોમેટિક સ્પીચ રેકગ્નિશન માટે.
- Indic-Speak: ટેક્સ્ટ-ટુ-સ્પીચ માટે.
- Indic-Translate: મશીન ટ્રાન્સલેશન માટે.
- Indic-OCR: ઓપ્ટિકલ કેરેક્ટર રેકગ્નિશન માટે.
આ મોડેલ્સને ઓપન-વેઇટ રાખવામાં આવ્યા હોવાથી, સ્થાનિક સ્ટાર્ટઅપ્સ હવે શૂન્યથી શરૂઆત કર્યા વગર પોતાની જરૂરિયાત મુજબ તેને ફાઇન-ટ્યુન કરી શકશે.
આર્થિક ફાયદા અને પડકારો
આ મોડેલ્સ 'ડિજિટલ પબ્લિક ગુડ્સ' તરીકે ઉપલબ્ધ હોવાથી, નાના સ્ટાર્ટઅપ્સ માટે એન્ટ્રી બેરિયર ઘટશે. જોકે, શિક્ષણ જેવા સંવેદનશીલ ક્ષેત્રમાં AI ના ઉપયોગ સાથે કેટલાક જોખમો પણ જોડાયેલા છે. 'Hallucinations' (ખોટી માહિતી જનરેટ થવી) જેવી સમસ્યાઓને પહોંચી વળવા શિક્ષકોની દેખરેખ અત્યંત જરૂરી છે.
આ પ્રોજેક્ટની સફળતા લાંબા ગાળાના ફંડિંગ અને 20 થી વધુ ભાષાઓમાં સતત ડેટા અપડેટ્સ પર નિર્ભર રહેશે. આ ટેકનોલોજીનો ઉપયોગ કરતા ડેવલપર્સે ડેટા પ્રાઇવસી અને મોડેલની વિશ્વસનીયતા પર ખાસ ધ્યાન આપવું પડશે.
