IISc નો કમાલ! 65 ભારતીય ભાષાઓ માટે લોન્ચ કર્યું સ્પીચ AI મોડેલ 'SraVaani'

TECHNOLOGY
Whalesbook Logo
AuthorArnav Chakraborty|Published at:
IISc નો કમાલ! 65 ભારતીય ભાષાઓ માટે લોન્ચ કર્યું સ્પીચ AI મોડેલ 'SraVaani'

ભારતીય વિજ્ઞાન સંસ્થા (IISc) એ 'SraVaani' નામનું ઓપન-સોર્સ સ્પીચ AI મોડેલ લોન્ચ કર્યું છે, જે 65 ભાષાઓને સપોર્ટ કરે છે અને 25 કરોડ લોકોને મદદરૂપ થશે. ARTPARK અને Google સાથે મળીને વિકસાવવામાં આવેલ આ ટૂલનો ઉદ્દેશ્ય ભારતીય પ્રાદેશિક બોલીઓ માટે AIની પહોંચને વિસ્તૃત કરવાનો છે.

IISc એ લોન્ચ કર્યું SraVaani

ભારતીય વિજ્ઞાન સંસ્થા (IISc) એ આર્ટિફિશિયલ ઇન્ટેલિજન્સ (AI) ક્ષેત્રે એક મહત્વપૂર્ણ પગલું ભર્યું છે. સંસ્થાએ 'SraVaani' નામનું એક નવું સ્પીચ રેકગ્નિશન AI મોડેલ લોન્ચ કર્યું છે, જે ભારતીય ભાષાઓ વચ્ચેના અંતરને ઘટાડવાનું કામ કરશે.

આ મોડેલ IISc ની SPIRE Lab દ્વારા ARTPARK અને Google ના સહયોગથી વિકસાવવામાં આવ્યું છે. SraVaani 65 જુદી જુદી ભારતીય ભાષાઓ અને બોલીઓને સમજવા માટે સક્ષમ છે.

કોને થશે ફાયદો?

આ લોન્ચનો મુખ્ય ઉદ્દેશ્ય એવા 25 કરોડથી વધુ લોકોની જરૂરિયાતો પૂરી કરવાનો છે જેમની સ્થાનિક ભાષાઓને વૈશ્વિક AI મોડેલોમાં ઓછું પ્રતિનિધિત્વ મળ્યું છે. જ્યારે મોટાભાગની સ્પીચ ટેકનોલોજી ફક્ત મુખ્ય ભાષાઓ પર ધ્યાન કેન્દ્રિત કરે છે, ત્યારે SraVaani માં 20 શેડ્યૂલ્ડ અને 45 અન્ય પ્રાદેશિક ભાષાઓનો સમાવેશ થાય છે.

Hugging Face પ્લેટફોર્મ પર આ મોડેલને ઓપન-સોર્સ તરીકે ઉપલબ્ધ કરાવીને, IISc ડેવલપર્સ અને સ્ટાર્ટઅપ્સને MIT લાઇસન્સ હેઠળ તેનો મફતમાં ઉપયોગ કરવાની મંજૂરી આપે છે. આનાથી સ્થાનિક ભારતીય એપ્લિકેશન્સ બનાવવા માટે કંપનીઓનો ખર્ચ અને ટેકનિકલ અવરોધો ઘટશે.

ટેકનિકલ પાસાઓ અને પ્રદર્શન

SraVaani, 'Vaani' ડેટાસેટ પર આધારિત છે. આ એક વિશાળ પ્રોજેક્ટ છે જેમાં ભારતના 165 જિલ્લાઓમાં 156,000 થી વધુ લોકોના 31,000 કલાકથી વધુના વાસ્તવિક ભાષણનો ડેટા એકત્રિત કરવામાં આવ્યો હતો. આ ડેટાનો ઉદ્દેશ્ય કુદરતી, રોજિંદા ઉપયોગમાં લેવાતી બોલીઓને કેપ્ચર કરવાનો હતો.

આ તાલીમ ડેટાને કારણે, SraVaani ઓછી વપરાતી ભાષાઓ પર હાલની સિસ્ટમ્સ કરતાં નોંધપાત્ર રીતે વધુ સારું પ્રદર્શન કરે છે. ઉદાહરણ તરીકે, Garo ભાષા પરના પરીક્ષણોમાં, SraVaani એ 9.5% નો વર્ડ એરર રેટ (Word Error Rate) પ્રાપ્ત કર્યો, જે અન્ય સિસ્ટમોની સરખામણીમાં મોટી સુધારો દર્શાવે છે, જે ઘણીવાર પ્રાદેશિક બોલીઓમાં ઊંચા એરર રેટ સાથે સંઘર્ષ કરે છે.

ભારતીય AI ઇકોસિસ્ટમ પર અસર

ભારતીય ટેકનોલોજી ક્ષેત્ર માટે, SraVaani નું લોન્ચ 'Sovereign AI' બનાવવા તરફનું એક પગલું છે - જ્યાં ટેકનોલોજી સ્થાનિક જરૂરિયાતો માટે બનાવવામાં આવે છે, વૈશ્વિક મોડેલો પર આધાર રાખવાને બદલે જે પ્રાદેશિક સૂક્ષ્મતાને સમજી શકતા નથી.

ઓટોમેટેડ લેંગ્વેજ આઇડેન્ટિફિકેશન (Automated Language Identification) પ્રદાન કરીને, SraVaani ડેવલપર્સને વધુ ટેકનિકલ કુશળતા વિના વૉઇસ ફીચર્સને એપ્સમાં એકીકૃત કરવામાં મદદ કરે છે. આ બેંકિંગ, ઇ-ગવર્નન્સ અને ઇ-કોમર્સ જેવા ક્ષેત્રો માટે ખૂબ મૂલ્યવાન છે, જ્યાં વપરાશકર્તાઓને તેમની માતૃભાષામાં પહોંચવું એ મુખ્ય વૃદ્ધિ વ્યૂહરચના છે.

મોનિટર કરવાના પડકારો

જોકે મોડેલ આશાસ્પદ લાગે છે, ટેકનોલોજી નિષ્ણાતો જણાવે છે કે 65 જેટલી વિવિધ ભાષાઓમાં ઉચ્ચ ચોકસાઈ જાળવવી એ એક જટિલ પડકાર રહે છે. વાસ્તવિક દુનિયાની પરિસ્થિતિઓ, જેમ કે ઘોંઘાટવાળા વાતાવરણમાં પૃષ્ઠભૂમિ અવાજ (Background Noise) અથવા વિવિધ ઉચ્ચારો, હજુ પણ સ્પીચ રેકગ્નિશન ટૂલ્સના પ્રદર્શનને અસર કરી શકે છે.

જેમ જેમ કંપનીઓ અને ડેવલપર્સ SraVaani નું વ્યાપારી એપ્લિકેશન્સમાં પરીક્ષણ કરવાનું શરૂ કરશે, તેમ તેમ વિવિધ વસ્તી વિષયક (Demographics) અને ઑડિઓ વાતાવરણમાં મોડેલની સુસંગતતા તેના વ્યાપકપણે અપનાવવા માટે મુખ્ય પરિબળ બનશે. રોકાણકારો અને ઉદ્યોગના સહભાગીઓ આગામી મહિનાઓમાં સ્થાનિક ભાષાઓ પર કેન્દ્રિત ડિજિટલ સેવાઓના વિકાસના ખર્ચને આ ઓપન-સોર્સ ટૂલ કેવી રીતે પ્રભાવિત કરે છે તે જોઈ શકે છે.

Disclaimer: This article is published for informational purposes only. This is not a buy sell recommendation.