Amazon આર્ટિફિશિયલ ઇન્ટેલિજન્સ (AI) મોડેલો માટે ડેટા એકત્ર કરવા માટે દુર્લભ અને છપાયેલા પુસ્તકોનો ઉપયોગ કરી રહ્યું છે. કંપની આ પુસ્તકોના સ્પાઇન્સ (રીડની કરોડરજ્જુ) દૂર કરીને સ્કેનિંગ પ્રક્રિયા કરે છે, જેનાથી ભૌતિક નકલોનો નાશ થાય છે. આ પદ્ધતિએ બૌદ્ધિક સંપદા અને પ્રતિષ્ઠાના જોખમો અંગે ચિંતાઓ જગાવી છે.
AI ડેટા માટે દુર્લભ પુસ્તકોનો ઉપયોગ?
Amazon હાલમાં તેના આર્ટિફિશિયલ ઇન્ટેલિજન્સ (AI) મોડેલોને તાલીમ આપવા માટે દુર્લભ અને છપાયેલા પુસ્તકોનો ઉપયોગ કરી રહ્યું છે. પ્રાપ્ત માહિતી અનુસાર, Amazon આ પુસ્તકોને લાસ વેગાસ સ્થિત VGT3 સુવિધામાં મોકલી રહ્યું છે. અહીં, પુસ્તકોની સ્પાઇન (રીડની કરોડરજ્જુ) દૂર કરવામાં આવે છે જેથી હાઇ-સ્પીડ સ્કેનિંગ થઈ શકે. આ પ્રક્રિયામાં ભૌતિક પુસ્તકોનો નાશ થાય છે.
ઉચ્ચ-ગુણવત્તાવાળા ડેટાની જરૂરિયાત
આજકાલ ટેકનોલોજી કંપનીઓ વચ્ચે વધુ સચોટ અને સક્ષમ લાર્જ લેંગ્વેજ મોડેલ્સ (LLMs) બનાવવા માટે ભારે સ્પર્ધા ચાલી રહી છે. AI સિસ્ટમ્સ માટે એક મોટી સમસ્યા એ છે કે ઇન્ટરનેટ પર AI દ્વારા જનરેટ થયેલી સામગ્રી વધી રહી છે. જો AI મોડેલોને મશીન-જનરેટેડ ડેટા પર તાલીમ આપવામાં આવે, તો સમય જતાં તેમનું પ્રદર્શન ઘટી શકે છે. આને ટાળવા માટે, ટેક કંપનીઓ ખાસ કરીને 2022 પહેલાં પ્રકાશિત થયેલ, માનવ-લેખિત ઉચ્ચ-ગુણવત્તાવાળા ટેક્સ્ટ શોધી રહી છે જે ડિજિટલ ફોર્મેટમાં સરળતાથી ઉપલબ્ધ નથી. દુર્લભ પુસ્તકો આ હેતુ માટે એક લક્ષ્ય બન્યા છે કારણ કે તે અનન્ય, માનવ-લેખિત ડેટાસેટ્સ પ્રદાન કરે છે.
વ્યવસાય અને પ્રતિષ્ઠા સંબંધિત જોખમો
Amazon એ મીડિયાને જણાવ્યું છે કે તેઓ તેમના ઉત્પાદનો અને સેવાઓને વિકસાવવા અને સુધારવા માટે વ્યવસાયિક ચેનલો દ્વારા પુસ્તકો મેળવે છે. જોકે, ભૌતિક વિનાશની આ પદ્ધતિએ ઘણા પ્રશ્નો ઉભા કર્યા છે. રોકાણકારો માટે, આ પ્રવૃત્તિ ચિંતાના અનેક ક્ષેત્રોને ઉજાગર કરે છે. પ્રથમ, પ્રતિષ્ઠાને નુકસાન થવાનું જોખમ છે. કોર્પોરેટ AI મોડેલોને ફીડ કરવા માટે ઐતિહાસિક અથવા દુર્લભ ગ્રંથોનો નાશ કરવાની જાહેર ધારણા નકારાત્મક હોઈ શકે છે, જેનાથી બૌદ્ધિક ચાંચિયાગીરી અથવા સાંસ્કૃતિક વારસાની અવગણનાના આરોપો લાગી શકે છે.
બીજું, બૌદ્ધિક સંપદા અને કોપીરાઈટનો મુદ્દો પણ છે. જ્યારે કેટલીક ટેક ફર્મ્સ દલીલ કરે છે કે AI તાલીમ માટે સામગ્રીનું ડિજિટાઇઝેશન 'ફેર યુઝ' (Fair Use) હેઠળ આવે છે, ત્યારે કોપીરાઈટ સામગ્રીના ઉપયોગ અંગે કાનૂની પડકારો સમગ્ર AI ક્ષેત્ર માટે નોંધપાત્ર જોખમ ઊભું કરે છે. જો કોર્ટ અથવા નિયમનકારો નક્કી કરે કે આ પ્રથા કોપીરાઈટ કાયદાઓનું ઉલ્લંઘન કરે છે, તો તેના પરિણામે ખર્ચાળ મુકદ્દમા, તાલીમ પદ્ધતિઓમાં ફેરફાર અથવા નાણાકીય દંડ થઈ શકે છે.
આખરે, આ પગલું કંપનીઓ પર તેમના AI મોડેલોને સ્પર્ધાત્મક રાખવા માટેના ભારે ખર્ચ અને સંસાધનોના દબાણને રેખાંકિત કરે છે. જેમ જેમ ફર્મ્સ ઇન્ફ્રાસ્ટ્રક્ચર અને ડેટા પર ભારે ખર્ચ કરે છે, રોકાણકારોએ સંભવિત નિયમનકારી અપડેટ્સ પર નજર રાખવી જોઈએ. વિશ્વભરની સરકારો AI મોડેલોને કેવી રીતે તાલીમ આપવામાં આવે છે અને તેમના ડેટા ક્યાંથી આવે છે તેના પર વધુ ધ્યાન કેન્દ્રિત કરી રહી છે. AI ડેટા નિયમન અથવા કોપીરાઈટ કાયદાઓમાં કોઈપણ અચાનક ફેરફાર Amazon અને તેના સ્પર્ધકોને તેમની વ્યૂહરચના બદલવાની ફરજ પાડી શકે છે, જે સંભવિતપણે AI ઉત્પાદન લોન્ચના તેમના સમયપત્રકને અસર કરી શકે છે અથવા તેમના કાનૂની અને અનુપાલન ખર્ચમાં વધારો કરી શકે છે. શેરધારકો માટે મુખ્ય નિરીક્ષણ એ રહેશે કે શું આ ડેટા-સંગ્રહ પ્રથાઓ અર્થપૂર્ણ સરકારી હસ્તક્ષેપ આકર્ષિત કરે છે કે કેમ અથવા નોંધપાત્ર કાનૂની વિવાદો તરફ દોરી જાય છે જે કંપનીના વ્યાપક AI રોડમેપને અસર કરી શકે છે.
