Amazon ची AI ट्रेनिंग पद्धत वादग्रस्त! दुर्मिळ पुस्तके नष्ट करण्याचा आरोप.

TECHNOLOGY
Whalesbook Logo
AuthorPriya Kulkarni|Published at:
Amazon ची AI ट्रेनिंग पद्धत वादग्रस्त! दुर्मिळ पुस्तके नष्ट करण्याचा आरोप.

Amazon आता आर्टिफिशियल इंटेलिजन्स (AI) मॉडेलसाठी दुर्मिळ आणि जुनी पुस्तके वापरत आहे. यासाठी पुस्तकांचे पृष्ठभाग (Spines) काढून स्कॅन केले जात आहे, ज्यामुळे ती पुस्तके नष्ट होत आहेत. या प्रॅक्टिसमुळे बौद्धिक संपदा (Intellectual Property) आणि कंपनीच्या प्रतिमेवर (Reputation) प्रश्नचिन्ह निर्माण झाले आहे.

Amazon ची AI साठी पुस्तके नष्ट करण्याची पद्धत

Amazon आता आपल्या आर्टिफिशियल इंटेलिजन्स (AI) मॉडेल्सना अधिक चांगलं बनवण्यासाठी दुर्मिळ आणि बाजारात उपलब्ध नसलेली पुस्तके वापरत आहे. या पुस्तकांना Amazon च्या लास वेगासमधील एका फॅसिलिटीमध्ये, ज्याला VGT3 म्हणून ओळखले जाते, तिथे पाठवले जात आहे. तिथे या पुस्तकांचे पृष्ठभाग (Spines) काढून टाकले जातात, जेणेकरून त्यांना हाय-स्पीड स्कॅनरने स्कॅन करता येईल. या प्रक्रियेत ती मूळ पुस्तके अक्षरशः नष्ट होतात.

हाय-क्वालिटी डेटाची गरज

सध्या टेक्नॉलॉजी क्षेत्रात जास्त अचूक आणि सक्षम Large Language Models (LLMs) तयार करण्याची मोठी स्पर्धा लागली आहे. AI मॉडेल्ससाठी एक मोठी समस्या म्हणजे इंटरनेटवर AI ने तयार केलेल्या कंटेटचे वाढते प्रमाण. जेव्हा AI मॉडेल्सना AI-जनरेटेड डेटावर ट्रेनिंग दिले जाते, तेव्हा त्यांची कार्यक्षमता कालांतराने कमी होऊ शकते, याला 'मॉडल कोलॅप्स' म्हणतात. हे टाळण्यासाठी, टेक कंपन्या मानवांनी लिहिलेला, २००२ पूर्वीचा आणि डिजिटल फॉरमॅटमध्ये सहज उपलब्ध नसलेला उच्च-गुणवत्तेचा मजकूर शोधत आहेत. दुर्मिळ पुस्तके यासाठी लक्ष्य बनली आहेत कारण ती मानवी लेखनाचा अनोखा डेटासेट देतात.

बिझनेस आणि इमेजचे धोके

Amazon ने म्हटले आहे की ते आपल्या उत्पादने आणि सेवा सुधारण्यासाठी व्यावसायिक मार्गाने पुस्तके खरेदी करतात. मात्र, प्रत्यक्ष पुस्तके नष्ट करण्याच्या पद्धतीमुळे अनेक प्रश्न निर्माण झाले आहेत. गुंतवणूकदारांसाठी, ही कृती अनेक चिंतेचे क्षेत्र दर्शवते. पहिले म्हणजे, कंपनीच्या प्रतिष्ठेला (Reputation) धक्का लागण्याचा धोका आहे. कॉर्पोरेट AI मॉडेल्सना प्रशिक्षण देण्यासाठी ऐतिहासिक किंवा दुर्मिळ ग्रंथ नष्ट करण्याच्या सार्वजनिक कल्पनेमुळे बौद्धिक चोरी किंवा सांस्कृतिक वारसाकडे दुर्लक्ष केल्याचा आरोप होऊ शकतो.

दुसरे म्हणजे, बौद्धिक संपदा (Intellectual Property) आणि कॉपीराइटचा (Copyright) मुद्दा ऐरणीवर आहे. काही टेक कंपन्या असा युक्तिवाद करतात की AI ट्रेनिंगसाठी कंटेट डिजिटाइज करणे हे 'फेअर यूज' अंतर्गत येते, परंतु कॉपीराइटेड मटेरियलच्या वापरासंबंधी कायदेशीर आव्हानं संपूर्ण AI क्षेत्रासाठी एक मोठा धोका आहेत. जर न्यायालये किंवा नियामकांनी (Regulators) ही प्रथा कॉपीराइट कायद्यांचे उल्लंघन असल्याचे ठरवले, तर यामुळे महागडी कायदेशीर कारवाई, ट्रेनिंग पद्धतीत बदल किंवा आर्थिक दंड होऊ शकतो.

शेवटी, AI मॉडेल्सना स्पर्धेत टिकवून ठेवण्यासाठी कंपन्यांवर असलेल्या प्रचंड खर्च आणि संसाधनांचा दबाव यातून दिसून येतो. कंपन्या पायाभूत सुविधा आणि डेटावर मोठ्या प्रमाणात खर्च करत असल्याने, गुंतवणूकदारांनी संभाव्य नियामक अपडेट्सवर लक्ष ठेवावे. जगभरातील सरकारे AI मॉडेल्सना कसे प्रशिक्षित केले जाते आणि त्यांचा डेटा कुठून येतो यावर अधिकाधिक लक्ष केंद्रित करत आहेत. AI डेटा नियमनामध्ये किंवा कॉपीराइट कायद्यांमध्ये कोणताही अचानक बदल झाल्यास Amazon आणि त्याच्या प्रतिस्पर्धकांना त्यांच्या धोरणांमध्ये बदल करावे लागू शकतात, ज्यामुळे AI उत्पादने लॉन्च करण्याच्या त्यांच्या टाइमलाइनवर परिणाम होऊ शकतो किंवा त्यांचा कायदेशीर आणि अनुपालन खर्च वाढू शकतो. शेअरधारकांसाठी मुख्य गोष्ट म्हणजे, या डेटा संकलन पद्धतींमुळे लक्षणीय सरकारी हस्तक्षेप होतो का, किंवा यामुळे मोठे कायदेशीर वाद निर्माण होतात का, ज्याचा कंपनीच्या AI रोडमॅपवर परिणाम होऊ शकतो.

Disclaimer: This article is published for informational purposes only. This is not a buy sell recommendation.