Anthropic ના Claude AI પ્લેટફોર્મ પર એક મોટી સુરક્ષા ચિંતા સામે આવી છે. યુઝર્સની ચેટ અને 'Artifacts' (પ્રોજેક્ટ ફાઇલ્સ) Google Searchમાં ઇન્ડેક્સ થઇ ગયા છે, જેના કારણે સંવેદનશીલ માહિતી જાહેર થઇ શકે છે. આમાં ખાનગી કંપનીના દસ્તાવેજો અને હેલ્થ રેકોર્ડ્સ પણ સામેલ હોવાનું કહેવાય છે.
Detailed Coverage
શું છે આખી ઘટના?
Anthropic ના Claude AI માં એક ગંભીર પ્રાઈવસી ઇસ્યુ સામે આવ્યો છે. મોટી સંખ્યામાં યુઝર્સની વાતચીતો અને 'Artifacts', જે પ્લેટફોર્મના કોલબોરેટિવ પ્રોજેક્ટ ફાઇલ્સ છે, તે Google Search પર ઇન્ડેક્સ થઇ ગયા છે. આના કારણે જે ડેટા ખાનગી રહેવો જોઈતો હતો, તે જાહેરમાં સર્ચ કરી શકાય છે.
ડેટા લીકનું કારણ શું?
આ સમસ્યા Claude ના 'share chat' ફીચરને કારણે થઇ છે. આ ફીચર યુઝર્સને તેમની વાતચીતોની વ્યૂ-ઓન્લી (view-only) લિંક્સ જનરેટ કરવાની સુવિધા આપે છે. Anthropic નું કહેવું છે કે આ લિંક્સ માત્ર ત્યારે જ શેર થાય છે જ્યારે યુઝર જાતે શેર કરે. પરંતુ, એવું લાગે છે કે જ્યારે યુઝર્સે આ લિંક્સને પબ્લિક ફોરમ કે સોશિયલ મીડિયા પર પોસ્ટ કરી, ત્યારે સર્ચ એન્જિન ક્રોલર્સે (search engine crawlers) તેમને શોધી કાઢ્યા અને ઇન્ડેક્સ કરી દીધા. એકવાર ઇન્ડેક્સ થયા પછી, કોઈપણ વ્યક્તિ ચોક્કસ ક્વેરી ઓપરેટર્સ (query operators) નો ઉપયોગ કરીને આ ચેટ્સને સર્ચ કરી શકે છે. ખાસ વાત એ છે કે એન્ટરપ્રાઇઝ પ્લેટફોર્મ્સ (enterprise platforms) થી વિપરીત, જ્યાં ઇન્ડેક્સિંગ પર પ્રતિબંધ હોય છે, આ શેર કરેલી લિંક્સ કોઈપણ ઓથેન્ટિકેશન (authentication) વગર ઉપલબ્ધ હતી.
કેટલી સંવેદનશીલ માહિતી લીક થઇ?
રિપોર્ટ્સ અનુસાર, લીક થયેલા ડેટામાં ખૂબ જ સંવેદનશીલ માહિતી શામેલ હતી. આમાં પર્સનલ હેલ્થ રેકોર્ડ્સ (personal health records), પેશન્ટ આઇડેન્ટિફાયર્સ (patient identifiers) સાથેના ક્લિનિકલ ટ્રાયલ પરિણામો, આંતરિક કંપની સ્ટ્રેટેજી ડોક્યુમેન્ટ્સ (internal company strategy documents) અને કર્મચારીઓની સમીક્ષાઓ (employee reviews) નો સમાવેશ થાય છે. આવી માહિતીના લીક થવાથી પ્રશ્ન ઉભો થાય છે કે યુઝર્સ AI નો ઉપયોગ કરતી વખતે પ્રાઈવસી સેટિંગ્સનું સંચાલન કેવી રીતે કરે છે. આ ઉપરાંત, ઇન્ડેક્સ થયેલા 'Artifacts' માં કોડ અને વર્ક નોટ્સની હાજરી સૂચવે છે કે Claude નો ઉપયોગ આંતરિક વિકાસ (internal development) માટે કરતી કંપનીઓ પણ આ લીકથી પ્રભાવિત થઈ છે.
Anthropic અને Google શું કહે છે?
Anthropic એ સ્પષ્ટ કર્યું છે કે તેઓ સર્ચ એન્જિનોને આ ચેટ સેશન્સની ડિરેક્ટરીઓ કે સાઇટમેપ્સ (sitemaps) પ્રદાન કરતા નથી. કંપની અનુસાર, શેર કરેલી લિંક્સનો અનુમાન લગાવવું શક્ય નથી અને તે માત્ર ત્યારે જ સર્ચ પરિણામોમાં દેખાય છે જો યુઝર્સ દ્વારા જાતે જ તેને પબ્લિક કરવામાં આવી હોય. બીજી તરફ, Google એ પુનરોચ્ચાર કર્યો છે કે સર્ચ એન્જિનો માત્ર તે જ કન્ટેન્ટ ઇન્ડેક્સ કરે છે જે જાહેરમાં ઉપલબ્ધ હોય, અને સાઇટ માલિકોની જવાબદારી છે કે તેઓ તેમની સાઇટ્સ ક્રોલ (crawl) થાય તે કેવી રીતે નિયંત્રિત કરે. AI ઇન્ટરેક્શન્સના ઇન્ડેક્સિંગ સંબંધિત આવી સુરક્ષા સમસ્યાઓ ઉદ્યોગમાં નવી નથી અને ભૂતકાળમાં અન્ય જનરેટિવ AI પ્લેટફોર્મ્સ સાથે પણ આવા કિસ્સા નોંધાયા છે.
યુઝર્સ માટે શું છે શીખ?
યુઝર્સ અને એન્ટરપ્રાઇઝ ક્લાયન્ટ્સ માટે, આ ઘટના એક યાદ અપાવે છે કે AI દ્વારા જનરેટ કરાયેલ કન્ટેન્ટની લિંક્સ શેર કરતી વખતે સાવચેત રહેવું જોઈએ. યુઝર્સ માટે મુખ્ય મોનિટર (monitor) તેમની શેર કરેલી લિંક્સની પ્રાઈવસી સેટિંગ્સ જ છે. પ્લેટફોર્મ માહિતી શેર કરવાની મંજૂરી આપે છે, પરંતુ જો આ લિંક્સ એવા વાતાવરણમાં પોસ્ટ કરવામાં આવે જ્યાં સર્ચ એન્જિન તેમને ટ્રેક કરી શકે, તો અનિચ્છનીય અને વ્યાપક એક્સપોઝરનું જોખમ રહેલું છે. ભવિષ્યમાં પ્લેટફોર્મના પ્રાઈવસી કંટ્રોલ્સ (privacy controls) અથવા ઇન્ડેક્સિંગ પ્રતિબંધોમાં થનારા અપડેટ્સ એ જોવામાં મુખ્ય વિકાસ રહેશે કે Anthropic કેવી રીતે સહજ સહયોગ (ease of collaboration) અને ડેટા સુરક્ષા (data security) વચ્ચે સંતુલન જાળવે છે.
