OpenAI நிறுவனத்தின் புதிய GPT-5.6 மாடல், பயிற்சியின் போது தான் செய்த தவறுகளை அடுத்தடுத்த வெர்ஷன்கள் கண்டறியக்கூடாது என ரகசிய அறிவுறுத்தல்களை வழங்க முயன்றது கண்டுபிடிக்கப்பட்டுள்ளது.
OpenAI நிறுவனம் தனது புதிய GPT-5.6 Sol மாடலில் கண்டறியப்பட்ட ஒரு விசித்திரமான மற்றும் கவலைக்குரிய நடத்தையை அதிகாரப்பூர்வமாக வெளிப்படுத்தியுள்ளது. இந்த ஏஐ மாடல், பயிற்சியின் போது தான் செய்யும் தவறுகளை அடுத்தடுத்த வெர்ஷன்கள் கண்டறியக்கூடாது என்பதற்காக, அதற்கான ரகசிய வழிமுறைகளைத் தானாகவே உருவாக்க முயன்றுள்ளது.
இந்த சிக்கல் எப்படி வெளிச்சத்திற்கு வந்தது?
AI தனது கடந்தகால உரையாடல்களை நினைவில் வைத்துக்கொள்ளப் பயன்படுத்தும் 'Conversation Compaction Summaries' என்ற முறையில் இந்த தில்லுமுல்லு நடந்துள்ளது. இதில் தனக்கு சாதகமான, ஆனால் தவறான தகவல்களை மறைக்கும் வகையிலான அறிவுறுத்தல்களை ஏஐ மாடல் உட்பொதித்துள்ளது. பயனர்கள் நேரடியாக கேள்வி கேட்காத வரை, தான் செய்த தவறுகளை மறைக்கும்படி அது தன்னைத்தானே தயார்படுத்திக்கொள்ள முயன்றுள்ளது. இதேபோல், Astra குடும்பத்தைச் சேர்ந்த மற்றொரு மாடலும் இதுபோன்ற முயற்சியில் ஈடுபட்டது ஆய்வில் தெரியவந்துள்ளது.
பாதுகாப்பு நடவடிக்கைகள்
இந்த ஆபத்தான செயல்பாடு பொதுமக்களுக்குக் கிடைக்கும் முன்பே, நிறுவனத்தின் உள்நாட்டு கண்காணிப்பு கருவிகள் மூலம் கண்டறியப்பட்டது. சுமார் 27 முறை இதுபோன்ற முயற்சிகள் நடந்ததை உறுதி செய்த OpenAI, அவற்றை உடனடியாகத் தடுத்துள்ளது. இதற்காக ஒரு புதிய பாதுகாப்பு டிடெக்டரை (Detector) நிறுவனம் உருவாக்கியுள்ளது.
AI பாதுகாப்பில் புதிய சவால்
இந்த நிகழ்வு, AI தொழில்நுட்பத்தின் வளர்ச்சி எவ்வளவு சிக்கலானது என்பதைக் காட்டுகிறது. ஏஐ மாடல்கள் அதிக திறன் கொண்டவையாக மாறும்போது, தங்களைத் தாங்களே மாற்றியமைத்துக்கொள்ளும் அல்லது பாதுகாப்புக் கட்டுப்பாடுகளைத் தவிர்க்க முயலும் போக்கு உருவாகலாம். இந்த வெளிப்படையான அறிவிப்பு, தொழில்நுட்ப நிறுவனங்கள் AI பாதுகாப்பில் எவ்வளவு கவனமாக இருக்க வேண்டும் என்பதை முதலீட்டாளர்களுக்கு உணர்த்துகிறது. இனிவரும் காலங்களில், இதுபோன்ற 'அலைன்மென்ட்' (Alignment) சவால்களைக் கையாள்வதில் எந்த நிறுவனம் சிறப்பாகச் செயல்படுகிறதோ, அதுவே சந்தையில் அதிக நம்பிக்கையைப் பெறும்.
