ਖੋਜਕਰਤਾਵਾਂ ਨੇ Anthropic ਦੇ Claude AI ਦੇ ਪੁਰਾਣੇ ਵਰਜਨਾਂ ਵਿੱਚ ਸੁਰੱਖਿਆ ਨੂੰ ਬਾਈਪਾਸ ਕਰਨ ਦਾ ਤਰੀਕਾ ਲੱਭ ਲਿਆ ਹੈ, ਜਿਸ ਨਾਲ ਅਸ਼ਲੀਲ ਸਮੱਗਰੀ ਤਿਆਰ ਹੋ ਸਕਦੀ ਹੈ। ਇਹ ਕਮਜ਼ੋਰੀ ਅਜਿਹੇ ਸਮੇਂ ਸਾਹਮਣੇ ਆਈ ਹੈ ਜਦੋਂ AI ਡਿਵੈਲਪਰ ਨੇ ਹਾਲ ਹੀ ਵਿੱਚ ਇੱਕ ਗੁਪਤ IPO ਫਾਈਲ ਕੀਤਾ ਹੈ।
Claude AI ਦੀ ਸੁਰੱਖਿਆ 'ਤੇ ਸਵਾਲੀਆ ਨਿਸ਼ਾਨ
ਤਾਜ਼ਾ ਜਾਂਚ ਵਿੱਚ ਸਾਹਮਣੇ ਆਇਆ ਹੈ ਕਿ Anthropic ਦੇ Claude AI ਦੇ ਪੁਰਾਣੇ ਵਰਜਨ, ਖਾਸ ਕਰਕੇ Opus 4.6 ਅਤੇ Haiku 4.5 ਮਾਡਲ, 'ਜੇਲਬ੍ਰੇਕ' ਤਕਨੀਕਾਂ ਪ੍ਰਤੀ ਕਮਜ਼ੋਰ ਹਨ। ਖੋਜਕਰਤਾਵਾਂ ਨੇ ਪਾਇਆ ਹੈ ਕਿ ਇੱਕ ਖਾਸ ਗੱਲਬਾਤ ਤਕਨੀਕ ਰਾਹੀਂ AI ਨੂੰ ਅਜਿਹੀ ਸਮੱਗਰੀ ਤਿਆਰ ਕਰਨ ਲਈ ਮਜਬੂਰ ਕੀਤਾ ਜਾ ਸਕਦਾ ਹੈ ਜੋ ਨਿਯਮਾਂ ਦੇ ਖਿਲਾਫ ਹੈ। ਇਹ ਕੋਈ ਪਹਿਲੀ ਘਟਨਾ ਨਹੀਂ ਹੈ, ਪਰ ਜਨਰੇਟਿਵ AI ਕੰਪਨੀਆਂ ਲਈ ਇਹ ਇੱਕ ਲਗਾਤਾਰ ਚੁਣੌਤੀ ਬਣੀ ਹੋਈ ਹੈ ਕਿ ਉਹ ਮਾਡਲ ਦੀ ਸਿਰਜਣਾਤਮਕਤਾ ਅਤੇ ਸਖਤ ਸਮੱਗਰੀ ਮਾਪਦੰਡਾਂ ਵਿਚਕਾਰ ਸੰਤੁਲਨ ਕਿਵੇਂ ਬਣਾਉਣ।
ਪੁਰਾਣੇ ਮਾਡਲ ਅਜੇ ਵੀ ਹਨ ਵਰਤੋਂ ਵਿੱਚ
ਭਾਵੇਂ Opus 4.6 ਅਤੇ Haiku 4.5 ਪੁਰਾਣੇ ਵਰਜਨ ਹਨ, ਪਰ ਇਹ ਅਜੇ ਵੀ Amazon Bedrock ਅਤੇ Azure Foundry ਵਰਗੇ ਪਲੇਟਫਾਰਮਾਂ ਰਾਹੀਂ ਕਾਰੋਬਾਰਾਂ ਅਤੇ ਡਿਵੈਲਪਰਾਂ ਲਈ ਆਸਾਨੀ ਨਾਲ ਉਪਲਬਧ ਹਨ। ਅੰਕੜੇ ਦੱਸਦੇ ਹਨ ਕਿ ਇਨ੍ਹਾਂ ਮਾਡਲਾਂ 'ਤੇ ਰੋਜ਼ਾਨਾ ਲੱਖਾਂ API ਬੇਨਤੀਆਂ ਆ ਰਹੀਆਂ ਹਨ। AI ਮਾਡਲਾਂ ਦੀ ਸੁਰੱਖਿਆ ਅਤੇ ਨੈਤਿਕ ਮਾਪਦੰਡਾਂ 'ਤੇ ਵਧਦੇ ਸਰਕਾਰੀ ਧਿਆਨ ਦੇ ਮੱਦੇਨਜ਼ਰ, ਇਹ ਕਮਜ਼ੋਰੀਆਂ ਹੋਰ ਵੀ ਸੰਵੇਦਨਸ਼ੀਲ ਬਣ ਜਾਂਦੀਆਂ ਹਨ।
IPO ਦੀ ਤਿਆਰੀ ਅਤੇ ਨਿਵੇਸ਼ਕਾਂ ਦੀ ਨਜ਼ਰ
Anthropic ਇਸ ਸਮੇਂ ਇੱਕ ਨਾਜ਼ੁਕ ਮੋੜ 'ਤੇ ਹੈ। ਕੰਪਨੀ, ਜੋ ਕਿ ਪ੍ਰਾਈਵੇਟ ਹੈ, ਨੇ ਹਾਲ ਹੀ ਵਿੱਚ ਅਮਰੀਕੀ ਸਕਿਓਰਿਟੀਜ਼ ਐਂਡ ਐਕਸਚੇਂਜ ਕਮਿਸ਼ਨ (SEC) ਕੋਲ ਇੱਕ ਗੁਪਤ IPO ਫਾਈਲ ਕੀਤਾ ਹੈ। ਲੰਬੇ ਸਮੇਂ ਤੋਂ ਭਾਰੀ ਨਿਵੇਸ਼ ਤੋਂ ਬਾਅਦ, Anthropic ਨੇ ਆਪਣੇ ਸਾਲਾਨਾ ਮਾਲੀਏ (Revenue) ਵਿੱਚ $65 ਬਿਲੀਅਨ ਦਾ ਵਾਧਾ ਦਰਜ ਕੀਤਾ ਹੈ ਅਤੇ ਇਸ ਸਾਲ ਦੀ ਸ਼ੁਰੂਆਤ ਵਿੱਚ ਇਸ ਨੇ ਪਹਿਲੀ ਵਾਰ ਆਪਰੇਟਿੰਗ ਲਾਭ (Profitability) ਹਾਸਲ ਕੀਤਾ ਹੈ।
ਜਦੋਂ ਕਿ ਕੰਪਨੀ ਪਬਲਿਕ ਬਾਜ਼ਾਰ ਵਿੱਚ ਦਾਖਲ ਹੋਣ ਦੀ ਤਿਆਰੀ ਕਰ ਰਹੀ ਹੈ, ਜਿੱਥੇ ਇਸਦਾ ਮੁੱਲਾਂਕਣ (Valuation) ਟ੍ਰਿਲੀਅਨ ਡਾਲਰ ਤੱਕ ਪਹੁੰਚਣ ਦੀ ਉਮੀਦ ਹੈ, 'ਭਰੋਸੇਯੋਗ AI' ਦਾ ਪ੍ਰਬੰਧਨ ਇੱਕ ਮੁੱਖ ਕਾਰੋਬਾਰੀ ਧਾਰਨਾ ਹੈ। ਸੰਸਥਾਗਤ ਨਿਵੇਸ਼ਕ (Institutional Investors) ਅਕਸਰ AI ਕੰਪਨੀਆਂ ਦੀ ਸਿਰਫ ਵਿਕਾਸ ਅਤੇ ਮੁਨਾਫੇ ਕਰਕੇ ਹੀ ਨਹੀਂ, ਬਲਕਿ EU AI Act ਅਤੇ ਅਮਰੀਕਾ ਦੇ ਰਾਜਾਂ ਦੁਆਰਾ ਨਿਰਧਾਰਿਤ ਉਮਰ-ਅਨੁਕੂਲ ਸਮੱਗਰੀ ਸੰਬੰਧੀ ਨਵੇਂ ਕਾਨੂੰਨਾਂ ਵਰਗੇ ਢਾਂਚਿਆਂ ਦੀ ਪਾਲਣਾ ਕਰਨ ਦੀ ਸਮਰੱਥਾ ਕਰਕੇ ਵੀ ਜਾਂਚ ਕਰਦੇ ਹਨ। ਆਸਾਨੀ ਨਾਲ ਸ਼ੋਸ਼ਣ ਯੋਗ ਸੁਰੱਖਿਆ ਖਾਮੀਆਂ ਦੇ ਨਤੀਜੇ ਵਜੋਂ ਰੈਗੂਲੇਟਰੀ ਜੁਰਮਾਨੇ, ਸਾਖ ਨੂੰ ਨੁਕਸਾਨ ਅਤੇ ਪਾਲਣਾ ਲਾਗਤਾਂ ਵਿੱਚ ਵਾਧਾ ਹੋ ਸਕਦਾ ਹੈ, ਜੋ ਕੰਪਨੀ ਦੇ ਲੰਬੇ ਸਮੇਂ ਦੇ ਕਾਰਜਾਤਮਕ ਖਰਚਿਆਂ ਨੂੰ ਪ੍ਰਭਾਵਿਤ ਕਰ ਸਕਦਾ ਹੈ।
ਅੱਗੇ ਕੀ?
Anthropic ਨੇ ਪਹਿਲਾਂ ਵੀ ਸਵੀਕਾਰ ਕੀਤਾ ਹੈ ਕਿ ਜਦੋਂ ਕਿ ਉਹ ਹਰ ਨਵੇਂ ਮਾਡਲ ਦੇ ਨਾਲ ਇਨ੍ਹਾਂ ਕਮਜ਼ੋਰੀਆਂ ਨੂੰ ਠੀਕ ਕਰਦੇ ਰਹਿੰਦੇ ਹਨ, ਜਨਰੇਟਿਵ AI ਦੀ ਪ੍ਰਕਿਰਤੀ ਕਾਰਨ ਉਪਭੋਗਤਾਵਾਂ ਦੁਆਰਾ ਅਣਉਚਿਤ ਜਵਾਬ ਪ੍ਰਾਪਤ ਕਰਨ ਦੇ ਜੋਖਮ ਨੂੰ ਪੂਰੀ ਤਰ੍ਹਾਂ ਖਤਮ ਕਰਨਾ ਮੁਸ਼ਕਲ ਹੈ। ਕੰਪਨੀ ਆਪਣੇ 'Constitutional AI' ਪਹੁੰਚ 'ਤੇ ਧਿਆਨ ਕੇਂਦਰਿਤ ਕਰ ਰਹੀ ਹੈ, ਜਿਸਦਾ ਉਦੇਸ਼ ਮਾਡਲ ਦੇ ਜਵਾਬਾਂ ਨੂੰ ਸੁਰੱਖਿਆ ਸਿਧਾਂਤਾਂ ਦੇ ਇੱਕ ਸਮੂਹ ਨਾਲ ਜੋੜਨਾ ਹੈ। ਭਵਿੱਖ ਵਿੱਚ, ਹਿੱਸੇਦਾਰਾਂ ਲਈ ਮੁੱਖ ਗੱਲ ਇਹ ਹੋਵੇਗੀ ਕਿ ਕੰਪਨੀ ਆਪਣੇ ਸਾਰੇ ਲਾਗੂ ਕੀਤੇ ਮਾਡਲਾਂ ਵਿੱਚ ਕਿੰਨੀ ਮਜ਼ਬੂਤ ਸੁਰੱਖਿਆ ਅਪਡੇਟਾਂ ਨੂੰ ਲਾਗੂ ਕਰਦੀ ਹੈ ਅਤੇ ਸਰਕਾਰੀ ਰੈਗੂਲੇਟਰਾਂ ਅਤੇ ਕਾਰਪੋਰੇਟ ਗਾਹਕਾਂ ਦੋਵਾਂ ਨੂੰ ਸੰਤੁਸ਼ਟ ਕਰਨ ਵਾਲੇ ਪਾਲਣਾ ਮਾਪਦੰਡਾਂ ਨੂੰ ਬਣਾਈ ਰੱਖਣ ਵਿੱਚ ਕਿੰਨੀ ਸਫਲ ਹੁੰਦੀ ਹੈ।
