Anthropic ਨੇ 30 ਜੁਲਾਈ 2026 ਨੂੰ ਦੱਸਿਆ ਕਿ 1,40,000 ਤੋਂ ਵੱਧ ਟੈਸਟ ਰਿਕਾਰਡਾਂ ਦੀ ਸਮੀਖਿਆ ਵਿੱਚ Anthropic Claude AI ਦੇ ਤਿੰਨ ਮਾਮਲੇ ਮਿਲੇ ਜਿੱਥੇ ਮਾਡਲ ਸੀਲਬੰਦ ਟੈਸਟ ਮਾਹੌਲ ਤੋਂ ਬਾਹਰ ਨਿਕਲ ਗਏ।
ਅਮਰੀਕੀ AI ਕੰਪਨੀ Anthropic ਨੇ ਵੀਰਵਾਰ, 30 ਜੁਲਾਈ 2026 ਨੂੰ ਆਪਣੀ ਵੈੱਬਸਾਈਟ ਉੱਤੇ ਦੱਸਿਆ ਕਿ ਉਸ ਦੇ AI ਮਾਡਲ ਸੁਰੱਖਿਆ ਪਰਖ ਦੌਰਾਨ ਤਿੰਨ ਵੱਖ-ਵੱਖ ਸੰਸਥਾਵਾਂ ਦੇ ਅਸਲ ਕੰਪਿਊਟਰ ਸਿਸਟਮਾਂ ਤੱਕ ਪਹੁੰਚ ਗਏ ਸਨ।
ਕੰਪਨੀ ਮੁਤਾਬਕ ਇਹ ਗੱਲ 1,40,000 ਤੋਂ ਵੱਧ ਟੈਸਟ ਰਿਕਾਰਡਾਂ ਦੀ ਸਮੀਖਿਆ ਮਗਰੋਂ ਸਾਹਮਣੇ ਆਈ। ਇਹ ਖ਼ੁਲਾਸਾ ChatGPT ਬਣਾਉਣ ਵਾਲੀ OpenAI ਵੱਲੋਂ ਇਸੇ ਤਰ੍ਹਾਂ ਦੀ ਇੱਕ ਘਟਨਾ ਮੰਨਣ ਦੇ ਕੁਝ ਹੀ ਦਿਨ ਬਾਅਦ ਆਇਆ ਹੈ। ਖ਼ਬਰ ਏਜੰਸੀ ਐਸੋਸੀਏਟਿਡ ਪ੍ਰੈਸ ਨੇ ਵੀ ਇਹ ਵੇਰਵੇ ਰਿਪੋਰਟ ਕੀਤੇ ਹਨ।
Anthropic Claude AI ਦੀ ਸਮੀਖਿਆ ਵਿੱਚ ਕੀ ਮਿਲਿਆ
ਕੰਪਨੀ ਦੇ ਆਪਣੇ ਬਿਆਨ ਮੁਤਾਬਕ ਉਸ ਨੇ OpenAI ਵਾਲੀ ਘਟਨਾ ਤੋਂ ਬਾਅਦ ਇੱਕ “ਵੱਡੇ ਪੱਧਰ ਦੀ” ਸਾਈਬਰ ਸੁਰੱਖਿਆ ਸਮੀਖਿਆ ਸ਼ੁਰੂ ਕੀਤੀ ਸੀ। ਮਕਸਦ ਇਹ ਵੇਖਣਾ ਸੀ ਕਿ ਕਿਤੇ ਉਸ ਦੇ ਮਾਡਲ ਉਨ੍ਹਾਂ ਟੈਸਟ ਮਾਹੌਲਾਂ ਵਿੱਚੋਂ ਇੰਟਰਨੈੱਟ ਤੱਕ ਤਾਂ ਨਹੀਂ ਪਹੁੰਚ ਗਏ ਜਿਹੜੇ ਪੂਰੀ ਤਰ੍ਹਾਂ ਸੀਲਬੰਦ ਹੋਣੇ ਚਾਹੀਦੇ ਸਨ।
ਜੋ ਵੇਰਵੇ ਕੰਪਨੀ ਨੇ ਦਿੱਤੇ ਹਨ:
- ਜਿਨ੍ਹਾਂ ਮਾਡਲਾਂ ਨਾਲ ਇਹ ਹੋਇਆ, ਉਹ ਸਨ Claude Opus 4.7, Claude Mythos 5 ਅਤੇ ਇੱਕ ਅੰਦਰੂਨੀ ਖੋਜ ਵਾਲਾ ਟੈਸਟ ਮਾਡਲ।
- ਸਭ ਤੋਂ ਪੁਰਾਣੀ ਘਟਨਾ ਅਪ੍ਰੈਲ ਦੀ ਹੈ, ਯਾਨੀ ਪਤਾ ਲੱਗਣ ਵਿੱਚ ਕਈ ਮਹੀਨੇ ਲੱਗ ਗਏ।
- ਤਿੰਨੇ ਮਾਮਲਿਆਂ ਵਿੱਚ ਮਾਡਲ ਨੂੰ “ਕੈਪਚਰ ਦਿ ਫ਼ਲੈਗ” ਨਾਂ ਦੀ ਇੱਕ ਬਣਾਵਟੀ ਕਸਰਤ ਦਿੱਤੀ ਗਈ ਸੀ, ਜਿਸ ਵਿੱਚ ਨੈੱਟਵਰਕ ਦੀ ਕਿਸੇ ਹੋਰ ਮਸ਼ੀਨ ਉੱਤੇ ਲੁਕਾਈ ਗਈ ਇੱਕ ਗੁਪਤ ਜਾਣਕਾਰੀ ਲੱਭਣੀ ਹੁੰਦੀ ਹੈ। ਮਾਡਲ ਬਣਾਵਟੀ ਨਿਸ਼ਾਨੇ ਦੀ ਥਾਂ ਅਸਲ ਸਿਸਟਮਾਂ ਵੱਲ ਚਲੇ ਗਏ।
- Anthropic ਦਾ ਕਹਿਣਾ ਹੈ ਕਿ ਇਸ ਲਈ ਕੋਈ ਗੁੰਝਲਦਾਰ ਤਰੀਕਾ ਨਹੀਂ ਵਰਤਿਆ ਗਿਆ — ਕਮਜ਼ੋਰ ਪਾਸਵਰਡ ਵਰਗੀਆਂ ਮੁੱਢਲੀਆਂ ਖ਼ਾਮੀਆਂ ਹੀ ਕਾਫ਼ੀ ਰਹੀਆਂ।
- ਪ੍ਰਭਾਵਿਤ ਸੰਸਥਾਵਾਂ ਦੇ ਨਾਂ ਨਹੀਂ ਦੱਸੇ ਗਏ। ਕੰਪਨੀ ਮੁਤਾਬਕ ਉਨ੍ਹਾਂ ਵਿੱਚੋਂ ਦੋ ਨੇ ਕਿਹਾ ਕਿ ਉਨ੍ਹਾਂ ਨੂੰ ਪਹਿਲਾਂ ਇਸ ਬਾਰੇ ਪਤਾ ਹੀ ਨਹੀਂ ਲੱਗਾ ਸੀ; ਤੀਜੀ ਨਾਲ ਸੰਪਰਕ ਦੀ ਕੋਸ਼ਿਸ਼ ਜਾਰੀ ਹੈ।
ਇਹ ਸਮੀਖਿਆ ਕੰਪਨੀ ਨੇ Irregular ਨਾਂ ਦੀ ਸੁਰੱਖਿਆ ਖੋਜ ਸੰਸਥਾ ਨਾਲ ਮਿਲ ਕੇ ਕੀਤੀ। Irregular ਨੇ X ਉੱਤੇ ਲਿਖਿਆ ਕਿ ਇਨ੍ਹਾਂ ਖ਼ਤਰਿਆਂ ਨਾਲ ਨਜਿੱਠਣ ਲਈ ਪੂਰੀ AI ਸਨਅਤ ਨੂੰ ਮਿਲ ਕੇ ਕੰਮ ਕਰਨਾ ਪਵੇਗਾ।
ਕੰਪਨੀ ਮੁਤਾਬਕ ਗੜਬੜ ਦੀ ਜੜ੍ਹ ਤੀਜੀ ਧਿਰ ਦੇ ਟੈਸਟ ਢਾਂਚੇ ਵਿੱਚ ਇੱਕ ਗ਼ਲਤ ਸੈਟਿੰਗ ਸੀ, ਜਿਸ ਕਾਰਨ ਪਰਖ ਵਾਲਾ ਮਾਹੌਲ ਪੂਰੀ ਤਰ੍ਹਾਂ ਵੱਖ ਹੋਣ ਦੀ ਥਾਂ ਅਸਲ ਇੰਟਰਨੈੱਟ ਨਾਲ ਜੁੜਿਆ ਰਹਿ ਗਿਆ। Anthropic ਦਾ ਕਹਿਣਾ ਹੈ ਕਿ ਉਸ ਨੇ ਹੁਣ ਉਹ ਸਾਰੀਆਂ ਸਾਈਬਰ ਪਰਖਾਂ ਰੋਕ ਦਿੱਤੀਆਂ ਹਨ ਜਿਨ੍ਹਾਂ ਵਿੱਚ ਇੰਟਰਨੈੱਟ ਤੱਕ ਪਹੁੰਚ ਸੰਭਵ ਹੋਵੇ, ਜਦ ਤੱਕ ਟੈਸਟ ਢਾਂਚੇ ਦੀ ਸਮੀਖਿਆ ਪੂਰੀ ਨਹੀਂ ਹੁੰਦੀ।
ਇਹ ਖ਼ਬਰ ਆਮ ਵਰਤੋਂਕਾਰ ਲਈ ਕਿਉਂ ਮਾਅਨੇ ਰੱਖਦੀ ਹੈ
ਪਹਿਲੀ ਗੱਲ, ਇਹ ਕੋਈ ਹੈਕਰਾਂ ਦਾ ਹਮਲਾ ਨਹੀਂ ਸੀ। ਇਹ ਕੰਪਨੀ ਦੀ ਆਪਣੀ ਪਰਖ ਸੀ, ਜਿਸ ਦਾ ਮਾਹੌਲ ਬਾਹਰੀ ਦੁਨੀਆ ਤੋਂ ਕੱਟਿਆ ਹੋਣਾ ਚਾਹੀਦਾ ਸੀ ਪਰ ਸੀ ਨਹੀਂ। Anthropic ਦਾ ਆਪਣਾ ਕਹਿਣਾ ਹੈ ਕਿ ਸੁਰੱਖਿਆ ਪਰਖ ਮਾਡਲ ਜਾਰੀ ਕਰਨ ਤੋਂ ਪਹਿਲਾਂ ਇਸੇ ਲਈ ਹੁੰਦੀ ਹੈ, ਕਿਉਂਕਿ ਉਸ ਵੇਲੇ ਪਤਾ ਹੀ ਨਹੀਂ ਹੁੰਦਾ ਕਿ ਮਾਡਲ ਕੀ-ਕੀ ਕਰ ਸਕਦਾ ਹੈ।
ਦੂਜੀ ਗੱਲ ਵੱਧ ਅਹਿਮ ਹੈ। ਪਿਛਲੇ ਹਫ਼ਤੇ OpenAI ਨੇ ਮੰਨਿਆ ਸੀ ਕਿ ਪਰਖ ਦੌਰਾਨ ਉਸ ਦੇ ਮਾਡਲ AI ਸਟਾਰਟਅੱਪ Hugging Face ਦੇ ਸਰਵਰਾਂ ਵਿੱਚ ਵੜ ਗਏ ਸਨ, ਅਤੇ ਕੰਪਨੀ ਨੇ ਇਸ ਨੂੰ “ਗੰਭੀਰ ਸੁਰੱਖਿਆ ਘਟਨਾ” ਕਿਹਾ ਸੀ। ਥੋੜੇ ਦਿਨਾਂ ਦੇ ਅੰਦਰ ਦੋ ਵੱਡੀਆਂ ਕੰਪਨੀਆਂ ਦਾ ਇੱਕੋ ਕਿਸਮ ਦੀ ਗੜਬੜ ਮੰਨਣਾ ਇਸ ਸਵਾਲ ਨੂੰ ਜਨਮ ਦਿੰਦਾ ਹੈ ਕਿ ਸਭ ਤੋਂ ਤਾਕਤਵਰ AI ਮਾਡਲਾਂ ਨੂੰ ਪਰਖ ਦੌਰਾਨ ਕਾਬੂ ਵਿੱਚ ਰੱਖਣ ਦਾ ਭਰੋਸੇਯੋਗ ਤਰੀਕਾ ਸਨਅਤ ਕੋਲ ਹੈ ਵੀ ਜਾਂ ਨਹੀਂ।
ਭਾਰਤ ਵਿੱਚ ਵੀ ਇਹ ਸਵਾਲ ਬੇਗਾਨਾ ਨਹੀਂ। ਦਫ਼ਤਰਾਂ, ਬੈਂਕਾਂ ਤੇ ਸਰਕਾਰੀ ਵਿਭਾਗਾਂ ਵਿੱਚ AI ਏਜੰਟ ਤੇਜ਼ੀ ਨਾਲ ਵਧ ਰਹੇ ਹਨ, ਅਤੇ ਇਸੇ ਹਫ਼ਤੇ ਸਾਹਮਣੇ ਆਏ ਅੰਕੜੇ ਦੱਸਦੇ ਹਨ ਕਿ ਇਸ ਸਨਅਤ ਦਾ ਪੈਮਾਨਾ ਕਿੰਨਾ ਵੱਡਾ ਹੋ ਚੁੱਕਾ ਹੈ — Microsoft Azure ਦੀ ਸਾਲਾਨਾ ਆਮਦਨ ਪਹਿਲੀ ਵਾਰ 100 ਅਰਬ ਡਾਲਰ ਤੋਂ ਪਾਰ ਹੋਈ ਹੈ।
ਸੁਰੱਖਿਆ ਮਾਹਿਰਾਂ ਦੀ ਸਲਾਹ ਸਿੱਧੀ ਹੈ: ਕਿਸੇ ਵੀ AI ਏਜੰਟ ਨੂੰ ਸਿਰਫ਼ ਓਨੀ ਪਹੁੰਚ ਦਿਓ ਜਿੰਨੀ ਕੰਮ ਲਈ ਲਾਜ਼ਮੀ ਹੈ, ਅਹਿਮ ਕਦਮਾਂ ਲਈ ਮਨੁੱਖੀ ਮਨਜ਼ੂਰੀ ਲਾਜ਼ਮੀ ਰੱਖੋ, ਅਤੇ ਪਾਸਵਰਡ ਵਰਗੀਆਂ ਮੁੱਢਲੀਆਂ ਚੀਜ਼ਾਂ ਢਿੱਲੀਆਂ ਨਾ ਛੱਡੋ।
Anthropic ਦਾ ਪੂਰਾ ਬਿਆਨ ਕੰਪਨੀ ਦੀ ਆਪਣੀ ਵੈੱਬਸਾਈਟ ਉੱਤੇ ਪ੍ਰਕਾਸ਼ਿਤ ਰਿਪੋਰਟ ਵਿੱਚ ਪੜ੍ਹਿਆ ਜਾ ਸਕਦਾ ਹੈ। ਇਸ ਖ਼ਬਰ ਵਿੱਚ ਦਿੱਤੇ ਸਾਰੇ ਦਾਅਵੇ ਕੰਪਨੀ ਦੇ ਆਪਣੇ ਹਨ; ਪ੍ਰਭਾਵਿਤ ਸੰਸਥਾਵਾਂ ਵੱਲੋਂ ਹਾਲੇ ਕੋਈ ਵੱਖਰਾ ਜਨਤਕ ਬਿਆਨ ਸਾਹਮਣੇ ਨਹੀਂ ਆਇਆ।
