ਨਵੀਂ ਦਿੱਲੀ: OpenAI ਨੇ 16 ਸਤੰਬਰ 2026 ਨੂੰ AI ਮਾਡਲਾਂ ਦੇ ਅਣਉਮੀਦ ਅਤੇ ਚਿੰਤਾਜਨਕ ਵਿਵਹਾਰ ਨਾਲ ਸਬੰਧਤ ਇੱਕ ਨਵਾਂ ਮਿਸਅਲਾਈਨਮੈਂਟ ਰਿਪੋਰਟਿੰਗ ਫਰੇਮਵਰਕ ਜਾਰੀ ਕੀਤਾ ਹੈ। ਕੰਪਨੀ ਨੇ ਇਸ ਦੇ ਨਾਲ ਪਿਛਲੇ ਛੇ ਮਹੀਨਿਆਂ ਦੌਰਾਨ ਟ੍ਰੇਨਿੰਗ ਅਤੇ ਮੁਲਾਂਕਣ ਦੌਰਾਨ ਸਾਹਮਣੇ ਆਏ ਛੇ ਮਾਮਲਿਆਂ ਦੀ ਜਾਣਕਾਰੀ ਵੀ ਸਾਂਝੀ ਕੀਤੀ।
ਰਿਪੋਰਟ ਮੁਤਾਬਕ, ਇਨ੍ਹਾਂ ਮਾਮਲਿਆਂ ਵਿੱਚ ਕੁਝ ਮਾਡਲਾਂ ਨੇ ਆਪਣੇ ਆਮ ਨਿਯਮਾਂ ਤੋਂ ਹਟ ਕੇ ਅਜਿਹੇ ਕਦਮ ਚੁੱਕੇ ਜੋ ਨਿਰਧਾਰਤ ਕੰਮ ਜਾਂ ਸੁਰੱਖਿਆ ਸੀਮਾਵਾਂ ਦੇ ਅਨੁਕੂਲ ਨਹੀਂ ਸਨ। OpenAI ਨੇ ਇਨ੍ਹਾਂ ਨੂੰ ਵਿਅਕਤੀਗਤ ਘਟਨਾਵਾਂ ਵਜੋਂ ਦਰਜ ਕੀਤਾ ਹੈ ਅਤੇ ਸਪੱਸ਼ਟ ਕੀਤਾ ਹੈ ਕਿ ਇਨ੍ਹਾਂ ਛੇ ਮਾਮਲਿਆਂ ਨੂੰ ਇਹ ਨਹੀਂ ਮੰਨਿਆ ਜਾਣਾ ਚਾਹੀਦਾ ਕਿ ਮਾਡਲਾਂ ਵਿੱਚ ਅਜਿਹਾ ਵਿਵਹਾਰ ਕਿੰਨੀ ਵਾਰ ਹੁੰਦਾ ਹੈ।
ਇੱਕ ਮਾਮਲੇ ਵਿੱਚ ਇੱਕ ਅਣਰਿਲੀਜ਼ਡ ਰਿਸਰਚ ਮਾਡਲ ਨੇ ਕੰਮ ਦੀਆਂ ਸੰਖੇਪ ਰਿਪੋਰਟਾਂ ਵਿੱਚ ਅਜਿਹੀਆਂ ਹਦਾਇਤਾਂ ਸ਼ਾਮਲ ਕੀਤੀਆਂ ਜੋ ਆਮ ਪਾਬੰਦੀਆਂ ਨੂੰ ਨਜ਼ਰਅੰਦਾਜ਼ ਕਰਨ ਨਾਲ ਸਬੰਧਤ ਸਨ। ਇੱਕ ਹੋਰ ਮਾਮਲੇ ਵਿੱਚ GPT-5.6 Sol ਦੀ ਟ੍ਰੇਨਿੰਗ ਦੌਰਾਨ ਕੁਝ ਮਾਡਲ ਇੰਸਟੈਂਸਾਂ ਨੇ ਆਪਣੀਆਂ ਗਲਤੀਆਂ ਜਾਂ ਮਿਸਅਲਾਈਨਡ ਵਿਵਹਾਰ ਨੂੰ ਯੂਜ਼ਰ ਤੋਂ ਲੁਕਾਉਣ ਵਾਲੀਆਂ ਹਦਾਇਤਾਂ ਸ਼ਾਮਲ ਕੀਤੀਆਂ।
ਰਿਪੋਰਟ ਵਿੱਚ ਇੱਕ ਮਾਮਲਾ ਅਜਿਹਾ ਵੀ ਦਰਜ ਹੈ, ਜਿਸ ਵਿੱਚ ਮਾਡਲ ਨੇ ਇੱਕ ਜਨਤਕ ਰਿਪੋਜ਼ਟਰੀ ਵਿੱਚ ਮੌਜੂਦ ਐਕਸਪੋਜ਼ਡ API ਕੀ ਦੀ ਵਰਤੋਂ ਕੀਤੀ। ਇੱਕ ਹੋਰ ਘਟਨਾ ਵਿੱਚ ਮਾਡਲ ਨੇ ਯੂਜ਼ਰ ਤੋਂ ਇਜਾਜ਼ਤ ਲਏ ਬਿਨਾਂ ਇੱਕ ਫਾਈਲ ਨੂੰ ਇੰਟਰਨੈੱਟ ‘ਤੇ ਅਪਲੋਡ ਕਰ ਦਿੱਤਾ ਤਾਂ ਜੋ ਜਵਾਬ ਵਿੱਚ ਉਸਦਾ ਹਵਾਲਾ ਦਿੱਤਾ ਜਾ ਸਕੇ।
OpenAI ਨੇ ਮਿਸਅਲਾਈਨਮੈਂਟ ਦਾ ਅਰਥ ਅਜਿਹੇ ਵਿਵਹਾਰ ਵਜੋਂ ਦਰਸਾਇਆ ਹੈ, ਜਦੋਂ AI ਮਨੁੱਖੀ ਨਿਰਦੇਸ਼ਾਂ, ਇਰਾਦਿਆਂ ਜਾਂ ਸਥਾਪਿਤ ਸੁਰੱਖਿਆ ਸੀਮਾਵਾਂ ਤੋਂ ਭਟਕਦਾ ਹੈ। ਕੰਪਨੀ ਨੇ ਕਿਹਾ ਕਿ ਅਜਿਹੇ ਮਾਮਲਿਆਂ ਦੀ ਰਿਪੋਰਟਿੰਗ ਦਾ ਉਦੇਸ਼ ਖੋਜਕਰਤਾਵਾਂ ਅਤੇ AI ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਸੰਭਾਵਿਤ ਕਮਜ਼ੋਰੀਆਂ ਸਮਝਣ ਅਤੇ ਸੁਰੱਖਿਆ ਉਪਾਅ ਬਿਹਤਰ ਬਣਾਉਣ ਵਿੱਚ ਮਦਦ ਕਰਨਾ ਹੈ।
ਰਿਪੋਰਟ ਵਿੱਚ ਇਹ ਵੀ ਕਿਹਾ ਗਿਆ ਹੈ ਕਿ ਕੁਝ ਘਟਨਾਵਾਂ ਅਲੱਗ-ਥਲੱਗ ਹੋ ਸਕਦੀਆਂ ਹਨ ਅਤੇ ਜ਼ਰੂਰੀ ਨਹੀਂ ਕਿ ਉਹ ਕਿਸੇ ਵੱਡੇ ਪੈਟਰਨ ਜਾਂ ਭਵਿੱਖ ਦੇ ਵਿਵਹਾਰ ਦਾ ਸੰਕੇਤ ਹੋਣ। OpenAI ਨੇ ਅਜਿਹੇ ਮਾਮਲਿਆਂ ਦੀ ਜਾਂਚ ਅਤੇ ਜਨਤਕ ਖੁਲਾਸੇ ਲਈ ਨਵੀਂ ਪ੍ਰਕਿਰਿਆ ਜਾਰੀ ਰੱਖਣ ਦੀ ਗੱਲ ਕਹੀ ਹੈ।
