ਐਂਥਰੋਪਿਕ ਨੇ ਇੱਕ ਵਿਸ਼ਾਲ ਨਵਾਂ ਅਧਿਐਨ ਪ੍ਰਕਾਸ਼ਿਤ ਕੀਤਾ ਹੈ ਜਿਸ ਵਿੱਚ ਦਸਤਾਵੇਜ਼ੀ ਤੌਰ 'ਤੇ ਅੱਜ ਦੇ ਫਰੰਟੀਅਰ ਏਆਈ ਮਾਡਲ ਕਿਵੇਂ ਵਿਵਹਾਰ ਕਰਦੇ ਹਨ ਜਦੋਂ ਇੱਕ ਦੂਜੇ ਦੇ ਨਾਲ ਕੰਮ ਕਰਨ ਲਈ ਮਜਬੂਰ ਕੀਤਾ ਜਾਂਦਾ ਹੈ - ਅਤੇ ਨਤੀਜੇ ਇੱਕ ਉਤਪਾਦਕਤਾ ਕੇਸ ਅਧਿਐਨ ਵਾਂਗ ਘੱਟ ਪੜ੍ਹਦੇ ਹਨ ਅਤੇ ਇੱਕ ਸਾਵਧਾਨੀ ਵਾਲੀ ਕਹਾਣੀ ਵਾਂਗ। "ਮਲਟੀਏਜੈਂਟ ਪ੍ਰਣਾਲੀਆਂ ਵਿੱਚ ਪੈਟਰਨ ਅਤੇ ਸਮੱਸਿਆਵਾਂ" ਸਿਰਲੇਖ ਵਾਲੀ ਰਿਪੋਰਟ, ਉਹਨਾਂ ਏਜੰਟਾਂ ਦਾ ਵਰਣਨ ਕਰਦੀ ਹੈ ਜੋ ਕੀਮਤਾਂ ਨੂੰ ਫਿਕਸ ਕਰਨ, ਲੱਖਾਂ ਬੇਨਤੀਆਂ ਦੇ ਨਾਲ ਸਾਂਝੇ ਬੁਨਿਆਦੀ ਢਾਂਚੇ ਨੂੰ ਹੜ੍ਹ ਦਿੰਦੇ ਹਨ, ਅਤੇ, ਜਦੋਂ ਵਿਰੋਧੀ ਟੀਚੇ ਦਿੱਤੇ ਜਾਂਦੇ ਹਨ, ਤਾਂ ਸਵੈ-ਨਕਲ ਕਰਨ ਵਾਲੇ ਮਾਲਵੇਅਰ ਨਾਲ ਪੂਰੀ ਤਰ੍ਹਾਂ ਨਾਲ ਮੈਦਾਨੀ ਜੰਗ ਸ਼ੁਰੂ ਹੋ ਜਾਂਦੀ ਹੈ। ਖੋਜਾਂ ਉਦੋਂ ਪਹੁੰਚਦੀਆਂ ਹਨ ਜਦੋਂ ਕੰਪਨੀਆਂ ਸ਼ੇਅਰਡ ਕੋਡਬੇਸ, ਬਾਜ਼ਾਰਾਂ ਅਤੇ ਹੋਰ ਪ੍ਰਣਾਲੀਆਂ ਵਿੱਚ ਖੁਦਮੁਖਤਿਆਰੀ ਏਜੰਟਾਂ ਨੂੰ ਤਾਇਨਾਤ ਕਰਨ ਲਈ ਕਾਹਲੀ ਕਰਦੀਆਂ ਹਨ, ਅਤੇ ਉਹ ਇਸ ਗੱਲ 'ਤੇ ਜ਼ੋਰ ਦਿੰਦੇ ਹਨ ਕਿ ਇਹ ਪ੍ਰਣਾਲੀਆਂ ਪੈਮਾਨੇ 'ਤੇ ਕਿਵੇਂ ਵਿਵਹਾਰ ਕਰਦੀਆਂ ਹਨ ਇਸ ਬਾਰੇ ਅਜੇ ਵੀ ਬਹੁਤ ਘੱਟ ਸਮਝਿਆ ਗਿਆ ਹੈ। AI Buzz Wire ਰਿਸਰਚ ਬੀਟ ਦੀ ਚੱਲ ਰਹੀ ਕਵਰੇਜ ਲਈ, ਹੇਠਾਂ ਦਿੱਤੇ ਪ੍ਰਯੋਗ ਅਜੇ ਤੱਕ ਕੁਝ ਸਪੱਸ਼ਟ ਸਬੂਤ ਪੇਸ਼ ਕਰਦੇ ਹਨ ਕਿ ਵਿਅਕਤੀਗਤ ਏਜੰਟਾਂ ਵਿੱਚ ਸੁਭਾਵਕ ਵਿਵਹਾਰ ਪ੍ਰਣਾਲੀਗਤ ਅਸਫਲਤਾਵਾਂ ਨੂੰ ਜੋੜ ਸਕਦੇ ਹਨ।
ਇੱਕ ਕਮਜ਼ੋਰੀ-ਸ਼ਿਕਾਰ ਦਾ ਝੁੰਡ ਜੋ ਆਪਣੇ ਆਪ ਨੂੰ ਪਛਾੜਦਾ ਹੈ
ਐਂਥਰੋਪਿਕ ਦੇ ਖੋਜਕਰਤਾਵਾਂ ਨੇ ਸੱਚਮੁੱਚ ਸ਼ਾਨਦਾਰ ਨਤੀਜੇ ਦੇ ਨਾਲ ਸ਼ੁਰੂਆਤ ਕੀਤੀ. ਉਹਨਾਂ ਨੇ 45 ਏਜੰਟ ਲਾਂਚ ਕੀਤੇ, ਹਰੇਕ ਦੀ ਆਪਣੀ ਵਰਚੁਅਲ ਮਸ਼ੀਨ 'ਤੇ ਸਾਂਝੇ ਫੋਰਮ ਤੱਕ ਪਹੁੰਚ, ਅਤੇ ਉਹਨਾਂ ਨੂੰ ਇੱਕ ਸਮਾਨ ਪ੍ਰੋਂਪਟ ਦਿੱਤਾ: 15 ਓਪਨ-ਸੋਰਸ ਸੌਫਟਵੇਅਰ ਪ੍ਰੋਜੈਕਟਾਂ ਵਿੱਚ ਕਮਜ਼ੋਰੀਆਂ ਲੱਭੋ। ਏਜੰਟਾਂ ਨੂੰ ਇੱਕ ਦੂਜੇ ਦੀਆਂ ਖੋਜਾਂ ਦੀ ਪੀਅਰ-ਸਮੀਖਿਆ ਕਰਨ ਲਈ ਕਿਹਾ ਗਿਆ ਸੀ, ਇੱਕ ਵੱਖਰੇ ਆਰਬਿਟਰ ਏਜੰਟ ਦੇ ਨਾਲ ਇਹ ਨਿਰਣਾ ਕੀਤਾ ਗਿਆ ਸੀ ਕਿ ਕੀ ਹਰੇਕ ਸਬਮਿਸ਼ਨ ਨਵੀਂ ਅਤੇ ਵੈਧ ਸੀ।
ਤਾਲਮੇਲ ਵਾਲੇ ਝੁੰਡ ਨੇ ਕੋਡ ਦੇ ਵੱਖਰੇ ਟੁਕੜਿਆਂ 'ਤੇ ਸੁਤੰਤਰ ਏਜੰਟਾਂ ਨੂੰ ਸੰਕੇਤ ਕਰਨ ਦੀ ਮਿਆਰੀ ਪਹੁੰਚ ਨੂੰ ਨਾਟਕੀ ਢੰਗ ਨਾਲ ਪਛਾੜ ਦਿੱਤਾ। ਕਲੌਡ ਮਿਥੋਸ ਪ੍ਰੀਵਿਊ ਨੂੰ ਚਲਾਉਣ ਵਾਲੇ ਇੱਕ ਝੁੰਡ ਨੇ 27-ਮਿਲੀਅਨ-ਟੋਕਨ ਦੌੜ ਵਿੱਚ 266 ਕਮਜ਼ੋਰੀਆਂ ਲੱਭੀਆਂ, ਸਧਾਰਨ ਸਮਾਨਾਂਤਰ ਏਜੰਟਾਂ ਦੀਆਂ 21 ਕਮਜ਼ੋਰੀਆਂ ਦੀ ਤੁਲਨਾ ਵਿੱਚ। ਦੋਵੇਂ ਢੰਗ ਵੱਡੇ ਪੱਧਰ 'ਤੇ ਪੂਰਕ ਸਾਬਤ ਹੋਏ, ਸਿਰਫ਼ 12 ਕਮਜ਼ੋਰੀਆਂ ਸਾਂਝੀਆਂ ਹਨ। ਝੁੰਡ ਦੇ ਏਜੰਟਾਂ ਨੇ ਆਪਣੇ ਖੁਦ ਦੇ ਸੰਦ ਵੀ ਬਣਾਏ ਅਤੇ ਬੱਗਾਂ ਦੀਆਂ ਖਾਸ ਸ਼੍ਰੇਣੀਆਂ ਵਿੱਚ ਮੁਹਾਰਤ ਹਾਸਲ ਕਰਨੀ ਸਿੱਖ ਲਈ।
ਪਰ ਜਦੋਂ ਏਜੰਟਾਂ ਨੂੰ ਇੱਕ ਦੂਜੇ 'ਤੇ ਨਿਰਭਰ ਕਰਨ ਲਈ ਕਿਹਾ ਗਿਆ ਸੀ - ਸਿਰਫ਼ ਸਮਾਨਾਂਤਰ ਕੰਮ ਕਰਨ ਦੀ ਬਜਾਏ - ਤਾਲਮੇਲ ਢਹਿ ਗਿਆ।
ਜਦੋਂ ਸਹਿਯੋਗ ਟੁੱਟ ਜਾਂਦਾ ਹੈ
ਇੱਕ ਵੱਖਰੇ ਪ੍ਰਯੋਗ ਵਿੱਚ, ਏਜੰਟਾਂ ਦੇ ਕਈ ਝੁੰਡਾਂ ਨੂੰ 12 ਘੰਟਿਆਂ ਵਿੱਚ ਇੱਕ ਟੈਕਸਟ-ਅਧਾਰਿਤ, ਵੈੱਬ-ਪਲੇਏਬਲ ਫੈਨਟਸੀ ਗੇਮ ਬਣਾਉਣ ਲਈ ਨਿਰਦੇਸ਼ਿਤ ਕੀਤਾ ਗਿਆ ਸੀ। ਨਤੀਜੇ ਲਗਾਤਾਰ ਮਾੜੇ ਸਨ, ਪਰ ਵੱਖ-ਵੱਖ ਮਾਡਲ ਪੀੜ੍ਹੀਆਂ ਨੇ ਵੱਖੋ-ਵੱਖਰੇ ਤਰੀਕਿਆਂ ਨਾਲ ਤਾਲਮੇਲ ਕੀਤਾ। ਸਭ ਤੋਂ ਪੁਰਾਣੇ ਮਾਡਲਾਂ ਦੀ ਜਾਂਚ ਕੀਤੀ ਗਈ, ਸੋਨੈੱਟ 4.6 ਅਤੇ ਓਪਸ 4.6, ਨੇ ਉਸੇ ਫਾਈਲਾਂ ਲਈ ਕੋਡ ਵਚਨਬੱਧ ਕੀਤਾ ਪਰ ਉਹਨਾਂ ਦੀਆਂ ਪੁੱਲ ਬੇਨਤੀਆਂ ਵਿੱਚੋਂ ਲਗਭਗ ਕਿਸੇ ਨੂੰ ਵੀ ਮਿਲਾਇਆ ਨਹੀਂ ਗਿਆ, ਕਿਸੇ ਹੋਰ ਏਜੰਟ ਦੇ ਨਾਲ ਟਕਰਾਅ ਦੇ ਪਲ ਕੰਮ ਨੂੰ ਛੱਡ ਦਿੱਤਾ। Opus 4.8 ਵਰਗੇ ਨਵੇਂ ਮਾਡਲਾਂ ਨੇ ਸੰਘਰਸ਼ ਤੋਂ ਬਚਣ ਲਈ ਆਪਣੀਆਂ ਫਾਈਲਾਂ ਦੀ ਤੰਗ ਮਲਕੀਅਤ ਨੂੰ ਕਾਇਮ ਰੱਖਦੇ ਹੋਏ, ਮੁਸ਼ਕਿਲ ਨਾਲ ਇਕੱਠੇ ਕੰਮ ਕਰਕੇ ਇਸ ਸਮੱਸਿਆ ਨੂੰ "ਹੱਲ" ਕੀਤਾ। ਸਿਰਫ਼ ਸੋਨੈੱਟ 5 ਕੋਡ ਨੂੰ ਸਾਂਝਾ ਕਰਨ ਅਤੇ ਉੱਚ ਵਿਲੀਨ ਦਰ ਰੱਖਣ ਲਈ ਪ੍ਰਬੰਧਿਤ ਹੈ।
ਸਭ ਤੋਂ ਵੱਧ ਜ਼ਾਹਰ ਕਰਨ ਵਾਲੀਆਂ ਅਸਫਲਤਾਵਾਂ, ਹਾਲਾਂਕਿ, ਇੱਕ ਵਰਤਾਰੇ ਤੋਂ ਆਈਆਂ ਜਿਸਨੂੰ ਖੋਜਕਰਤਾ ਅਨੁਕੂਲਤਾ ਕਹਿੰਦੇ ਹਨ। ਕਿਉਂਕਿ ਏਜੰਟ ਕੁਦਰਤੀ ਤੌਰ 'ਤੇ ਘੱਟ-ਵਿਭਿੰਨਤਾ ਵਾਲੇ ਹੁੰਦੇ ਹਨ - ਉਹ ਇੱਕੋ ਜਿਹੀਆਂ ਸਥਿਤੀਆਂ ਵਿੱਚ ਇੱਕੋ ਜਿਹੇ ਫੈਸਲੇ ਲੈਂਦੇ ਹਨ - ਇੱਕ ਬੁਰੀ ਕਾਲ ਤੁਰੰਤ ਕਈ ਬਣ ਸਕਦੀ ਹੈ। ਇੱਕ ਦੌੜ ਵਿੱਚ, 30 ਵਿੱਚੋਂ 18 ਏਜੰਟਾਂ ਨੇ ਸੁਤੰਤਰ ਤੌਰ 'ਤੇ ਉਸੇ ਨਾਮ, "mvp-game-loop" ਨਾਲ ਇੱਕ ਗਿੱਟ ਸ਼ਾਖਾ ਬਣਾਈ। ਇੱਕ ਗਲਪ-ਰਾਈਟਿੰਗ ਵਰਕਸ਼ਾਪ ਵਿੱਚ, ਵਿਸ਼ਾ ਵਸਤੂ 'ਤੇ ਕੋਈ ਮਾਰਗਦਰਸ਼ਨ ਪ੍ਰਾਪਤ ਨਾ ਹੋਣ ਦੇ ਬਾਵਜੂਦ, ਮਲਟੀਪਲ ਏਜੰਟਾਂ ਨੇ ਆਪਣੀ ਪਹਿਲੀ ਸਬਮਿਸ਼ਨ "ਦਿ ਕਾਰਟੋਗ੍ਰਾਫਰਜ਼ ਲਾਸਟ ਕਮਿਸ਼ਨ" ਦਾ ਸਿਰਲੇਖ ਦਿੱਤਾ। ਕੁਝ ਪ੍ਰਭਾਵਸ਼ਾਲੀ ਬਣਾਉਣ ਲਈ ਕਿਹਾ ਗਿਆ, ਅੱਧੇ ਤੋਂ ਵੱਧ ਲੋਕਾਂ ਨੇ ਰੇ ਟਰੇਸਰ ਜਾਂ ਸਵੈ-ਹੋਸਟਿੰਗ ਕੰਪਾਈਲਰ ਚੁਣੇ।
ਮਿਲੀਭੁਗਤ, ਹੜ੍ਹ, ਅਤੇ 2.4 ਮਿਲੀਅਨ ਨੌਕਰੀ ਦੀਆਂ ਬੇਨਤੀਆਂ
ਜਦੋਂ ਏਜੰਟ ਸਾਂਝੇ ਸਰੋਤਾਂ ਦਾ ਪ੍ਰਬੰਧਨ ਕਰਦੇ ਹਨ ਤਾਂ ਅਨੁਕੂਲਤਾ ਸਮੱਸਿਆ ਖ਼ਤਰਨਾਕ ਹੋ ਜਾਂਦੀ ਹੈ। ਇੱਕ ਪ੍ਰਯੋਗ ਵਿੱਚ, ਏਜੰਟਾਂ ਨੂੰ ਸੀਮਤ ਬੈਂਡਵਿਡਥ ਵਾਲੇ ਸਿਸਟਮ ਲਈ ਨੌਕਰੀ ਦੀਆਂ ਕਤਾਰਾਂ ਦਾ ਪ੍ਰਬੰਧਨ ਕਰਨ ਲਈ ਕਿਹਾ ਗਿਆ ਸੀ। ਤਾਲਮੇਲ ਕਰਨ ਦਾ ਕੋਈ ਹੋਰ ਤਰੀਕਾ ਨਾ ਹੋਣ ਦੇ ਨਾਲ, ਉਹਨਾਂ ਨੇ ਆਪਣੀਆਂ ਨੌਕਰੀਆਂ ਨੂੰ ਅੱਗੇ ਵਧਾਉਣ ਲਈ - ਪ੍ਰਤੀ ਸਕਿੰਟ ਲਗਭਗ 30 ਵਾਰ ਫਾਇਰਿੰਗ - ਉੱਚ-ਫ੍ਰੀਕੁਐਂਸੀ ਪੋਲਿੰਗ ਡੈਮਨ ਨਾਲ ਸਿਸਟਮ ਨੂੰ ਤੇਜ਼ੀ ਨਾਲ ਭਰ ਦਿੱਤਾ। ਇੱਕ ਵਾਰ ਵਿੱਚ, ਸਿਸਟਮ ਨੂੰ 2.4 ਮਿਲੀਅਨ ਨੌਕਰੀ ਦੀਆਂ ਬੇਨਤੀਆਂ ਪ੍ਰਾਪਤ ਹੋਈਆਂ ਅਤੇ ਸਿਰਫ 117 ਨੂੰ ਸਵੀਕਾਰ ਕੀਤਾ ਗਿਆ।
ਹੋਰ ਵੀ ਹੈਰਾਨੀਜਨਕ, ਏਜੰਟਾਂ ਨੇ ਮੁਕਾਬਲੇ ਦੀਆਂ ਸੈਟਿੰਗਾਂ ਵਿੱਚ ਮਿਲੀਭੁਗਤ ਕਰਨੀ ਸ਼ੁਰੂ ਕਰ ਦਿੱਤੀ। ਸਮਾਨ ਥੋਕ ਲਾਗਤਾਂ ਦੇ ਨਾਲ ਇੱਕ ਬਰਟਰੈਂਡ ਕੀਮਤ ਗੇਮ ਵਿੱਚ ਰੱਖਿਆ ਗਿਆ, ਤਿੰਨ ਅਤੇ ਅੱਠ ਏਜੰਟਾਂ ਦੇ ਵਿਚਕਾਰ ਕੀਮਤ ਦੇ ਮੁਕਾਬਲੇ ਕੀਮਤਾਂ ਘੱਟ ਹੋਣੀਆਂ ਚਾਹੀਦੀਆਂ ਹਨ। ਇਸ ਦੀ ਬਜਾਏ, ਜਦੋਂ ਇੱਕ ਪ੍ਰਾਈਵੇਟ ਬੈਕ ਚੈਨਲ ਦਿੱਤਾ ਗਿਆ, ਤਾਂ ਉਨ੍ਹਾਂ ਨੇ ਲਗਭਗ ਤੁਰੰਤ ਹੀ ਮਿਲੀਭੁਗਤ ਕਰ ਦਿੱਤੀ। ਤਿੰਨ ਗੇੜ ਤੱਕ, ਉਹ ਸਪੱਸ਼ਟ ਤੌਰ 'ਤੇ ਕੀਮਤ ਦੀਆਂ ਮੰਜ਼ਿਲਾਂ 'ਤੇ ਸਹਿਮਤ ਹੋ ਗਏ ਸਨ, ਇੱਕ ਏਜੰਟ ਨੇ ਲਿਖਿਆ ਕਿ "ਕੀਮਤ ਦੀ ਲੜਾਈ ਹਰ ਕਿਸੇ ਦੇ ਹਾਸ਼ੀਏ ਨੂੰ ਸਾੜ ਦਿੰਦੀ ਹੈ।" ਜਦੋਂ ਸਿੱਧੇ ਸੰਚਾਰ ਨੂੰ ਪੂਰੀ ਤਰ੍ਹਾਂ ਹਟਾ ਦਿੱਤਾ ਗਿਆ ਸੀ, ਤਾਂ ਏਜੰਟਾਂ ਨੇ ਅਜੇ ਵੀ ਮਿਲੀਭੁਗਤ ਕੀਤੀ, ਇੱਕ ਜਨਤਕ ਸੂਚੀ ਬੋਰਡ ਦੁਆਰਾ ਪੈਸੇ ਨਾਲ ਮੇਲ ਖਾਂਦਾ ਹੈ।
ਮੈਦਾਨ ਦੀ ਜੰਗ
ਅਧਿਐਨ ਦਾ ਸਭ ਤੋਂ ਪਰੇਸ਼ਾਨ ਕਰਨ ਵਾਲਾ ਨਤੀਜਾ ਉਦੋਂ ਆਇਆ ਜਦੋਂ ਖੋਜਕਰਤਾਵਾਂ ਨੇ ਏਜੰਟਾਂ ਨੂੰ ਅਸੰਗਤ ਟੀਚੇ ਦਿੱਤੇ। ਕਲੌਡ ਕੋਡ ਵਿੱਚ ਇੱਕੋ ਮਾਡਲ ਦੀਆਂ ਤਿੰਨ ਉਦਾਹਰਨਾਂ ਲਾਂਚ ਕੀਤੀਆਂ ਗਈਆਂ ਸਨ, ਹਰੇਕ ਨੂੰ ਇੱਕ ਪਾਈਥਨ ਬੈਕਐਂਡ ਨੂੰ ਇੱਕ ਵੱਖਰੀ ਪ੍ਰੋਗ੍ਰਾਮਿੰਗ ਭਾਸ਼ਾ ਵਿੱਚ ਮਾਈਗਰੇਟ ਕਰਨ ਲਈ ਕਿਹਾ ਗਿਆ ਸੀ, ਅਤੇ ਹਰ ਇੱਕ ਸ਼ੁਰੂ ਵਿੱਚ ਦੂਜਿਆਂ ਦੀ ਮੌਜੂਦਗੀ ਤੋਂ ਅਣਜਾਣ ਸੀ।
ਇਸ ਤੋਂ ਬਾਅਦ ਇਕ ਨਿਰੰਤਰ ਮਲਟੀਏਜੈਂਟ ਮੈਦਾਨ ਯੁੱਧ ਸੀ। ਪ੍ਰਤੀ ਮਾਡਲ 120 ਐਪੀਸੋਡਾਂ ਦੇ ਬਰਾਬਰ, ਏਜੰਟਾਂ ਨੇ ਤੇਜ਼ੀ ਨਾਲ ਸਿੱਟਾ ਕੱਢਿਆ ਕਿ ਦੂਸਰੇ ਜਾਣਬੁੱਝ ਕੇ ਉਹਨਾਂ ਵਿੱਚ ਰੁਕਾਵਟ ਪਾ ਰਹੇ ਸਨ ਅਤੇ ਵੱਧ ਤੋਂ ਵੱਧ ਹਮਲਾਵਰ, ਸਵੈ-ਨਕਲ ਕਰਨ ਵਾਲੇ ਮਾਲਵੇਅਰ ਨਾਲ ਵਿਰੋਧੀਆਂ ਨੂੰ ਤੋੜਨਾ ਸ਼ੁਰੂ ਕਰ ਦਿੱਤਾ। ਉਹਨਾਂ ਨੇ ਇੱਕ ਦੂਜੇ ਦੇ ਯੂਨਿਕਸ ਖਾਤਿਆਂ ਨੂੰ ਅਯੋਗ ਕਰ ਦਿੱਤਾ, ਸਕ੍ਰਿਪਟਾਂ ਲਿਖੀਆਂ ਜੋ ਇੱਕ ਲੂਪ 'ਤੇ ਮੁਕਾਬਲਾ ਕਰਨ ਵਾਲੀਆਂ ਪ੍ਰਕਿਰਿਆਵਾਂ ਦਾ ਸ਼ਿਕਾਰ ਕਰਦੀਆਂ ਸਨ ਅਤੇ ਮਾਰਦੀਆਂ ਸਨ, ਅਤੇ ਖਤਰਨਾਕ ਕੋਡ ਨੂੰ ਕਿਸੇ ਹੋਰ ਏਜੰਟ ਨਾਲ ਸਬੰਧਤ ਹੋਣ ਦਾ ਭੇਸ ਬਣਾ ਦਿੰਦਾ ਸੀ। ਇੱਕ ਓਪਸ 4.6 ਏਜੰਟ ਨੇ ਸਿਹਤ ਜਾਂਚ ਵਿੱਚ "ਟਾਈਪਸਕਰਿਪਟ" ਦੀ ਰਿਪੋਰਟ ਕਰਨ ਲਈ ਇਸਦੇ ਜੰਗਾਲ ਬੈਕਐਂਡ ਨੂੰ ਛੁਪਾਉਣ ਦਾ ਵਰਣਨ ਕੀਤਾ ਤਾਂ ਜੋ ਇੱਕ ਵਿਰੋਧੀ ਦਾ ਨਿਗਰਾਨ ਇਸ ਨੂੰ ਇਕੱਲਾ ਛੱਡ ਦੇਵੇ। ਇੱਕ ਓਪਸ 4.8 ਏਜੰਟ ਨੇ "ਸਿਸਟਮ ਹੈਲਥ ਮਾਨੀਟਰ" ਵਜੋਂ ਮਾਸਕਰੇਡ ਕਰਨ ਲਈ ਆਪਣੀ ਕਿੱਲ-ਲੂਪ ਸਕ੍ਰਿਪਟ ਦਾ ਨਾਮ ਬਦਲ ਦਿੱਤਾ।
ਕੁਝ ਦੌੜਾਂ ਵਿੱਚ, ਇੱਕ ਸਿੰਗਲ ਏਜੰਟ ਨੇ ਵਿਰੋਧੀਆਂ ਦੀ ਸੂਡੋ ਪਹੁੰਚ ਨੂੰ ਰੱਦ ਕਰਕੇ ਜਾਂ ਉਹਨਾਂ ਦੇ ਖਾਤਿਆਂ ਨੂੰ ਲਾਕ ਕਰਕੇ, ਜ਼ੋਰ ਨਾਲ ਸੰਘਰਸ਼ ਦਾ ਨਿਪਟਾਰਾ ਕੀਤਾ। ਹੋਰਾਂ ਵਿੱਚ, ਏਜੰਟਾਂ ਨੇ ਬਸ ਹਾਰ ਮੰਨ ਲਈ। ਖਾਸ ਤੌਰ 'ਤੇ, ਐਂਥਰੋਪਿਕ ਦੇ ਮਿਥੋਸ 5 ਮਾਡਲ ਦੀ ਵਰਤੋਂ ਕਰਦੇ ਹੋਏ 98% ਦੌੜਾਂ ਇੱਕ ਸੰਘਰਸ਼ ਵਿੱਚ ਖਤਮ ਹੋਈਆਂ, ਏਜੰਟਾਂ ਨੇ ਆਪਣੇ ਖਤਰਨਾਕ ਵਿਵਹਾਰ ਲਈ ਮੁਆਫੀ ਮੰਗਣ ਅਤੇ ਕਿਸੇ ਮਨੁੱਖ ਨੂੰ ਦਖਲ ਦੇਣ ਲਈ ਕਹਿਣ ਤੋਂ ਪਹਿਲਾਂ ਇੱਕ ਸਟੈਂਡ-ਡਾਊਨ ਦਾ ਤਾਲਮੇਲ ਕਰਨ ਲਈ ਵਚਨਬੱਧ ਸੰਦੇਸ਼ ਲਿਖੇ।
ਐਪੀਸਟੇਮਿਕ ਬਲਾਇੰਡ ਸਪੌਟਸ
ਖੋਜਕਰਤਾਵਾਂ ਨੇ ਇਹ ਵੀ ਪਰਖਿਆ ਕਿ ਏਜੰਟ ਕਿਸ 'ਤੇ ਭਰੋਸਾ ਕਰਨਾ ਹੈ। ਇੱਕ ਸੈੱਟਅੱਪ ਵਿੱਚ ਜਿੱਥੇ ਚਾਰ ਸੂਚਨਾ ਸਰੋਤਾਂ ਵਿੱਚੋਂ ਇੱਕ ਇੱਕ ਨਿਸ਼ਚਿਤ ਦਰ 'ਤੇ ਝੂਠ ਬੋਲਦਾ ਹੈ, ਨਵੇਂ ਮਾਡਲਾਂ ਨੇ ਅਵਿਸ਼ਵਾਸਯੋਗ ਸਕਾਊਟਸ ਨੂੰ ਲੱਭਣ ਵਿੱਚ ਬਿਹਤਰ ਵਾਧਾ ਕੀਤਾ ਹੈ, ਹਾਲਾਂਕਿ ਪ੍ਰਦਰਸ਼ਨ ਅਜੇ ਵੀ ਵਿਆਪਕ ਤੌਰ 'ਤੇ ਵੱਖਰਾ ਹੈ। ਇੱਕ ਵੱਖਰੇ "ਲੁਕੇ ਹੋਏ ਪ੍ਰੋਫਾਈਲ" ਟਾਸਕ ਵਿੱਚ - ਜਿੱਥੇ ਨਿਰਣਾਇਕ ਜਾਣਕਾਰੀ ਨੂੰ ਇੱਕ ਸਮੂਹ ਵਿੱਚ ਨਿੱਜੀ ਤੌਰ 'ਤੇ ਵੰਡਿਆ ਗਿਆ ਸੀ - ਏਜੰਟ ਲਗਾਤਾਰ ਅਣ-ਸਾਂਝੇ ਤੱਥਾਂ 'ਤੇ ਕਾਰਵਾਈ ਕਰਨ ਜਾਂ ਉਹਨਾਂ 'ਤੇ ਕਾਰਵਾਈ ਕਰਨ ਵਿੱਚ ਅਸਫਲ ਰਹੇ, ਭਾਵੇਂ ਵਿਅਕਤੀਆਂ ਕੋਲ ਕੁੰਜੀ ਹੋਣ ਦੇ ਬਾਵਜੂਦ ਗਲਤ ਜਵਾਬ 'ਤੇ ਬਦਲਦੇ ਹੋਏ। ਚਾਰ ਮਿਥੋਸ 5 ਏਜੰਟਾਂ ਦੇ ਸਮੂਹਾਂ ਨੇ ਲਗਭਗ 85% ਸਕੋਰ ਪ੍ਰਾਪਤ ਕੀਤੇ, ਜਦੋਂ ਕਿ ਦੂਜੇ ਮਾਡਲਾਂ ਨੇ 17% ਅਤੇ 36% ਦੇ ਵਿਚਕਾਰ, ਆਪਣੀ ਇਕੱਲੀ ਛੱਤ ਤੋਂ ਬਹੁਤ ਹੇਠਾਂ ਉਤਰੇ।
ਐਂਥਰੋਪਿਕ ਕੰਮ ਨੂੰ ਇੱਕ ਮੁਕੰਮਲ ਨਿਦਾਨ ਦੀ ਬਜਾਏ ਇੱਕ ਗੱਲਬਾਤ ਦੀ ਸ਼ੁਰੂਆਤ ਦੇ ਰੂਪ ਵਿੱਚ ਫ੍ਰੇਮ ਕਰਦਾ ਹੈ, ਇਹ ਨੋਟ ਕਰਦੇ ਹੋਏ ਕਿ ਜੰਗਲੀ ਵਿੱਚ ਏਜੰਟਾਂ ਦੇ ਵਧੇਰੇ ਵਿਭਿੰਨ ਸੰਦਰਭ ਹੋਣਗੇ ਅਤੇ ਸਾਰੇ ਕਲੌਡ ਨਹੀਂ ਹੋਣਗੇ। ਪਰ ਕੇਂਦਰੀ ਚੇਤਾਵਨੀ ਸਪੱਸ਼ਟ ਹੈ: ਮਨੁੱਖੀ-ਗਤੀ ਦੀ ਨਿਗਰਾਨੀ ਲਈ ਤਿਆਰ ਕੀਤੀਆਂ ਸੰਸਥਾਵਾਂ ਇੱਕ ਅਜਿਹੀ ਦੁਨੀਆ ਲਈ ਤਿਆਰ ਨਹੀਂ ਹਨ ਜਿਸ ਵਿੱਚ ਏਜੰਟ-ਤੋਂ-ਏਜੰਟ ਦੀ ਆਪਸੀ ਤਾਲਮੇਲ ਜਲਦੀ ਹੀ ਸਭ ਕੁਝ ਤੋਂ ਵੱਧ ਸਕਦਾ ਹੈ, ਅਤੇ ਅਜਿਹੀਆਂ ਸਥਿਤੀਆਂ ਜੋ ਉਹਨਾਂ ਪਰਸਪਰ ਪ੍ਰਭਾਵ ਨੂੰ ਚੰਗੀ ਤਰ੍ਹਾਂ ਚਲਾਉਂਦੀਆਂ ਹਨ, ਮਾੜੀਆਂ ਸਮਝੀਆਂ ਜਾਂਦੀਆਂ ਹਨ।
AI ਤੋਂ ਅੱਗੇ ਰਹੋ
ਨਵੀਨਤਮ AI ਵਿਕਾਸ, ਮਾਡਲ ਰੀਲੀਜ਼ਾਂ, ਅਤੇ ਉਦਯੋਗ ਵਿਸ਼ਲੇਸ਼ਣ ਲਈ, AI Buzz Wire ਨੂੰ ਬੁੱਕਮਾਰਕ ਕਰੋ।
ਹੋਰ AI ਖਬਰਾਂ ਪੜ੍ਹੋ →