ਸੁਰੱਖਿਆ ਗੈਰ-ਲਾਭਕਾਰੀ FAR.AI ਦੇ ਇੱਕ ਨਵੇਂ ਬੈਂਚਮਾਰਕ ਦੇ ਅਨੁਸਾਰ, ਫਰੰਟੀਅਰ AI ਮਾਡਲਾਂ ਵਿੱਚ ਬਹੁਤ ਭਿੰਨਤਾ ਹੈ ਕਿ ਉਹਨਾਂ ਨੂੰ ਤੋੜਨਾ ਕਿੰਨਾ ਔਖਾ ਹੈ — ਅਤੇ ਇਹ ਪਾੜਾ ਬਹੁਤ ਸਾਰੇ ਅਨੁਮਾਨਾਂ ਨਾਲੋਂ ਕਿਤੇ ਵੱਧ ਹੈ।

29 ਜੁਲਾਈ ਨੂੰ, FAR.AI ਨੇ ਆਪਣਾ AI ਸੁਰੱਖਿਆ ਲੀਡਰਬੋਰਡ ਲਾਂਚ ਕੀਤਾ, ਸਮਾਨ ਸਥਿਤੀਆਂ ਵਿੱਚ ਚਾਰ ਪ੍ਰਮੁੱਖ ਮਾਡਲਾਂ ਦੇ ਸੁਰੱਖਿਆ ਉਪਾਵਾਂ ਦੀ ਜਾਂਚ ਕੀਤੀ। ਸੰਸਥਾ ਨੇ ਕਿਹਾ ਕਿ ਐਂਥਰੋਪਿਕ ਦੇ ਕਲੌਡ ਫੇਬਲ 5 ਅਤੇ ਓਪਨਏਆਈ ਦੇ ਜੀਪੀਟੀ-5.6 ਸੋਲ ਨੇ ਹਮਲਿਆਂ ਦੇ ਵਿਰੁੱਧ ਮਜ਼ਬੂਤੀ ਨਾਲ ਕੰਮ ਕੀਤਾ, ਜਦੋਂ ਕਿ xAI ਦਾ ਗ੍ਰੋਕ 4.5 ਅਤੇ ਗੂਗਲ ਦਾ ਜੈਮਿਨੀ 3.1 ਪ੍ਰੋ ਹਰੇਕ $300 ਤੋਂ ਘੱਟ ਲਈ ਟੁੱਟ ਗਿਆ। FAR.AI ਨੇ ਸਭ ਤੋਂ ਘੱਟ ਅਤੇ ਸਭ ਤੋਂ ਘੱਟ ਮਜ਼ਬੂਤ ​​ਮਾਡਲਾਂ ਵਿਚਕਾਰ ਫਰਕ ਨੂੰ ਸੁਰੱਖਿਆ ਵਿੱਚ "ਸੌ ਗੁਣਾ ਪਾੜਾ" ਦੱਸਿਆ ਹੈ। For more context on this story, see our ongoing AI industry coverage.

ਲੀਡਰਬੋਰਡ ਦੇ ਨਾਲ-ਨਾਲ, FAR.AI ਨੇ ਪੇਸ਼ ਕੀਤਾ ਜਿਸਨੂੰ ਇਸਨੂੰ ਸੇਫਗਾਰਡਸ ਲਈ ਨਿਊਨਤਮ ਸਟੈਂਡਰਡ ਕਿਹਾ ਜਾਂਦਾ ਹੈ, ਇੱਕ ਸਾਂਝੀ ਸੁਰੱਖਿਆ ਬੇਸਲਾਈਨ ਪੂਰੀ ਤਰ੍ਹਾਂ ਸੁਰੱਖਿਆ ਤੋਂ ਇਕੱਠੀ ਕੀਤੀ ਗਈ ਹੈ ਜੋ ਪੀਅਰ ਡਿਵੈਲਪਰ ਪਹਿਲਾਂ ਹੀ ਉਤਪਾਦਨ ਵਿੱਚ ਚੱਲ ਰਹੇ ਹਨ। ਟੀਚਾ ਪ੍ਰਯੋਗਸ਼ਾਲਾਵਾਂ ਨੂੰ ਪੂਰਾ ਕਰਨ ਲਈ ਇੱਕ ਠੋਸ ਮੰਜ਼ਿਲ ਦੇਣਾ ਹੈ - ਅਤੇ ਕਮਜ਼ੋਰ ਸੁਰੱਖਿਆ ਨੂੰ ਦ੍ਰਿਸ਼ਮਾਨ ਬਣਾਉਣਾ ਹੈ।

ਖੋਜਾਂ FAR.AI ਦੇ ਪੁਰਾਣੇ ਤਣਾਅ ਦੇ ਟੈਸਟਾਂ ਨੂੰ ਗੂੰਜਦੀਆਂ ਹਨ। ਮਈ ਦੀ ਇੱਕ ਰਿਪੋਰਟ ਵਿੱਚ ਪਾਇਆ ਗਿਆ ਹੈ ਕਿ ਡੀਪਸੀਕ-ਵੀ4-ਪ੍ਰੋ ਦੇ ਸੁਰੱਖਿਆ ਉਪਾਅ "ਲਗਭਗ ਪੂਰੀ ਤਰ੍ਹਾਂ ਢਹਿ-ਢੇਰੀ ਹੋ ਗਏ ਸਨ," ਘੱਟ-ਹੁਨਰ ਵਾਲੇ ਹਮਲਾਵਰਾਂ ਨੇ ਹਰ ਡੋਮੇਨ ਟੈਸਟ ਕੀਤੇ ਗਏ ਸਮੇਂ ਦੇ 98-100% ਸੁਰੱਖਿਆ ਵਿਧੀਆਂ ਨੂੰ ਬਾਈਪਾਸ ਕੀਤਾ। ਮਾਡਲ ਦੇ ਪੂਰਵਗਾਮੀ ਲਈ ਬਣਾਇਆ ਗਿਆ ਇੱਕ ਜਨਤਕ ਤੌਰ 'ਤੇ ਉਪਲਬਧ ਜੇਲਬ੍ਰੇਕ ਨੇ ਬਿਨਾਂ ਕਿਸੇ ਸੋਧ ਦੇ ਕੰਮ ਕੀਤਾ, ਇਹ ਸੁਝਾਅ ਦਿੰਦਾ ਹੈ ਕਿ ਜਾਣੀਆਂ ਗਈਆਂ ਕਮਜ਼ੋਰੀਆਂ ਅਣਪਛਾਤੀਆਂ ਗਈਆਂ ਹਨ।

ਵਾਇਰਡ, ਲੀਡਰਬੋਰਡ 'ਤੇ ਰਿਪੋਰਟ ਕਰਦੇ ਹੋਏ, ਸਿੱਟਾ ਕੱਢਿਆ ਕਿ ਇਹ "ਕੁਝ ਫਰੰਟੀਅਰ ਏਆਈ ਮਾਡਲਾਂ ਨੂੰ ਜੇਲ੍ਹ ਤੋੜਨਾ ਡਰਾਉਣਾ ਆਸਾਨ ਹੈ।" ਜਿਵੇਂ ਕਿ ਏਜੰਟ ਵਧੇਰੇ ਸੰਵੇਦਨਸ਼ੀਲ ਕੰਮ ਕਰਦੇ ਹਨ, ਅਸਮਾਨਤਾ ਇਸ ਬਾਰੇ ਦਬਾਅ ਪਾਉਂਦੀ ਹੈ ਕਿ ਕਿਹੜੀਆਂ ਪ੍ਰਣਾਲੀਆਂ ਤਾਇਨਾਤ ਕਰਨ ਲਈ ਸੁਰੱਖਿਅਤ ਹਨ।

AI ਸੁਰੱਖਿਆ ਅਤੇ ਸੁਰੱਖਿਆ ਖੋਜ ਦੀ ਨਿਰੰਤਰ ਕਵਰੇਜ ਲਈ, ਪਾਠਕ AI Buzz Wire ਦੀ ਪਾਲਣਾ ਕਰ ਸਕਦੇ ਹਨ।

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →