حفاظتی غیر منفعتی FAR.AI کے ایک نئے بینچ مارک کے مطابق، فرنٹیئر AI ماڈلز اس بات میں کافی مختلف ہیں کہ انہیں توڑنا کتنا مشکل ہے۔
29 جولائی کو، FAR.AI نے اپنا AI سیکیورٹی لیڈر بورڈ لانچ کیا، ایک جیسی حالتوں میں چار سرکردہ ماڈلز کے تحفظات کی جانچ کی۔ تنظیم نے کہا کہ اینتھروپک کے کلاڈ فیبل 5 اور اوپن اے آئی کے جی پی ٹی-5.6 سول نے حملوں کے خلاف مضبوطی سے کام لیا، جبکہ xAI کا گروک 4.5 اور گوگل کا جیمنی 3.1 پرو ہر ایک $300 سے کم میں ٹوٹ گیا۔ FAR.AI نے سب سے زیادہ اور کم سے کم مضبوط ماڈلز کے درمیان فرق کو حفاظتی اقدامات میں "سو گنا فرق" کے طور پر بیان کیا۔ For more context on this story, see our ongoing more AI stories.
لیڈر بورڈ کے ساتھ ساتھ، FAR.AI نے متعارف کرایا جسے وہ حفاظت کے لیے کم سے کم معیار کہتا ہے، ایک مشترکہ سیکیورٹی بیس لائن مکمل طور پر دفاع سے جمع کی گئی ہے جو ہم مرتبہ ڈویلپرز پہلے سے پیداوار میں چل رہے ہیں۔ مقصد یہ ہے کہ لیبز کو پورا کرنے کے لیے کنکریٹ کا فرش فراہم کیا جائے — اور کمزور تحفظات کو مرئی بنایا جائے۔
نتائج FAR.AI کے پہلے تناؤ کے ٹیسٹوں کی بازگشت کرتے ہیں۔ مئی کی ایک رپورٹ میں پتا چلا ہے کہ DeepSeek-V4-Pro کے حفاظتی اقدامات "تقریباً مکمل طور پر منہدم ہو چکے ہیں"، جس میں کم مہارت والے حملہ آور ہر ڈومین کے ٹیسٹ کیے گئے وقت کے 98-100% حفاظتی طریقہ کار کو نظرانداز کرتے ہیں۔ ماڈل کے پیشرو کے لیے بنایا گیا عوامی طور پر دستیاب جیل بریک نے بغیر کسی ترمیم کے کام کیا، جس سے معلوم ہوتا ہے کہ معلوم کمزوریوں کا پیچھا نہیں کیا گیا۔
WIRED، لیڈر بورڈ پر رپورٹنگ کرتے ہوئے، یہ نتیجہ اخذ کیا کہ "کچھ فرنٹیئر AI ماڈلز کو جیل بریک کرنا خوفناک حد تک آسان ہے۔" جیسا کہ ایجنٹ زیادہ حساس کام انجام دیتے ہیں، تفاوت اس بارے میں اہم سوالات اٹھاتا ہے کہ کون سے نظام تعینات کرنے کے لیے محفوظ ہیں۔
AI حفاظت اور حفاظتی تحقیق کی مسلسل کوریج کے لیے، قارئین AI Buzz Wire کی پیروی کر سکتے ہیں۔
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →