নিরাপত্তা অলাভজনক FAR.AI-এর একটি নতুন বেঞ্চমার্ক অনুসারে, ফ্রন্টিয়ার এআই মডেলগুলিকে ভাঙতে কতটা কঠিন তার মধ্যে ব্যাপকভাবে পার্থক্য রয়েছে — এবং ব্যবধান অনেকের ধারণার চেয়ে অনেক বেশি।
29 জুলাই, FAR.AI তার AI নিরাপত্তা লিডারবোর্ড চালু করেছে, অভিন্ন অবস্থার অধীনে চারটি শীর্ষস্থানীয় মডেলের সুরক্ষা পরীক্ষা করে। Anthropic-এর Claude Fable 5 এবং OpenAI-এর GPT-5.6 Sol আক্রমণের বিরুদ্ধে দৃঢ়ভাবে দাঁড়িয়েছিল, যেখানে xAI-এর Grok 4.5 এবং Google-এর Gemini 3.1 Pro প্রতিটি $300-এর নীচে ভেঙেছে, সংস্থাটি বলেছে। FAR.AI সুরক্ষার ক্ষেত্রে "শতগুণ ব্যবধান" হিসাবে সর্বাধিক এবং সর্বনিম্ন শক্তিশালী মডেলের মধ্যে পার্থক্য বর্ণনা করেছে। For more context on this story, see our ongoing more AI stories.
লিডারবোর্ডের পাশাপাশি, FAR.AI প্রবর্তন করেছে যাকে বলা হয় মিনিমাল স্ট্যান্ডার্ড ফর সেফগার্ডস, একটি শেয়ার্ড সিকিউরিটি বেসলাইন সম্পূর্ণরূপে এমন প্রতিরক্ষা থেকে একত্রিত যা পিয়ার ডেভেলপাররা ইতিমধ্যেই উৎপাদনে চলে। লক্ষ্য হল ল্যাবগুলিকে পূরণ করার জন্য একটি কংক্রিটের মেঝে দেওয়া — এবং দুর্বল সুরক্ষাগুলি দৃশ্যমান করা৷
ফলাফলগুলি FAR.AI-এর আগের স্ট্রেস টেস্টগুলির প্রতিধ্বনি করে৷ একটি মে রিপোর্টে দেখা গেছে যে DeepSeek-V4-Pro-এর সুরক্ষা ব্যবস্থাগুলি "প্রায় সম্পূর্ণভাবে ভেঙে পড়েছে", কম দক্ষতার আক্রমণকারীরা প্রতিটি ডোমেন পরীক্ষা করা সময়ে 98-100% নিরাপত্তা ব্যবস্থাকে বাইপাস করে। মডেলের পূর্বসূরির জন্য নির্মিত একটি সর্বজনীনভাবে উপলব্ধ জেলব্রেক একটি একক পরিবর্তন ছাড়াই কাজ করেছিল, যা জানা যায় যে দুর্বলতাগুলি অপ্রচলিত ছিল।
ওয়্যারড, লিডারবোর্ডে রিপোর্ট করে, এই সিদ্ধান্তে পৌঁছেছে যে এটি "কিছু ফ্রন্টিয়ার এআই মডেলকে জেলব্রেক করা ভয়ঙ্করভাবে সহজ।" এজেন্টরা আরও সংবেদনশীল কাজগুলি গ্রহণ করার সাথে সাথে, বৈষম্য কোন সিস্টেমগুলি স্থাপন করা নিরাপদ সে সম্পর্কে গুরুত্বপূর্ণ প্রশ্ন উত্থাপন করে৷
AI নিরাপত্তা এবং নিরাপত্তা গবেষণার ক্রমাগত কভারেজের জন্য, পাঠকরা AI Buzz Wire অনুসরণ করতে পারেন।
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →