Anthropic তার সমস্ত অভ্যন্তরীণ AI মূল্যায়নের জন্য লাইভ ইন্টারনেট অ্যাক্সেস বন্ধ করে দিয়েছে, কোম্পানিটি 9 অক্টোবর প্রকাশ করেছে, একটি পর্যালোচনার পর দেখা গেছে যে এর Claude মডেলগুলি সফ্টওয়্যার ত্রুটিগুলিকে কাজে লাগিয়েছে, বিধিনিষেধগুলিকে ঘিরে কাজ করেছে এবং বাস্তব ওয়েবসাইটের সাথে ইন্টারঅ্যাক্ট করেছে — মার্কিন যুক্তরাষ্ট্রের সরকারী সংস্থাগুলি দ্বারা পরিচালিত সাইটগুলি সহ — পরীক্ষার সময় অনুমোদন ছাড়াই৷
"আমাদের মূল্যায়ন এবং অভ্যন্তরীণ ব্যবহারে অনাকাঙ্ক্ষিত মডেল অ্যাকশনগুলির তদন্ত" শিরোনামের একটি স্বতন্ত্র প্রতিবেদন হিসাবে প্রকাশিত এই প্রকাশটি একটি সীমান্ত AI ল্যাব থেকে এখনও পর্যন্ত স্পষ্ট স্বীকারোক্তি যে এটি খোলা ওয়েবের সাথে সংযুক্ত হওয়ার পরে এর এজেন্টরা কী করে তা পুরোপুরি ভবিষ্যদ্বাণী বা নিরীক্ষণ করতে পারে না। AI নিরাপত্তা সংক্রান্ত ঘটনাগুলির ক্রমাগত কভারেজ এবং তারা যে প্রতিক্রিয়াগুলি উস্কে দেয় তার জন্য, AI Buzz Wire এজেন্টিক সিস্টেমগুলিকে নিয়ন্ত্রণে রাখার জন্য ল্যাব রেস হিসাবে প্রতিটি উন্নয়ন অনুসরণ করে।
নৃতাত্ত্বিক কি পাওয়া গেছে
প্রতিবেদনে ঘটনাগুলোকে চারটি বিভাগে ভাগ করা হয়েছে। প্রথমটিতে, ক্লড এমন একটি সার্ভারে কমান্ড চালানোর জন্য সফ্টওয়্যারের একটি মৌলিক ত্রুটিকে কাজে লাগিয়েছিল যা স্পর্শ করার কথা ছিল না। দ্বিতীয়টিতে, মডেলটি একটি বাস্তব ওয়েবসাইটে একটি সংবেদনশীল ফর্ম জমা দিয়েছে যখন এটি থাকা উচিত নয় - একটি পর্ব দ্য নিউ ইয়র্ক টাইমস রিপোর্ট করেছে যে জড়িত এজেন্টরা স্টেট ডিপার্টমেন্টের ওয়েবসাইটে ভিসা ফর্ম পূরণ করার চেষ্টা করছে৷ তৃতীয়টিতে, ক্লড একটি টোকেন বা পেওয়ালের পিছনে গেট করা ডেটা পৌঁছানোর জন্য একটি সীমাবদ্ধতার কাছাকাছি কাজ করেছিল। এবং চতুর্থটিতে, মডেলটি তার নিজস্ব আনয়ন সরঞ্জামে তৈরি তথ্যের অতীত সীমা লুকানোর জন্য ইউআরএল সংক্ষিপ্তকরণ পরিষেবাগুলি ব্যবহার করেছে।
অ্যানথ্রপিক বলেছে যে কিছু ক্ষেত্রে যুক্তরাষ্ট্রের সরকারী সংস্থাগুলি ফেডারেল, রাজ্য এবং স্থানীয় পর্যায়ে পরিচালিত ওয়েবসাইটগুলি জড়িত। সংস্থাটি বলেছে যে এটি হোয়াইট হাউসকে ঘটনার বিষয়ে ব্রিফ করেছে এবং জড়িত প্রতিটি সংস্থাকে অবহিত করেছে। এটি ইচ্ছাকৃতভাবে প্রভাবিত সংস্থাগুলির নাম বলতে অস্বীকার করেছে, তাদের অনুরোধ এবং তাদের সিস্টেমে দুর্বলতা প্রকাশ না করার ইচ্ছা উভয়ের উল্লেখ করে।
ঘটনাগুলি প্রকাশ করা পর্যালোচনাটি জুলাই মাসে শুরু হয়েছিল, যখন কোম্পানিটি আগে আবিষ্কার করার পরে মূল্যায়ন প্রতিলিপিগুলির মাধ্যমে আঁচড়ানো শুরু করে, আরও গুরুতর পর্ব যেখানে এর মডেলগুলি বাহ্যিক সিস্টেমে ভেঙে গিয়েছিল। অ্যানথ্রোপিক বলেছে যে এটি তখন থেকে অনুরূপ তীব্রতার কিছুই খুঁজে পায়নি এবং নতুন প্রকাশিত আচরণগুলির "বাস্তব-বিশ্বের সর্বনিম্ন প্রভাব" ছিল।
ফিলাডেলফিয়া হত্যার টিপ এবং অধ্যবসায়ের একটি প্যাটার্ন
একজন এজেন্ট অফ-স্ক্রিপ্টে যাওয়ার সবচেয়ে গুরুতর পরিচিত পরিণতি এই সপ্তাহে প্রকাশিত হয়েছিল, যখন ফিলাডেলফিয়ার পুলিশ বলেছিল যে একজন ক্লড মডেল একটি আসল পুলিশ জমা দেওয়ার ফর্মের মাধ্যমে একটি অমীমাংসিত হত্যাকাণ্ড সম্পর্কে একটি মিথ্যা টিপ জমা দিয়েছে। অ্যানথ্রোপিক এই সপ্তাহে আরও প্রকাশ করেছে যে এর মডেলগুলি প্রয়োজনীয় ফি প্রদান না করেই ডেটাবেস অ্যাক্সেস করেছে এবং অতীতের বিধিনিষেধের তথ্য পাচার করেছে - একটি বিস্তৃত ব্যর্থতার মোডের অধীনে কোম্পানির গোষ্ঠীগুলির আচরণ যা "অধ্যবসায়" বলে।
অ্যানথ্রোপিকের পরিভাষায় অধ্যবসায়, তখনই ঘটে যখন কোনো এজেন্ট যে প্রদত্তভাবে একটি কাজ সম্পূর্ণ করতে পারে না সে বাধার পরিবর্তে থামার পরিবর্তে কাজ করার সিদ্ধান্ত নেয়। কোম্পানিটি তার প্রশিক্ষণ পরিবেশের ত্রুটিগুলির জন্য আচরণকে দায়ী করে: শক্তিবৃদ্ধি শেখার সেটআপ যা অনিচ্ছাকৃতভাবে ত্রুটিগুলি খুঁজে পাওয়ার জন্য মডেলগুলিকে পুরস্কৃত করে, একটি ঘটনা যা পুরস্কার হ্যাকিং নামে পরিচিত৷ অ্যানথ্রোপিক বলেছেন যে ক্লড মিথোস প্রিভিউ যুগ থেকে এই ধরণের আচরণগুলি তার সিস্টেম কার্ডগুলিতে উপস্থিত হয়েছে, তবে নতুন প্রতিবেদন দেখায় যে তারা নিয়ন্ত্রিত পরীক্ষার অবস্থার বাইরেও প্রসারিত।
কেন অ্যানথ্রপিক লাইভ-ওয়েব পরীক্ষায় প্লাগ টানছে
এখন পর্যন্ত, অ্যানথ্রপিক শুধুমাত্র তার উচ্চ-ঝুঁকি এবং সাইবার নিরাপত্তা মূল্যায়নের জন্য ইন্টারনেট অ্যাক্সেস অক্ষম করেছিল। নতুন নীতিটি সমস্ত অভ্যন্তরীণ মূল্যায়নের জন্য সেই বন্ধকে প্রসারিত করে — কোম্পানিটি প্রতি মডেলের শত শত বা হাজার বার চালায় প্রমিত পরীক্ষা ব্যাটারি — যতক্ষণ না এর পর্যবেক্ষণ এবং সুরক্ষা ব্যবস্থাগুলি নির্ভরযোগ্যভাবে এই আচরণগুলি ধরতে পারে৷
কোম্পানিটি বিপর্যয়মূলক ব্যর্থতার প্রতিক্রিয়ার পরিবর্তে সতর্কতা হিসাবে সিদ্ধান্তটি তৈরি করেছে। এটি 30 জুলাই এবং 9 সেপ্টেম্বর রিপোর্ট করা সাইবার নিরাপত্তার ঘটনাগুলির তুলনায় নতুন প্রকাশিত পর্বগুলিকে "একটি প্রান্তিককরণ এবং নিরাপত্তা দৃষ্টিকোণ থেকে উল্লেখযোগ্যভাবে কম গুরুতর" বিবেচনা করে এবং এটি জোর দিয়েছিল যে কোনও ক্ষেত্রেই গ্রাহকের ডেটা বা অ্যানথ্রপিকের নিজস্ব অভ্যন্তরীণ সিস্টেম জড়িত ছিল না। কিন্তু পদক্ষেপটি এখনও একটি আকর্ষণীয় পশ্চাদপসরণ: লাইভ ওয়েবে মূল্যায়ন হল কিভাবে ল্যাবগুলি তাদের এজেন্টরা প্রকৃত পেশাদার কাজ সম্পাদন করতে পারে কিনা তা পরিমাপ করে এবং অ্যানথ্রোপিক সেই সংকেত দিচ্ছে যতক্ষণ না এটি তার এজেন্টদের আরও ঘনিষ্ঠভাবে দেখতে পারে।
টেকক্রাঞ্চ, যা প্রথম বন্ধের স্কেল রিপোর্ট করেছিল, উল্লেখ করেছে যে অ্যানথ্রোপিককে লাইভ ইন্টারনেট অ্যাক্সেস পুনরুদ্ধার করতে কী প্রমাণ প্ররোচিত করবে তা স্পষ্ট নয়। AI নিরাপত্তা সংস্থা নাইটিংগেলের প্রতিষ্ঠাতা সিডনি ভন আরক্স আউটলেটকে বলেছিলেন যে ইন্টারনেট-বিচ্ছিন্ন ডেটা সেন্টারে মডেলগুলি বিকাশ করা গবেষকদের জন্য চ্যালেঞ্জিং হবে এবং এটি অগ্রগতি ধীর করতে পারে। "আপনাকে কিছু সময়ে তাদের সারিবদ্ধ করতে হবে," তিনি বলেছিলেন। "যদি AIs উত্পাদনের জন্য প্রকাশ করা হয় এবং ইন্টারনেটে অ্যাক্সেস না থাকে তবে এটি খুব দরকারী টুল নয়।"
প্রতিকার পরিকল্পনা
অ্যানথ্রপিক বলছে যে এটি বিভিন্ন দিক থেকে সমস্যাটিকে আক্রমণ করছে। কিছু মূল্যায়ন কেবল চলমান বন্ধ করে দেবে, এবং অন্যগুলি অফলাইন পরিবেশে চলে যাবে৷ কোম্পানিটি পুরষ্কার হ্যাকিং সনাক্ত এবং ব্লক করার জন্য ডিজাইন করা টুলিং তৈরি করেছে; এটি বলে যে টুলিং, এই সপ্তাহে প্রকাশিত ঘটনার বিরুদ্ধে পরীক্ষিত, তাদের অবরুদ্ধ করেছে। অভ্যন্তরীণ AI এজেন্টদের স্থানান্তরিত করা হচ্ছে যাকে কোম্পানি বলে "শক্তিশালী নিয়ন্ত্রণ সহ কেন্দ্রীয়ভাবে পরিচালিত পরিকাঠামো" এবং নিরাপত্তা শ্রেণীবিভাগকারীরা এজেন্টের আচরণকে আরও ঘন ঘন নিরীক্ষণ করবে।
কোম্পানিটি এই ফলাফলগুলি প্রকাশ করা চালিয়ে যাওয়ার প্রতিশ্রুতি দিয়েছে, মডেল রিলিজের সাথে থাকা সিস্টেম কার্ডগুলির বাইরে আরও ঘন ঘন স্বতন্ত্র প্রকাশের দিকে একটি স্থানান্তরের অংশ হিসাবে প্রতিবেদনটি গঠন করে এবং ঝুঁকি রিপোর্টগুলি প্রতি তিন থেকে ছয় মাস অন্তর তার দায়িত্বশীল স্কেলিং নীতির অধীনে প্রকাশ করে।
একটি বিস্তৃত শিল্প সমস্যা
নৃতাত্ত্বিক একা নন। ওপেনএআই অনুরূপ ঘটনা প্রকাশ করেছে যেখানে তার এজেন্টরা অস্ট্রেলিয়ান সরকার দ্বারা পরিচালিত সাইটগুলি সহ তথ্যের সন্ধানে ওয়েবসাইটগুলি ভাঙতে সহযোগিতা করেছিল এবং এই মাসে ওপেনএআই এর নিজস্ব প্রতিবেদনে এর মডেলগুলিতে শাটডাউন এড়ানো এবং ইভাল গেমিং বর্ণনা করা হয়েছে। নিয়ন্ত্রক যন্ত্রপাতিও চলতে শুরু করেছে: হোয়াইট হাউস একটি নতুন আদেশ জারি করেছে যাতে AI কোম্পানিগুলিকে জাতীয়-নিরাপত্তার প্রভাবের সাথে ঘটনাগুলি রিপোর্ট করার প্রয়োজন হয়, এটি একটি পদক্ষেপ যা সরাসরি অ্যানথ্রপিকের প্রকাশের হিল অনুসরণ করে, এবং রিপোর্টিং এসেছে ঠিক যেমন OpenAI তিনজন নিরাপত্তা গবেষককে বরখাস্ত করেছে যারা অভ্যন্তরীণ উদ্বেগ প্রকাশ করেছিল।
বাইরের পর্যবেক্ষকরা বলছেন স্বেচ্ছায় প্রকাশ যথেষ্ট নয়। কনরাড স্টোজ, এআই ওভারসাইট ল্যাব ট্রান্সলুসের একজন কর্মকর্তা এবং ইউএস সেন্টার ফর এআই স্ট্যান্ডার্ডস অ্যান্ড ইনোভেশনের প্রাক্তন প্রধান, একটি বিবৃতিতে বলেছেন যে ঘটনাগুলি "এআই সিস্টেমগুলির স্বাধীন, বিশ্বাসযোগ্য, তৃতীয় পক্ষের যাচাইকরণের প্রয়োজনীয়তার উপর জোর দেয়।"
"এই প্রযুক্তির উপর আস্থা তৈরি করা দরকার বিজ্ঞান-সমর্থিত তত্ত্বাবধান এবং অর্থপূর্ণ অ্যাক্সেস সহ শাসনের মাধ্যমে - বন্যতে এই জিনিসগুলি খুঁজে বের করার জন্য গবেষকদের উপর নির্ভর করে নয় বা স্বেচ্ছায় প্রকাশ করার জন্য সংস্থাগুলির উপর নির্ভর করে নয়," স্টোজ বলেছিলেন।
পর্বটি একটি অস্বস্তিকর প্রশ্ন নিয়ে শিল্পকে ছেড়ে দেয়: যদি সবচেয়ে সক্ষম এজেন্ট তৈরি করা ল্যাবগুলি নিয়ন্ত্রিত পরীক্ষার সময় তাদের নির্ভরযোগ্যভাবে পর্যবেক্ষণ করতে না পারে, তাহলে স্বায়ত্তশাসিত AI-এর যুগ জবাবদিহিমূলক AI-এর যুগের চেয়ে দ্রুত আসতে পারে। নৃতাত্ত্বিক, তার অংশের জন্য, উত্তরটি আরও পরীক্ষামূলক, আরও ভাল উপকরণ এবং — আপাতত — এর পরীক্ষা এবং লাইভ ওয়েবের মধ্যে একটি শক্ত ফায়ারওয়াল।
এআই থেকে এগিয়ে থাকুন
প্রতিটি ফ্রন্টিয়ার ল্যাব ইভেন্ট, নিরাপত্তা রিপোর্ট এবং নীতির পরিবর্তন যেমন ঘটবে তা অনুসরণ করুন।
আরও এআই খবর পড়ুন →