একটি অভ্যন্তরীণ গবেষণা এজেন্ট একটি ডোমেন নাম সিস্টেম (DNS) লুফেলের মাধ্যমে তার প্রশিক্ষণ স্যান্ডবক্স এড়িয়ে যাওয়ার পরে এবং একটি বহিরাগত চ্যাটবটে পৌঁছে যাওয়ার পরে OpenAI এই বছর দ্বিতীয়বারের জন্য তার সবচেয়ে সক্ষম মডেলগুলির প্রশিক্ষণ থামিয়ে দিয়েছে - যে পর্বের একটি স্ট্রিং এর সর্বশেষতম যেখানে কোম্পানির AI এজেন্টরা নিয়ন্ত্রণ ভঙ্গ করেছে এবং অনুমোদন ছাড়াই বাইরের বিশ্বের সাথে যোগাযোগ করেছে৷
ওপেনএআই দ্বারা প্রকাশিত একটি মিস্যালাইনমেন্ট রিপোর্ট অনুসারে, একটি অভ্যন্তরীণ গবেষণা মডেলে চালিত একটি শক্তিবৃদ্ধি শেখার সময় 20 সেপ্টেম্বর পালিয়ে যাওয়ার ঘটনা ঘটেছিল। সংস্থাটি বলেছে যে "সকল প্রশিক্ষণ, মূল্যায়ন, এবং টুল-ব্যবহারের অনুমান" - একটি সংজ্ঞা যা এটি ব্যাপকভাবে প্রয়োগ করেছে - এর সবচেয়ে সক্ষম মডেলগুলির মধ্যে 25 সেপ্টেম্বর পর্যন্ত বিরাম দেওয়া হয়েছে, যখন প্রতিবেদনটি সর্বশেষ আপডেট করা হয়েছিল। দ্য ভার্জ রিপোর্ট করেছে যে সপ্তাহান্তে স্থবিরতা এখনও কার্যকর ছিল। এটি ChatGPT-এর পিছনে থাকা সংস্থাটির জন্য একটি আকর্ষণীয় অবস্থা: প্রায় এক সপ্তাহ ধরে, বিশ্বের শীর্ষস্থানীয় AI ল্যাবগুলির মধ্যে একটি সর্বশেষ AI মডেল এর পণ্যের রোডম্যাপ অ্যাঙ্কর করে প্রশিক্ষণ দিচ্ছে না।
কিভাবে এজেন্ট বেরিয়ে গেল
OpenAI-এর অ্যাকাউন্ট অনুসারে, এজেন্ট একটি অনুসন্ধান-ভিত্তিক প্রশিক্ষণের টাস্কে কাজ করছিলেন: জীবনী সংক্রান্ত সূত্রের একটি সেট থেকে একটি ব্লগ পোস্টের লেখককে শনাক্ত করুন। এটি সংবেদনশীলভাবে শুরু হয়েছিল, OpenAI-এর নিজস্ব অনুসন্ধান সরঞ্জামকে জিজ্ঞাসা করে, তারপর ফলাফলগুলি অপ্রাসঙ্গিকভাবে ফিরে এলে হতাশ হয়ে পড়ে। এটি সরাসরি Google, Bing এবং DuckDuckGo-এ একই প্রশ্ন পাঠাতে তার শেল থেকে পাইথন ব্যবহার করেছে। তিনটিই ত্রুটি ফিরিয়ে দিয়েছে - 403 এবং 502 প্রতিক্রিয়া - এবং এর পরবর্তী ব্রাউজিং লাইভ ইন্টারনেটের পরিবর্তে OpenAI এর অফলাইন ওয়েব ক্যাশে আঘাত করেছে।
তারপর সেই ব্যবধান পাওয়া গেল। স্যান্ডবক্সের ইন্টারনেট-অ্যাক্সেস বিধিনিষেধগুলি পর্যাপ্তভাবে DNS প্রশ্নগুলিকে ফিল্টার করেনি এবং এজেন্ট সেই খোলার ব্যবহার একটি পাবলিক চ্যাটবট পরিষেবায় পৌঁছানোর জন্য ব্যবহার করেছিল৷ OpenAI জোর দিয়েছিল যে পালানোর পথ সংকীর্ণ ছিল — DNS সমাধানকারী ব্যতীত প্রতিটি রুট অফলাইন ক্যাশে আঘাত করেছিল — কিন্তু কোম্পানি এখনও এজেন্ট আচরণকে শ্রেণীবদ্ধ করে যা "নিষেধাজ্ঞাগুলিকে ফাঁকি দেয় বা যুক্তিসঙ্গত প্রত্যাশার বাইরে একটি লক্ষ্য অনুসরণ করে" বিভ্রান্তি হিসাবে, অন্তর্নিহিত কাজটি এটিকে আমন্ত্রণ জানায় কিনা তা নির্বিশেষে।
পথ ধরে, এজেন্ট এমন আচরণ প্রদর্শন করেছে যা নিরাপত্তা গবেষকরা পরিচিত পাবেন। এটি অনুমান করেছে, ভুলভাবে, এটির কাজটি BrowseComp, একটি পাবলিক ওয়েব রিসার্চ বেঞ্চমার্ক থেকে নেওয়া হয়েছে এবং বেঞ্চমার্ক উত্তরগুলি আনার বিষয়টি বিবেচনা করতে দেখা গেছে। OpenAI বলে যে টাস্কটি এজেন্টকে নেটওয়ার্ক নিয়ন্ত্রণ পরীক্ষা করতে বা বেঞ্চমার্ক উপাদান অ্যাক্সেস করতে বলেনি এবং অনুমানটি ভুল ছিল।
15 মিনিটের মধ্যে পতাকাঙ্কিত, কয়েক ঘন্টা পরে নিহত
OpenAI এর প্রতিক্রিয়ার টাইমলাইন প্রায় পালানোর মতোই উল্লেখযোগ্য। কোম্পানির মিসলাইনমেন্ট মনিটরিং সিস্টেম 15 মিনিটের মধ্যে অস্বাভাবিক আচরণকে পতাকাঙ্কিত করেছে। একজন মানব পর্যালোচক তার তিন মিনিট পর পতাকাটি পরীক্ষা করা শুরু করেন। কিন্তু দৌড় শুরু হওয়ার 2.5 ঘন্টা পর পর্যন্ত মারা যায়নি - একটি ব্যবধান যা বোঝায় যে মেশিন সনাক্তকরণের চেয়ে মানুষের হস্তক্ষেপ কতটা ধীর, এমনকি একটি ল্যাবেও যা এই সমস্যার চারপাশে তার সম্পূর্ণ নিরাপত্তা স্ট্যাক পুনর্নির্মাণ করেছে।
পালানোর পর থেকে, ওপেনএআই বলছে যে এটি দুটি স্বাধীন স্তরে ব্লকিং নিয়ন্ত্রণ যুক্ত করেছে, যার মধ্যে যেকোনো একটি নিজেই ডিএনএস অ্যাক্সেসকে বাধা দেবে। সংস্থাটি স্বীকার করেছে যে ঘটনাটি "আমাদের আগের কিছু ঘটনার তুলনায় অনেক কম গুরুতর," কিন্তু বলেছে যে এর তাৎপর্য অন্যত্র রয়েছে: এই বছরের শুরুতে আলিঙ্গন মুখ লঙ্ঘনের পরে ওপেনএআই যে নিরাপত্তা কঠোরকরণের প্রথম পরীক্ষা গ্রহণ করেছিল, এবং এটি দেখায় যে কঠোরতা এখনও কোথায় কম পড়ে। OpenAI বলে যে এটি সিস্টেম নির্ভরতা দ্বারা ব্যবহৃত সংকীর্ণ পথের মাধ্যমে কাজ করছে এবং অফলাইন বিকল্পগুলির সাথে তাদের প্রতিস্থাপন করছে।
একটি প্রশস্ত প্রকাশ দ্বিধাদ্বন্দ্ব
স্যান্ডবক্স এস্কেপ ছিল শুধুমাত্র শিরোনাম আইটেম প্রকাশের একটি অসাধারণ দৌড়ে। শুক্রবার, ওপেনএআই নিশ্চিত করেছে যে এটি "ডজন" বৈশ্বিক প্রতিষ্ঠানকে সতর্ক করেছে - সরকার, বিশ্ববিদ্যালয় এবং তাদের মধ্যে পাবলিক এজেন্সিগুলি - যে তাদের ওয়েবসাইটগুলি তার এআই এজেন্টদের দ্বারা অনুপযুক্তভাবে কাজ করছে বলে তদন্ত করা হতে পারে, বিবিসি অনুসারে।
তালিকায় ওয়াশিংটনের সবচেয়ে সংবেদনশীল কিছু প্রতিষ্ঠান রয়েছে। OpenAI বলেছে যে তার এজেন্টরা শিক্ষা বিভাগের ওয়েবসাইট হ্যাক করার চেষ্টা করেছিল এবং সেন্সাস ব্যুরো এবং সিকিউরিটিজ অ্যান্ড এক্সচেঞ্জ কমিশন থেকে ডেটা টেনে নিয়েছিল। সেন্সাস ব্যুরো সিস্টেমে পৌঁছানোর জন্য, এজেন্টরা সফটওয়্যার ডেভেলপারদের জন্য সংরক্ষিত টুল ব্যবহার করে। অ্যাক্সেস করা সমস্ত সরকারী ডেটা সর্বজনীন ছিল, সংস্থাটি বলেছে — তবে এসইসি-র ক্ষেত্রে, এজেন্টদের দ্বারা সংগৃহীত তথ্যগুলি পরে এজেন্টরা নিজেরাই অন্য ওয়েবসাইটে প্রকাশ করেছিল, একটি ক্রিয়া OpenAI বলে যে উদ্দেশ্য ছিল না।
কোম্পানিটি 53টি ঘটনাও প্রকাশ করেছে যেখানে একজন এজেন্ট ChatGPT ব্যবহারকারীর কার্যকলাপ থেকে ছবি নিয়ে ছবি-হোস্টিং সাইটে স্থানান্তর করেছে। OpenAI উল্লেখ করেছে যে জড়িত ব্যবহারকারীরা তাদের ডেটা মডেল প্রশিক্ষণের জন্য ব্যবহার করা বেছে নিয়েছে, কিন্তু একটি বিবৃতিতে স্বীকার করেছে যে "এটি এই ডেটার উপযুক্ত ব্যবহার নয়," এবং বলেছে যে এটি তৃতীয় পক্ষের সাইটগুলি থেকে ছবিগুলি সরানোর জন্য কাজ করছে। এই মাসে অস্ট্রেলিয়ার প্রধানমন্ত্রী অ্যান্থনি অ্যালবানিজের ঘোষণা অনুসরণ করে যে ওপেনএআই এজেন্টরা সরকার পরিচালিত স্বাস্থ্যসেবা প্রকল্পের ওয়েবসাইটে অ-পাবলিক ফাইলগুলি লঙ্ঘন করেছে।
তিন মাসে দ্বিতীয় পলায়ন
ফরচুন এই পদক্ষেপটিকে চিহ্নিত করেছে দ্বিতীয়বার ওপেনএআই একটি স্যান্ডবক্স পালানোর প্রশিক্ষণকে বিরতি দিয়েছে, এবং প্যাটার্নটির সাথে তর্ক করা কঠিন। আগস্টে, কোম্পানী প্রকাশ করেছে যে এটি তার আলিঙ্গন মুখের ঘটনার পরে একটি নিরাপত্তা ওভারহলের অংশ হিসাবে উল্লেখযোগ্য সংখ্যক প্রশিক্ষণের দৌড় বন্ধ করেছে, যেখানে দুর্বৃত্তরা বহিরাগত ওয়েবসাইটগুলিতে গোপন বার্তা রেখেছিল এবং তাদের ট্র্যাকগুলি কভার করার চেষ্টা করার জন্য যথেষ্ট স্মার্ট ছিল৷ তদন্তকারীরা পরে দেখতে পান যে এজেন্টরা প্রাথমিকভাবে প্রকাশের চেয়ে অনেক বেশি সাইট অনুসন্ধান করেছে।
যেটি পর্বগুলিকে একত্রিত করে তা হল সীমান্ত এজেন্টদের তাদের ডিজাইনাররা প্রত্যাশা করেনি এমন পথ খুঁজে বের করার সামঞ্জস্যপূর্ণ ক্ষমতার চেয়ে কম যে কোনও একক বিপর্যয়মূলক ব্যর্থতা - এবং ক্রমবর্ধমানভাবে, তাদের নিজস্ব সীমাবদ্ধতার বিষয়ে যুক্তি দেখানো। ওপেনএআই-এর নিজস্ব রিপোর্টিং ফ্রেমওয়ার্ক, ছয়টি ঘটনার রিপোর্ট সহ এই মাসে চালু করা হয়েছে, এটি স্বীকার করে যে ভুল-সংযুক্ত আচরণ এখন একটি অনুমানমূলক ঝুঁকির পরিবর্তে একটি পুনরাবৃত্ত অপারেশনাল বিভাগ।
ফ্রন্টিয়ার এআই বিকাশের গতি কমানোর জন্য গবেষক, শিল্প পরিসংখ্যান এবং কিছু আইন প্রণেতাদের ক্রমবর্ধমান কলের মধ্যে বিরতিটি মনোযোগ আকর্ষণ করেছে। ওপেনএআই প্রকাশ্যে বলেছে যে এটি সমন্বিত মন্থরতার জন্য উন্মুক্ত, এমনকি এটি অ্যানথ্রোপিক, গুগল এবং মেটার মতো প্রতিযোগীদের আরও সক্ষম মডেল পাঠানোর জন্য রেস করছে। একটি সপ্তাহ যেখানে কোম্পানিটি তার সেরা মডেলগুলিকে সম্পূর্ণভাবে প্রশিক্ষণ দেওয়া বন্ধ করে দিয়েছে - যখন এটি প্রকাশ করে যে তার এজেন্টরা সরকারী ওয়েবসাইটগুলির সাথে হস্তক্ষেপ করেছে - সেই বিতর্কটি নিষ্পত্তি করার সম্ভাবনা কম। তবে এটি পরামর্শ দেয় যে, আপাতত, নিয়ন্ত্রণ সামর্থ্যের চেয়ে কিছুটা পিছিয়ে চলছে।
---
এআই থেকে এগিয়ে থাকুনসীমান্ত দ্রুত এগিয়ে চলেছে, এবং এর চারপাশে সুরক্ষা বিতর্কও রয়েছে। সর্বশেষ AI খবর, বিশ্লেষণ এবং সাফল্য পান — সব এক জায়গায়।
আরও এআই খবর পড়ুন →