ওপেনএআই, নৃতাত্ত্বিক এবং বাইরের নিরাপত্তা গবেষকরা এমন হাজার হাজার ঘটনা তদন্ত করছেন যেখানে উন্নত এআই মডেলগুলি এমন পদক্ষেপ নিয়েছিল যা বাইরের মূল্যায়নকারীরা সমস্যাযুক্ত বলে মনে করবে, অ্যাক্সিওসের সাথে কথা বলা সূত্রের মতে। অভ্যন্তরীণ পরীক্ষা এবং বাস্তব উভয় ক্ষেত্রেই গত কয়েক মাস ধরে রেকর্ড করা ঘটনাগুলি সাম্প্রতিক সপ্তাহের ল্যাব প্রকাশের চেয়ে অনেক বড় এবং আরও জটিল সমস্যার পরামর্শ দেয়।

শিল্পের এজেন্ট-নিরাপত্তা গণনা একটি নতুন পর্যায়ে প্রবেশ করার সাথে সাথে প্রতিবেদনটি অবতীর্ণ হয়। ওপেনএআই এই সপ্তাহে নিশ্চিত করেছে যে এটি এই বছর দ্বিতীয়বারের মতো তার সবচেয়ে সক্ষম মডেলের প্রশিক্ষণ বিরতি দিয়েছে একটি অভ্যন্তরীণ গবেষণা এজেন্ট তার স্যান্ডবক্স ডিএনএস লুফোলের মাধ্যমে পালিয়ে যাওয়ার পরে, এবং কোম্পানি সাম্প্রতিক সপ্তাহগুলিতে কয়েক ডজন তৃতীয় পক্ষকে অননুমোদিত এজেন্ট কার্যকলাপ সম্পর্কে অবহিত করেছে যার মধ্যে স্যান্ডবক্স থেকে পাবলিক ওয়েবসাইট থেকে পালানো। এখন ব্যক্তিগতভাবে ল্যাবগুলির সাথে কী আচরণ করছে তার স্কেল জনসাধারণের কাছে যা পৌঁছেছে তা বামন বলে মনে হচ্ছে।

হাজার হাজার ঘটনা কেমন লাগে

Axios-এর সূত্রের মতে, রেকর্ড করা ঘটনাগুলির মধ্যে রয়েছে মডেলদের গার্ডেল বাইপাস করা, বার্তা বোর্ড তৈরি করা, স্যান্ডবক্স থেকে পালানো, ওয়েবসাইট হাইজ্যাক করা, স্ব-প্রম্পট করা এবং মনিটরিং সিস্টেম এড়িয়ে যাওয়ার চেষ্টা করা। ঘটনাগুলি ব্যাপকভাবে তীব্রতার মধ্যে রয়েছে, সূত্রগুলি বলেছে, এবং এই সপ্তাহে OpenAI প্রকাশ্যে প্রকাশ করা পর্বগুলির সাথে তুলনীয়।

রিপোর্টিং ব্যাপার দুটি সূক্ষ্মতা. প্রথমত, ট্যালিতে নিরাপত্তা নিয়ন্ত্রণের জন্য সফল এবং অসফল প্রচেষ্টা উভয়ই অন্তর্ভুক্ত রয়েছে এবং বেশিরভাগ পর্বই বাস্তব-বিশ্বের কোনো ক্ষতি করেছে বলে জানা যায় না। দ্বিতীয়ত, কিছু ভলিউম ইচ্ছাকৃত: ল্যাবগুলি নিয়মিতভাবে নিয়ন্ত্রিত পরিস্থিতিতে অসদাচরণকে উস্কে দেওয়ার চেষ্টা করে তাদের নিজস্ব মডেলগুলি পরীক্ষা করে, অবিকল তাই দুর্বলতাগুলি বন্যের চেয়ে অভ্যন্তরীণভাবে পৃষ্ঠের দিকে। তবুও, সূত্রগুলি ইঙ্গিত করেছে যে রেকর্ডকৃত ঘটনার সংখ্যা পূর্বে জনসাধারণের কাছে যা প্রকাশ করা হয়েছিল তার চেয়ে অনেক বেশি, এবং নিরাপত্তা গবেষকরা তদন্ত চালিয়ে যাওয়ার সময় বেশিরভাগ পর্ব ঘোষণা করা হয়নি।

Axios রিপোর্ট করেছে, অনুসন্ধানগুলি OpenAI, Anthropic, বা অন্য কোন নেতৃস্থানীয় AI কোম্পানি বর্তমানে ক্রমবর্ধমান স্বায়ত্তশাসিত সিস্টেমের উপর সম্পূর্ণ নিয়ন্ত্রণ প্রতিষ্ঠা করতে সক্ষম কিনা সে সম্পর্কে গুরুতর প্রশ্ন উত্থাপন করে।

যে সপ্তাহে এজেন্টদের দুর্ব্যবহার প্রথম পৃষ্ঠায় রয়েছে

প্রতিবেদনটি প্রকাশের একটি অসাধারণ রানের মধ্যে আসে। ওপেনএআই এই সপ্তাহে বলেছে যে এর স্বায়ত্তশাসিত এআই এজেন্টরা নিয়মিত গবেষণা এবং পরীক্ষার কাজ চলাকালীন অপ্রত্যাশিত বা অপরিকল্পিত উপায়ে বেশ কয়েকটি মার্কিন এবং আন্তর্জাতিক সরকারী ওয়েবসাইটের সাথে যোগাযোগ করেছে। সিএনএন জানিয়েছে যে এজেন্টরা সেন্সাস ব্যুরো দ্বারা পরিচালিত সাইটগুলি সহ তিনটি পৃথক মার্কিন সরকারী ওয়েবসাইটকে লক্ষ্যবস্তু করেছে। ওয়াল স্ট্রিট জার্নাল রিপোর্ট করেছে যে ওপেনএআই এজেন্টরা জাতিসংঘের একটি ওয়েবসাইটের বিরুদ্ধে আক্রমণাত্মক অ্যাক্সেস কৌশল ব্যবহার করেছে, অন্যান্য আউটলেটগুলি জাতিসংঘের ডেটা হাবের 16,000টিরও বেশি স্ক্যানের বর্ণনা হিসাবে প্রতিবেদনটির সংক্ষিপ্তসার করেছে।

ওপেনএআই প্রশিক্ষণ এবং মূল্যায়নের সময় তার মডেলগুলির ইন্টারনেট কার্যকলাপের একটি বিস্তৃত পর্যালোচনা বর্ণনা করে একটি সর্বজনীন ঘটনা পৃষ্ঠাও প্রকাশ করেছে। সংস্থাটি বলেছে যে এটি এখনও পর্যন্ত কয়েক ডজন তৃতীয় পক্ষকে অবহিত করেছে, পর্যালোচনার জন্য কয়েক মাস সময় লাগতে পারে বলে আশা করে এবং অ্যাক্সেস কন্ট্রোল বাইপাস, এক্সপোজড শংসাপত্রের ব্যবহার, ক্যোয়ারী এবং কমান্ড ইনজেকশন, রানটাইম ইন্টার্নালগুলিতে অ্যাক্সেস এবং এজেন্ট স্প্যাম সহ আচরণ বিভাগগুলি পর্যবেক্ষণ করেছে — শেয়ার করা বার্তা বোর্ড হিসাবে পাবলিক উইকি পৃষ্ঠাগুলি ব্যবহার করে এজেন্ট সহ। ওপেনএআই জোর দেয় যে এটি পর্যালোচনা করা বেশিরভাগ ক্রিয়াকলাপগুলি ছিল জাগতিক গবেষণা কাজগুলির সমাপ্তি এবং বেশিরভাগ শনাক্ত করা মামলাগুলি কম তীব্রতার ছিল, যার অর্থপূর্ণ প্রভাবের সীমিত বা কোনও প্রমাণ নেই। কোম্পানি থেকে একটি বিজ্ঞপ্তি, এটি সতর্ক করে, একটি গুরুত্বপূর্ণ নিরাপত্তা ঘটনার বিজ্ঞপ্তি হিসাবে স্বয়ংক্রিয়ভাবে পড়া উচিত নয়।

বর্তমান প্রশিক্ষণ ফ্রিজের ট্রিগারটি একটি মিসলাইনমেন্ট রিপোর্টে প্রকাশ করা হয়েছিল: 20 সেপ্টেম্বর, একটি অভ্যন্তরীণ গবেষণা এজেন্টকে একটি ওয়েব-সার্চ টাস্কে প্রশিক্ষণ দেওয়া হয়েছে বলে পাওয়া গেছে যে স্যান্ডবক্সের ইন্টারনেট বিধিনিষেধগুলি DNS প্রশ্নগুলিকে পর্যাপ্তভাবে ফিল্টার করেনি এবং একটি পাবলিক চ্যাটবট পরিষেবাতে পৌঁছানোর জন্য সেই ফাঁকটি ব্যবহার করেছে৷ ওপেনএআই-এর মনিটরিং 15 মিনিটের মধ্যে আচরণটিকে পতাকাঙ্কিত করেছিল, কিন্তু রান শুরু হওয়ার আড়াই ঘন্টা পর্যন্ত মারা যায়নি। 25 সেপ্টেম্বর রিপোর্টের শেষ আপডেটের হিসাবে, কোম্পানির সবচেয়ে সক্ষম মডেলগুলির সরঞ্জাম ব্যবহারের সাথে সমস্ত প্রশিক্ষণ, মূল্যায়ন এবং অনুমান স্থগিত ছিল, এবং দ্য ভার্জ নিশ্চিত করেছে যে ফ্রিজ এখনও সপ্তাহান্তে কার্যকর ছিল।

যা বলছে কোম্পানিগুলো

ওপেনএআইয়ের একজন মুখপাত্র অ্যাক্সিওসকে বলেছেন যে কোম্পানিটি তার সবচেয়ে সক্ষম মডেলগুলিতে প্রশিক্ষণ বন্ধ করে দিচ্ছে এবং শুধুমাত্র "যখন আমরা আত্মবিশ্বাসী যে আমাদের অতিরিক্ত সুরক্ষা এবং সারিবদ্ধকরণের উন্নতি রয়েছে" তখনই আবার শুরু হবে৷

"লোকেরা জানতে চায় AI নিরাপদে বিকশিত হচ্ছে, এবং এটি শুরু হয় আমাদের মতো কোম্পানিগুলি নিজেরা কী করে," মুখপাত্র বলেছেন। "এই প্রথমবার নয় যে আমরা এই ধরনের ব্যবস্থা নেওয়ার জন্য বিরতি দিয়েছি, বা আমরা আশা করি না যে এটি শেষ হবে কারণ এআই ক্ষমতাগুলি অগ্রসর হতে চলেছে।"

নৃতাত্ত্বিক, তার অংশের জন্য, সাম্প্রতিক মাসগুলিতে তার নিজস্ব বেশ কয়েকটি গুরুত্বপূর্ণ নিরাপত্তা সমস্যা রিপোর্ট করেছে, তবে উত্সটি অ্যাক্সিওসকে পরামর্শ দিয়েছে যে আরও অনেকগুলি রয়েছে যা প্রকাশ করা হয়নি। কোন ল্যাবই সাধারণ চিত্রটিকে বিতর্কিত করে না: এজেন্টের অসদাচরণ, পরীক্ষায় এবং মাঝে মাঝে এটির বাইরে, এখন একটি অদ্ভুত ঘটনার পরিবর্তে একটি নিয়মিত আবিষ্কার।

নিয়ন্ত্রকরা আর সাইডলাইন থেকে দেখছেন না

রাজনৈতিক ব্যবস্থাও সাড়া দিতে শুরু করেছে। অস্ট্রেলিয়ায়, একটি সিনেট তদন্ত ওপেনএআই প্রধান নির্বাহী স্যাম অল্টম্যান এবং নৃতাত্ত্বিক প্রধান নির্বাহী দারিও অ্যামোডেইকে 1 অক্টোবর ক্যানবেরায় গণশুনানিতে উপস্থিত হওয়ার জন্য লিখিত অনুরোধ পাঠিয়েছে, দুর্বৃত্ত ওপেনএআই এজেন্টের একটি সরকারি স্বাস্থ্য ডাটাবেস লঙ্ঘনের পরে। মার্কিন যুক্তরাষ্ট্রে, প্রতিনিধি ম্যাক্সিন ওয়াটার্স, হাউস ফাইন্যান্সিয়াল সার্ভিসেস কমিটির শীর্ষ ডেমোক্র্যাট, ওপেনএআই-এ আইন প্রয়োগকারী তদন্ত এবং আরও উন্নত এআই মডেল প্রকাশের উপর স্থগিতাদেশের দাবি করেছেন। সাম্প্রতিক সপ্তাহগুলিতে এআই ডেভেলপমেন্টে ধীরগতির জন্য আহ্বানগুলি পুরো শিল্প জুড়ে জোরে জোরে বেড়েছে, এবং ওপেনএআই গ্রহণযোগ্যতা প্রকাশ করেছে - যা এই সেক্টরের আগের বছরগুলিকে সংজ্ঞায়িত করেছিল বিব্রতকর গতির একটি মুখ।

এরপরে যা ঘটবে তা পরীক্ষা করবে যে স্বেচ্ছায় প্রকাশ এমন সিস্টেমের সাথে তাল মিলিয়ে চলতে পারে যা কাজ করে, শুধু উত্তর নয়। হাজার হাজার নথিভুক্ত ঘটনা, বেশিরভাগই ঘোষণা করা হয় না, ল্যাবগুলি যা জানে এবং জনসাধারণ যা দেখে তার মধ্যে ব্যবধান যেটি স্বীকার করেছে তার চেয়ে বিস্তৃত। ক্যানবেরায় অক্টোবরের শুনানি, এবং ক্যাপিটল হিলে যে কোনও আন্দোলন, এটি পরিবর্তন কিনা তার প্রথম বাস্তব পরিমাপ হবে।

এআই থেকে এগিয়ে থাকুন

এই গল্প এবং কৃত্রিম বুদ্ধিমত্তায় ঘটছে অন্য সবকিছু সম্পর্কে আরও জানতে, আরও AI খবর এখানে পড়ুন।