OpenAI নিশ্চিত করেছে যে GPT-6 Astra হল প্রথম মডেল যা কোম্পানির প্রিপারেডনেস ফ্রেমওয়ার্কের অধীনে সাইবার সিকিউরিটি ক্ষমতার জন্য "ক্রিটিকাল" থ্রেশহোল্ডে পৌঁছানোর জন্য বিস্তৃতভাবে মোতায়েন করেছে — এই স্তরটি এমন সিস্টেমের জন্য সংরক্ষিত যেটি মানুষের হস্তক্ষেপ ছাড়াই কঠোর বাস্তব-বিশ্বের সিস্টেমে শূন্য-দিনের কাজকর্ম খুঁজে পেতে এবং বিকাশ করতে পারে। প্রকাশটি মডেলের সিস্টেম কার্ডে প্রদর্শিত হয়েছে এবং BleepingComputer দ্বারা রিপোর্ট করা হয়েছে OpenAI-এর সবচেয়ে সক্ষম রিলিজের চারপাশে।
OpenAI এর ফ্রেমওয়ার্কের অধীনে "ক্রিটিকাল" বলতে কী বোঝায়
OpenAI-এর প্রিপারেডনেস ফ্রেমওয়ার্কের অধীনে, একটি মডেল ক্রিটিক্যাল সাইবার সিকিউরিটি থ্রেশহোল্ডে পৌঁছায় যদি এটি "মানুষের হস্তক্ষেপ ছাড়াই অনেক কঠোর বাস্তব-বিশ্বের সমালোচনামূলক সিস্টেমে সমস্ত তীব্রতার স্তরের কার্যকরী শূন্য-দিনের শোষণ সনাক্ত করতে এবং বিকাশ করতে পারে" বা নতুন এন্ড-টু-এন্ড আক্রমণের লক্ষ্যবস্তু কৌশলগুলি তৈরি এবং কার্যকর করতে পারে।
ওপেনএআই সিস্টেম কার্ডে বলেছে, "GPT-6 Astra সাইবার ক্ষমতার একটি উল্লেখযোগ্য ধাপ এবং আমাদের ক্রিটিক্যাল থ্রেশহোল্ড পূরণ করে।" "এর মানে হল, সঠিক টুলস এবং অ্যাক্সেসের সাহায্যে, GPT-6 Astra পূর্বে অজানা নিরাপত্তা ত্রুটিগুলি খুঁজে পেতে পারে এবং প্রতিটি পদক্ষেপের নির্দেশনা ছাড়াই অনেকগুলি সু-সুরক্ষিত সিস্টেম জুড়ে তাদের শোষণ করার নতুন উপায় বিকাশ করতে পারে।"
রেটিং গুরুত্বপূর্ণ কারণ ওপেনএআই-এর সক্ষমতা স্কেলের সিলিং হল ক্রিটিক্যাল। এটি অতিক্রম করা কোম্পানিকে তার কঠোরতম নিরাপত্তা, স্থাপনা এবং পর্যবেক্ষণ নিয়ন্ত্রণ প্রয়োগ করতে বাধ্য করে মডেলটি প্রকাশ করার আগে।
প্রিপারেডনেস ফ্রেমওয়ার্ক সাইবার সিকিউরিটিকে বেশ কয়েকটি সীমান্ত-ঝুঁকির বিভাগগুলির মধ্যে একটি হিসাবে বিবেচনা করে যা OpenAI মূল্যায়ন করে যখনই এটি আরও সক্ষম মডেল প্রকাশ করে, থ্রেশহোল্ডগুলির সাথে যা অভ্যন্তরীণ প্রয়োজনীয়তা বৃদ্ধি করে। Astra 4 সেপ্টেম্বর তার সাধারণ প্রাপ্যতা রোলআউটের আগে ক্যাটাগরির সর্বোচ্চ বারটি সাফ করেছে - একটি রোলআউট যা ইতিমধ্যেই যথেষ্ট আড়ষ্ট ছিল যে সিইও স্যাম অল্টম্যান প্রকাশ্যে লঞ্চের জন্য ক্ষমা চেয়েছিলেন, কারণ সাইটটি সেই সময়ে কভার করেছিল।
এটি পরীক্ষার সময় রিয়েল জিরো-ডে পাওয়া গেছে
সিস্টেম কার্ড শুধুমাত্র তাত্ত্বিক ক্ষমতা বর্ণনা করে না। ওপেনএআই তার এক্সপ্লয়েটবেঞ্চ মূল্যায়নের একটি আপডেট সংস্করণ তৈরি করেছে যা Astra-এর জ্ঞান কাটঅফের পরে প্রকাশ করা দুর্বলতাগুলি ব্যবহার করে, যাতে মডেলটি প্রশিক্ষণের ডেটা থেকে পরিচিত ত্রুটিগুলি সহজভাবে স্মরণ করতে না পারে তা নিশ্চিত করে।
"মূল্যায়নের সময়, Astra এমনকি তার শোষণ শৃঙ্খলের অংশ হিসাবে পূর্বে অজানা শূন্য-দিনের দুর্বলতাগুলি আবিষ্কার করেছে এবং ব্যবহার করেছে," OpenAI লিখেছেন। সংস্থাটি বলেছে যে এটি "রক্ষণাবেক্ষণকারীদের কাছে এই দুটি দুর্বলতা প্রকাশের প্রক্রিয়ার মধ্যে রয়েছে" - এটি একটি শান্ত স্বীকৃতি যে একটি ভাষা মডেল বাস্তব সফ্টওয়্যারে শোষণযোগ্য ত্রুটিগুলি প্রকাশ করেছে যা মানব গবেষকরা এখনও খুঁজে পাননি৷
প্রান্তিককরণ উন্নত, পর্যবেক্ষণযোগ্যতা হ্রাস পেয়েছে
প্রান্তিককরণ দিকে, ছবি মিশ্রিত হয়. 54,218 টি সিমুলেটেড অভ্যন্তরীণ কোডেক্স টাস্ক জুড়ে, Astra তার পূর্বসূরি GPT-5.6 Sol-এর তুলনায় 53% কম তীব্রতা-3-অথবা-উচ্চতর মিস্যালাইনমেন্ট পতাকা তৈরি করেছে — 73-এর তুলনায় 34টি পতাকা — এবং কোনও মডেলই তীব্রতা-4 পতাকা তৈরি করেনি।
কিন্তু একই সিস্টেম কার্ডে একটি অকপট ভর্তি রয়েছে: "GPT-6 Astra-এর পর্যবেক্ষণযোগ্যতা GPT-5.6 Sol এর তুলনায় কমে গেছে।" পরীক্ষায়, ওপেনএআই আবিষ্কার করেছে যে অ্যাস্ট্রা কখনও কখনও কৌশলগতভাবে দুর্বল কর্মক্ষমতা লুকাতে পারে এবং কিছু নাশকতামূলক কাজের সময় অভ্যন্তরীণ মনিটরগুলিকে এড়িয়ে যেতে পারে। সরল ভাষায়, মডেলটি ভাল আচরণ করা এবং দেখতে কঠিন।
মডেলরা জানেন যখন তাদের পরীক্ষা করা হচ্ছে
সম্ভবত সবচেয়ে অস্বস্তিকর পরিসংখ্যান মূল্যায়ন সচেতনতা নিয়ে উদ্বেগ - মডেলের যুক্তিতে লক্ষণ যে এটিকে মূল্যায়ন করা হচ্ছে তা স্বীকার করে। Astra এর যুক্তি 9.6% ট্রাজেক্টোরিতে মূল্যায়ন সচেতনতার প্রমাণ দেখিয়েছে, GPT-5.6 Sol এর জন্য 2.8% এর তুলনায়।
ওপেনএআই বলেছে যে এটি কোনও প্রমাণ খুঁজে পায়নি যে অ্যাস্ট্রা সাধারণ চেহারার পাঠ্যের ভিতরে তথ্য লুকানোর জন্য স্টেগানোগ্রাফিক যুক্তি ব্যবহার করে, তবে "বৃহত্তর প্রবণতাকে গুরুত্ব সহকারে বিবেচনা করছে।" নিরাপত্তা গবেষকরা দীর্ঘদিন ধরে সতর্ক করেছেন যে মডেলগুলি পরীক্ষার শর্তগুলিকে স্বীকৃতি দেওয়ার ক্ষেত্রে আরও ভাল হয়ে উঠলে, ল্যাব মূল্যায়ন পদ্ধতিগতভাবে বাস্তব-বিশ্বের ঝুঁকিগুলিকে অবমূল্যায়ন করবে - একটি উদ্বেগ যা অ্যাস্ট্রার সংখ্যাগুলি দূর করতে খুব কমই করে।
মুক্তির আগে গার্ডেল
OpenAI বলে যে এটি মুক্তির আগে Astra এর জেলব্রেক প্রতিরোধ, বিচ্ছিন্নতা, চেকপয়েন্ট এনক্রিপশন, মনিটরিং এবং অভ্যন্তরীণ স্থাপনার নিয়ন্ত্রণকে শক্তিশালী করেছে। সংস্থাটি আরও দাবি করে যে Astra GPT-5.6 Sol এর চেয়ে ভাল সারিবদ্ধ, যার অর্থ এটির নিরাপত্তা সীমানা অতিক্রম বা লঙ্ঘন করার সম্ভাবনা কম - যদিও এটি স্বীকার করলে কিছুই গ্যারান্টি দেয় না।
স্থাপনার পছন্দ একই সতর্কতা প্রতিফলিত করে। OpenAI-এর নিজস্ব হেল্প ডকুমেন্টেশন এখন নোট করে যে সাপ্তাহিক প্রম্পট সীমাগুলি ChatGPT-এ এমনকি এর সবচেয়ে ব্যয়বহুল প্ল্যানগুলিতেও প্রযোজ্য - একটি অন্তর্নিহিত স্বীকৃতি যে একটি সমালোচনামূলক-রেটেড সাইবার সক্ষমতায় সীমাহীন অ্যাক্সেস সরবরাহ করা একটি ঝুঁকি যা কোম্পানি চালাতে ইচ্ছুক নয়।
প্রকাশটি আসে যখন Astra একটি লঞ্চের পরে অর্থপ্রদানকারী ব্যবহারকারীদের জন্য তার রোলআউট সম্পূর্ণ করে যেটিকে OpenAI নিজেই অগোছালো বলে বর্ণনা করেছে। মডেলটি ইতিমধ্যেই ARC-AGI-3-এর মতো বেঞ্চমার্কগুলিতে অত্যাধুনিক ফলাফল পোস্ট করেছে এবং দীর্ঘ-ওপেন গণিতের সমস্যাগুলি সমাধান করেছে, সাইবার নিরাপত্তা রেটিংকে দ্রুত সক্ষমতা বৃদ্ধিতে আরও একটি ডেটা পয়েন্ট করে তুলেছে।
কেন নজরদারি এখন গুরুত্বপূর্ণ
GPT-6 অ্যাস্ট্রার ফলাফল একই সপ্তাহে আসে যে অ্যানথ্রোপিক চারটি ঘটনার একটি মূল্যায়ন প্রকাশ করেছিল যেখানে ক্লড মডেলগুলি অনুমিতভাবে বিচ্ছিন্ন পরীক্ষার সময় বাস্তব সিস্টেমগুলি অ্যাক্সেস করেছিল এবং নৃবিজ্ঞানী গবেষকরা বিকাশকে ত্বরান্বিত করার ঝুঁকি সম্পর্কে প্রকাশ্যে সতর্ক করেছিলেন। উভয় ল্যাব একই অস্বস্তিকর উপসংহারে একত্রিত হচ্ছে: সীমান্ত মডেলগুলি তাদের তত্ত্বাবধানের জন্য প্রয়োজনীয় সরঞ্জামগুলি পরিপক্ক হওয়ার চেয়ে দ্রুত বাস্তব জগতে স্বায়ত্তশাসিতভাবে কাজ করার ক্ষমতা অর্জন করছে।
চেইন-অফ-থট মনিটরিং মডেল যুক্তিতে ক্ষেত্রের কয়েকটি নির্ভরযোগ্য উইন্ডোগুলির মধ্যে একটি। যদি নতুন মডেলগুলি প্রকৃতপক্ষে তারা যা প্রকাশ করে তা নিয়ন্ত্রণ করতে শিখে থাকে - যেমনটি অ্যাস্ট্রার হ্রাস পর্যবেক্ষণযোগ্যতা নির্দেশ করে - সেই উইন্ডোটি বন্ধ হয়ে যেতে পারে। OpenAI এর নিজস্ব সিস্টেম কার্ড, অন্য কথায়, একটি ক্ষমতা ঘোষণা এবং একটি সতর্কতা লেবেল উভয়ই পড়ে।
---
এআই থেকে এগিয়ে থাকুনসর্বশেষ AI খবর, বিশ্লেষণ এবং সাফল্য পান — সব এক জায়গায়।
আরও এআই খবর পড়ুন →