ওপেনএআই-এর সহ-প্রতিষ্ঠাতা জন শুলম্যান, যিনি এখন থিঙ্কিং মেশিনে প্রধান বিজ্ঞানী হিসেবে কাজ করছেন, বলেছেন তিনি প্রায় তিন থেকে চার বছরের মধ্যে পুনরাবৃত্ত স্ব-উন্নতি — এআই সিস্টেমগুলি তাদের নিজস্ব বিকাশকে ত্বরান্বিত করার আশা করেন, একটি সময়রেখা যা তাকে ক্ষেত্রের আরও আক্রমণাত্মক পূর্বাভাসকারীদের মধ্যে স্থান দেয়৷ শুক্রবার প্রকাশিত দ্বারকেশ পডকাস্টের একটি গোলটেবিল পর্বের সময় শুলম্যান অনুমানটি দিয়েছেন, যেখানে তিন ফ্রন্টিয়ার ল্যাব গবেষকরা খোলাখুলিভাবে বিতর্ক করেছেন যে শিল্পটি আসলে তার সিলিং এর কতটা কাছাকাছি।
কথোপকথনটি সীমান্তের কাছাকাছি গবেষকরা কীভাবে অগ্রগতি সম্পর্কে চিন্তা করছে তার একটি বিরল অপ্রত্যাশিত চেহারার প্রস্তাব দিয়েছে, একটি কোলাহলপূর্ণ সপ্তাহের মধ্যে পৌঁছেছে যেখানে এনভিডিয়ার সিইও জেনসেন হুয়াং ঘোষণা করেছেন যে "এজিআই এসেছে" এবং 25 ফিল্ড মেডেলিস্টদের একটি দল সতর্ক করেছে যে AI বেঞ্চমার্ক-ধাওয়া গণিতের ক্ষতি করছে। সাম্প্রতিক AI উন্নয়ন ট্র্যাক করা পাঠকদের জন্য, পর্বটি একটি কার্যকর কাউন্টারওয়েট: এই লোকেরা সিস্টেম তৈরি করছে এবং তারা একে অপরের সাথে তীব্রভাবে একমত নয়।
কে ছিল টেবিলে
হোস্ট দ্বারকেশ প্যাটেল বলেছিলেন যে তিনি প্যানেলটি একত্রিত করেছিলেন কারণ অতিথিরা যাকে "কিছুটা উন্মুক্ত-ইশ ল্যাব এবং সংস্থাগুলি" বলে ডাকেন তাতে কাজ করেন, যার অর্থ তারা রেকর্ডে কথা বলতে পারে। শুলম্যানে যোগদানকারীরা হলেন বেরেন মিলিজ, জিফ্রার চিফ টেকনোলজি অফিসার, একটি স্টার্টআপ যা ওপেন সোর্স মডেল ডেভেলপ করছে এবং চার্লি ও'নিল, বেসেটেনের মডেল প্রশিক্ষণের প্রধান।
শুলম্যানের শংসাপত্রগুলি তার টাইমলাইনের কথাকে বিশেষ ওজন দেয়। তিনি ওপেনএআই-এর সহ-প্রতিষ্ঠা করেন এবং থিঙ্কিং মেশিনে যাওয়ার আগে, যেখানে তিনি এখন প্রধান বিজ্ঞানী হিসাবে কাজ করেন, সেখানে ChatGPT-এর পিছনে কৌশলগুলি তৈরি করে এমন মানব প্রতিক্রিয়া গবেষণা থেকে শক্তিবৃদ্ধি শিক্ষার নেতৃত্ব দেন।
সিঙ্গুলারিটির বিরুদ্ধে মামলা, স্টিলম্যানড
প্যাটেল একটি সূক্ষ্ম প্রশ্ন দিয়ে খোলেন: যদি 2036 কোটি কোটি সুপারিন্টেলিজেন্ট সিস্টেম বিশ্বকে পরিবর্তন না করেই আসে, তাহলে প্রযুক্তিগত কারণ কী হবে? মিলিজ সংশয়বাদের জন্য সবচেয়ে শক্তিশালী কেস প্রস্তাব করেছেন, বর্ণনা করেছেন যাকে তিনি প্রায় মোরাভেকের প্যারাডক্স-স্টাইল প্যাটার্ন বলে অভিহিত করেছেন যেখানে মডেলরা গবেষকরা তাদের সামনে যা কিছু বেঞ্চমার্ক রাখুক না কেন, তবুও বাস্তব-বিশ্বের প্রভাব হতাশাজনক।
"এখনও কিছু ক্রমাগত সিম-টু-রিয়েল গ্যাপ রয়েছে যা একরকম সবকিছুকে অবরুদ্ধ করছে," মিলিজ বলেছেন, এমন একটি বিশ্বের বর্ণনা করে যেখানে এআই আরও সাধারণীকরণ ছাড়াই "মানুষের মানদণ্ডে রাখা সমস্ত কিছুতে অত্যন্ত ভাল" হয়ে ওঠে। তিনি যোগ করেছেন যে তিনি এই ফলাফলটিকে অসম্ভাব্য মনে করেন, প্রমাণের দিকে ইঙ্গিত করে যে শক্তিবৃদ্ধি শেখা ইতিমধ্যে অনুশীলনে সাধারণীকরণ করেছে।
শুলম্যান মূলত সম্মত হন যে অগ্রগতি স্বয়ংক্রিয় নয়। তিনি বলেন, আজকের মডেলগুলির উপর মানুষের প্রকৃত সুবিধা রয়েছে, এবং প্রতিটি নতুন মডেলের রিলিজ কিছু ক্ষেত্রে ধরা পড়ে যখন অন্যগুলিতে বাধাগ্রস্ত থাকে - যে প্যাটার্নটি গত বেশ কয়েকটি পণ্য চক্রকে সংজ্ঞায়িত করেছে।
র্যাপিড-ফায়ার টাইমলাইন: দুই বছর, তিন থেকে চার, পাঁচ থেকে দশ
প্যাটেল সংখ্যার জন্য চাপ দিলে, প্যানেলটি বিভক্ত হয়ে যায়। একজন দক্ষ হোয়াইট-কলার কর্মীর জন্য কখন AI দশগুণ উত্পাদনশীলতা উন্নীত করতে পারে জানতে চাইলে, শুলম্যান প্রথমে একটি একক পরিসংখ্যান দিতে অস্বীকার করেছিলেন, তারপর বলেছিলেন "আমি বলব দুই বছর।" মিলিজ বলেছিলেন যে তিনি "আসলে এটি দেখতে পারেন," যুক্তি দিয়েছিলেন যে কিছু বিভাগের কাজের জন্য লাভ ইতিমধ্যে 10x ছাড়িয়ে গেছে। ও'নিল সবচেয়ে রক্ষণশীল ছিলেন, "5 থেকে 10" বছর উত্তর দিয়েছিলেন।
প্যাটেল তখন আরও ধাক্কা দেন, দৃশ্যটিকে "মূলত শুধু এএসআই" হিসাবে চিহ্নিত করেন। শুলম্যানের প্রতিক্রিয়া: "আমি বলব 3-4 বছর," যোগ করে যে AI গবেষণা নিজেই "AI এর জন্য সবচেয়ে কঠিন জিনিসগুলির মধ্যে একটি নয়, কারণ এতে প্রচুর কাজ জড়িত" যা বর্তমান কৌশলগুলি ইতিমধ্যেই যোগাযোগ করতে পারে। অন্যান্য গবেষকদের কাছ থেকে অনুমানটি কতটা সামান্য পুশব্যাক হয়েছে তার জন্য বিনিময়টি উল্লেখযোগ্য ছিল।
কিভাবে স্বয়ংক্রিয় গবেষকরা আসলে প্রশিক্ষিত হবে
এপিসোডের একটি উল্লেখযোগ্য অংশে শুলম্যান দৃশ্যকল্পের মেকানিক্সের সাথে মোকাবিলা করা হয়েছিল। এআই গবেষণাকে স্বয়ংক্রিয় করতে সক্ষম AI সিস্টেমগুলিকে কীভাবে প্রশিক্ষণ দেওয়া হবে জানতে চাওয়া হলে, শুলম্যান বর্ণনা করেন "গবেষকদের রুচিকে শুষে নেওয়ার জন্য মানুষের প্রতিক্রিয়া থেকে শেখার কিছু সংমিশ্রণ, এবং অনেকগুলি গবেষণার পরিবেশ তৈরি করে যা বহু-স্তরে গবেষণা করে।"
এই উত্তরটি শিল্পের অর্থ কোথায় যাচ্ছে তার সাথে সংযোগ করে। মেকানাইজের জন্য Google-এর সম্প্রতি সম্পন্ন চুক্তি, একটি স্টার্টআপ যা প্রশিক্ষণ এজেন্টদের জন্য সিমুলেটেড কাজের পরিবেশ তৈরি করে, ঠিক এই বাজিটিকে প্রতিফলিত করে যে আরও ভাল প্রশিক্ষণের ভিত্তি — শুধু বড় মডেল নয় — পরবর্তী রাউন্ডের সক্ষমতা লাভের দিকে নিয়ে যাবে৷ শুলম্যান একটি মূল অসুবিধাও ফ্ল্যাগ করেছেন: প্রাকৃতিক ডেটার উপর নির্মিত পুরষ্কার ফাংশনগুলি নির্দিষ্ট করা কঠিন, এবং কোনও ব্যবহারকারী কোড সম্পাদনা গ্রহণ করেছে কিনা তা প্রশিক্ষণকে বিভ্রান্ত করতে পারে।
পাতন বনাম কেন্দ্রীকরণ
শুলম্যানের সবচেয়ে সুনির্দিষ্ট ভবিষ্যদ্বাণীগুলির মধ্যে একটি শিল্প কাঠামো সম্পর্কিত। "আমি মনে করি পাতন হল প্রধান জিনিস যা কেন্দ্রীকরণ শক্তির বিরুদ্ধে লড়াই করে," তিনি যুক্তি দিয়ে বলেছিলেন যে শক্তিবৃদ্ধি শেখার মাধ্যমে শেখা ক্ষমতাগুলি অপেক্ষাকৃত সহজে ছোট মডেলগুলিতে স্থানান্তরিত করা যেতে পারে, ফ্রন্টিয়ার-সংলগ্ন দক্ষতাকে কয়েকটি কোম্পানির বাইরে ছড়িয়ে দেয় যা সীমান্ত প্রশিক্ষণ চালানোর সামর্থ্য রাখে।
মানুষের জন্য কি অবশিষ্ট আছে এই প্রশ্নে, শুলম্যান স্পষ্টবাদী ছিলেন। "আমি বলব যে মানুষের জন্য শেষ কাজ, বা মানুষের জন্য যে ভূমিকা সবচেয়ে দীর্ঘস্থায়ী হবে, তা হল উদ্দেশ্য সংজ্ঞায়িত করা এবং আমরা আসলে কী চাই তা নির্ধারণ করা," তিনি বলেছিলেন। প্যাটেল যখন "সারিবদ্ধকরণই চূড়ান্ত কাজ" সংক্ষিপ্ত করেন, তখন শুলম্যান সম্মত হন: "সারিবদ্ধকরণ হল উত্তরের মতো," যখন লক্ষ্য করা যায় যে এটি সঠিক উদ্দেশ্য খুঁজে বের করতে এবং তারপরে এটি বাস্তবে এটি অর্জনে পচে যায়।
যেখানে পর্বটি টাইমলাইন বিতর্কে খাপ খায়
পর্বের সাবটাইটেল — "আমরা সিলিং এর কাছাকাছি কোথাও নেই" — এর সামগ্রিক টেনার ক্যাপচার করে: গবেষকরা যারা সামনে যথেষ্ট রানওয়ে দেখতে পান, এমনকি তারা বিতর্ক করে যে পথটি কতটা আড়ষ্ট হবে। চীনা ল্যাবগুলির অগ্রগতির কারণ কী, দীর্ঘ-দিগন্তের শক্তিবৃদ্ধি শিক্ষা সাধারণ বুদ্ধিমত্তাকে উদ্ঘাটন করতে পারে কি না এবং কেন RL কাজ শুরু করেছে, সেসব নিয়ে আলোচনা করা হয়েছিল।
টাইমলাইন নিয়ে পাবলিক বিতর্ক এই মাসে সব দিকেই তীব্র হয়েছে। হুয়াং-এর "এজিআই এসেছে" ঘোষণাটি বিশ্লেষকদের কাছ থেকে সংশয় তৈরি করেছে যারা এটিকে বৈজ্ঞানিক দাবির পরিবর্তে একটি ব্যবসায়িক কেস হিসাবে পড়েছেন, যখন ওপেনএআই সিইও স্যাম অল্টম্যান কর্মীদের বলেছেন, ব্লুমবার্গের মতে, সুরক্ষা উদ্বেগ বেড়ে যাওয়ায় কোম্পানিটি অত্যাধুনিক উন্নয়নকে ধীর করার জন্য উন্মুক্ত। পুনরাবৃত্ত স্ব-উন্নতির জন্য শুলম্যানের তিন থেকে চার বছরের উইন্ডো বিপণন এবং স্থগিতের মাঝামাঝি কোথাও বসেছে — এখন ক্ষেত্রটি চালনা করার কৌশলগুলি তৈরি করার ট্র্যাক রেকর্ড সহ কারও কাছ থেকে একটি কার্যকরী অনুমান।
তিনি সঠিক কিনা তা নির্ভর করবে প্যানেলের শুধুমাত্র চক্কর দেওয়া প্রশ্নগুলির উপর: শক্তিবৃদ্ধি শিক্ষা তার প্রশিক্ষণের পরিবেশকে সাধারণীকরণ করে চলেছে কিনা এবং বেঞ্চমার্ক পারফরম্যান্স এবং বাস্তব অর্থনৈতিক মূল্যের মধ্যে ব্যবধান বন্ধ হতে চলেছে কিনা।
এআই থেকে এগিয়ে থাকুন
ফ্রন্টিয়ার গবেষকরা জনসমক্ষে AI এর সীমা নিয়ে বিতর্ক করছেন — গল্পটি বিকাশের সাথে সাথে অনুসরণ করুন।
এআই বাজ ওয়্যারে আরও এআই খবর পড়ুন