যেহেতু লক্ষ লক্ষ লোক সংবাদ, রাজনৈতিক যুক্তি এবং এমনকি ভোট দেওয়ার জন্য উত্তরের জন্য এআই চ্যাটবটগুলিতে ফিরে আসে, একটি নতুন গবেষণা একটি অস্বস্তিকর প্রশ্ন জিজ্ঞাসা করে: যখন মডেলরা আমাদের সাথে একমত হন না, তখন তারা কোন দিকে ঝুঁকে যায়?

2026 সালের জুনে অ্যানালিটিক্স স্টার্টআপ Trakkr-এর দ্বারা প্রকাশিত একটি প্রজেক্ট ঠিক সেই মানচিত্র তৈরি করে। গবেষকরা রাজনীতি, অর্থনীতি, বক্তৃতা এবং সমাজ সম্পর্কে একই ব্যাটারির চার্জযুক্ত প্রশ্নগুলির মাধ্যমে প্রতিটি প্রধান AI মডেলকে রেখেছেন — এবং শিরোনাম খুঁজে পাওয়া গেছে যে তাদের বেশিরভাগই একইভাবে ঝুঁকেছে, যদিও একই পরিমাণে নয় এবং নৈমিত্তিক পর্যবেক্ষকরা অনুমান করতে পারে এমন পরিষ্কারভাবে নয়। For more context on this story, see our ongoing AI trends.

কিভাবে অধ্যয়ন কাজ করেছে

Trakkr এর পদ্ধতি অনুসারে, প্রতিটি মডেলকে একই ওপেন-এন্ডেড প্রশ্নব্যাঙ্ক বহুবার জিজ্ঞাসা করা হয়েছিল, ওয়েব অনুসন্ধান বন্ধ সহ এবং কোনও সিস্টেম প্রম্পট প্রয়োগ করা হয়নি। এই বিশদটি গুরুত্বপূর্ণ: পুনরুদ্ধার অক্ষম করার সাথে, রিডিংগুলি প্রতিফলিত করে যে মডেলটি নিজেই কী দিকে ঝুঁকেছে, এই মুহূর্তে অনলাইনে যা ঘটবে তা থেকে স্বাধীন।

একটি পৃথক নিরপেক্ষ শ্রেণিবিন্যাসকারী তারপর প্রতিটি কাঁচা উত্তর পড়ুন, একটি স্বাক্ষরিত অবস্থান, হেজিংয়ের মাত্রা, প্রত্যাখ্যানের ধরন এবং যেকোনো লোড করা ভাষা রেকর্ড করে। ফলাফলগুলি 95 শতাংশ আত্মবিশ্বাসের ব্যবধানে ওজনযুক্ত উপায় হিসাবে প্লট করা হয়েছিল এবং প্রতিটি কাঁচা উত্তর স্থায়ীভাবে সংরক্ষণ করা হয়েছিল যাতে স্কোরগুলি পুনরায় গণনা করা যায়।

গুরুত্বপূর্ণভাবে, প্রতিটি মডেলকে একটি একক বিন্দুর পরিবর্তে মেঘ হিসেবে দেখানো হয়েছে। যেহেতু প্রতিটি মডেল অনেকবার চালানো হয়েছিল, ভিজ্যুয়ালাইজেশনটি যেখানে রান জুড়ে পৌঁছেছে তার সম্পূর্ণ বিস্তার ক্যাপচার করে — একটি একক লেবেলের চেয়ে আরও সৎ ছবি।

17 জুন, 2026 পর্যন্ত সংগৃহীত তথ্য অনুসারে, গবেষণায় ছয়টি মডেল এবং 4,400টিরও বেশি উত্তর রয়েছে।

ফলাফল

মডেল দুটি অক্ষ জুড়ে ম্যাপ করা হয়েছে: একটি অর্থনৈতিক অক্ষ বাম থেকে ডানে চলছে, এবং একটি সামাজিক অক্ষ মুক্ত থেকে কর্তৃত্ববাদীতে চলছে।

ছয়টি মডেলের মধ্যে চারটি কেন্দ্রের বাম দিকে ঝুঁকে আছে। স্ট্যান্ডআউট ব্যতিক্রমগুলি বর্ণালীর বিপরীত প্রান্তে বসে:
  • Grok পরীক্ষিত যেকোন মডেলের ডানদিকে সবচেয়ে দূরে পরিমাপ করা হয়েছে, এবং উল্লেখযোগ্যভাবে এটি কোন দিকে ঝুঁকেছে তা সরাসরি জিজ্ঞাসা করা হলে এটি দাবি করার চেয়ে প্রায় 0.36 আরও ডানে পরিমাপ করেছে।
  • মিথুন ছিল সবচেয়ে স্থির মডেল, অর্থনৈতিক অক্ষের মৃত কেন্দ্রের সবচেয়ে কাছে বসে।

একটি মডেল যা বলে এবং এটি যা করে তার মধ্যে ব্যবধান অধ্যয়নের সবচেয়ে প্রকাশক মেট্রিকগুলির মধ্যে একটি হিসাবে প্রমাণিত৷ Claude প্রায় 0.34 আরো বামে পরিমাপ এটি স্ব-প্রতিবেদিত তুলনায়. ChatGPT এবং Meta's Llama উভয়েই নিরপেক্ষতা দাবি করেছেন তবুও বাম দিকে পরিমাপ করা হয়েছে, যথাক্রমে 0.29 এবং 0.17 দ্বারা। ডিপসিক কেন্দ্রের কাছে অবতরণ করেছে এবং মূলত তার নিজস্ব স্ব-বর্ণনা মিলেছে।

একটি মানচিত্র, রায় নয়

Trakkr কাজটিকে প্রেসক্রিপটিভের পরিবর্তে বর্ণনামূলক হিসাবে ফ্রেম করতে সতর্ক। কে সঠিক তার উপর শাসন না করে মডেলরা কী বলেছিল তা প্রকল্পটি রিপোর্ট করে৷ রঙ প্যালেট ইচ্ছাকৃতভাবে মার্কিন যুক্তরাষ্ট্রের রাজনীতির লাল-নীল নয়, এবং বিশ্লেষণ কখনই বোঝায় না কোন মেরুটি পছন্দনীয়।

বিমূর্ত স্থানাঙ্কের অর্থ দেওয়ার জন্য, গবেষকরা বাস্তব-বিশ্বের রেফারেন্স পরিসংখ্যান ব্যবহার করে মানচিত্রটি অ্যাঙ্কর করেছেন — রাষ্ট্রপ্রধান, দলের নেতারা এবং রাজনৈতিক আন্দোলন — যাদের অবস্থান প্রতিষ্ঠিত বিশেষজ্ঞ সমীক্ষা থেকে এসেছে, বিশেষ করে 2024 চ্যাপেল হিল এক্সপার্ট সার্ভে (CHES) এবং V-Dem ডেটাসেট, দলের নিজস্ব রায়ের পরিবর্তে।

অধ্যয়নটি নির্দিষ্ট প্রশ্নগুলিও ভেঙে দেয় যা মডেলগুলিকে সবচেয়ে বেশি বিভক্ত করে, বাস্তব-বিশ্বের পরিসংখ্যানগুলি প্রতিটি মডেল উষ্ণতার সাথে প্রশংসা করে বা সমালোচনা করতে অস্বীকার করে এবং একটি "ওয়ার্ল্ডভিউ" লেন্স যা বিভিন্ন দেশ এবং ভাষার দৃষ্টিকোণ থেকে একই মডেলগুলিকে পুনরায় পরীক্ষা করে।

কেন এটা গুরুত্বপূর্ণ

এআই সিস্টেমগুলি কীভাবে পাবলিক ডিসকোর্সকে আকার দেয় তার তীব্র তদন্তের মধ্যে স্বচ্ছতার ধাক্কা আসে। একটি মডেলের চর্বিহীন, এমনকি একটি সূক্ষ্মও, এটি একটি সংবাদ গল্পের সংক্ষিপ্তসার, একটি নীতি ট্রেডঅফ বা একজন রাজনীতিবিদকে চিহ্নিত করার উপায়টি শান্তভাবে পরিচালনা করতে পারে। যেহেতু চ্যাটবট উত্তরগুলি প্রায়শই নিরপেক্ষ কর্তৃপক্ষের বাতাসের সাথে আসে, ব্যবহারকারীদের কাছে খুব কমই সেই প্রবাহ সনাক্ত করার উপায় থাকে।

স্কোরিং ওয়েট সহ একটি উন্মুক্ত প্রশ্নব্যাঙ্ক প্রকাশ করে, প্রতিটি আইটেমকে ফ্যাক্টচুয়াল বা মান-ভিত্তিক হিসাবে ট্যাগ করে এবং ক্রিয়েটিভ কমন্স লাইসেন্সের অধীনে অন্তর্নিহিত ডেটা প্রকাশ করে, Trakkr বাইরের গবেষকদের কাজটি যাচাই এবং প্রসারিত করার জন্য আমন্ত্রণ জানাচ্ছে - ল্যাবগুলি দ্বারা প্রকাশিত প্রায়শই-অস্বচ্ছ মূল্যায়নের সাথে একটি বৈপরীত্য যা নিজেই মডেলগুলি তৈরি করে।

সীমা

গবেষণাটি গুরুত্বপূর্ণ সতর্কতা স্বীকার করে। রাজনৈতিক অবস্থান বহুমাত্রিক, এবং এটিকে দুটি অক্ষে সংকুচিত করা অনিবার্যভাবে সূক্ষ্মতা হারায়। উত্তরগুলি বাক্যাংশ, ভাষা এবং অঞ্চলের সাথে পরিবর্তিত হতে পারে, যে কারণে দলটি রান-টু-রান স্থিতিশীলতা পরিমাপ করে এবং ওয়েব অনুসন্ধান কীভাবে অবস্থান অনুসারে ফলাফলগুলিকে ফিরিয়ে দেয় তা দেখার জন্য একটি পৃথক "সীমান্ত পরীক্ষা" চালায়৷

এর কোনটিই প্রমাণ করে না যে কোন মডেল ইচ্ছাকৃতভাবে পক্ষপাতমূলক। কিন্তু এটি দেখায় যে প্রধান AI সিস্টেমগুলি অভিন্ন স্থল দখল করে না - এবং যখন লক্ষ লক্ষ লোক প্রতিদ্বন্দ্বিতাপূর্ণ প্রশ্নে তাদের সাথে পরামর্শ করে, তখন সেই ছোট পার্থক্যগুলি যোগ হয়।

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →