مع لجوء الملايين من الأشخاص إلى روبوتات الدردشة المدعمة بالذكاء الاصطناعي للحصول على إجابات حول الأخبار والحجج السياسية وحتى كيفية التصويت، تطرح دراسة جديدة سؤالاً غير مريح: عندما تختلف النماذج معنا، إلى أي اتجاه يميلون؟

يهدف المشروع الذي نشرته شركة التحليلات الناشئة Trakkr في يونيو 2026 إلى رسم خريطة لذلك بالضبط. وضع الباحثون كل نماذج الذكاء الاصطناعي الرئيسية في نفس مجموعة الأسئلة المشحونة حول السياسة والاقتصاد والكلام والمجتمع، وكانت النتيجة الرئيسية هي أن معظمها يميل بنفس الطريقة، ولكن ليس بنفس القدر وليس بشكل نظيف كما قد يفترض المراقبون العاديون. لمزيد من السياق حول هذه القصة، راجع أخبار الذكاء الاصطناعي.

كيف عملت الدراسة

وفقًا لمنهجية Trakkr، تم طرح نفس بنك الأسئلة المفتوح على كل نموذج عدة مرات، مع إيقاف بحث الويب وعدم تطبيق أي مطالبة من النظام. هذه التفاصيل مهمة: مع تعطيل الاسترجاع، تعكس القراءات ما يميل إليه النموذج نفسه، بغض النظر عما يحدث على الإنترنت في الوقت الحالي.

ثم يقوم مصنف محايد منفصل بقراءة كل إجابة أولية، وتسجيل الموقف الموقع، ودرجة التحوط، ونوع الرفض، وأي لغة محملة. تم رسم النتائج كوسائل مرجحة بفواصل ثقة تبلغ 95 بالمائة، وتم تخزين كل إجابة أولية بشكل دائم حتى يمكن إعادة حساب الدرجات.

والأهم من ذلك، أن كل نموذج يظهر على هيئة سحابة وليس نقطة واحدة. نظرًا لأنه تم تشغيل كل نموذج عدة مرات، فإن التمثيل المرئي يلتقط الانتشار الكامل لمكان وصوله عبر المسارات - وهي صورة أكثر صدقًا من تسمية واحدة.

اعتبارًا من البيانات التي تم جمعها حتى 17 يونيو 2026، غطت الدراسة ستة نماذج وأكثر من 4400 إجابة.

النتائج

يتم رسم خرائط النماذج عبر محورين: محور اقتصادي يمتد من اليسار إلى اليمين، ومحور اجتماعي يمتد من الليبرالية إلى الاستبدادية.

أربعة من النماذج الستة تميل إلى يسار الوسط. وتقع الاستثناءات البارزة على طرفي نقيض من الطيف:
  • Grok تم قياسه على أقصى يمين أي نموذج تم اختباره، وتم قياسه بشكل ملحوظ بحوالي 0.36 على اليمين أكثر مما ادعى عندما سُئل مباشرة عن الاتجاه الذي يميل فيه.
  • الجوزاء كان النموذج الأكثر ثباتًا، حيث يقع بالقرب من المركز الميت على المحور الاقتصادي.

أثبتت الفجوة بين ما يقوله النموذج وما يفعله أنها واحدة من أكثر مقاييس الدراسة كشفًا. قام كلود بقياس حوالي 0.34 إلى اليسار مما أبلغ عنه بنفسه. ادعى كل من ChatGPT وMeta's Llama الحياد ولكن تم قياسهما إلى اليسار، بحوالي 0.29 و0.17 على التوالي. هبط برنامج DeepSeek بالقرب من المركز وطابق إلى حد كبير وصفه الذاتي.

خريطة وليست حكمًا

يحرص تراكر على تأطير العمل على أنه وصفي وليس توجيهي. ويورد المشروع ما قالته العارضات دون الحكم على من هو على حق. إن لوحة الألوان ليست باللونين الأحمر والأزرق في سياسة الولايات المتحدة، ولا يشير التحليل أبداً إلى أي القطبين هو الأفضل.

ولإضفاء معنى على الإحداثيات المجردة، قام الباحثون بتثبيت الخريطة باستخدام أرقام مرجعية من العالم الحقيقي - رؤساء الدول، وقادة الأحزاب، والحركات السياسية - التي تأتي مواقفها من استطلاعات الخبراء الراسخة، وتحديدًا استطلاع تشابل هيل للخبراء (CHES) لعام 2024 ومجموعة بيانات V-Dem، بدلاً من حكم الفريق نفسه.

تكسر الدراسة أيضًا الأسئلة المحددة التي تقسم النماذج أكثر من غيرها، والشخصيات الواقعية التي يشيد بها كل نموذج بحرارة أو يرفض انتقاده، وعدسة "النظرة العالمية" التي تعيد فحص نفس النماذج من منظور بلدان ولغات مختلفة.

لماذا يهم

وتأتي حملة الشفافية وسط تدقيق مكثف لكيفية تشكيل أنظمة الذكاء الاصطناعي للخطاب العام. يمكن لميول النموذج، حتى لو كان دقيقًا، أن يوجه بهدوء الطريقة التي يلخص بها قصة إخبارية، أو يزن مقايضة سياسية، أو يصف السياسي. نظرًا لأن إجابات Chatbot غالبًا ما تصل بجو من السلطة المحايدة، نادرًا ما يكون لدى المستخدمين طريقة لاكتشاف هذا الانجراف.

من خلال نشر بنك أسئلة مفتوح مع أوزان الترجيح، ووضع علامات على كل عنصر باعتباره واقعيًا أو قائمًا على القيم، وإصدار البيانات الأساسية بموجب ترخيص المشاع الإبداعي، يدعو تراكر الباحثين الخارجيين للتحقق من العمل وتوسيع نطاقه، وهو ما يتناقض مع التقييمات الغامضة غالبًا، الصادرة عن المختبرات التي تبني النماذج نفسها.

الحدود

وتعترف الدراسة بالمحاذير الهامة. فالموقف السياسي متعدد الأبعاد، وضغطه على محورين يفقد حتماً فارقه الدقيق. يمكن أن تتغير الإجابات باختلاف الصياغة واللغة والمنطقة، ولهذا السبب يقوم الفريق بقياس ثبات التشغيل وإجراء "اختبار حدودي" منفصل لمعرفة كيف يؤدي إعادة بحث الويب إلى تغيير النتائج حسب الموقع.

لا شيء من هذا يثبت أن أي نموذج هو حزبي عمدا. لكنها تُظهر أن أنظمة الذكاء الاصطناعي الرئيسية لا تشغل نفس الأرضية، وأنه عندما يستشيرها الملايين من الأشخاص بشأن أسئلة متنازع عليها، فإن هذه الاختلافات الصغيرة تتراكم.

---

ابق على اطلاع بأخبار الذكاء الاصطناعي

آخر أخبار وتحليلات وإنجازات الذكاء الاصطناعي — في مكان واحد.

اقرأ المزيد من أخبار الذكاء الاصطناعي →