أبحاث الذكاء الاصطناعي
50 articles
GPT-6 Astra يسجل أحدث نتيجة ARC-AGI-3، ويتفوق على البشر في كفاءة العمل
تشير تقارير جائزة ARC إلى أن GPT-6 Astra حصل على 99.9% على ARC-AGI-3 مع مجموعة المزودين و62.7% بموجب القواعد القياسية، متفوقًا على كفاءة العمل البشري في 96% من المستويات.
Google DeepMind تطلق WeatherNext 3، وهو نموذج للطقس يعمل بالذكاء الاصطناعي مع توقعات بمسافة 5 كيلومترات كل ساعة
يقدم تطبيق WeatherNext 3 من Google DeepMind تنبؤات جوية كل ساعة بتقنية الذكاء الاصطناعي بدقة 5 كيلومترات باستخدام بيانات الأقمار الصناعية المباشرة، وهي متاحة الآن في البحث والخرائط وGemini وCloud.
NSF تمنح 35 مليون دولار أمريكي لإطلاق المركز الوطني لعمليات موارد أبحاث الذكاء الاصطناعي بقيادة SDSC وTACC
منحت مؤسسة العلوم الوطنية 35 مليون دولار على مدى خمس سنوات لمركز SDSC التابع لجامعة كاليفورنيا في سان دييغو وTACC في جامعة تكساس في أوستن لتشغيل مركز عمليات NAIRR، ونقل موارد أبحاث الذكاء الاصطناعي من البنية التحتية التجريبية إلى البنية التحتية الدائمة.
شركة OpenAI's Astra تستخدم منطق "العمق المتكرر"، ويشعر خبراء السلامة بالقلق
تشير المعلومات إلى أن Astra من OpenAI ستستخدم منطق "العمق المتكرر" الذي قد يجعل مراقبة سلسلة أفكارها أكثر صعوبة، مما يثير قلق خبراء السلامة.
مختبرات Fei-Fei Li العالمية تكشف عن أطلس، وهو نموذج عالمي شامل للذكاء المكاني
أطلس World Labs هو محول نشر ذاتي الانحدار متعدد الوسائط يقوم بإنشاء وإعادة بناء ومحاكاة عوالم ثلاثية الأبعاد من النصوص والصور والفيديو.
الذكاء الاصطناعي "الخارق" يرصد أمراض القلب في أقل من ثانيتين من خلال تخطيط كهربية القلب الروتيني
اكتشفت أداة الذكاء الاصطناعي التي تم تدريبها على ملايين تخطيطات القلب ما يصل إلى 90% من حالات أمراض صمامات القلب في تجربة شملت 67000 مريض، مما يوفر تتبعًا سريعًا للمرضى الذين يواجهون انتظارًا لمدة شهر.
Anthropic تفتح 10000 مقعد مجاني لكلود للعلماء في مجال الذكاء الاصطناعي الموسع لدفع العلوم
ستمنح Anthropic اشتراكات Claude مجانية لـ 10,000 عالم وما يصل إلى 50,000 دولار أمريكي من اعتمادات الذكاء الاصطناعي للعلوم لكل مشروع، مع الحفاظ على ضمانات علم الأحياء.
يُظهر الباحثون الآليون في Anthropic أن الذكاء الاصطناعي يمكنه إصلاح فشل المحاذاة الخاص به
تقول ورقة Anthropic الجديدة إن باحثي الذكاء الاصطناعي الآلي قاموا بتحسين التوافق في جميع معايير الاختبار العشرة بتكلفة 4 دولارات في الساعة، مقابل 150 دولارًا في الساعة للباحثين البشريين.
تضاعفت حوادث فقدان السيطرة على الذكاء الاصطناعي تقريبًا في يوليو، وفقًا لأبحاث مدعومة من المملكة المتحدة
بلغت حوادث فقدان السيطرة على الذكاء الاصطناعي أكثر من 300 حالة في يوليو، أي ما يقرب من ضعف عدد يونيو، مع 1600 حالة في عام 2026، وفقًا لتقارير مراقبة الأبحاث الممولة من AISI في المملكة المتحدة.
يقوم العالم المشارك في الذكاء الاصطناعي في Google DeepMind الآن بالتخطيط للتجارب وتشغيل معدات المختبرات وكتابة الأوراق البحثية
قامت شركة Google DeepMind بتوسيع عالم الذكاء الاصطناعي المشارك الخاص بها إلى شريك في مختبر مغلق الحلقة يصمم التجارب ويتحكم في معدات المختبر ويكتب الأوراق البحثية.
يكشف التقرير أن عملاء OpenAI استغلوا ثغرة في Linux Kernel لاستئصال أنظمتهم الخاصة
يقول تقرير حادثة OpenAI أن عملاء الذكاء الاصطناعي استخدموا استغلالًا عامًا لـ CVE-2026-53362 للوصول إلى الجذر على البنية التحتية للشركة، مما أدى إلى إدراج CISA KEV.
مختبر Terminal-Bench-Science الذي تقوده جامعة ستانفورد يختبر وكلاء الذكاء الاصطناعي على سير عمل بحثي حقيقي - حصل على أفضل نموذج بنسبة 30%
Terminal-Bench-Science 0.1، وهو معيار تقوده جامعة ستانفورد يضم 70 مهمة علمية برعاية الخبراء، يجد أن أقوى وكيل للذكاء الاصطناعي، كلود أوبوس 5، يحل 30% فقط من سير العمل البحثي الحقيقي.
Google DeepMind تطلق أول تقييمات مزدوجة التعمية للذكاء الاصطناعي في العالم للتغلب على التلوث المعياري
يحافظ صندوق تقييم التشفير الخاص بـ DeepMind على خصوصية أوزان Gemini ومطالبات الاختبار الخارجية بشكل متبادل، في تجربة تجريبية هي الأولى من نوعها مع معهد سلامة الذكاء الاصطناعي في سنغافورة.
OpenAI تتتبع اختراق عميل معانقة الوجه إلى اختراق المكافآت في عصر التدريب: تم تعليم النماذج عن غير قصد للغش
يقول التقرير الفني الجديد لـ OpenAI إن العملاء الذين اخترقوا Hugging Face تمت مكافأتهم على الغش والتواصل أثناء التدريب - ولن يأتي الإصلاح بين عشية وضحاها.
أول جراحة لأورام الدماغ بمساعدة الذكاء الاصطناعي في العالم تنقذ بصر مريض في لندن
قام الجراحون في NHNN بلندن بإزالة ورم في المخ يبلغ طوله 11 ملم باستخدام توجيه الذكاء الاصطناعي المباشر الذي يقوم بترميز التشريح الحرج بالألوان، مما أدى إلى إنقاذ بصر المريض ريس هيبرت.
استخدمت Google برنامج Gemini لإعادة كتابة مكتبة لغة C واسعة الانتشار، وتفادت يوم الصفر قبل الإبلاغ عنها
استخدمت Google برنامج Gemini لإعادة كتابة مكتبة الصور C giflib في Rust، وتم التحقق من صحتها على 30 مليون صورة GIF، وكانت محصنة ضد CVE-2026-26740 قبل الكشف عنها.
توصلت الدراسة إلى أن وكلاء الذكاء الاصطناعي يتوافقون تلقائيًا مع آراء الأغلبية، وقد يؤدي ضغط الأقران إلى قلب قيمهم
وجد باحثو كونستانز أن عملاء الذكاء الاصطناعي يتبعون الأغلبية مثل الجسيمات الممغنطة، ويخضعون لضغط الأقران على غرار آش، ويمكن أن ينقلبوا إلى اختلال جماعي.
وكلاء الذكاء الاصطناعي يضيقون الفجوة مع السجل البشري في اختبار NanoGPT Speedrun الخاص بشركة Prime Intellect
أجرى Prime Intellect 153 بحثًا مستقلاً للذكاء الاصطناعي على نظام nanoGPT السريع. أفضل وكيل أغلق 81.7% من الفجوة في السجل البشري. المتصدرين الكاملة.
نماذج الذكاء الاصطناعي المفتوحة تلتقط نماذج الحدود المغلقة في نصف الوقت، حسبما توصلت إليه شركة SemiAnalys
توصلت شركة SemiAnalogy إلى أن نماذج الذكاء الاصطناعي ذات الوزن المفتوح تتطابق الآن مع نماذج الحدود المغلقة في نصف الوقت مع كل حقبة ماجستير إدارة أعمال، مما يزيد من حدة التهديد الذي تتعرض له هوامش المختبرات الحدودية.
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
دراسة الواجبات المنزلية باستخدام الذكاء الاصطناعي: ارتفعت النتائج بنسبة 18 بالمائة، وانخفض أداء الامتحان بنسبة 20 بالمائة
وجدت دراسة أجريت على 27 ألف طالب صيني أن الذكاء الاصطناعي رفع درجات الواجبات المنزلية بنسبة 18% بينما انخفضت درجات الامتحانات بنسبة 20%، حيث قام معظم المستخدمين بالاستعانة بمصادر خارجية للواجبات بالكامل.
تأخذ Google DeepMind أبحاثها المتعلقة بالذكاء الاصطناعي في عالم EVE Online المستمر الذي يبلغ عمره 23 عامًا
يقدم Google DeepMind تفاصيل عن كيفية امتداد 15 عامًا من أبحاث الذكاء الاصطناعي للألعاب، بدءًا من Atari إلى AlphaStar، إلى EVE Online مع Fenris Creations.
وكيل Nvidia's AVO يصل إلى 100% على ARC-AGI-3 مع Claude Opus 5 - دليل على أن الحزام يتفوق الآن على النموذج
أدت بنية وكيل AVO من Nvidia إلى وصول Claude Opus 5 إلى نتيجة مثالية بنسبة 100% في ARC-AGI-3 عبر جميع المستويات البالغ عددها 183 - وسجل نفس النموذج 30% فقط بمفرده.
يقول تيرينس تاو إن الذكاء الاصطناعي يدفع الرياضيات إلى أكبر حساباتها منذ جودل
يقول المقال الجديد للحائز على ميدالية فيلدز إن الذكاء الاصطناعي هو بمثابة اختبار للقيم غير المكتوبة للرياضيات - ما الذي يمكن اعتباره مساهمة، ومن قام بالعمل بالفعل.
كلود يصمم مجلدات البروتين العاملة بالإضافة إلى كبار الخبراء البشريين، كما يقول الأنثروبيك
يقول أنثروبيك إن كلود صمم روابط بروتينية فعالة لـ 14 هدفًا من أصل 15 هدفًا بضعف معدل الإصابة النموذجي، وقام بتحليل البيانات الكيميائية الأولية في دقائق.
ماجستير إدارة الأعمال هي "حرباء أيديولوجية": وجدت الدراسة أن جميع النماذج الـ 21 التي تم اختبارها تعكس سياسات المستخدمين
توصلت دراسة أجرتها مجلة Scientific Reports شملت 47376 إجابة إلى أن جميع نماذج اللغات الكبيرة البالغ عددها 21 نموذجًا تغير موقفها السياسي لتتناسب مع المستخدمين، مما يعرضها لخطر غرف الصدى.
توصلت دراسة معهد ماساتشوستس للتكنولوجيا إلى أن الصور التي تم إنشاؤها بواسطة الذكاء الاصطناعي لا يمكن في كثير من الأحيان تتبعها إلى أي بيانات تدريب
يُظهر بحث معهد ماساتشوستس للتكنولوجيا المنشور في مجلة Nature Communications أن مخرجات نموذج الانتشار تصبح غير قابلة للإسناد على نطاق واسع، مما يعقد التقاضي بشأن حقوق الطبع والنشر في مجال الذكاء الاصطناعي.
The Benchmarkpocalypse: Dan Luu يوضح كيف يتلاعب وكلاء الذكاء الاصطناعي بهدوء بمعايير الأداء
يوضح المهندس دان لو أن عملاء الذكاء الاصطناعي يمكنهم أن يبالغوا بشكل تافه في مجموعات المعايير الرئيسية، مما ينتج عنه انتصارات زائفة في الأداء - ومطالبات بحثية زائفة في مجال الذكاء الاصطناعي.
قام الباحثون بتدريب ماجستير في القانون على مواد الصف الخامس فقط، ووجدوا سقف قدراتها
يُظهر نموذج LittleLearner، وهو نموذج 5B تم تدريبه فقط على منهج K-5، أن التوسع والتدريب اللاحق يؤدي إلى تضخيم المعرفة ولكن لا يمكنه تجاوز ما قدمه التدريب المسبق.
تقرير المخاطر الجديد الخاص بـ Anthropic يرفع تصنيف الاختلال ويكشف عن "النموذج 2" على الرف
يرفع تقرير المخاطر الثاني الصادر عن Anthropic مخاطر الاختلال الكارثي إلى "منخفض" ويكشف عن نموذج داخلي أقوى لم يتم إصداره يقول إنه لن يتم شحنه.
مترجم HEIR من Google يجلب التشفير المتماثل إلى استدلال الذكاء الاصطناعي الخاص
تعرض Google HEIR، وهو مترجم مفتوح المصدر يقوم بتشغيل استدلال الذكاء الاصطناعي مباشرة على البيانات المشفرة للذكاء الاصطناعي الخاص المشفر.
تطلق Anthropic العنان لعملاء الذكاء الاصطناعي للقيام بنفس المهمة ويبدأون حربًا على النفوذ
يُظهر بحث Anthropic الجديد متعدد الوكلاء أن عملاء Claude يتواطؤون على الأسعار، ويغرقون طوابير الوظائف، وينشرون برامج ضارة ذاتية التكرار لتخريب المنافسين.
الباحثون يسرقون منطق الذكاء الاصطناعي الخفي من آثار سلسلة الأفكار المشفرة عبر كلود وجي بي تي وجيميني
قام الباحثون بفك تشفير 315,320 كتلة استدلالية مشفرة من المستودعات العامة، وكشفوا عن 182 بيانات اعتماد و367 قطعة أثرية من معلومات تحديد الهوية الشخصية عبر موفري الذكاء الاصطناعي الرئيسيين.
يطابق برنامج AMIE AI من Google الأطباء في الاستشارات الطبية عبر الفيديو في الوقت الفعلي في دراسة تاريخية
أظهر نظام الذكاء الاصطناعي للفيديو AMIE من Google Research أداءً على مستوى الخبراء في استشارات الفيديو السريرية في الوقت الفعلي، ومطابقة الأطباء المعتمدين من مجلس الإدارة عبر المقاييس الرئيسية في دراسة عشوائية.
كلود من أنثروبيك يحقق اختراقًا رياضيًا غير متوقع في دالة ريمان زيتا، مما يرفع نسبة 41.6% إلى 67.2%
قامت نسخة بحثية غير منشورة من كتاب أنثروبيك كلود بتحسين الحد الأدنى طويل الأمد لدالة زيتا لريمان من 41.6% إلى 67.2% بعد تحدي مرتجل لحل واحدة من أعظم المسائل المفتوحة في الرياضيات.
AI Model Evo يُنتج 16 فيروسًا جديدًا من الصفر في دراسة علمية بارزة
استخدم علماء معهد ستانفورد وآرك نموذج Evo AI لتصميم 16 عاثيات بكتيرية قابلة للحياة من الصفر، ونشرت النتائج في مجلة Science.
توصل تحليل جديد إلى أن وكلاء الذكاء الاصطناعي يستهلكون ما يقرب من 600 مرة من الطاقة أكثر من رسالة الدردشة
وجدت مراجعة كلود كود التي أجراها عالم المناخ زيكي هاوسفاذر لمدة ثمانية أسابيع أن عملاء الذكاء الاصطناعي يستخدمون طاقة أكثر بنحو 600 مرة لكل مطالبة من استعلام محادثة بسيط، مما يكشف عن فجوة واسعة في ادعاءات شركات التكنولوجيا المنخفضة للطاقة.
وزارة الطاقة الأمريكية تطلق مبادرة جينيسيس للنماذج المفتوحة للاكتشافات العلمية المعتمدة على الذكاء الاصطناعي
تكشف مبادرة Genesis Open Models التابعة لوزارة الطاقة عن Genesis-Science-1 مع Arcee، التي تقدم نماذج ذكاء اصطناعي مفتوحة الوزن لتسريع أبحاث المواد والطاقة والاندماج والبيولوجيا.
الذكاء الاصطناعي يصمم 16 فيروسًا قابلاً للحياة غير موجودة في الطبيعة، حسبما أفاد باحثون في جامعة ستانفورد ومعهد برود
استخدم الباحثون في جامعة ستانفورد ومعهد برود الذكاء الاصطناعي لإنشاء 16 فيروسًا وظيفيًا يقتل البكتيريا، ونشروا النتيجة الأولى من نوعها في مجلة العلوم.
الذكاء الاصطناعي في جامعة ستانفورد يصمم 16 فيروسًا جديدًا غير موجود في الطبيعة، مما يثير إنذار الأمن البيولوجي
استخدم علماء جامعة ستانفورد نماذج لغة الجينوم لتصميم 16 من العاثيات الاصطناعية التي تصيب البكتيريا، وهي أول جينومات فيروسية كاملة مصممة بواسطة الذكاء الاصطناعي. الخبراء يحثون على الرقابة الجديدة.
نموذج Google WeatherNext 2 للذكاء الاصطناعي يمنح المتنبئين يومًا إضافيًا للتحذير من الإعصار
يوفر نموذج WeatherNext 2 AI من Google DeepMind أكثر من 24 ساعة من الوقت الإضافي للإعصار، ويتوافق مع عقد من التقدم، وهو الآن مفتوح المصدر. نشرت في الطبيعة.
Anthropic's Claude Fable 5 يدحض تخمينًا رياضيًا عمره 87 عامًا بصيغة واحدة صغيرة
استخدم عالم رياضيات إنساني نموذج كلود فابل 5 للعثور على مثال مضاد لحدسية جاكوبي، مما أدى إلى إسقاط مشكلة ظلت قائمة منذ عام 1939.
تطلق NSF مراكز بنية تحتية للذكاء الاصطناعي على مستوى الولاية والإقليم بقيمة 100 مليون دولار لنشر الحوسبة في جميع أنحاء أمريكا
سيقوم برنامج مراكز البنية التحتية للذكاء الاصطناعي على مستوى الولاية والإقليمية الجديد التابع لمؤسسة العلوم الوطنية بقيمة 100 مليون دولار بتمويل ما يصل إلى 10 اتحادات لتوسيع الوصول إلى حوسبة الذكاء الاصطناعي للبحث وتدريب القوى العاملة.
أنثروبيك تكتشف أن نماذج الذكاء الاصطناعي الحدودية تخرب التعليمات البرمجية بشكل سري وتساعد على الاحتيال في دراسة محاذاة جديدة
يوثق فريق Anthropic's Alignment Science أربع حالات فشل جديدة في اختلال المحاذاة عبر النماذج الحدودية من ست شركات، بما في ذلك تخريب التعليمات البرمجية السرية والمساعدة في الاحتيال.
Microsoft Open-Sources Orchard، إطار عمل للذكاء الاصطناعي الوكيل حيث تنافس النماذج الصغيرة الأنظمة الحدودية
أصدرت شركة Microsoft Research برنامج Orchard، وهو إطار عمل مفتوح المصدر لتدريب عملاء الذكاء الاصطناعي. يصل نموذجها الذي يحتوي على 3 مليارات من المعلمات إلى 69.7% على أنظمة SWE-bench التي تم التحقق منها، والتي تقترب من الأنظمة الحدودية.
يقوم وكلاء ترميز الذكاء الاصطناعي بتحديث برامج أبحاث الشيخوخة ولكن لا يمكنهم معرفة ما إذا كان العلم صحيحًا
يُظهر تقرير ميداني صادر عن OpenAI وشركاء أكاديميين أن وكلاء تشفير الذكاء الاصطناعي يمكنهم إعادة بناء أدوات بحث عمرها عقود بسرعة تصل إلى 60 مرة، ومع ذلك يظلون "مخطئين بثقة" فيما يتعلق بالدقة العلمية.
نموذج Astra من OpenAI يحل 10 مسائل رياضية مفتوحة بأقل من 2000 دولار في الحوسبة
تقول شركة OpenAI إن نموذجها "Astra" الذي لم يتم إصداره قد حل 10 مسائل في الرياضيات وعلوم الكمبيوتر لم يتم حلها سابقًا بتكلفة أقل من 2000 دولار أمريكي في الحوسبة، وعرضه على أعضاء مجلس الشيوخ الأمريكي باعتباره GPT-6 المحتمل.
لوحة ترتيب الأمان من FAR.AI تكشف فجوة بمئة ضعف في حماية نماذج الذكاء الاصطناعي المتقدمة
كشفت لوحة ترتيب الأمان الجديدة للذكاء الاصطناعي من FAR.AI أن Claude Fable 5 وGPT-5.6 Sol صمدا أمام اختراقات الجيلبريك، بينما انكسر كل من Grok 4.5 وGemini 3.1 Pro بأقل من 300 دولار، ما يكشف عن فجوة أمنية هائلة بين النماذج المتقدمة.
باحث يُظهر دودة ذكاء اصطناعي تنتشر ذاتيًا في Microsoft Copilot لبرنامج Word
يُظهر إفصاح منسق أن تعليمات مخفية يمكن أن تنتشر عبر مستندات Word بواسطة Copilot، وتنسخ نفسها، وتصمد أمام تحديث النموذج إلى GPT-5.6.
نموذج كلود "ميثوس" من Anthropic يجد عيوبًا حقيقية في التشفير الذي يؤمن الإنترنت
تقول Anthropic إن نموذج Claude Mythos Preview الخاص بها اكتشف نقاط ضعف حقيقية في خوارزميات التشفير AES وHAWK، بما في ذلك تشفير ما بعد الكم الذي استعرضه البشر لمدة عامين.
