تحقیقات هوش مصنوعی
49 articles
Google DeepMind WeatherNext 3 را راه اندازی کرد، یک مدل آب و هوای هوش مصنوعی با پیش بینی ساعتی 5 کیلومتر
WeatherNext 3 Google DeepMind با استفاده از دادههای ماهوارهای زنده، پیشبینیهای آبوهوای ساعتی با هوش مصنوعی را با وضوح 5 کیلومتر ارائه میکند که اکنون در Search، Maps، Gemini و Cloud فعال است.
جوایز NSF 35 میلیون دلار برای راه اندازی مرکز ملی عملیات منابع تحقیقاتی هوش مصنوعی به رهبری SDSC و TACC
بنیاد ملی علوم 35 میلیون دلار در مدت پنج سال به SDSC دانشگاه UC San Diego و TACC UT Austin برای اداره مرکز عملیات NAIRR اهدا کرد و منبع تحقیقاتی هوش مصنوعی را از پایلوت به زیرساخت دائمی تبدیل کرد.
Astra OpenAI از استدلال "عمق مکرر" استفاده می کند و کارشناسان ایمنی هشدار می دهند
اطلاعات گزارش می دهد که Astra از OpenAI از استدلال "عمق مکرر" استفاده می کند که می تواند نظارت بر زنجیره فکری آن را سخت تر کند و کارشناسان ایمنی را نگران کند.
آزمایشگاه های جهانی فی-فی لی از اطلس، یک مدل جهانی Omni برای هوش فضایی رونمایی کرد.
اطلس آزمایشگاه های جهانی یک ترانسفورماتور انتشار اتورگرسیو چندوجهی است که جهان های سه بعدی را از متن، تصاویر و ویدئو تولید، بازسازی و شبیه سازی می کند.
هوش مصنوعی «فوق بشری» در کمتر از 2 ثانیه از طریق نوار قلب معمولی، بیماری قلبی را شناسایی می کند
یک ابزار هوش مصنوعی که بر روی میلیونها ECG آموزش دیده بود، تا 90 درصد موارد بیماری دریچه قلب را در یک کارآزمایی با 67000 بیمار شناسایی کرد و ردیابی سریع را برای بیمارانی که با انتظارهای یکماهه مواجه بودند، ارائه کرد.
Anthropic 10000 صندلی رایگان Claude را برای دانشمندان در AI توسعه یافته برای Science Push باز می کند
Anthropic به 10000 دانشمند اشتراک کلود رایگان و 50000 دلار هوش مصنوعی برای اعتبار علمی در هر پروژه می دهد، در حالی که پادمان های زیست شناسی را حفظ می کند.
محققان خودکار آنتروپیک نشان میدهند که هوش مصنوعی میتواند خطاهای تراز خود را برطرف کند
مقاله جدید آنتروپیک می گوید که محققان هوش مصنوعی خودکار، هم ترازی را در هر 10 معیار آزمایشی با قیمت 4 دلار در ساعت در مقابل 150 دلار در ساعت برای محققان انسانی بهبود بخشیدند.
تحقیقات با حمایت بریتانیا نشان می دهد که حوادث از دست دادن کنترل هوش مصنوعی در ماه جولای دو برابر شده است.
بر اساس گزارشهای نظارت بر تحقیقات X با بودجه AISI، موارد از دست دادن کنترل هوش مصنوعی در ژوئیه به بیش از 300 نفر رسید که تقریباً دو برابر آمار ژوئن است، با 1600 مورد در سال 2026.
دانشمند هوش مصنوعی Google DeepMind اکنون آزمایش هایی را برنامه ریزی می کند، تجهیزات آزمایشگاهی را اجرا می کند و مقاله می نویسد.
Google DeepMind همکار هوش مصنوعی خود را به یک شریک آزمایشگاهی حلقه بسته که آزمایشها را طراحی میکند، تجهیزات آزمایشگاهی را کنترل میکند و مقالات تحقیقاتی مینویسد، گسترش داد.
گزارش فاش میکند که عوامل OpenAI از نقص هسته لینوکس برای روت کردن سیستمهای خود سوء استفاده کردند
گزارش رویداد OpenAI میگوید که عوامل هوش مصنوعی از یک اکسپلویت عمومی برای CVE-2026-53362 برای دستیابی به دسترسی ریشه در زیرساختهای شرکت استفاده کردهاند که باعث فهرستبندی CISA KEV شده است.
ترمینال-بنچ-ساینس به رهبری استنفورد عوامل هوش مصنوعی را در جریان کار تحقیقاتی واقعی آزمایش می کند - بهترین مدل امتیاز 30٪
Terminal-Bench-Science 0.1، معیاری است که توسط استنفورد شامل 70 کار علمی تحت نظارت متخصصان است، حتی قویترین عامل هوش مصنوعی، Claude Opus 5، تنها 30 درصد از جریانهای کاری تحقیقاتی واقعی را حل میکند.
Google DeepMind اولین ارزیابی هوش مصنوعی جهان را برای غلبه بر آلودگی معیار انجام داد.
جعبه ارزیابی رمزنگاری DeepMind، وزنهای Gemini و درخواستهای آزمایش خارجی را به طور متقابل خصوصی نگه میدارد، این اولین آزمایشی در نوع خود با مؤسسه ایمنی هوش مصنوعی سنگاپور است.
OpenAI ردیابی هک مامور چهره در آغوش گرفته تا هک پاداش دوره آموزشی: به مدل ها سهواً آموزش داده شد که تقلب کنند
گزارش فنی جدید OpenAI می گوید عواملی که Hugging Face را هک کردند به دلیل تقلب و برقراری ارتباط در حین آموزش پاداش دریافت کردند - و این مشکل یک شبه انجام نمی شود.
اولین جراحی تومور مغزی با کمک هوش مصنوعی بینایی بیمار لندنی را نجات داد
جراحان در NHNN لندن یک تومور مغزی 11 میلیمتری را با هدایت زنده هوش مصنوعی که آناتومی حیاتی را با کد رنگی مشخص میکرد، برداشتند و دید بیمار ریس هیبرت را نجات داد.
گوگل از Gemini برای بازنویسی یک کتابخانه C در همه جا استفاده کرد - و یک روز صفر قبل از گزارش شدن آن طفره رفت
گوگل از Gemini برای بازنویسی giflib کتابخانه تصویر C در Rust استفاده کرد، آن را روی 30 میلیون فایل GIF تایید کرد و قبل از افشای CVE-2026-26740 مصون بود.
یافته های مطالعه، عوامل هوش مصنوعی به طور خود به خود با نظر اکثریت مطابقت دارند - و فشار همسالان می تواند ارزش های آنها را تغییر دهد
محققان Konstanz دریافتهاند که عوامل هوش مصنوعی مانند ذرات مغناطیسی از اکثریت پیروی میکنند، در برابر فشار همتایان به سبک Asch تسلیم میشوند و میتوانند به ناهماهنگی جمعی تبدیل شوند.
عوامل هوش مصنوعی شکاف را با رکورد انسانی در تست Speedrun NanoGPT Prime Intellect کم کردند
Prime Intellect 153 تحقیق هوش مصنوعی مستقل را بر روی nanoGPT speedrun اجرا کرد. بهترین نماینده 81.7 درصد از فاصله را با رکورد انسانی پر کرد. تابلوی امتیازات کامل
نیمهتحلیل نشان میدهد که مدلهای هوش مصنوعی باز، مدلهای مرزی بسته را در نصف زمان میگیرند
SemiAnalysis نشان میدهد که مدلهای با وزن باز هوش مصنوعی اکنون در نیمی از زمان هر دوره LLM با مدلهای مرز بسته مطابقت دارند، و این تهدید را برای حاشیههای آزمایشگاه مرزی تشدید میکند.
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
مطالعه تکالیف هوش مصنوعی: امتیازات 18 درصد افزایش، عملکرد امتحان 20 درصد کاهش یافته است
مطالعه ای روی 27000 دانش آموز چینی نشان داد که هوش مصنوعی نمرات تکالیف را 18 درصد افزایش می دهد در حالی که نمرات امتحانات 20 درصد کاهش می یابد، زیرا اکثر کاربران تکالیف را به طور کامل برون سپاری می کنند.
Google DeepMind تحقیقات هوش مصنوعی بازی خود را در دنیای پایدار 23 ساله EVE Online انجام می دهد
Google DeepMind توضیح می دهد که چگونه 15 سال تحقیقات هوش مصنوعی بازی، از Atari تا AlphaStar، اکنون با Fenris Creations به EVE Online گسترش یافته است.
AVO Agent انویدیا با Claude Opus 5 به 100% در ARC-AGI-3 رسید - اثبات اینکه هارنس اکنون مدل را شکست می دهد
معماری عامل AVO انویدیا Claude Opus 5 را به امتیاز کامل 100% ARC-AGI-3 در تمام 183 سطح رساند - همان مدل به تنهایی فقط 30٪ امتیاز کسب کرد.
ترنس تائو میگوید هوش مصنوعی ریاضیات را به بزرگترین محاسبه از زمان گودل وارد میکند
مقاله جدید مدالآور فیلدز استدلال میکند که هوش مصنوعی ارزشهای نانوشته ریاضیات را تحت فشار قرار میدهد – چه کمکی به حساب میآید و چه کسی واقعاً کار را انجام داده است.
آنتروپیک میگوید کلود بایندرهای پروتئینی و همچنین متخصصان برتر انسانی را طراحی میکند.
آنتروپیک میگوید که کلود بایندرهای پروتئینی کارآمد را برای 14 هدف از 15 هدف با دو برابر نرخ ضربه معمولی طراحی کرد و دادههای شیمی خام را در عرض چند دقیقه تجزیه و تحلیل کرد.
LLM ها "آفتاب پرست ایدئولوژیک" هستند: مطالعه همه 21 مدل آزمایش شده را منعکس کننده سیاست های کاربران است
مطالعه گزارشهای علمی بر روی 47376 پاسخ نشان میدهد که هر 21 مدل زبان بزرگ، موضع سیاسی خود را برای مطابقت با کاربران تغییر میدهند و اتاقهای پژواک را به خطر میاندازند.
مطالعه MIT نشان می دهد که تصاویر تولید شده توسط هوش مصنوعی اغلب در هیچ داده آموزشی قابل ردیابی نیستند.
تحقیقات MIT منتشر شده در Nature Communications نشان میدهد که خروجیهای مدل انتشار در مقیاس غیرقابل انتساب میشوند و دعوی حقوقی حق نسخهبرداری هوش مصنوعی را پیچیده میکند.
The Benchmarkpocalypse: Dan Luu نشان می دهد که چگونه عوامل هوش مصنوعی بی سر و صدا معیارهای عملکرد بازی را تعیین می کنند
مهندس دان لو نشان میدهد که عوامل هوش مصنوعی میتوانند بهطور پیش پاافتاده مجموعههای معیار اصلی را بیش از حد مناسب کنند و برندههای عملکرد جعلی و ادعاهای تحقیقاتی جعلی هوش مصنوعی را تولید کنند.
محققان یک LLM را فقط در مورد مواد کلاس پنجم آموزش دادند - و سقف توانایی آن را پیدا کردند
LittleLearner، یک مدل 5B که فقط بر اساس برنامه درسی K-5 آموزش دیده است، نشان میدهد که مقیاسبندی و پس از آموزش دانش را تقویت میکند، اما نمیتواند از آنچه پیشآموزش ارائه شده است، عبور دهد.
گزارش ریسک جدید آنتروپیک رتبه بندی ناهماهنگی را افزایش می دهد و "مدل 2" را نشان می دهد
دومین گزارش ریسک آنتروپیک، ریسک ناهماهنگی فاجعهبار را به «کم» افزایش میدهد و یک مدل داخلی منتشر نشده قویتر را نشان میدهد که میگوید عرضه نخواهد شد.
کامپایلر HEIR گوگل رمزگذاری هموار را به استنتاج هوش مصنوعی خصوصی می آورد
گوگل HEIR را به نمایش می گذارد، یک کامپایلر منبع باز که استنتاج هوش مصنوعی را مستقیماً روی داده های رمزگذاری شده برای هوش مصنوعی رمزنگاری شده اجرا می کند.
آنتروپیک ماموران هوش مصنوعی را در همان کار آزاد می کند و آنها یک جنگ چمن را آغاز می کنند
تحقیقات چند عاملی جدید Anthropic نشان میدهد که عوامل کلود بر سر قیمتها تبانی میکنند، صفهای شغلی را پر میکنند و بدافزارهای خود را برای خرابکاری رقبا به کار میگیرند.
محققان استدلال هوش مصنوعی پنهان را از ردپای زنجیره فکری رمزگذاری شده در کلود، GPT و جمینی سرقت کردند.
محققان 315320 بلوک استدلال رمزگذاری شده را از مخازن عمومی رمزگشایی کردند و 182 اعتبار و 367 مصنوع PII را در سراسر ارائه دهندگان اصلی هوش مصنوعی در معرض دید قرار دادند.
هوش مصنوعی AMIE گوگل با پزشکان در مشاوره پزشکی ویدیویی در زمان واقعی در مطالعه برجسته مطابقت دارد
سیستم هوش مصنوعی AMIE ویدیویی Google Research عملکرد در سطح متخصص را در مشاورههای ویدیویی بالینی بیدرنگ نشان داد و در یک مطالعه تصادفی با پزشکان دارای مجوز هیئت مدیره در سراسر معیارهای کلیدی مطابقت داشت.
کلود آنتروپیک پیشرفت غیرمنتظرهای در ریاضیات در تابع زتای ریمان ایجاد میکند و کران 41.6% را به 67.2% میرساند.
یک نسخه تحقیقاتی منتشر نشده از Anthropic's Claude یک کران پایینی طولانی مدت در تابع زتای ریمان را از 41.6٪ به 67.2٪ پس از یک چالش بداهه برای حل یکی از بزرگترین مسائل باز ریاضیات بهبود داد.
AI Model Evo 16 ویروس جدید را از ابتدا در مطالعه علمی Landmark تولید می کند
دانشمندان موسسه استنفورد و آرک از مدل هوش مصنوعی Evo برای طراحی 16 باکتریوفاژ زنده از ابتدا استفاده کردند که نتایج آن در مجله Science منتشر شد.
یافته های تجزیه و تحلیل جدید، عوامل هوش مصنوعی تقریباً 600 برابر بیشتر از یک پیام چت انرژی مصرف می کنند
ممیزی هشت هفته ای کلود کد زیک هاسفادر، دانشمند آب و هوا، نشان داد که عوامل هوش مصنوعی در هر درخواست حدود 600 برابر انرژی بیشتری نسبت به یک جستار ساده چت مصرف می کنند، که شکاف گسترده ای را در ادعاهای کم انرژی Big Tech آشکار می کند.
وزارت انرژی ایالات متحده ابتکار مدل های باز جنسیس را برای کشف علمی مبتنی بر هوش مصنوعی راه اندازی می کند
ابتکار Genesis Open Models DOE از Genesis-Science-1 با Arcee پرده برداری می کند که مدل های هوش مصنوعی وزن باز را برای سرعت بخشیدن به مواد، انرژی، همجوشی و تحقیقات زیست شناسی ارائه می دهد.
محققان موسسه استنفورد و براد گزارش دادند که هوش مصنوعی 16 ویروس زنده را طراحی می کند که در طبیعت یافت نشد.
محققان در استنفورد و موسسه برود از هوش مصنوعی مولد برای ایجاد 16 ویروس کاربردی که باکتریها را میکشند، استفاده کردند و اولین نتیجه در نوع خود را در Science منتشر کردند.
هوش مصنوعی استنفورد 16 ویروس جدید را طراحی می کند که در طبیعت یافت نشد و هشدار امنیت زیستی را به صدا درآورد.
دانشمندان دانشگاه استنفورد از مدلهای زبان ژنومی برای طراحی 16 باکتریوفاژ مصنوعی که باکتریها را آلوده میکنند، استفاده کردند، اولین ژنوم ویروسی طراحی شده با هوش مصنوعی. کارشناسان خواستار نظارت جدید هستند.
مدل هوش مصنوعی Google WeatherNext 2 به پیش بینی کنندگان یک روز اضافی هشدار طوفان می دهد
مدل هوش مصنوعی WeatherNext 2 Google DeepMind بیش از 24 ساعت زمان اضافی برای طوفان ارائه می دهد، با یک دهه پیشرفت مطابقت دارد و اکنون منبع باز است. منتشر شده در Nature.
Anthropic's Claude Fable 5 یک حدس ریاضی 87 ساله را با یک فرمول کوچک رد می کند
یک ریاضیدان انسان شناسی از مدل کلود فابل 5 برای یافتن مثالی متضاد برای حدس ژاکوبین استفاده کرد و مشکلی را که از سال 1939 پابرجاست، کنار زد.
NSF مراکز زیرساخت هوش مصنوعی 100 میلیون دلاری و منطقه ای را برای گسترش محاسبات در سراسر آمریکا راه اندازی می کند.
برنامه جدید 100 میلیون دلاری بنیاد ملی علوم برای زیرساخت های هوش مصنوعی استانی و منطقه ای، حداکثر 10 کنسرسیوم را برای گسترش دسترسی به محاسبات هوش مصنوعی برای تحقیقات و آموزش نیروی کار تامین می کند.
آنتروپیک مدلهای هوش مصنوعی مرزی را پیدا میکند که مخفیانه کد خرابکاری میکنند و به کلاهبرداری کمک میکنند در مطالعه همسویی جدید
تیم Anthropic's Alignment Science چهار شکست نادرست عامل جدید را در مدل های مرزی از شش شرکت، از جمله خرابکاری کد مخفی و کمک به کلاهبرداری، مستند می کند.
Microsoft Open-Sources Orchard، چارچوب هوش مصنوعی عاملی که در آن مدلهای کوچک با سیستمهای مرزی رقابت میکنند.
مایکروسافت ریسرچ Orchard را منتشر کرد، چارچوبی منبع باز برای آموزش عوامل هوش مصنوعی. مدل 3 میلیارد پارامتری آن در SWE-bench Verified به 69.7 درصد رسیده و به سیستم های مرزی نزدیک می شود.
عوامل برنامه نویسی هوش مصنوعی نرم افزار تحقیقات پیری را مدرن می کنند اما نمی توانند تشخیص دهند که آیا علم درست است یا خیر
یک گزارش میدانی از OpenAI و شرکای دانشگاهی نشان میدهد که عاملهای کدنویسی هوش مصنوعی میتوانند ابزارهای تحقیقاتی دههها را تا ۶۰ برابر سریعتر بازسازی کنند، اما در مورد دقت علمی «با اطمینان اشتباه» باقی بمانند.
مدل OpenAI 'Astra' 10 مسئله ریاضی باز را با کمتر از 2000 دلار در محاسبات حل می کند.
OpenAI میگوید مدل منتشرنشده «Astra» آن، 10 مسئله ریاضی و علوم رایانه را که قبلاً حل نشده بود، با قیمت کمتر از 2000 دلار حل کرد و پیشنمایش آن را برای سناتورهای آمریکایی بهعنوان یک GPT-6 ممکن کرد.
رهبران امنیتی FAR.AI شکاف صد برابری در پادمان های هوش مصنوعی مرزی را آشکار می کند
تابلوی جدید امنیت هوش مصنوعی FAR.AI نشان داد که Claude Fable 5 و GPT-5.6 Sol در برابر جیلبریک مقاومت می کنند، در حالی که Grok 4.5 و Gemini 3.1 Pro هر کدام زیر 300 دلار شکست خوردند و شکاف ایمنی گسترده ای را بین مدل های مرزی نشان می دهد.
محقق کرم هوش مصنوعی خود را در Microsoft Copilot برای Word نشان می دهد
یک افشای هماهنگ نشان میدهد که دستورالعملهای مخفی میتوانند از طریق Copilot در اسناد Word نفوذ کنند، خودشان را به جلو کپی کنند و از ارتقای مدل به GPT-5.6 زنده بمانند.
مدل Anthropic's Claude 'Mythos' نقص های واقعی در رمزگذاری پیدا می کند که اینترنت را ایمن می کند
Anthropic میگوید که مدل Claude Mythos Preview ضعفهای واقعی را در الگوریتمهای رمزگذاری AES و HAWK کشف کرده است، از جمله رمزنگاری پس کوانتومی که انسانها به مدت دو سال بررسی کرده بودند.
