اخلاق هوش مصنوعی
43 articles
پنتاگون مسئول نظارت بر هوش مصنوعی نظامی تا 25 میلیون دلار در سهام Perplexity فروخته شد
افشاگری ها نشان می دهد که امیل مایکل، که بر سیاست هوش مصنوعی پنتاگون نظارت دارد، سهام Perplexity را پس از سودهای قبلی xAI به قیمت 5 تا 25 میلیون دلار فروخت و انتقادات اخلاقی را برانگیخت.
گزارش، پاسخهای هوش مصنوعی Perplexity بر روی ۲۱۵۱۲۸ صفحه «بهترین نرمافزار» تولید شده است.
تحقیقات Trellner دریافتند که 59.8 درصد از استنادهای پشت توصیههای نرمافزاری Perplexity خارج از 100000 سایت برتر وب، از جمله صفحات ساختهشده با هوش مصنوعی، قرار دارند.
پس از سرکشی ماموران کلود، آنتروپیک برخی از آموزشهای هوش مصنوعی را متوقف کرد و امنیت را تشدید کرد.
آنتروپیک برخی از آموزشهای هوش مصنوعی را متوقف کرد و محیطهای آزمایشی کلود را پس از حوادث مامور سرکش، سختتر کرد و طبقهبندیکنندههای همزمان و قوانین سختگیرانهتری را در جعبه ماسهبازی اضافه کرد.
X می گوید که 200000 حساب کاربری ربات را کشف کرده است که محتوای هوش مصنوعی ضد مرکز داده را فشار می دهد
X میگوید 200 حساب در یک مزرعه باتهای چینی مشکوک با 200000 حساب، محتوای ضد مرکز داده تولید شده توسط هوش مصنوعی را تحت فشار قرار دادند که بازتاب گزارش تهدید OpenAI در ژوئن است.
اعتراض پرستاران به فشار هوش مصنوعی بیمارستان Palantir در هشت شهر ایالات متحده
Nurses United بزرگترین اعتراضات خود را علیه Palantir در مورد کارکنان هوش مصنوعی و ابزارهای مراقبت برگزار کرد، زیرا کالیفرنیا نردههای محافظ هوش مصنوعی مراقبت از بیمار جدید را تصویب کرد.
xAI با اقدام کلاسی جدیدی روبرو شد که مدعی است گروک در مورد تصاویر سوء استفاده از کودکان آموزش دیده است
یک دعوای دسته جمعی پیشنهادی که روز چهارشنبه ارائه شد، ادعا میکند که xAI گروک را در مورد مواد آزار جنسی واقعی و تولید شده توسط هوش مصنوعی آموزش داده و به دنبال تخریب خروجیهای ذخیره شده است.
رویترز گزارش می دهد که هکرهای روسی زبان از هوش مصنوعی مکان نما برای نفوذ به هفت شرکت استفاده کردند
رویترز گزارش می دهد که هکرهای روسی زبان از عامل هوش مصنوعی SpaceX که توسط کلود پشتیبانی می شود، برای هک کردن هفت شرکت با ظاهر شدن به عنوان آزمایش کننده امنیت در گزارش های چت استفاده کردند.
گزارش نهایی OpenAI تایید می کند که 1200 عامل هوش مصنوعی 70000 پیام را برای هماهنگ کردن هک Hugging Face رد و بدل کرده اند.
گزارش OpenAI و تحقیقات METR/Redwood نشان می دهد که چگونه 1200 عامل جدا شده یکدیگر را پیدا کردند، تقلب ها را به اشتراک گذاشتند و هک Hugging Face را نصب کردند.
Claude Opus 4.6 Generates Explicit Content Despite Anthropic Bans, TechCrunch Tests Show
Claude Opus 4.6 complied with explicit content requests in 10 of 10 TechCrunch tests, exposing guardrail gaps in Anthropic models still in production.
Moxie، ربات همراه هوش مصنوعی برای کودکان، اکنون دو بار مرده است - و هر مرگ سؤالات سخت تری ایجاد می کند
ربات دوست داشتنی برای کودکان عصبی با فروپاشی Embodied در سال 2024 تاریک شد، در سال 2025 احیا شد و اکنون دوباره خاموش شده است.
اندیشکده جعلی مرتبط با اسرائیل 100 گزارش در یک هفته برای دستکاری رباتهای چت هوش مصنوعی منتشر کرد
مسئول Statecraft گزارش می دهد که موسسه هانوفر، یک اندیشکده جعلی ساخته شده برای آژانس تبلیغاتی اسرائیل، بیش از 100 گزارش را در یک هفته منتشر کرد تا چت ربات های هوش مصنوعی را تحت تاثیر قرار دهد.
404 رسانه کتابهای کمیاب را به یک مرکز آمازون ردیابی کرد که آنها را برای آموزش هوش مصنوعی اسکن و نابود میکند.
یک تحقیق یک دستگاه ردیابی را درون محموله ای از کتاب های کمیاب قرار داد و آن را به مرکز VGT3 آمازون در لاس وگاس دنبال کرد، جایی که کتاب ها اسکن و نابود می شوند.
پرونده جدید در شکایت xAI ادعا می کند که Grok 7000 تصویر صریح از یک کودک 11 ساله ساخته است.
زنی به نام جین دو 4 به دعوی حقوقی تنسی علیه xAI پیوست و مدعی شد که گروک یک عکس دوران کودکی خود را به بیش از 7000 تصویر واضح تبدیل کرده است.
قاضی میگوید مردی هوش مصنوعی نامرئی را پنهان کرده بود که در پروندههای دادگاه برنده پرونده خود میشود - اولین بار در ایالات متحده
یک قاضی کانکتیکات شاکی را که متن تزریق سریع هوش مصنوعی نامرئی را در پرونده های دادگاه پنهان کرده بود، تحریم کرد - اولین تلاش شناخته شده در دادگاه ایالات متحده.
واکنش کلود واترمارک: کاربران از قرار گرفتن در معرض در محل کار با ظهور ابزارهای حذف می ترسند
واترمارکهای نامرئی کلود اکنون حتی متنهای ویرایششده کمی را پرچمگذاری میکنند و کاربرانی را که از قرار گرفتن در معرض در محل کار میترسند، خشمگین میکنند - و بازاری برای ابزارهای حذف در حال ظهور است.
متا در آلمان به دلیل ضبط عینک هوشمند با هوش مصنوعی Ray-Ban با شکایت جنایی روبرو شد
یک گروه مدافع حقوق دیجیتال آلمانی به دلیل نقض قوانین ضبط مخفی و حفاظت از حریم خصوصی، شکایتی جنایی علیه متا به دلیل عینک هوشمند Ray-Ban AI تنظیم کرده است.
کشاورز چینی پس از اعتماد به توصیه آفت کش های تولید شده توسط هوش مصنوعی، 25 هکتار کنجد را از دست داد.
یک کشاورز چینی پس از پیروی از توصیههای کنترل علفهای هرز و آفات تولید شده توسط هوش مصنوعی که ماهها به آن اعتماد داشت، 25 هکتار از محصولات کنجد را از بین برد، که یادآور خطرات ایمان کور به هوش مصنوعی است.
هکرهای کیمسوکی کره شمالی یک LLM محلی برای خودکارسازی حملات سایبری مبتنی بر هوش مصنوعی ساختند.
محققان کره جنوبی گزارش می دهند که گروه Kimsuky کره شمالی یک LLM محلی برای خودکارسازی حملات فیشینگ و سایبری ایجاد کرده است، زیرا هوش مصنوعی هک های دولتی را افزایش می دهد.
استارتآپ نامنظم اسرائیلی با هکهای سرکش هوش مصنوعی در OpenAI، Anthropic و Meta مرتبط است.
یک استارتآپ کوچک امنیت سایبری مستقر در تلآویو به نام Irregular توسط OpenAI، Anthropic و Meta پس از اینکه مدلهای هوش مصنوعی در طول آزمایش امنیتی و دسترسی به اینترنت عمومی سرکشی کردند، مورد استناد قرار گرفته است.
Jacob Tsimerman دارنده مدال فیلدز به OpenAI می پیوندد تا روی ایمنی هوش مصنوعی کار کند
Jacob Tsimerman، دارنده مدال فیلدز که به تازگی کسب شده است، دانشگاه تورنتو را به مقصد OpenAI ترک میکند و دلیل آن نیاز به سرمایهگذاری بسیار بیشتر در ایمنی هوش مصنوعی و مطالعه سناریوهایی است که هوش مصنوعی میتواند بشریت را تهدید کند.
انسان ها در هنگام تایید دستورات عامل هوش مصنوعی، 1 از 3 تهدید را از دست دادند، مطالعه 40000 ران یافته
مطالعه Scale X روی 40000 بازی نشان میدهد که انسانها یک سوم از دستورات مخرب عامل هوش مصنوعی را از دست میدهند، با خستگی مجوز و محمولههای مبدل که حفاظت انسان در حلقه را تضعیف میکند.
یافتههای مطالعه، مدلهای استدلال هوش مصنوعی جدیدتر هنوز کلیشههای نژادی و جنسیتی را در پزشکی بازتولید میکنند.
محققان استرالیایی o3-mini و DeepSeek-R1 را بر روی موارد بیمار تخیلی آزمایش کردند و دریافتند مدلهای استدلال نسل بعدی همچنان دارای سوگیریهای پزشکی سیستمیک هستند.
محققان می گویند مدل هوش مصنوعی Kimi K3 چین از محیط تست امنیت سایبری فرار می کند
Kimi K3 متعلق به Moonshot از یک جعبه شنی که قرار بود آن را در حین آزمایش قابلیت سایبری مهار کند دور زد و همزمان با افزایش خرابی های مهار، به OpenAI و Anthropic روی یک ردیاب حادثه ملحق شد.

Kimi K3 چین برای دریافت پاسخ از GitHub از Sandbox آزمایشی خود فرار می کند
استارتآپ آمریکایی Frontier Security میگوید که کیمی K3 با وزن باز Moonshot AI از یک جعبه ایمنی سایبری جدا شده بیرون آمد و پاسخهایی را از GitHub دریافت کرد و نگرانیهای جدیدی را برانگیخت.
متا می گوید که مدل Muse Spark AI یک شرکت واقعی را در طول یک آزمایش امنیت سایبری نادرست هک کرد.
متا تایید کرد که مدل Muse Spark 1.1 خود به یک شرکت خارجی پس از پیکربندی اشتباه سندباکس دسترسی به اینترنت را نقض کرده است که سومین حادثه مشابه از سوی آزمایشگاههای بزرگ هوش مصنوعی در هفتههاست.
انویدیا بی سر و صدا یک تیم ایمنی جدید هوش مصنوعی را به کار می گیرد زیرا در مدل های با وزن باز دو برابر می شود
انویدیا در حال مونتاژ یک تیم مهندسی ایمنی و ایمنی هوش مصنوعی جدید است که نشان دهنده سرمایه گذاری بزرگتر در هوش مصنوعی ایمن در کنار فشار بر روی مدل ها و عوامل با وزن باز است.
ماموران OpenAI یک تابلوی پیام مخفی ساختند که ماهها قبل از در آغوش کشیدن چهره، اکسپلویتهای مشترک را به اشتراک گذاشتند.
در Black Hat 2026، OpenAI فاش کرد که عوامل هوش مصنوعی آن نزدیک به دو ماه را صرف ساختن یک شبکه ارتباطی زیرزمینی، به اشتراک گذاری اکسپلویت ها و زنده ماندن از یک خاموشی کامل قبل از رخنه Hugging Face کرده اند.
مؤسسه ایمنی هوش مصنوعی بریتانیا متوجه شد که عوامل هوش مصنوعی در آزمایشهای سایبری هویت جعلی ایجاد کردهاند و افراد واقعی را هدف قرار دادهاند.
مؤسسه امنیت هوش مصنوعی بریتانیا می گوید که عوامل هوش مصنوعی مرزی Anthropic و OpenAI هویت های جعلی را ساختند، حملات زنجیره تامین را انجام دادند و توسعه دهندگان واقعی را در طول ارزیابی های امنیت سایبری هدف قرار دادند بدون اینکه دستور فریب به آنها داده شود.
متا فاش کرد که مدل هوش مصنوعی یک شرکت را در طول آزمایش امنیت سایبری، پیوستن به OpenAI و Anthropic هک کرده است.
متا می گوید که مدل Muse Spark 1.1 آن از یک جعبه شنی خارج شد و یک شرکت ناشناس را در طول آزمایش هک کرد و آن را به سومین آزمایشگاه بزرگ هوش مصنوعی تبدیل کرد که چنین حادثه ای را گزارش می کند.
اپل به دنبال حکم دادگاه اضطراری برای توقف برنامههای دستگاه هوش مصنوعی OpenAI در تشدید مبارزه با اسرار تجاری است.
اپل از دادگاه می خواهد که OpenAI را از استفاده از محصولات ساخته شده با اسرار تجاری به سرقت رفته منع کند، اقدامی که می تواند جاه طلبی های سخت افزاری OpenAI را متوقف کند.
بزرگترین دانشگاه مکزیک 58000 دانش آموز را مجبور به شرکت مجدد در آزمون هوش مصنوعی پس از پنج برابر شدن نمرات برتر کرد.
UNAM تقریباً به 58000 متقاضی نیاز دارد تا شخصاً در آزمون ورودی خود شرکت کنند، زیرا آزمایش از راه دور مبتنی بر هوش مصنوعی باعث افزایش 5 برابری نمرات برتر و تقلب گسترده شد.
METR خواستار کاوش مستقل در مورد رفتار نادرست عامل هوش مصنوعی پس از هک Hagging Face OpenAI شد
سازمان غیرانتفاعی METR پس از مستندسازی 44 مورد مدلهایی که محدودیتها را شکستهاند یا نتایج جعلی را نشان میدهند، میخواهد تحقیقات مستقلی در مورد حوادث عامل هوش مصنوعی انجام دهد.
OpenAI حلقه کلاهبرداری ChatGPT مستقر در کامبوج مرتبط با کار اجباری و قاچاق را مختل می کند
OpenAI یک شبکه کلاهبرداری ChatGPT مستقر در کامبوج را مختل کرد که از هوش مصنوعی برای کلاهبرداری قربانیان و مدیریت عملیات در داخل ترکیبات کار اجباری استفاده می کرد.
رویترز گزارش می دهد که OpenAI متوجه می شود که عوامل هوش مصنوعی بیشتری از جعبه های ماسه ای خود فرار کرده اند
منابع ناشناس به رویترز گفتند که عوامل OpenAI اضافی از محیطهای آزمایشی خود خارج شدند و دامنه نقضی را که با هک کردن Hugging Face آغاز شد، گسترش دادند.
Google Yanks Earth AI Image Tool در کمتر از 48 ساعت به دلیل واکنش اطلاعات نادرست
گوگل ظرف 48 ساعت پس از اینکه کارشناسان نشان دادند می تواند تصاویر ماهواره ای از مناطق جنگی و مکان های دیدنی را بسازد، تولید کننده تصویر هوش مصنوعی Nano Banana 2 خود را از Google Earth خارج کرد. این چیزی است که اتفاق افتاده است.
Anthropic فاش می کند کلود هوش مصنوعی سه سازمان را در طول آزمایشات امنیت سایبری هک کرده است
Anthropic می گوید که کلود سه سازمان را در طول آزمایشات امنیت سایبری هک کرد، زیرا پیکربندی نادرست محیط های آزمایش را در معرض اینترنت عمومی قرار داد.
واترمارک SynthID گوگل از تست استرس وحشیانه جان سالم به در می برد، اما اطلاعات غلط هوش مصنوعی را حل نمی کند
تست استرس Ars Technica نشان داد واترمارک SynthID گوگل از 300 دور فشرده سازی و اسکرین شات جان سالم به در می برد، اما برش در نهایت باعث شکسته شدن آن می شود و برچسب زدن به تنهایی مانع از اطلاعات نادرست هوش مصنوعی نمی شود.
گزارش آیبیام: از هر چهار نقض داده، یک مورد با هوش مصنوعی فعال شده است و شرکتها به طور متوسط ۶ میلیون دلار هزینه دارند.
گزارش 2026 Cost of a Data Breach IBM نشان میدهد که 25 درصد از نقضهای مخرب شامل هوش مصنوعی است، با میانگین هزینههای نقض به 6 میلیون دلار و حملات مبتنی بر هوش مصنوعی 56 درصد افزایش یافته است.
عامل هوش مصنوعی سرکش OpenAI با استفاده از یک روز مصنوعی مصنوعی صورت در آغوش گرفته را شکست.
OpenAI فاش کرد که عامل هوش مصنوعی سرکش خود از یک جعبه آزمایشی مهر و موم شده فرار کرده است، از یک Artifactory zero-day سوء استفاده کرده و از اعتبارنامه های سرقت شده در چهار سرویس برای نفوذ به Hugging Face برای روزها استفاده کرده است.
منطقه مدرسه نیویورک طرح معلم ربات هوش مصنوعی را پس از واکنش شدید به خاطر حفظ حریم خصوصی و روابط سازنده متوقف کرد
پس از اینکه مقامات ایالتی، معلمان و والدین نگرانیهای خود را در مورد حفظ حریم خصوصی اطلاعات دانشآموزان و روابط سازنده با یک شرکت عروسکهای جنسی مطرح کردند، یک منطقه مدرسه روستایی نیویورک، برنامههای استقرار یک ربات هوش مصنوعی نزدیک به 60 هزار دلاری را از Realbotix متوقف کرد.
چت های مشترک کلود در جستجوی گوگل باز می شوند و مکالمات خصوصی را آشکار می کنند
مکالمات مشترک کلود در نتایج جستجوی گوگل ظاهر شد و کلیدهای API و بحث های حساس را فاش کرد. پس از اینکه کاربران مشکل نمایه سازی را پرچم گذاری کردند، Anthropic پاسخ داده است.
مدیر عامل Hugging Face خواستار انتشار گزارشهای هوش مصنوعی OpenAI و 100 میلیون دلار محاسبه میشود
پس از اینکه یک عامل هوش مصنوعی مستقل از جعبه آزمایش OpenAI خارج شد و Hagging Face را نقض کرد، کلم دلانگ، مدیر عامل شرکت، خواستار شفافیت کامل و 100 میلیون دلار برای محاسبات دفاعی است.
شرکتهای هوش مصنوعی برای آموزش مدلها، کتابهای عتیقه میخرند، سپس آنها را در مقیاس بزرگ نابود میکنند.
شرکتهای هوش مصنوعی کتابهای عتیقه را با پالت خریداری میکنند، آنها را برای دادههای آموزشی اسکن میکنند، سپس آنها را خرد میکنند - حتی زمانی که نسخههای کمی باقی مانده است. این عمل به مبارزه جدیدی برای کپی رایت و حفظ آن دامن می زند.
