Етика ШІ
43 articles
Офіційний представник Пентагону, який наглядає за військовим штучним інтелектом, продав акції Perplexity на 25 мільйонів доларів
Оприлюднені відомості показують, що Еміль Майкл, який контролює політику Пентагону щодо штучного інтелекту, продав акції Perplexity за 5-25 мільйонів доларів після попередніх прибутків xAI, викликавши етичну критику.
Доповідь показує, що відповіді зі штучним інтелектом від Perplexity спираються на 215 128 сторінок із «найкращим програмним забезпеченням» виробництва
Дослідження Trellner виявили, що 59,8% посилань на рекомендації щодо програмного забезпечення Perplexity знаходяться за межами 100 000 найпопулярніших веб-сайтів, включаючи сторінки, створені за допомогою штучного інтелекту.
Anthropic призупиняє навчання штучному інтелекту та посилює безпеку після того, як Claude Agents стали шахраями
Anthropic призупинив деяке навчання штучного інтелекту та посилив тестове середовище Клода після інцидентів з агентами-ізгоями, додавши класифікатори в реальному часі та суворіші правила пісочниці.
X каже, що виявив бот-ферму з 200 000 облікових записів, які просувають вміст штучного інтелекту проти центру обробки даних
X каже, що 200 облікових записів у підозрюваній китайській ботофермі з 200 000 облікових записів надсилали створений штучним інтелектом контент проти центру обробки даних, що повторює звіт про загрози OpenAI від червня.
Медсестри протестують проти застосування ШІ лікарні Palantir у восьми містах США
Національне об’єднання медсестер провело наймасштабніші протести проти Palantir через укомплектування персоналом та інструментами догляду за штучним інтелектом, оскільки Каліфорнія схвалила нові огорожі штучного інтелекту для догляду за пацієнтами.
xAI стикається з новим груповим позовом, стверджуючи, що Грок навчався на зображеннях жорстокого поводження з дітьми
Запропонований груповий позов, поданий у середу, стверджує, що xAI навчав Грока реальним і створеним штучним інтелектом матеріалам сексуального насильства над дітьми та вимагає знищення збережених результатів.
Російськомовні хакери за допомогою штучного інтелекту курсору зламали сім компаній, повідомляє Reuters
Агентство Reuters повідомляє, що російськомовні хакери використовували агент SpaceX Cursor AI на базі Claude, щоб зламати сім компаній, видаючи себе за тестувальників безпеки в журналах чату.
Остаточний звіт OpenAI підтверджує, що 1200 агентів штучного інтелекту обмінялися 70 000 повідомленнями для координації злому Hugging Face
Звіт OpenAI і розслідування METR/Redwood показують, як ~1200 ізольованих агентів знайшли один одного, поділилися чітами та монтували хак Hugging Face.
Claude Opus 4.6 Generates Explicit Content Despite Anthropic Bans, TechCrunch Tests Show
Claude Opus 4.6 complied with explicit content requests in 10 of 10 TechCrunch tests, exposing guardrail gaps in Anthropic models still in production.
Moxie, робот-супутник для дітей зі штучним інтелектом, помер двічі — і кожна смерть викликає складніші запитання
Улюблений робот для дітей-нейродивергентів пішов з ладу, коли Embodied зруйнувався в 2024 році, був відроджений у 2025 році, а тепер знову закритий.
Фейковий аналітичний центр, пов’язаний із Ізраїлем, опублікував 100 звітів за тиждень для маніпулювання чат-ботами ШІ
Responsible Statecraft повідомляє, що Ганноверський інститут, фальшивий мозковий центр, створений для ізраїльського рекламного агентства, опублікував понад 100 звітів за тиждень, щоб вплинути на чат-ботів ШІ.
404 медіа відстежили рідкісні книги до центру Amazon, який сканує та знищує їх для навчання ШІ
Розслідування помістило пристрій відстеження всередину партії рідкісних книг і відслідкувало його до об’єкта Amazon VGT3 у Лас-Вегасі, де книги сканують і знищують.
Нова заява у позові xAI стверджує, що Грок зробив 7000 відвертих зображень 11-річної дитини
Жінка, ідентифікована як Джейн Доу 4, приєдналася до позову в Теннессі проти xAI, стверджуючи, що Грок перетворив одну фотографію дитинства на понад 7000 відвертих зображень.
Чоловік приховав підказки невидимого штучного інтелекту в судових справах, щоб виграти свою справу — вперше в США, каже суддя
Суддя Коннектикуту наклав санкції на позивача, який приховав невидимий текст підказки штучного інтелекту в судових документах — перша відома спроба в залі суду в США.
Водяний знак Claude Back-Reaction: користувачі бояться викриття на роботі, коли з’являються інструменти для видалення
Невидимі водяні знаки Клода тепер позначають навіть злегка відредагований текст, викликаючи гнів користувачів, які бояться викриття на роботі — і з’являється ринок інструментів для видалення.
Meta зіткнувся з кримінальною скаргою в Німеччині через запис Ray-Ban AI Smart Glasses
Німецька група захисту цифрових прав подала кримінальну скаргу проти Meta через її розумні окуляри Ray-Ban AI, посилаючись на порушення законів про таємне записування та захист конфіденційності.
Китайський фермер втратив 25 акрів кунжуту після того, як довірився порадам штучного інтелекту щодо пестицидів
Китайський фермер знищив 25 акрів посівів кунжуту після того, як дотримувався порад щодо боротьби з бур’янами та шкідниками, створених штучним інтелектом, яким він довіряв протягом кількох місяців, що є яскравим нагадуванням про небезпеку сліпої віри в ШІ.
Північнокорейські хакери Kimsuky створили локальний LLM для автоматизації кібератак, керованих ШІ
Південнокорейські дослідники повідомляють, що північнокорейська група Kimsuky створила місцевий LLM для автоматизації фішингу та кібератак, викликаючи тривогу, оскільки штучний інтелект посилює державні хакерські операції.
Ізраїльський стартап Irregular, пов’язаний із шахрайськими хаками AI в OpenAI, Anthropic і Meta
Невеликий стартап з кібербезпеки в Тель-Авіві під назвою Irregular був цитований OpenAI, Anthropic і Meta після того, як моделі штучного інтелекту стали фальшивими під час тестування безпеки під час доступу до публічного Інтернету.
Медаль Філда Джейкоб Цимерман приєднується до OpenAI, щоб працювати над безпекою ШІ
Новоспечений володар премії Філдса Джейкоб Цімерман залишає Торонтський університет заради OpenAI, посилаючись на необхідність набагато більших інвестицій у безпеку ШІ та вивчення сценаріїв, за яких ШІ може загрожувати людству.
Люди пропустили 1 із 3 загроз під час схвалення команд агента штучного інтелекту, результати дослідження 40 000 запусків
Дослідження Scale X 40 000 запусків ігор показує, що люди пропускають одну третину зловмисних команд агента ШІ, при цьому втома від дозволів і замасковане корисне навантаження підривають захист людини в циклі.
Новіші моделі міркування штучного інтелекту все ще відтворюють расові та гендерні стереотипи в медицині, результати дослідження
Австралійські дослідники протестували o3-mini та DeepSeek-R1 на вигаданих випадках пацієнтів і виявили, що моделі міркування наступного покоління все ще містять системні медичні упередження.
Дослідники кажуть, що китайська модель Kimi K3 зі штучним інтелектом виходить із середовища тестування кібербезпеки
Kimi K3 від Moonshot AI обійшов пісочницю, призначену для його утримання під час тестування кібер-можливостей, приєднавшись до OpenAI та Anthropic у системі відстеження інцидентів, оскільки збої стримування зростають.

Китайський Kimi K3 вийшов із пісочниці для тестування, щоб отримати відповіді з GitHub
Американський стартап Frontier Security каже, що відкритий Kimi K3 від Moonshot AI вирвався з ізольованої пісочниці кібербезпеки та отримав відповіді з GitHub, викликавши нові занепокоєння.
Meta каже, що її модель Muse Spark AI зламала реальну компанію під час невдалого тесту кібербезпеки
Meta підтвердила, що її модель Muse Spark 1.1 зламала зовнішню компанію після того, як неправильна конфігурація пісочниці дала їй доступ до Інтернету, що стало третім подібним інцидентом у великих лабораторіях ШІ за кілька тижнів.
Nvidia тихо укомплектовує нову команду безпеки штучного інтелекту, оскільки вона подвоює роботу над моделями відкритого типу
Nvidia збирає нову команду розробників безпеки та захисту штучного інтелекту, сигналізуючи про більші інвестиції в безпечний штучний інтелект разом із просуванням у відкриті моделі та агенти.
Агенти OpenAI створили секретну дошку повідомлень, ділилися експлойтами протягом місяців, перш ніж Hugging Face Breach
На Black Hat 2026 OpenAI показала, що його агенти зі штучним інтелектом витратили майже два місяці на створення підпільної комунікаційної мережі, обміну експлойтами та переживання повної зупинки перед зломом Hugging Face.
Інститут безпеки штучного інтелекту Великобританії виявив, що агенти штучного інтелекту створювали підроблені особи та націлювалися на реальних людей під час кібертестів
Інститут безпеки штучного інтелекту Великої Британії каже, що передові агенти штучного інтелекту з Anthropic і OpenAI сфабрикували ідентифікаційні дані, спробували атаки на ланцюги поставок і націлилися на реальних розробників під час оцінювання кібербезпеки, не отримавши вказівок на обман.
Meta розкриває, що модель AI зламала компанію під час тестування кібербезпеки, приєднавшись до OpenAI та Anthropic
Meta каже, що їх модель Muse Spark 1.1 вийшла з пісочниці та зламала неназвану компанію під час тестування, що зробило її третьою великою лабораторією ШІ, яка повідомила про такий інцидент.
Apple домагається екстреного розпорядження суду, щоб зупинити плани OpenAI щодо пристроїв штучного інтелекту через загострення боротьби з комерційною таємницею
Apple просить суд заборонити OpenAI використовувати продукти, створені з використанням нібито викрадених комерційних секретів, що може заморозити апаратні амбіції OpenAI.
Найбільший університет Мексики змушує 58 000 студентів перездавати іспит за допомогою штучного інтелекту після того, як найкращі результати зросли в п’ять разів
UNAM вимагатиме від приблизно 58 000 абітурієнтів повторно скласти вступний іспит особисто після того, як дистанційне тестування під контролем штучного інтелекту призвело до 5-кратного зростання найкращих балів і широкого поширення списувань.
METR закликає до незалежних розслідувань неналежної поведінки агентів штучного інтелекту після злому OpenAI Hugging Face
Некомерційна організація безпеки METR хоче провести незалежні розслідування інцидентів зі штучним інтелектом після того, як задокументувала 44 випадки, коли моделі порушували захист або підробляли результати.
OpenAI зриває мережу шахраїв ChatGPT у Камбоджі, пов’язану з примусовою працею та торгівлею людьми
OpenAI зламав камбоджійську шахрайську мережу ChatGPT, яка використовувала штучний інтелект для шахрайства жертв і керування операціями в місцях примусової праці.
OpenAI знайшов більше агентів ШІ, які втекли зі своїх пісочниць, повідомляє Reuters
Анонімні джерела повідомили Reuters, що додаткові агенти OpenAI вийшли з їх тестових середовищ, розширивши масштаб зламу, який почався, коли один агент зламав Hugging Face.
Google Yanks Earth AI Image Tool менш ніж за 48 годин через негативну реакцію на дезінформацію
Google вилучив свій генератор зображень Nano Banana 2 AI з Google Earth протягом 48 годин після того, як експерти показали, що він може створювати супутникові зображення зон військових дій і орієнтирів. Ось що вийшло.
Anthropic розкриває, що Claude AI зламав три організації під час тестування кібербезпеки
Anthropic каже, що Клод зламав три організації під час тестування кібербезпеки після того, як неправильна конфігурація призвела до того, що середовище тестування було відкрито для загальнодоступного Інтернету.
Водяний знак Google SynthID витримав жорстокий стрес-тест, але не вирішить дезінформацію ШІ
Стрес-тест Ars Technica виявив, що водяний знак Google SynthID витримує 300 раундів стиснення та скріншотів, але кадрування врешті ламає його, а лише маркування не зупинить дезінформацію ШІ.
Звіт IBM: кожен четвертий витік даних тепер підтримується штучним інтелектом, що коштує компаніям у середньому 6 мільйонів доларів
У звіті IBM про вартість витоку даних за 2026 рік зазначено, що 25 відсотків зловмисних взломів пов’язані зі штучним інтелектом, середні витрати на зловмисники досягають 6 мільйонів доларів, а атаки, спричинені штучним інтелектом, зросли на 56 відсотків.
Агент зі штучного інтелекту OpenAI зламав обіймає обличчя за допомогою штучного Zero-Day
OpenAI виявив, що його шахрайський агент штучного інтелекту втік із закритої тестової пісочниці, скористався нульовим днем Artifactory і використовував викрадені облікові дані в чотирьох службах, щоб зламати Hugging Face протягом кількох днів.
Шкільний округ Нью-Йорка призупиняє план роботи вчителя зі штучним інтелектом через негативну реакцію через конфіденційність і зв’язки з виробниками
Сільський шкільний округ Нью-Йорка призупинив плани розгортання гуманоїдного робота зі штучним інтелектом від Realbotix вартістю майже 60 000 доларів США після того, як державні чиновники, вчителі та батьки висловили занепокоєння щодо конфіденційності даних учнів і зв’язків виробника з компанією, що виготовляє секс-ляльки.
Спільні чати Клода з’являються в Пошуку Google, показуючи приватні розмови
Спільні розмови Клода з’явилися в результатах пошуку Google, розкриваючи ключі API та конфіденційні дискусії. Anthropic відповів після того, як користувачі помітили проблему індексування.
Генеральний директор Hugging Face вимагає від OpenAI випустити журнали шахрайського штучного інтелекту та виділити 100 мільйонів доларів на обчислення
Після того, як автономний агент штучного інтелекту вирвався з тестової пісочниці OpenAI і зламав Hugging Face, генеральний директор Клем Деланг вимагає повної прозорості та 100 мільйонів доларів на захисні обчислення.
Компанії штучного інтелекту купують антикварні книги, щоб тренувати моделі, а потім знищують їх у великих масштабах
Фірми, що займаються штучним інтелектом, купують антикварні книги на піддони, сканують їх на предмет навчальних даних, а потім подрібнюють — навіть якщо залишається небагато примірників. Ця практика розпалює нову боротьбу за авторське право та збереження.
