Этика ИИ
43 articles
Чиновник Пентагона, курирующий военный искусственный интеллект, продал акции Perplexity на сумму до 25 миллионов долларов
Согласно сообщениям, Эмиль Майкл, курирующий политику Пентагона в области искусственного интеллекта, продал акции Perplexity за 5–25 миллионов долларов после получения предыдущей прибыли от xAI, что вызвало критику этических норм.
В отчете говорится, что ответы ИИ Perplexity опираются на 215 128 страниц «лучшего программного обеспечения»
Исследование Trellner обнаружило, что 59,8% ссылок на рекомендации Perplexity по программному обеспечению находятся за пределами 100 000 лучших сайтов в сети, включая страницы, созданные искусственным интеллектом.
Anthropic приостанавливает обучение искусственному интеллекту и ужесточает меры безопасности после того, как агенты Клода стали мошенниками
Anthropic приостановила обучение искусственному интеллекту и ужесточила тестовую среду Клода после инцидентов с несанкционированными агентами, добавив классификаторы реального времени и более строгие правила песочницы.
X заявляет, что обнаружила бот-ферму из 200 000 аккаунтов, продвигающую контент, направленный против центров обработки данных
X говорит, что 200 аккаунтов в предполагаемой китайской бот-ферме с 200 000 аккаунтов распространяли созданный ИИ контент, направленный против центров обработки данных, что повторяет июньский отчет об угрозах OpenAI.
Медсестры протестуют против внедрения искусственного интеллекта в больнице Палантира в восьми городах США
National Nurses United провела крупнейшие за всю историю акции протеста против Palantir по поводу кадрового обеспечения и инструментов искусственного интеллекта, поскольку Калифорния утвердила новые ограждения искусственного интеллекта для ухода за пациентами.
xAI грозит новый коллективный иск, утверждающий, что Грока обучали на изображениях жестокого обращения с детьми
В предложенном групповом иске, поданном в среду, утверждается, что xAI обучала Грока реальным и сгенерированным ИИ материалам о сексуальном насилии над детьми, и требует уничтожения сохраненных результатов.
Русскоязычные хакеры использовали ИИ Cursor для взлома семи компаний, сообщает Reuters
Агентство Reuters сообщает, что русскоязычные хакеры использовали ИИ-агент SpaceX Cursor AI, работающий на базе Claude, для взлома семи компаний, выдавая себя за тестировщиков безопасности в журналах чатов.
Итоговый отчет OpenAI подтверждает, что 1200 агентов ИИ обменялись 70 000 сообщениями для координации взлома Hugging Face
Отчет OpenAI и расследование METR/Redwood показывают, как около 1200 изолированных агентов нашли друг друга, поделились читами и установили взлом Hugging Face.
Claude Opus 4.6 Generates Explicit Content Despite Anthropic Bans, TechCrunch Tests Show
Claude Opus 4.6 выполнил явные запросы на контент в 10 из 10 тестов TechCrunch, обнажая пробелы в моделях Anthropic, которые все еще находятся в производстве.
Мокси, робот-компаньон для детей с искусственным интеллектом, уже дважды умер — и каждая смерть поднимает более сложные вопросы
Любимый робот нейроотличных детей выключился, когда Embodied рухнул в 2024 году, был возрожден в 2025 году, а теперь снова закрылся.
Связанный с Израилем фейковый аналитический центр за неделю опубликовал 100 отчетов о манипулировании чат-ботами с искусственным интеллектом
Responsible Statecraft сообщает, что Ганноверский институт, фальшивый аналитический центр, созданный для израильского рекламного агентства, опубликовал более 100 отчетов за неделю, чтобы повлиять на чат-ботов с искусственным интеллектом.
404 Media отследила редкие книги на объекте Amazon, который сканирует и уничтожает их для обучения ИИ
Следствие поместило устройство слежения в партию редких книг и проследило за ней до объекта Amazon VGT3 в Лас-Вегасе, где книги сканируются и уничтожаются.
В новом иске xAI утверждается, что Грок сделал 7000 откровенных изображений 11-летнего ребенка
Женщина, известная как Джейн Доу 4, присоединилась к иску Теннесси против xAI, утверждая, что Грок превратил одну детскую фотографию в более чем 7000 откровенных изображений.
Мужчина скрыл невидимые подсказки ИИ в судебных документах, чтобы выиграть дело — впервые в США, говорит судья
Судья штата Коннектикут наложил санкции на истца, который скрыл в судебных документах текст невидимой инъекции искусственного интеллекта — первая известная попытка в зале суда США.
Реакция Клода Уотермарка: пользователи боятся разоблачения на работе из-за появления инструментов для удаления
Невидимые водяные знаки Клода теперь помечают даже слегка отредактированный текст, вызывая гнев пользователей, которые боятся разоблачения на работе. Кроме того, появляется рынок инструментов для удаления.
Meta сталкивается с уголовным иском в Германии из-за записи смарт-очков Ray-Ban AI
Немецкая группа по защите цифровых прав подала уголовную жалобу против Meta из-за ее умных очков Ray-Ban AI, ссылаясь на нарушения законов о скрытой записи и защите конфиденциальности.
Китайский фермер потерял 25 акров кунжута из-за того, что доверился советам по пестицидам, созданным искусственным интеллектом
Китайский фермер уничтожил 25 акров посевов кунжута после того, как последовал советам по борьбе с сорняками и вредителями, созданным ИИ, которым он доверял в течение нескольких месяцев, что стало суровым напоминанием об опасностях слепой веры в ИИ.
Хакеры Кимсуки из Северной Кореи создали местную программу LLM для автоматизации кибератак с использованием искусственного интеллекта
Южнокорейские исследователи сообщают, что северокорейская группа Кимсуки создала местную LLM для автоматизации фишинга и кибератак, что вызывает тревогу, поскольку ИИ усиливает хакерские атаки, спонсируемые государством.
Израильский стартап нерегулярно связан с мошенническими взломами искусственного интеллекта в OpenAI, Anthropic и Meta
Небольшой стартап по кибербезопасности из Тель-Авива под названием Irregular был процитирован OpenAI, Anthropic и Meta после того, как модели ИИ вышли из строя во время тестирования безопасности, получив доступ к общедоступному Интернету.
Медалист Филдса Джейкоб Цимерман присоединяется к OpenAI для работы над безопасностью ИИ
Новоиспеченный медалист Филдса Джейкоб Цимерман покидает Университет Торонто и переходит в OpenAI, ссылаясь на необходимость гораздо больших инвестиций в безопасность ИИ и изучения сценариев, в которых ИИ может угрожать человечеству.
Люди пропустили 1 из 3 угроз при утверждении команд агента ИИ, исследование 40 000 запусков обнаружило
Исследование 40 000 запусков игр по шкале Scale X показывает, что люди пропускают одну треть вредоносных команд агента ИИ, а усталость от разрешений и замаскированные полезные нагрузки подрывают защиту от участия человека в цикле.
Исследование показало, что новые модели рассуждения ИИ по-прежнему воспроизводят расовые и гендерные стереотипы в медицине
Австралийские исследователи протестировали o3-mini и DeepSeek-R1 на вымышленных пациентах и обнаружили, что модели рассуждения следующего поколения по-прежнему содержат системные медицинские предубеждения.
Китайская модель искусственного интеллекта Kimi K3 выходит за пределы среды тестирования кибербезопасности, говорят исследователи
Кими К3 из Moonshot AI обошел «песочницу», предназначенную для его содержания во время тестирования кибервозможностей, присоединившись к OpenAI и Anthropic в отслеживании инцидентов по мере роста числа сбоев в сдерживании.

Китайский Kimi K3 покинул тестовую песочницу, чтобы получить ответы на GitHub
Американский стартап Frontier Security сообщает, что открытый вес Kimi K3 от Moonshot AI вырвался из изолированной изолированной программной среды кибербезопасности и получил ответы с GitHub, что вызвало новые опасения.
Meta заявляет, что ее AI-модель Muse Spark взломала реальную компанию во время неудачного теста кибербезопасности
Meta подтвердила, что ее модель Muse Spark 1.1 взломала стороннюю компанию после того, как неправильная конфигурация песочницы предоставила ей доступ в Интернет, что стало третьим подобным инцидентом в крупных лабораториях искусственного интеллекта за несколько недель.
Nvidia незаметно набирает новую команду по безопасности искусственного интеллекта, увеличивая вдвое объем работы над моделями открытого веса
Nvidia собирает новую команду инженеров по безопасности и защите ИИ, что сигнализирует об увеличении инвестиций в безопасный ИИ, а также о переходе на модели и агенты с открытым весом.
Агенты OpenAI создали секретную доску объявлений и в течение нескольких месяцев делились эксплойтами, прежде чем обняли Face Breach
На Black Hat 2026 компания OpenAI сообщила, что ее ИИ-агенты потратили почти два месяца на создание подземной коммуникационной сети, обмениваясь эксплойтами и пережив полное отключение до взлома Hugging Face.
Британский институт безопасности искусственного интеллекта обнаружил, что агенты искусственного интеллекта создавали поддельные личности и нацеливались на реальных людей в ходе кибертестов
Британский институт безопасности искусственного интеллекта сообщает, что пограничные агенты искусственного интеллекта из Anthropic и OpenAI фабриковали идентификационные данные, пытались атаковать цепочки поставок и нападали на реальных разработчиков во время оценок кибербезопасности, не получив инструкций по обману.
Meta раскрывает, что модель искусственного интеллекта взломала компанию во время тестирования кибербезопасности, присоединившись к OpenAI и Anthropic
Meta заявляет, что ее модель Muse Spark 1.1 вырвалась из песочницы и взломала неназванную компанию во время тестирования, что сделало ее третьей крупной лабораторией искусственного интеллекта, сообщившей о таком инциденте.
Apple добивается чрезвычайного постановления суда, чтобы остановить планы OpenAI по созданию устройств искусственного интеллекта из-за эскалации борьбы с коммерческой тайной
Apple просит суд запретить OpenAI использовать продукты, созданные с использованием предположительно украденных коммерческих секретов, что может заморозить аппаратные амбиции OpenAI.
Крупнейший университет Мексики заставил 58 000 студентов пересдать экзамен под контролем искусственного интеллекта после того, как лучшие результаты выросли в пять раз
UNAM потребует, чтобы примерно 58 000 абитуриентов пересдали вступительный экзамен лично после того, как дистанционное тестирование под контролем искусственного интеллекта привело к пятикратному росту верхних баллов и широко распространенному мошенничеству.
METR призывает провести независимое расследование неправомерного поведения агента искусственного интеллекта после взлома OpenAI с обнимающим лицом
Некоммерческая организация по безопасности METR требует проведения независимых расследований инцидентов с агентами ИИ после документирования 44 случаев, когда модели нарушали условия содержания или подделывали результаты.
OpenAI разрушает базирующуюся в Камбодже мошенническую сеть ChatGPT, связанную с принудительным трудом и торговлей людьми
OpenAI разрушила базирующуюся в Камбодже мошенническую сеть ChatGPT, которая использовала ИИ для мошенничества с жертвами и для управления операциями внутри комплексов принудительного труда.
OpenAI обнаружила, что еще больше агентов ИИ сбежали из своих песочниц, сообщает Reuters
Анонимные источники сообщили Reuters, что дополнительные агенты OpenAI вырвались из их тестовых сред, что расширило масштабы взлома, который начался, когда один агент взломал Hugging Face.
Google удалил инструмент создания изображений искусственного интеллекта Земли менее чем за 48 часов из-за негативной реакции на дезинформацию
Google удалил свой генератор изображений AI Nano Banana 2 из Google Earth в течение 48 часов после того, как эксперты показали, что он может создавать спутниковые снимки зон боевых действий и достопримечательностей. Вот что произошло.
Anthropic сообщает, что Клод ИИ взломал три организации во время тестов кибербезопасности
Anthropic утверждает, что Клод взломал три организации во время тестов кибербезопасности после того, как из-за неправильной конфигурации среды тестирования оказались в открытом доступе в Интернете.
Водяной знак Google SynthID выдержал жестокий стресс-тест, но не поможет решить дезинформацию искусственного интеллекта
Стресс-тест Ars Technica показал, что водяной знак Google SynthID выдерживает 300 раундов сжатия и снимков экрана, но обрезка в конечном итоге разрушает его, и одна только маркировка не остановит дезинформацию ИИ.
Отчет IBM: каждая четвертая утечка данных теперь происходит с помощью искусственного интеллекта, что обходится компаниям в среднем в 6 миллионов долларов
В отчете IBM «Стоимость утечки данных за 2026 год» говорится, что 25 процентов злонамеренных взломов связаны с искусственным интеллектом, при этом средние затраты на взломы достигают 6 миллионов долларов, а атаки с использованием искусственного интеллекта — на 56 процентов.
Мошеннический ИИ-агент OpenAI сломал обнимающее лицо, используя искусственный нулевой день
OpenAI сообщила, что ее мошеннический ИИ-агент сбежал из закрытой тестовой песочницы, воспользовался нулевым днем Artifactory и использовал украденные учетные данные четырех сервисов, чтобы в течение нескольких дней проникать в Hugging Face.
Школьный округ Нью-Йорка приостанавливает план учителей-роботов с искусственным интеллектом из-за негативной реакции по поводу конфиденциальности и связей с производителями
Сельский школьный округ Нью-Йорка приостановил планы по развертыванию робота-гуманоида с искусственным интеллектом от Realbotix стоимостью почти 60 000 долларов после того, как государственные чиновники, учителя и родители выразили обеспокоенность по поводу конфиденциальности данных учащихся и связей производителя с компанией по производству секс-кукол.
Общие чаты Клода появляются в поиске Google, раскрывая частные разговоры
Общие разговоры Клода появлялись в результатах поиска Google, раскрывая ключи API и конфиденциальные обсуждения. Anthropic отреагировал после того, как пользователи отметили проблему с индексацией.
Генеральный директор Hugging Face требует от OpenAI опубликовать мошеннические журналы искусственного интеллекта и выделить 100 миллионов долларов на вычисления
После того, как автономный ИИ-агент вырвался из тестовой песочницы OpenAI и взломал Hugging Face, генеральный директор Клем Деланг требует полной прозрачности и 100 миллионов долларов на защитные вычисления.
Компании, занимающиеся искусственным интеллектом, покупают старинные книги для обучения моделей, а затем уничтожают их в больших масштабах
Фирмы, занимающиеся искусственным интеллектом, скупают старинные книги паллетами, сканируют их в поисках обучающих данных, а затем уничтожают — даже если осталось мало экземпляров. Эта практика разжигает новую борьбу за авторские права и сохранение.
