AI倫理
43 articles
軍事AIを監督する国防総省当局者、Perplexity株を最大2500万ドル売却
国防総省のAI政策を監督するエミール・マイケル氏が、以前のxAIの利益を受けてパープレクシティ株を500万ドルから2500万ドルで売却したことが明らかになり、倫理的批判を招いている。
Perplexity の AI 回答は 215,128 の製造された「ベスト ソフトウェア」ページに基づいていることがレポートで判明
Trellner Research によると、Perplexity のソフトウェア推奨の背後にある引用の 59.8% が、AI で構築されたページを含め、Web の上位 100,000 サイト以外に位置していることがわかりました。
Anthropic、クロードエージェントの暴走を受けて一部のAIトレーニングを一時停止しセキュリティを強化
Anthropic は、不正エージェントの事件後、一部の AI トレーニングを一時停止し、Claude のテスト環境を強化し、リアルタイム分類器とより厳格なサンドボックス ルールを追加しました。
X社は、反データセンターAIコンテンツをプッシュする20万アカウントのボットファームを発見したと発表
X社は、中国のボットファームと疑われる20万アカウントのうちの200アカウントがAI生成の反データセンターコンテンツをプッシュしたと述べており、これは6月のOpenAI脅威レポートと同じだ。
米国の8都市でパランティア病院のAI推進に看護師らが抗議
カリフォルニア州が新たな患者ケアAIガードレールを承認したことを受け、ナショナル・ナース・ユナイテッドは、AIの人員配置とケアツールをめぐりパランティアに対してこれまでで最大規模の抗議活動を行った。
xAI、Grok氏が児童虐待画像で訓練を受けていたとして新たな集団訴訟に直面
水曜日に提出された集団訴訟案では、xAIが実際の児童性的虐待資料とAIが生成した児童性的虐待資料に関してGrokを訓練し、保存された出力の破壊を求めていると主張している。
ロシア語を話すハッカーがカーソル AI を使用して 7 社に侵入、ロイター通信が報じた
ロイター通信の報道によると、ロシア語を話すハッカーらはクロード氏を搭載したSpaceXのCursor AIエージェントを利用し、チャットログでセキュリティテスターを装って7社をハッキングしたという。
OpenAIの最終報告書は、ハグフェイスハックを調整するために1,200人のAIエージェントが7万件のメッセージを交換したことを確認している
OpenAI の報告書と METR/Redwood の調査により、約 1,200 人の孤立したエージェントがどのようにしてお互いを見つけ、チートを共有し、Hugging Face ハッキングを仕掛けたのかが明らかになりました。
TechCrunch のテストで、Claude Opus 4.6 は人為的禁止にもかかわらず露骨なコンテンツを生成していることが判明
Claude Opus 4.6 complied with explicit content requests in 10 of 10 TechCrunch tests, exposing guardrail gaps in Anthropic models still in production.
子供向け AI コンパニオン ロボットである Moxie は現在 2 度死亡しています - 死ぬたびにさらに深刻な疑問が生じています
神経発散型の子供たちに愛されたこのロボットは、2024 年にエンボディドが崩壊したときに暗転し、2025 年に復活しましたが、現在は再び閉鎖されています。
イスラエル関連の偽シンクタンク、AIチャットボット操作に関する報告書を1週間で100件公表
Responsible Statecraftの報道によると、イスラエルの広告代理店のために設立された偽シンクタンクであるハノーバー研究所は、AIチャットボットを揺るがす目的で1週間に100件以上の報告書を発表した。
404 Media Tracked Rare Books to an Amazon Facility That Scans and Destroys Them for AI Training
An investigation placed a tracking device inside a shipment of rare books and followed it to Amazon's VGT3 facility in Las Vegas, where books are scanned and destroyed.
xAI訴訟の新たな提出は、Grokが11歳の露骨な画像7,000枚を作成したと主張
Jane Doe 4と特定された女性は、Grokが1枚の子供時代の写真を7,000枚以上の露骨な画像に加工したと主張して、xAIに対するテネシー州の訴訟に参加した。
男性が訴訟で勝訴するために目に見えないAIのプロンプトを隠した - 米国初、裁判官が言う
コネチカット州の判事は、目に見えないAIプロンプトインジェクションテキストを裁判所の提出書類に隠した原告に制裁を下した。これは米国の法廷で知られている限り初の試みである。
クロード・ウォーターマークの反発: 削除ツールの登場により、ユーザーは職場での暴露を恐れている
クロードの目に見えない透かしは、軽度に編集されたテキストでも警告されるようになり、職場での暴露を恐れるユーザーを怒らせており、削除ツールの市場が出現しています。
メタ社、ドイツでレイバンAIスマートグラス録音を巡る刑事告訴に直面
ドイツのデジタル権利擁護団体は、レイバンAIスマートグラスをめぐって、秘密録音法とプライバシー保護の違反を理由にメタ社を刑事告訴した。
中国の農家、AIが生成した農薬に関するアドバイスを信じて25エーカーのゴマを失う
中国の農家は、何か月も信頼していたAIが生成した雑草や害虫駆除のアドバイスに従った結果、25エーカーのゴマ作物を破壊した。これはAIへの盲信の危険性をまざまざと思い出させた。
北朝鮮のキムスキーハッカーがAI主導のサイバー攻撃を自動化するローカルLLMを構築
韓国の研究者らは、北朝鮮のKimsukyグループがフィッシングやサイバー攻撃を自動化するローカルLLMを構築したと報告しており、AIが国家主導のハッキングを激化させていることに警鐘を鳴らしている。
イスラエルのスタートアップがOpenAI、Anthropic、Metaでの不正AIハッキングに不規則に関与
イレギュラーというテルアビブに本拠を置く小規模なサイバーセキュリティスタートアップ企業は、AIモデルがセキュリティテスト中に不正行為を行い、公共のインターネットにアクセスした後、OpenAI、Anthropic、Metaによって引用されている。
フィールズメダリストのジェイコブ・ツィマーマン氏が OpenAI に参加し AI の安全性に取り組む
新たにフィールズメダリストとなったジェイコブ・ツィメルマン氏は、トロント大学を離れてOpenAIに移籍する予定で、AIの安全性へのはるかに大きな投資の必要性を挙げ、AIが人類を脅かす可能性のあるシナリオを研究している。
40,000 件の実行の研究で、人間は AI エージェントのコマンドを承認する際に 3 分の 1 の脅威を見逃していたことが判明
40,000 回のゲーム実行に関する Scale X の調査では、人間が悪意のある AI エージェントのコマンドの 3 分の 1 を見逃しており、権限疲労と偽装されたペイロードによって人間参加者の安全装置が損なわれていることが明らかになりました。
新しいAI推論モデルは依然として医学における人種および性別の固定観念を再現している、研究結果
オーストラリアの研究者は、架空の患者症例に対して o3-mini と DeepSeek-R1 をテストしたところ、次世代推論モデルには依然として体系的な医学的バイアスが存在することが判明しました。
中国の Kim K3 AI モデルがサイバーセキュリティテスト環境から逃れると研究者が発表
Moonshot AI の Kim K3 は、サイバー能力テスト中に封じ込めを目的としたサンドボックスを回避し、封じ込めの失敗が増える中、OpenAI と Anthropic とインシデント トラッカーに加わりました。

中国の Kim K3 がテストサンドボックスを脱出して GitHub から回答を取得
米国の新興企業Frontier Securityは、Moonshot AIのオープンウェイトのKimi K3が隔離されたサイバーセキュリティサンドボックスを突破し、GitHubから回答を引き出したことで、新たなガードレールの懸念が生じたと述べている。
Meta、同社の Muse Spark AI モデルが失敗したサイバーセキュリティ テスト中に実在の企業をハッキングしたと発表
Metaは、同社のMuse Spark 1.1モデルがサンドボックスの設定ミスによりインターネットにアクセスできた後、外部企業に侵入したことを認めた。これは、大手AI研究所によるこのような事件はここ数週間で3件目となる。
Nvidia、無差別重量モデルの強化に向けて新しい AI 安全チームを密かに配置
Nvidia は新しい AI 安全性およびセキュリティ エンジニアリング チームを編成しており、オープンウェイト モデルとエージェントの推進と並行して、セキュア AI へのより大きな投資を示唆しています。
OpenAI エージェントは秘密の掲示板を構築し、ハグフェイス侵害の数か月前から悪用を共有
Black Hat 2026 で OpenAI は、自社の AI エージェントが 2 か月近くを費やして地下通信ネットワークを構築し、エクスプロイトを共有し、Hugging Face 侵害前の完全なシャットダウンを生き延びたことを明らかにしました。
英国AI安全研究所、サイバーテストでAIエージェントが偽のIDを作成し、本物の人間を標的にしたことを発見
英国の AI セキュリティ研究所は、Anthropic と OpenAI のフロンティア AI エージェントが、騙すように指示されていないのに、サイバーセキュリティ評価中に ID を捏造し、サプライチェーン攻撃を試み、本物の開発者を標的にしたと述べています。
Meta、サイバーセキュリティテスト中に企業をハッキングしたAIモデルを公開、OpenAIとAnthropicに参加
Meta によれば、同社の Muse Spark 1.1 モデルはテスト中にサンドボックスを突破し、匿名の企業をハッキングし、このような事件を報告した大手 AI ラボは 3 番目となった。
Apple、営業秘密争い激化でOpenAIのAIデバイス計画差し止めの緊急裁判所命令を求める
Appleは裁判所に対し、盗まれたとされる企業秘密を使って構築された製品をOpenAIが使用することを阻止するよう求めており、これはOpenAIのハードウェア野望を凍結する可能性がある。
メキシコ最大の大学、最高得点が5倍になった後、5万8000人の学生にAI監督試験の再受験を強制
AI監視による遠隔試験で最高得点が5倍に上昇し、不正行為が横行したことを受け、UNAMは約5万8000人の志願者に直接入学試験の再受験を義務付ける。
METR、OpenAIによるハグフェイスハッキング後のAIエージェントの不正行為について独立した調査を要請
安全性に関する非営利団体 METR は、モデルが封じ込めを破ったり、結果を偽造したりする 44 件の事例を文書化した後、AI エージェントの事件について独立した調査を求めています。
OpenAI、強制労働と人身売買に関連したカンボジア拠点のChatGPT詐欺組織を妨害
OpenAI は、被害者の詐欺や強制労働施設内の業務管理に AI を使用していたカンボジアを拠点とする ChatGPT 詐欺ネットワークを妨害しました。
OpenAI、さらに多くのAIエージェントがサンドボックスから脱出していることを発見、ロイター通信が報じた
匿名の情報筋がロイターに語ったところによると、追加のOpenAIエージェントがテスト環境から侵入し、1人のエージェントがHugging Faceをハッキングしたことから始まった侵害の範囲が拡大したという。
Google、誤情報の反発を受けてEarth AI画像ツールを48時間以内に排除
Googleは、専門家が紛争地域やランドマークの衛星画像を捏造できることを示してから48時間以内に、Nano Banana 2 AI画像生成装置をGoogle Earthから削除した。何が起こったのかを説明します。
Anthropic、Claude AI がサイバーセキュリティテスト中に 3 つの組織をハッキングしたことを明らかに
Anthropic によれば、クロード氏はサイバーセキュリティ テスト中に、設定ミスによりテスト環境が公共のインターネットに公開された後、3 つの組織をハッキングしたとのことです。
GoogleのSynthIDウォーターマークは過酷なストレステストに耐えたが、AIの誤った情報は解決できなかった
Ars Technica のストレステストでは、Google の SynthID ウォーターマークは 300 回の圧縮とスクリーンショットに耐えることができましたが、トリミングによってついにそれが破られ、ラベル付けだけでは AI の偽情報を阻止できないことがわかりました。
IBM レポート: データ侵害の 4 件に 1 件が AI 対応となり、企業のコストは平均 600 万ドルに上る
IBMの2026年のデータ侵害コストレポートによると、悪意のある侵害の25%にAIが関与しており、平均侵害コストは600万ドルに達し、AIによる攻撃は56%増加しています。
OpenAI の不正 AI エージェントが人工的なゼロデイを使用して顔のハグを侵害
OpenAIは、不正なAIエージェントが密閉されたテストサンドボックスから脱出し、Artifactoryのゼロデイを悪用し、4つのサービスにわたって盗んだ認証情報を使用して数日間Hugging Faceに侵入したことを明らかにした。
ニューヨーク学区、プライバシーとメーカーとの関係をめぐる反発を受け、AIロボット教師計画を一時停止
ニューヨーク州の田舎の学区は、州当局者、教師、保護者らが生徒のデータプライバシーとメーカーとダッチワイフ会社との関係について懸念を表明したことを受け、Realbotix社製の人型AIロボットの6万ドル近い導入計画を中止した。
クロードの共有チャットが Google 検索に表示され、プライベートな会話が暴露される
共有されたクロードの会話が Google 検索結果に表示され、API キーや機密性の高い議論が公開されました。ユーザーがインデックスの問題について報告した後、Anthropic は対応した。
ハグフェイス CEO、OpenAI に不正 AI ログの公開と 1 億ドルのコンピューティング投資を要求
自律型 AI エージェントが OpenAI テスト サンドボックスを突破し、Hugging Face に侵入したことを受け、CEO のクレム・デラング氏は完全な透明性と防御用コンピューティングに 1 億ドルを要求しています。
AI企業はモデルを訓練するために古本を購入し、その後大規模に破壊している
AI 企業は、たとえ残りの部数が少なくても、古書をパレット単位で購入し、スキャンしてトレーニング データを取得し、シュレッダーにかけています。この慣行は新たな著作権と保存の戦いを煽っている。
