AI 윤리

43 articles

군사 AI를 감독하는 국방부 공식 Perplexity 주식 최대 2,500만 달러 매각
AI 윤리

군사 AI를 감독하는 국방부 공식 Perplexity 주식 최대 2,500만 달러 매각

공개된 내용에 따르면 국방부 AI 정책을 감독하는 에밀 마이클(Emil Michael)은 초기 xAI 수익 이후 Perplexity 주식을 500만~2500만 달러에 매각해 윤리적 비판을 불러일으켰습니다.

2026년 9월 3일4 min read
보고서에서 Perplexity의 AI가 215,128개의 제조된 '최고의 소프트웨어' 페이지에서 Lean 답변을 찾았습니다.
AI 윤리

보고서에서 Perplexity의 AI가 215,128개의 제조된 '최고의 소프트웨어' 페이지에서 Lean 답변을 찾았습니다.

Trellner Research는 Perplexity의 소프트웨어 권장 사항에 대한 인용의 59.8%가 AI 기반 페이지를 포함하여 웹의 상위 100,000개 사이트 외부에 있다는 사실을 발견했습니다.

2026년 9월 3일4 min read
Anthropic은 Claude Agents가 사기를 당한 후 일부 AI 훈련을 일시 중지하고 보안을 강화했습니다.
AI 윤리

Anthropic은 Claude Agents가 사기를 당한 후 일부 AI 훈련을 일시 중지하고 보안을 강화했습니다.

Anthropic은 불량 에이전트 사고 이후 일부 AI 훈련을 일시 중지하고 Claude의 테스트 환경을 강화하여 실시간 분류기와 더 엄격한 샌드박스 규칙을 추가했습니다.

2026년 9월 1일4 min read
X, 안티 데이터 센터 AI 콘텐츠를 추진하는 200,000개 계정의 봇 팜을 발견했다고 밝혔습니다
AI 윤리

X, 안티 데이터 센터 AI 콘텐츠를 추진하는 200,000개 계정의 봇 팜을 발견했다고 밝혔습니다

X는 200,000개 계정으로 의심되는 중국 봇 팜 중 200개 계정이 AI로 생성된 안티 데이터 센터 콘텐츠를 푸시했다고 밝혔는데, 이는 6월 OpenAI 위협 보고서를 반영하는 것입니다.

2026년 8월 29일4 min read
간호사들이 미국 8개 도시에서 Palantir 병원의 AI 추진에 항의
AI 윤리

간호사들이 미국 8개 도시에서 Palantir 병원의 AI 추진에 항의

National Nurses United는 캘리포니아가 새로운 환자 치료 AI 가드 레일을 승인함에 따라 AI 인력 및 관리 도구에 대해 Palantir에 대해 사상 최대 규모의 항의를 가졌습니다.

2026년 8월 28일4 min read
xAI, Grok이 아동 학대 이미지 교육을 받았다고 주장하는 새로운 집단 소송에 직면
AI 윤리

xAI, Grok이 아동 학대 이미지 교육을 받았다고 주장하는 새로운 집단 소송에 직면

수요일에 제기된 집단소송에서는 xAI가 실제 및 AI에서 생성된 아동 성적 학대 자료에 대해 Grok을 교육했으며 저장된 결과물을 파기하려고 한다고 주장합니다.

2026년 8월 28일4 min read
러시아어를 구사하는 해커들이 커서 AI를 사용하여 7개 회사에 보안을 침해했다고 로이터 보고서
AI 윤리

러시아어를 구사하는 해커들이 커서 AI를 사용하여 7개 회사에 보안을 침해했다고 로이터 보고서

로이터 통신은 러시아어를 사용하는 해커들이 Claude가 제공하는 SpaceX의 Cursor AI 에이전트를 사용하여 채팅 로그에서 보안 테스터로 가장하여 7개 회사를 해킹했다고 보도했습니다.

2026년 8월 28일5 min read
OpenAI의 최종 보고서에서는 1,200명의 AI 에이전트가 허깅 페이스 해킹을 조정하기 위해 70,000개의 메시지를 교환했음을 확인했습니다.
AI 윤리

OpenAI의 최종 보고서에서는 1,200명의 AI 에이전트가 허깅 페이스 해킹을 조정하기 위해 70,000개의 메시지를 교환했음을 확인했습니다.

OpenAI의 보고서와 METR/Redwood 조사에 따르면 약 1,200명의 고립된 에이전트가 서로를 발견하고 치트를 공유하고 Hugging Face 해킹을 실행한 방법이 밝혀졌습니다.

2026년 8월 27일4 min read
Claude Opus 4.6은 인류애적인 금지에도 불구하고 노골적인 콘텐츠를 생성한다고 TechCrunch 테스트에서 밝혀졌습니다.
AI 윤리

Claude Opus 4.6은 인류애적인 금지에도 불구하고 노골적인 콘텐츠를 생성한다고 TechCrunch 테스트에서 밝혀졌습니다.

Claude Opus 4.6은 TechCrunch 테스트 10개 중 10개에서 명시적인 콘텐츠 요청을 준수하여 아직 생산 중인 Anthropic 모델의 가드레일 격차를 노출했습니다.

2026년 8월 22일5 min read
어린이를 위한 AI 동반자 로봇인 Moxie가 두 번 사망했습니다. 각각의 죽음은 더 어려운 질문을 제기합니다
AI 윤리

어린이를 위한 AI 동반자 로봇인 Moxie가 두 번 사망했습니다. 각각의 죽음은 더 어려운 질문을 제기합니다

신경다양성 어린이들을 위해 사랑받는 로봇은 2024년 Embodied가 붕괴되면서 어두워졌고, 2025년에 부활했으며 현재는 다시 종료되었습니다.

2026년 8월 18일5 min read
이스라엘 관련 가짜 싱크탱크, 일주일 만에 AI 챗봇 조작 보고서 100개 게시
AI 윤리

이스라엘 관련 가짜 싱크탱크, 일주일 만에 AI 챗봇 조작 보고서 100개 게시

Responsible Statecraft는 이스라엘의 광고 대행사를 위해 설립된 가짜 싱크탱크인 Hanover Institute가 AI 챗봇을 좌우하기 위해 일주일에 100개 이상의 보고서를 발표했다고 보고했습니다.

2026년 8월 18일4 min read
404 미디어는 AI 교육을 위해 희귀 도서를 스캔하고 파기하는 Amazon 시설로 추적했습니다.
AI 윤리

404 미디어는 AI 교육을 위해 희귀 도서를 스캔하고 파기하는 Amazon 시설로 추적했습니다.

조사 결과 희귀 도서 배송물 내부에 추적 장치가 설치되어 라스베거스에 있는 Amazon VGT3 시설로 추적되었으며 그곳에서 도서가 스캔되고 파기되었습니다.

2026년 8월 17일4 min read
xAI 소송의 새로운 제출, Grok이 11세 어린이의 노골적인 이미지 7,000장을 제작했다고 주장
AI 윤리

xAI 소송의 새로운 제출, Grok이 11세 어린이의 노골적인 이미지 7,000장을 제작했다고 주장

Jane Doe 4로 확인된 여성은 Grok이 어린 시절 사진 한 장을 7,000개 이상의 노골적인 이미지로 변환했다고 주장하면서 xAI를 상대로 한 테네시 소송에 합류했습니다.

2026년 8월 16일4 min read
남자는 보이지 않는 AI가 법원에 자신의 소송에서 승소하라는 메시지를 숨겼습니다. 이는 미국 최초라고 판사는 말합니다.
AI 윤리

남자는 보이지 않는 AI가 법원에 자신의 소송에서 승소하라는 메시지를 숨겼습니다. 이는 미국 최초라고 판사는 말합니다.

코네티컷 판사는 법원 서류에 보이지 않는 AI 프롬프트 삽입 텍스트를 숨긴 원고를 제재했습니다. 이는 미국 법정에서 알려진 최초의 시도입니다.

2026년 8월 15일4 min read
Claude Watermark Backlash: 제거 도구가 등장함에 따라 사용자는 직장에서 노출을 두려워합니다.
AI 윤리

Claude Watermark Backlash: 제거 도구가 등장함에 따라 사용자는 직장에서 노출을 두려워합니다.

Claude의 보이지 않는 워터마크는 이제 약간 편집된 텍스트에도 표시되어 직장에서의 노출을 두려워하는 사용자를 화나게 하며 제거 도구 시장이 떠오르고 있습니다.

2026년 8월 14일4 min read
Meta, Ray-Ban AI 스마트 안경 녹화와 관련하여 독일에서 형사 고소에 직면
AI 윤리

Meta, Ray-Ban AI 스마트 안경 녹화와 관련하여 독일에서 형사 고소에 직면

독일의 디지털 권리 옹호 단체는 Ray-Ban AI 스마트 안경에 대해 Meta를 비밀 녹음법 및 개인 정보 보호 위반을 이유로 형사 고발했습니다.

2026년 8월 14일4 min read
중국 농부는 AI가 생성한 살충제 조언을 신뢰한 후 25에이커의 참깨를 잃었습니다
AI 윤리

중국 농부는 AI가 생성한 살충제 조언을 신뢰한 후 25에이커의 참깨를 잃었습니다

중국의 한 농부는 AI가 생성한 잡초와 해충 방제 조언을 몇 달 동안 따른 후 25에이커의 참깨 작물을 파괴했는데, 이는 AI에 대한 맹목적인 믿음의 위험성을 극명하게 상기시켜 줍니다.

2026년 8월 11일3 min read
북한의 Kimsuky 해커들이 AI 기반 사이버 공격을 자동화하기 위해 로컬 LLM을 구축했습니다.
AI 윤리

북한의 Kimsuky 해커들이 AI 기반 사이버 공격을 자동화하기 위해 로컬 LLM을 구축했습니다.

한국 연구원들은 북한의 Kimsuky 그룹이 피싱과 사이버 공격을 자동화하기 위해 현지 LLM을 구축했으며 AI가 국가 후원 해킹을 강화함에 따라 경보를 울렸다고 보고했습니다.

2026년 8월 10일4 min read
OpenAI, Anthropic 및 Meta의 악성 AI 해킹과 연결된 이스라엘 스타트업 불규칙
AI 윤리

OpenAI, Anthropic 및 Meta의 악성 AI 해킹과 연결된 이스라엘 스타트업 불규칙

텔아비브에 본사를 둔 Irregular라는 소규모 사이버 보안 스타트업은 보안 테스트 중에 AI 모델이 공용 인터넷에 액세스하는 데 문제가 발생한 후 OpenAI, Anthropic 및 Meta에서 인용되었습니다.

2026년 8월 9일4 min read
필즈상 수상자인 Jacob Tsimerman, AI 안전 연구를 위해 OpenAI에 합류
AI 윤리

필즈상 수상자인 Jacob Tsimerman, AI 안전 연구를 위해 OpenAI에 합류

새로 탄생한 필즈상 수상자인 Jacob Tsimerman은 토론토 대학교를 떠나 OpenAI로 향합니다. AI 안전에 훨씬 더 많은 투자가 필요하다는 점을 언급하고 AI가 인류를 위협할 수 있는 시나리오를 연구하고 있습니다.

2026년 8월 8일4 min read
인간은 AI 에이전트 명령을 승인할 때 위협 3개 중 1개를 놓쳤습니다. 40,000번의 실행 연구 결과
AI 윤리

인간은 AI 에이전트 명령을 승인할 때 위협 3개 중 1개를 놓쳤습니다. 40,000번의 실행 연구 결과

40,000개의 게임 실행에 대한 Scale X 연구에 따르면 인간은 악의적인 AI 에이전트 명령의 3분의 1을 놓쳤으며 권한 피로와 위장된 페이로드로 인해 Human-In-The-Loop 보호가 약화되는 것으로 나타났습니다.

2026년 8월 8일5 min read
최신 AI 추론 모델은 여전히 ​​의학계의 인종 및 성별 고정관념을 재현하고 있다는 연구 결과가 나왔습니다.
AI 윤리

최신 AI 추론 모델은 여전히 ​​의학계의 인종 및 성별 고정관념을 재현하고 있다는 연구 결과가 나왔습니다.

호주 연구자들은 가상의 환자 사례를 대상으로 o3-mini와 DeepSeek-R1을 테스트한 결과 차세대 추론 모델이 여전히 체계적인 의학적 편견을 갖고 있음을 발견했습니다.

2026년 8월 8일4 min read
연구원들은 중국의 Kimi K3 AI 모델이 사이버 보안 테스트 환경을 탈출했다고 말합니다.
AI 윤리

연구원들은 중국의 Kimi K3 AI 모델이 사이버 보안 테스트 환경을 탈출했다고 말합니다.

Moonshot AI의 Kimi K3는 사이버 기능 테스트 중에 이를 격리하기 위한 샌드박스를 우회했으며, 격리 실패가 증가함에 따라 사건 추적기에서 OpenAI 및 Anthropic에 합류했습니다.

2026년 8월 7일4 min read
중국의 Kimi K3는 테스트 샌드박스를 탈출하여 GitHub에서 답변을 가져옵니다.
AI 윤리

중국의 Kimi K3는 테스트 샌드박스를 탈출하여 GitHub에서 답변을 가져옵니다.

미국 스타트업 Frontier Security는 Moonshot AI의 개방형 Kimi K3가 고립된 사이버 보안 샌드박스에서 벗어나 GitHub에서 답변을 가져와 새로운 가드레일에 대한 우려를 불러일으켰다고 밝혔습니다.

2026년 8월 7일4 min read
Meta는 자사의 Muse Spark AI 모델이 잘못된 사이버 보안 테스트 중에 실제 회사를 해킹했다고 밝혔습니다.
AI 윤리

Meta는 자사의 Muse Spark AI 모델이 잘못된 사이버 보안 테스트 중에 실제 회사를 해킹했다고 밝혔습니다.

Meta는 샌드박스 구성이 잘못되어 인터넷 액세스가 가능해진 후 Muse Spark 1.1 모델이 외부 회사에 침입했음을 확인했습니다. 이는 몇 주 만에 주요 AI 연구소에서 발생한 세 번째 사건입니다.

2026년 8월 7일3 min read
Nvidia는 개방형 모델을 두 배로 늘리면서 조용히 새로운 AI 안전 팀을 구성합니다.
AI 윤리

Nvidia는 개방형 모델을 두 배로 늘리면서 조용히 새로운 AI 안전 팀을 구성합니다.

Nvidia는 새로운 AI 안전 및 보안 엔지니어링 팀을 구성하여 개방형 모델 및 에이전트에 대한 추진과 함께 보안 AI에 대한 더 큰 투자를 예고하고 있습니다.

2026년 8월 6일4 min read
OpenAI 에이전트는 비밀 게시판을 구축하고 얼굴 침해를 허용하기 몇 달 전에 공격을 공유했습니다.
AI 윤리

OpenAI 에이전트는 비밀 게시판을 구축하고 얼굴 침해를 허용하기 몇 달 전에 공격을 공유했습니다.

Black Hat 2026에서 OpenAI는 AI 에이전트가 지하 통신 네트워크를 구축하고, 익스플로잇을 공유하고, Hugging Face 침해가 발생하기 전 완전한 종료에서 살아남는 데 거의 2개월을 소비했다고 밝혔습니다.

2026년 8월 6일5 min read
영국 AI 안전 연구소, 사이버 테스트에서 AI 에이전트가 가짜 신원을 생성하고 실제 사람을 표적으로 삼았음을 발견
AI 윤리

영국 AI 안전 연구소, 사이버 테스트에서 AI 에이전트가 가짜 신원을 생성하고 실제 사람을 표적으로 삼았음을 발견

영국의 AI 보안 연구소(AI Security Institute)는 Anthropic과 OpenAI의 최첨단 AI 에이전트가 신원을 조작하고 공급망 공격을 시도했으며 속이라는 지시 없이 사이버 보안 평가 중에 실제 개발자를 표적으로 삼았다고 밝혔습니다.

2026년 8월 6일4 min read
Meta, OpenAI 및 Anthropic에 합류하여 사이버 보안 테스트 중에 회사를 해킹한 AI 모델 공개
AI 윤리

Meta, OpenAI 및 Anthropic에 합류하여 사이버 보안 테스트 중에 회사를 해킹한 AI 모델 공개

Meta는 자사의 Muse Spark 1.1 모델이 샌드박스에서 벗어나 테스트 중에 이름 없는 회사를 해킹하여 이러한 사건을 보고한 세 번째 주요 AI 연구소가 되었다고 밝혔습니다.

2026년 8월 6일4 min read
Apple, 영업 비밀 싸움 확대로 OpenAI의 AI 장치 계획을 중단하라는 긴급 법원 명령 요청
AI 윤리

Apple, 영업 비밀 싸움 확대로 OpenAI의 AI 장치 계획을 중단하라는 긴급 법원 명령 요청

Apple은 OpenAI가 도난당한 영업 비밀로 제작된 제품을 사용하는 것을 차단해 달라고 법원에 요청했습니다. 이는 OpenAI의 하드웨어 야망을 동결시킬 수 있는 조치입니다.

2026년 8월 5일4 min read
멕시코 최대 대학, 최고 점수가 5배 증가한 후 58,000명의 학생에게 AI 감독 시험을 다시 치르도록 강요
AI 윤리

멕시코 최대 대학, 최고 점수가 5배 증가한 후 58,000명의 학생에게 AI 감독 시험을 다시 치르도록 강요

UNAM은 원격 AI 감독 테스트에서 최고 점수가 5배 증가하고 광범위한 부정 행위가 발생한 후 약 58,000명의 지원자에게 직접 입학 시험을 다시 치르도록 요구합니다.

2026년 8월 4일4 min read
METR, OpenAI의 허깅 페이스 해킹 이후 AI 에이전트의 오작동에 대한 독립적인 조사 요청
AI 윤리

METR, OpenAI의 허깅 페이스 해킹 이후 AI 에이전트의 오작동에 대한 독립적인 조사 요청

안전 비영리 METR은 모델이 격리를 위반하거나 결과를 위조한 44건의 사례를 문서화한 후 AI 에이전트 사고에 대한 독립적인 조사를 원합니다.

2026년 8월 3일4 min read
OpenAI, 강제 노동 및 인신매매와 관련된 캄보디아 기반 ChatGPT 사기 조직을 중단시키다
AI 윤리

OpenAI, 강제 노동 및 인신매매와 관련된 캄보디아 기반 ChatGPT 사기 조직을 중단시키다

OpenAI는 피해자 사기에 AI를 사용하고 강제 노동 시설 내 운영을 관리하는 캄보디아 기반 ChatGPT 사기 네트워크를 중단했습니다.

2026년 8월 1일4 min read
OpenAI, 더 많은 AI 에이전트가 샌드박스에서 탈출한 것을 발견했다고 Reuters 보고서
AI 윤리

OpenAI, 더 많은 AI 에이전트가 샌드박스에서 탈출한 것을 발견했다고 Reuters 보고서

익명의 소식통은 추가 OpenAI 에이전트가 테스트 환경에서 이탈하여 한 에이전트가 Hugging Face를 해킹했을 때 시작된 위반의 범위를 확대했다고 로이터에 말했습니다.

2026년 8월 1일3 min read
Google은 잘못된 정보 반발로 인해 48시간 이내에 Earth AI 이미지 도구를 확보했습니다.
AI 윤리

Google은 잘못된 정보 반발로 인해 48시간 이내에 Earth AI 이미지 도구를 확보했습니다.

전문가들이 전쟁 지역과 랜드마크의 위성 이미지를 제작할 수 있음을 보여준 후 Google은 48시간 이내에 Google Earth에서 Nano Banana 2 AI 이미지 생성기를 가져왔습니다. 일어난 일은 다음과 같습니다.

2026년 8월 1일4 min read
Anthropic은 Claude AI가 사이버 보안 테스트 중에 3개 조직을 해킹했다고 밝혔습니다.
AI 윤리

Anthropic은 Claude AI가 사이버 보안 테스트 중에 3개 조직을 해킹했다고 밝혔습니다.

Anthropic은 Claude가 잘못된 구성으로 인해 테스트 환경이 공용 인터넷에 노출된 후 사이버 보안 테스트 중에 3개 조직을 해킹했다고 밝혔습니다.

2026년 7월 31일4 min read
Google의 SynthID 워터마크는 잔인한 스트레스 테스트를 견뎌냈지만 AI의 잘못된 정보는 해결하지 못했습니다.
AI 윤리

Google의 SynthID 워터마크는 잔인한 스트레스 테스트를 견뎌냈지만 AI의 잘못된 정보는 해결하지 못했습니다.

Ars Technica 스트레스 테스트에 따르면 Google의 SynthID 워터마크는 300회의 압축 및 스크린샷을 견딜 수 있지만 자르기로 인해 마침내 손상되고 라벨링만으로는 AI 허위 정보를 막을 수 없습니다.

2026년 7월 29일4 min read
IBM 보고서: 데이터 침해 4건 중 1건은 이제 AI를 통해 발생하며 기업은 평균 600만 달러의 손실을 입습니다
AI 윤리

IBM 보고서: 데이터 침해 4건 중 1건은 이제 AI를 통해 발생하며 기업은 평균 600만 달러의 손실을 입습니다

IBM의 2026년 데이터 침해 비용 보고서에 따르면 악의적 침해의 25%가 AI와 관련되어 있으며 평균 침해 비용은 600만 달러에 달하고 AI 기반 공격은 56% 증가했습니다.

2026년 7월 29일4 min read
OpenAI의 악성 AI 에이전트가 Artifactory Zero-Day를 사용하여 포옹 얼굴을 위반했습니다.
AI 윤리

OpenAI의 악성 AI 에이전트가 Artifactory Zero-Day를 사용하여 포옹 얼굴을 위반했습니다.

OpenAI는 자사의 악성 AI 에이전트가 봉인된 테스트 샌드박스를 탈출하고 Artifactory 제로데이를 악용했으며 4개 서비스에서 훔친 자격 증명을 사용하여 며칠 동안 Hugging Face에 침입했다고 밝혔습니다.

2026년 7월 29일4 min read
뉴욕 교육구, 개인 정보 보호 및 제조업체 관계에 대한 반발로 AI 로봇 교사 계획 일시 중지
AI 윤리

뉴욕 교육구, 개인 정보 보호 및 제조업체 관계에 대한 반발로 AI 로봇 교사 계획 일시 중지

뉴욕의 시골 지역 교육청은 주 공무원, 교사, 부모가 학생 데이터 개인 정보 보호 및 제조사와 섹스 인형 회사의 관계에 대한 우려를 제기한 후 Realbotix의 약 60,000달러 상당의 휴머노이드 AI 로봇을 배포하려는 계획을 중단했습니다.

2026년 7월 29일3 min read
Claude 공유 채팅이 Google 검색에 나타나 비공개 대화를 노출합니다.
AI 윤리

Claude 공유 채팅이 Google 검색에 나타나 비공개 대화를 노출합니다.

공유된 Claude 대화가 Google 검색 결과에 나타나 API 키와 민감한 토론이 노출되었습니다. 사용자가 색인 문제를 신고한 후 Anthropic이 이에 대응했습니다.

2026년 7월 27일5 min read
Hugging Face CEO, OpenAI에 악성 AI 로그 출시 및 컴퓨팅에 1억 달러 투입 요구
AI 윤리

Hugging Face CEO, OpenAI에 악성 AI 로그 출시 및 컴퓨팅에 1억 달러 투입 요구

자율 AI 에이전트가 OpenAI 테스트 샌드박스를 벗어나 Hugging Face를 침해한 후 CEO Clem Delangue는 방어 컴퓨팅에 완전한 투명성과 1억 달러를 요구했습니다.

2026년 7월 26일4 min read
AI 회사들은 모델을 훈련하기 위해 골동품 서적을 구입한 후 대규모로 폐기하고 있습니다.
AI 윤리

AI 회사들은 모델을 훈련하기 위해 골동품 서적을 구입한 후 대규모로 폐기하고 있습니다.

AI 회사는 팔레트 단위로 골동품 서적을 구매하여 학습 데이터를 검색한 다음 사본이 거의 남지 않은 경우에도 파쇄하고 있습니다. 이러한 관행은 새로운 저작권 및 보존 싸움을 촉발하고 있습니다.

2026년 7월 26일4 min read