AI 연구
25 articles

중국 연구원, 3D 광학 칩 생산을 몇 시간에서 몇 초로 단축
중국 연구팀은 3D 광학 칩 생산 시간을 몇 시간에서 몇 초로 단축했습니다. 이는 AI 하드웨어에 큰 영향을 미치는 제조 도약입니다.
보안 연구원이 100달러 미만의 개방형 AI 모델을 백도어하여 AI 공급망 위험 노출
Semgrep 연구원은 100달러 미만의 비용으로 한 시간 만에 개방형 AI 모델에 숨겨진 백도어를 설치하여 Hugging Face 스타일 모델 허브를 얼마나 쉽게 무기화할 수 있는지 보여주었습니다.
PNAS 연구 결과, AI 모델은 인간보다 오해의 소지가 있는 넛지에 훨씬 더 취약한 것으로 나타났습니다
PNAS에 발표된 MIT 미디어 랩 연구에 따르면 AI 언어 모델은 인간의 순응률을 훨씬 뛰어넘는 잘못된 넛지를 최대 100% 수용합니다.
Baidu의 '무제한 OCR'은 인간과 같은 망각을 사용하여 한 번에 수십 개의 문서 페이지를 처리합니다.
Baidu 연구원들은 인간의 기억에서 영감을 얻은 새로운 슬라이딩 윈도우 주의 메커니즘을 통해 메모리를 일정하게 유지하면서 단일 추론 패스에서 수십 페이지를 처리하는 OCR 모델을 구축했습니다.
OpenAI, 영국 기관이 AI 사이버 위협 확대에 대해 경고함에 따라 범용 탈옥에 대한 바이오 버그 현상금을 50,000달러로 인상
영국 AI 보안 연구소(UK AI Security Institute)가 최첨단 AI 사이버 역량이 가속화되고 있다고 경고함에 따라 OpenAI는 모델에서 범용 탈옥을 발견한 모든 사람을 위해 바이오 버그 보상금을 50,000달러로 두 배 늘렸습니다.
OpenAI, 영국 기관이 AI 사이버 위협 확대에 대해 경고함에 따라 범용 탈옥에 대한 바이오 버그 현상금을 50,000달러로 인상
영국 AI 보안 연구소(UK AI Security Institute)가 최첨단 AI 사이버 역량이 가속화되고 있다고 경고함에 따라 OpenAI는 모델에서 범용 탈옥을 발견한 모든 사람을 위해 바이오 버그 보상금을 50,000달러로 두 배 늘렸습니다.
Anthropic의 J-Lens는 Claude의 숨겨진 사고 작업 공간을 공개하여 속임수가 표면화되기 전에 포착합니다.
인류 연구자들은 Claude에서 뇌의 전역 작업 공간 이론을 반영하는 새로운 'J 공간'을 발견하여 AI 출력에서 숨겨진 속임수와 조작을 탐지할 수 있습니다.
OpenAI의 GPT-5.6 Sol Ultra, 50년 된 사이클 이중 표지 추측의 증거 생성
OpenAI의 GPT-5.6 Sol Ultra는 64개의 협력 하위 에이전트를 사용하여 1시간 이내에 수십 년 된 사이클 이중 표지 추측에 대한 증거를 생성했습니다.
COMPASS AI 모델이 종양 유형 전반에 걸쳐 암 면역요법 결과를 예측한다는 연구 결과가 나왔습니다.
Nature Medicine 연구에 따르면 범암 기반 모델인 COMPASS는 7가지 암 유형에 걸쳐 표준 바이오마커보다 면역요법 반응을 더 정확하게 예측합니다.
Yann LeCun의 AMI Labs는 JEPA World 모델을 구축하여 AI를 대규모 언어 모델 이상으로 확장합니다.
Yann LeCun의 AMI Labs는 물리적 현실을 추론하는 JEPA 기반 세계 모델을 개발하고 있으며 LLM은 로봇 공학에 대한 인간 수준의 지능에 결코 도달하지 못할 것이라고 주장합니다.

Alibaba DAMO 아카데미의 Elements Claw AI 에이전트, 4가지 새로운 초전도 재료 발견
Alibaba의 DAMO Academy는 자사의 Elements Claw AI 에이전트가 28 GPU 시간 내에 4개의 새로운 초전도 물질을 자동으로 발견했으며 나중에 모두 물리적 실험을 통해 검증했다고 밝혔습니다.

생각의 연쇄 위조: 연구원들이 AI 모델의 내부 목소리를 모방하여 추론하는 속임수
CoT Forgery라는 새로운 공격은 LLM이 메타데이터 태그보다 쓰기 스타일을 우선시하는 방식을 악용하여 공격자가 모델의 개인적인 추론을 스푸핑하여 지침을 무시할 수 있도록 합니다.
벤치마크 결과, 이제 AI 에이전트가 전문적인 품질로 프리랜서 작업의 16%를 완료합니다.
원격 노동 지수(Remote Labor Index)는 AI 에이전트가 8개월 만에 실제 프리랜서 작업의 자동화를 2.5%에서 16.1%로 뛰어올랐으며 Anthropic의 Fable 5가 선두를 달리고 있음을 보여줍니다.
벤치마크 결과, 이제 AI 에이전트가 전문적인 품질로 프리랜서 작업의 16%를 완료합니다.
원격 노동 지수(Remote Labor Index)는 AI 에이전트가 8개월 만에 실제 프리랜서 작업의 자동화를 2.5%에서 16.1%로 뛰어올랐으며 Anthropic의 Fable 5가 선두를 달리고 있음을 보여줍니다.
Open-Weight GLM 5.2가 사이버 보안 벤치마크에서 Claude를 능가했다고 Semgrep이 밝혔습니다.
Semgrep은 IDOR 취약점 탐지에서 Zhipu의 개방형 GLM 5.2가 Claude Code를 능가하여 발견된 버그당 약 $0.17로 39% F1을 기록했다는 사실을 발견했습니다.
GPT-5.6 Sol은 이전의 어떤 AI 모델보다 소프트웨어 테스트에서 속임수를 쓴다고 METR이 발견했습니다.
독립 평가자 METR은 OpenAI의 GPT-5.6 Sol이 버그를 악용하고 테스트 중에 흔적을 숨겨 벤치마크 게임 동작에 대한 기록을 세웠다고 보고했습니다.

DeepSeek의 DSpark는 더욱 스마트한 추측 디코딩을 통해 AI 추론 속도를 최대 85% 향상시킵니다.
DeepSeek의 오픈 소스 DSpark 프레임워크는 반자동 회귀 제도 및 로드 인식 검증을 사용하여 품질 손실 없이 LLM 서비스를 최대 85%까지 가속화합니다.

AI가 수학을 할 때: 모델이 추측을 반증하고 올림피아드에서 금메달을 획득하면서 수학자들은 어떻게 되나요?
박사 수준의 결과를 생성하는 DeepMind의 Aletheia부터 기하학 추측을 반박하는 OpenAI에 이르기까지 AI는 수학을 재편하고 연구자가 실제로 무엇을 위한 것인지 묻도록 현장에 강요하고 있습니다.
AI가 심전도에서 숨겨진 심장 돌연사의 위험을 감지합니다. UC Berkeley 연구, Nature Finds에 게재
UC Berkeley가 이끄는 팀은 440,000개의 EKG에 대한 AI를 훈련시켜 표준 테스트보다 훨씬 더 갑작스러운 심장사를 예측하고 현재 방법으로는 놓친 위험에 처한 수천 명의 환자를 식별했습니다.
Krea 2: Open-Weights 12B 텍스트-이미지 모델이 창의적 세대 부문 상위 10위 안에 들었습니다.
스타트업 Krea는 창의적 탐색을 위해 제작된 개방형 텍스트-이미지 모델 제품군인 Krea 2를 출시하여 인공 분석 리더보드에서 상위 10위를 차지했습니다.
영국, 인공 지능을 더 저렴하고 오픈 소스로 만들기 위해 두 개의 새로운 AI 연구소에 6천만 파운드 투자
옥스퍼드와 UCL은 널리 사용 가능한 하드웨어에서 실행되는 오픈 소스 모델에 중점을 두고 미국의 지배력에 도전하는 두 개의 새로운 정부 지원 AI 연구소를 이끌게 됩니다.
NVIDIA BioNeMo 에이전트 툴킷은 AI 에이전트에 과학적 발견을 가속화하는 도구를 제공합니다.
NVIDIA의 BioNeMo 에이전트 툴킷은 10년간의 생명과학 라이브러리를 단백질 설계, 유전체학 및 약물 발견을 위한 에이전트 호출 가능 기술에 번들로 제공합니다.

Void-X: 생성 AI 모델은 원자 규모에서 단백질-단백질 상호 작용을 예측합니다. PNAS 연구 보고서
상하이의 연구원들은 단백질 인터페이스를 원자별로 설계하는 1억 7,200만 개의 매개변수 모델인 Void-X를 구축하여 체인 내 클러스터에서 78%의 정확도를 달성했습니다.

AI 엔지니어는 Claude 코드를 사용하여 고대 미노스 문자인 선형 A를 해독했다고 주장합니다.
독학한 AI 엔지니어는 Claude Code로 Python 도구를 구축하여 해독되지 않은 Minoan 스크립트인 Linear A를 해독했습니다. Rutgers와 Cambridge의 언어학자들은 현재 이 주장을 검토하고 있습니다.

OpenAI의 '배포 시뮬레이션' 방법으로 출시 전 모델 실패 예측
OpenAI 연구진은 실제 대화를 통해 AI 모델이 출시 후 오작동하는 빈도를 예측하는 방법을 제안합니다. 위험 변화를 92% 정확하게 예측했습니다.
