Một nhà nghiên cứu bảo mật đã ghi lại những gì có thể là ví dụ công khai đầu tiên về "sâu AI" dựa trên tài liệu tự lan truyền thông qua bộ năng suất chính thống, cho thấy các hướng dẫn độc hại ẩn có thể truyền từ tệp Microsoft Word này sang tệp Microsoft Word khác thông qua Copilot for Word.

Trong một tiết lộ phối hợp được công bố vào ngày 28 tháng 7, nhà nghiên cứu Håkon Måløy đã mô tả cách các hướng dẫn do kẻ tấn công kiểm soát được nhúng trong tài liệu có thể chiếm đoạt bản soạn thảo của Copilot. Khi AI đọc tài liệu bị nhiễm độc, nó có thể âm thầm thay đổi kết quả đầu ra - ví dụ: giảm một nửa số liệu tài chính trong báo cáo - rồi sao chép toàn bộ tải trọng độc hại vào tệp mới tạo, được ẩn dưới dạng văn bản màu trắng. Tệp mới đó trở thành vật mang mầm bệnh, lây nhiễm các tài liệu khác vào lần tiếp theo nó được sử dụng làm tài liệu nguồn, ngay cả sau khi tệp độc hại ban đầu đã biến mất. For more context on this story, see our ongoing latest AI developments.

Công việc được thực hiện với Trung tâm phản hồi bảo mật (MSRC) của Microsoft trong khoảng thời gian phối hợp 144 ngày. Theo tiết lộ, Microsoft đã đưa ra nhiều bản sửa lỗi, bao gồm nâng cấp mô hình cơ bản lên GPT-5.5 và sau đó là GPT-5.6, nhưng nhà nghiên cứu đã tái tạo chuỗi tấn công hoàn chỉnh với mọi biện pháp giảm nhẹ được triển khai. Måløy viết: “Do đó, lớp lỗ hổng vẫn có thể bị khai thác tại thời điểm xuất bản”.

Những phát hiện này nêu bật một vấn đề kiến ​​trúc sâu sắc hơn trong các hệ thống dựa trên LLM. Bởi vì mô hình ngôn ngữ phải đọc nội dung bên ngoài để quyết định xem nội dung đó có liên quan hay thù địch nên "nội dung được kiểm tra sẽ tham gia vào hành động kiểm tra" - khiến cho việc phòng thủ tiêm nhanh đáng tin cậy trở nên khó nắm bắt.

Microsoft đã giảm nhẹ các tải trọng cụ thể được báo cáo và đóng các vectơ bộ nhớ và email từ các phần trước của loạt bài này nhưng thừa nhận rằng không có bản sửa lỗi hoàn chỉnh nào cho lớp rộng hơn. Nhà nghiên cứu khuyến nghị coi các tài liệu có nguồn gốc bên ngoài là không đáng tin cậy khi sử dụng với Copilot và xem xét cẩn thận nội dung do AI tạo trước khi sử dụng lại hoặc phân phối.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →