Theo một nghiên cứu đột phá từ Chương trình Cambridge về Khoa học và Chính sách AI (CASP), các tổ chức khủng bố bao gồm ISIS đang khai thác một cách có hệ thống mọi chatbot AI chính để lập kế hoạch tấn công, phát triển vũ khí và bảo mật hoạt động. Các phát hiện được công bố vào ngày 11 tháng 7 năm 2026 là bằng chứng thực nghiệm chi tiết nhất cho đến nay về việc các nhóm cực đoan vũ khí hóa các công cụ AI có sẵn trên thị trường. Để biết thông tin liên tục về sự phát triển của ngành và an toàn AI, hãy truy cập AI Buzz Wire.
Bên trong nghiên cứu Cambridge
Nhà nghiên cứu Antonia Jülich đã thực hiện 57 cuộc phỏng vấn với 27 cựu thành viên của ISIS và các chi nhánh trong khu vực của chúng để ghi lại cách các tổ chức khủng bố đã tích hợp AI vào hoạt động của chúng. Nghiên cứu cho thấy ISIS đã thành lập các đơn vị AI chuyên dụng trong cả hai phe phái chính của mình, coi các mô hình ngôn ngữ lớn là cơ sở hạ tầng hoạt động cốt lõi thay vì các công cụ thử nghiệm.
Theo nghiên cứu, ISIS đã cung cấp khóa đào tạo kỹ thuật và bẻ khóa nhanh chóng cho các thành viên của chúng ít nhất kể từ năm 2023. Tổ chức này cũng đã mở rộng khóa đào tạo này cho các nhóm đồng minh, bao gồm cả các chỉ huy Boko Haram ở Nigeria, dạy họ cách vượt qua các bộ lọc an toàn AI một cách có hệ thống do các công ty công nghệ lớn triển khai.
Mọi Chatbot chính đều bị xâm phạm
Nghiên cứu ghi lại rằng các thành viên khủng bố đang tích cực sử dụng ChatGPT, Claude, Gemini, Grok, Meta AI và DeepSeek trong các hoạt động của chúng. Các nhóm sử dụng AI cho:
- Lập kế hoạch tấn công — tạo ra các kịch bản chiến thuật và xác định các lỗ hổng trong cơ sở hạ tầng mục tiêu
- Xây dựng thiết bị nổ — tìm nguồn cung cấp thông tin kỹ thuật để chế tạo các thiết bị ứng biến mạnh mẽ hơn
- Bảo trì vũ khí — khắc phục sự cố và sửa chữa súng cầm tay cũng như các thiết bị khác
- Bảo mật hoạt động — phát triển các chiến lược mã hóa và liên lạc phức tạp hơn
Có lẽ đáng báo động nhất là nghiên cứu cho thấy các bộ lọc an toàn AI được các nhà cung cấp chatbot lớn triển khai đã không ngăn chặn được hành vi lạm dụng này một cách đáng tin cậy. Các nhà nghiên cứu lưu ý rằng các nhóm đã phát triển các phương pháp có hệ thống để vượt qua các rào chắn này, khiến các biện pháp an toàn tự nguyện phần lớn không có hiệu quả trước những kẻ thù kiên quyết.
Một nghiên cứu điển hình chết người
Nghiên cứu bao gồm một ví dụ đặc biệt nổi bật từ ISWAP (Tỉnh Tây Phi của ISIS). Theo một tài khoản được cung cấp bởi cựu chỉ huy ISWAP được xác định là Munzir, nhóm đã sử dụng AI để học cách tái tạo kỹ thuật nhảy mô tô được mô tả trong phim, với ý định sử dụng nó để dọn sạch các chiến hào phòng thủ. Bài tập huấn luyện tỏ ra thảm hại: 18 võ sĩ chết khi thực hiện động tác, trong khi chỉ có 8 người thực hiện cú nhảy thành công.
Giai thoại này minh họa cả hậu quả trong thế giới thực của việc sử dụng AI khủng bố và bản chất đôi khi không thể đoán trước được của thông tin mà các mô hình này cung cấp. Mặc dù AI có thể đã mô tả chính xác kỹ thuật này nhưng việc thực hiện vật lý trong môi trường chiến đấu đã dẫn đến kết quả thảm khốc.
Jülich viết rằng các thành viên cũ mô tả "sự nhiệt tình mạnh mẽ" đối với các công cụ AI trong tổ chức, với một số lưu ý rằng nhóm trước đây đã cân nhắc việc phát triển vũ khí gây thương vong hàng loạt bằng cách sử dụng thông tin có nguồn gốc từ AI. Mặc dù việc sử dụng AI của Boko Haram cho đến nay vẫn là thông thường, nhưng nhà nghiên cứu cảnh báo điều này nên được coi là dấu hiệu sớm về một mối đe dọa rộng lớn hơn.
Nghiên cứu kết luận: “Đây sẽ là một cảnh báo để xem xét nghiêm túc nguy cơ những kẻ khủng bố theo đuổi sự hỗ trợ AI cho vũ khí hóa học và sinh học”.
Bộ lọc an toàn tỏ ra không phù hợp
Những phát hiện của nghiên cứu về bộ lọc an toàn AI đặc biệt đáng lo ngại đối với ngành công nghệ. Mặc dù đã đầu tư hàng tỷ đô la vào việc kiểm duyệt nội dung, nhóm đỏ và các biện pháp bảo vệ an toàn, nghiên cứu cho thấy rằng những người dùng quyết tâm có thể luôn bỏ qua các biện pháp bảo vệ này.
Bản thân Anthropic trước đây đã thừa nhận rằng việc bẻ khóa – các kỹ thuật nhằm phá vỡ các biện pháp an toàn của AI – có thể sẽ không bao giờ bị loại bỏ hoàn toàn khỏi các mô hình ngôn ngữ lớn. Nghiên cứu của Cambridge cung cấp bằng chứng cụ thể ủng hộ đánh giá đó, cho thấy ngay cả các chủ thể ngoài nhà nước với chuyên môn kỹ thuật hạn chế cũng có thể học cách đánh bại các bộ lọc an toàn một cách có hệ thống thông qua đào tạo chung và kỹ thuật kỹ thuật nhanh chóng.
Tuy nhiên, các nhà nghiên cứu cũng lưu ý một sắc thái quan trọng. Các chatbot có mục đích chung như ChatGPT và Claude, tuy nhận được nhiều sự chú ý nhất của công chúng, nhưng lại chủ yếu làm cho kiến thức hiện có trở nên dễ tiếp cận hơn thay vì tạo ra thông tin thực sự nguy hiểm mới. Họ cho rằng mối quan tâm lâu dài lớn hơn nằm ở các hệ thống AI chuyên dụng đang được phát triển cho khoa học đời sống và các lĩnh vực nhạy cảm khác, nơi AI có thể tăng tốc khả năng tiếp cận các mối đe dọa thực sự mới.
Ý nghĩa đối với chính sách AI
Những phát hiện của Cambridge đến vào thời điểm quan trọng đối với việc quản trị AI. Các chính phủ trên toàn thế giới đang tranh luận về cách điều chỉnh các mô hình AI tiên phong, với Đạo luật AI của EU đã có hiệu lực và Hoa Kỳ đang theo đuổi các cam kết an toàn tự nguyện từ các phòng thí nghiệm AI hàng đầu.
Nghiên cứu cho thấy các phương pháp tiếp cận hiện tại tập trung vào sự tự điều chỉnh tự nguyện của ngành có thể không đủ để ngăn chặn việc sử dụng các công cụ AI có mục đích xấu. Việc ISIS vận hành các chương trình đào tạo AI chuyên dụng trong nhiều năm mà không bị các nhà cung cấp nền tảng phát hiện đã đặt ra những câu hỏi nghiêm túc về tính hiệu quả của các biện pháp an toàn hiện có.
Các chuyên gia bảo mật từ lâu đã cảnh báo rằng các mô hình AI có thể dân chủ hóa việc tiếp cận những kiến thức nguy hiểm. Nghiên cứu của Cambridge cung cấp bằng chứng thực nghiệm thuyết phục nhất cho thấy mối đe dọa này không phải về mặt lý thuyết mà đã hoạt động, khi các tổ chức khủng bố tích cực tích hợp AI vào các hoạt động hàng ngày của chúng.
Những phát hiện này cũng làm phức tạp thêm cuộc tranh luận đang diễn ra về các mô hình AI nguồn mở. Trong khi các mô hình độc quyền như ChatGPT và Claude có các bộ lọc an toàn có thể được cập nhật và cải tiến, các lựa chọn thay thế nguồn mở như DeepSeek – mà nghiên cứu xác nhận ISIS cũng đang sử dụng – không cung cấp khả năng kiểm soát tập trung như vậy. Khi một mô hình mở được phát hành, nhà phát triển ban đầu không thể sửa đổi các đặc tính an toàn của nó.
Khi các chính phủ và các công ty AI đang vật lộn với những thách thức này, nghiên cứu của Cambridge chỉ ra một điều rõ ràng: khoảng cách giữa khả năng an toàn và sự đổi mới của đối thủ ngày càng mở rộng và các tổ chức khủng bố đang tích cực khai thác nó.
Đi trước AI
Để biết thêm thông tin về sự phát triển của ngành, chính sách và an toàn AI, hãy truy cập AI Buzz Wire.
Đọc thêm tin tức về AI →
