Sáng kiến Project Glasswing của Anthropic đã xác minh ít nhất 129.000 lỗ hổng phần mềm từ tháng 4 đến tháng 7 năm 2026, với hơn 33.000 lỗ hổng trong số đó được xếp hạng nghiêm trọng hoặc mức độ nghiêm trọng cao, công ty tiết lộ hôm thứ Ba cùng với việc mở rộng các chương trình truy cập bảo mật của mình. Nhưng phân tích độc lập về các phát hiện này đã đưa ra một câu chuyện đáng ngạc nhiên: hầu như không có lỗ hổng nào do AI phát hiện xuất hiện trong các cuộc tấn công trong thế giới thực.
Quy mô khám phá dựa trên AI For more context on this story, see our ongoing more AI stories.
Tổng số lỗ hổng đến từ tính toán riêng của Anthropic về Dự án Glasswing, sáng kiến được đưa ra vào tháng 4 nhằm áp dụng các mô hình Claude biên giới của mình vào việc tăng cường phần mềm quan trọng. Ngoài 129.000 lỗ hổng đã được xác minh được tìm thấy bởi các đối tác của Glasswing, công ty cho biết nỗ lực quét mã nguồn mở đã phát hiện thêm 5.500 lỗ hổng đã được xác minh trong khoảng thời gian từ tháng 4 đến tháng 10 năm 2026.
Anthropic cảnh báo rằng các số liệu về mức độ nghiêm trọng có thể là một con số thấp đáng kể. Hơn 33.000 xếp hạng quan trọng và mức độ nghiêm trọng cao chỉ dựa trên dữ liệu khảo sát từ một nhóm nhỏ các đối tác của Glasswing và công ty ước tính tác động thực sự có thể cao hơn ít nhất 5 lần.
Đối với bối cảnh, Cơ sở dữ liệu về lỗ hổng bảo mật quốc gia của Hoa Kỳ trong những năm gần đây đã ghi lại khoảng 28.000 đến 40.000 CVE mới hàng năm trên toàn bộ hệ sinh thái phần mềm toàn cầu. Một chương trình do AI điều khiển duy nhất xử lý hơn 129.000 vấn đề đã được xác minh trong khoảng ba tháng cho thấy các mô hình như Claude Opus 5.5 và Claude Mythos 5.1 đang thay đổi tính kinh tế của nghiên cứu bảo mật một cách đáng kể như thế nào.
Khoảng trống khai thác
Phát hiện khiêu khích hơn đến từ bên ngoài Anthropic. Trong một phân tích được công bố vào cuối tháng 9, nhà nghiên cứu Patrick Garrity của VulnCheck đã kiểm tra 300 lỗ hổng được cho là của Anthropic hoặc Project Glasswing và phát hiện ra rằng chỉ có 2 – khoảng 0,67% – bị khai thác ngoài tự nhiên.
Sự phân bổ mức độ nghiêm trọng của 300 lỗ hổng đó được chia thành 39 lỗ hổng nghiêm trọng, 141 lỗ hổng cao, 81 lỗ hổng trung bình và 18 lỗ hổng thấp. Tuy nhiên, hai thứ thu hút sự bóc lột tích cực đều là những tác phẩm kinh điển không mấy hấp dẫn:
- CVE-2026-26980, một lỗ hổng SQL trong Ghost CMS, nền tảng xuất bản nguồn mở phổ biến.
- CVE-2026-61500, lỗ hổng giả mạo phiên trong Rejetto HTTP File Server, một công cụ chia sẻ tệp được triển khai rộng rãi.
Cả hai đều là loại lỗ hổng ứng dụng web dài hạn mà các máy quét hàng loạt và những kẻ tấn công cơ hội đã săn lùng trong nhiều thập kỷ. Không yêu cầu khả năng vũ khí hóa của mô hình biên giới - đó chính xác là điểm mà dữ liệu đưa ra. AI đang phát hiện ra vô số lỗ hổng mà những kẻ tấn công không bao giờ bận tâm tìm kiếm và những lỗ hổng bị khai thác trong thực tế vẫn bị chi phối bởi các kiểu tấn công lỗi thời chống lại phần mềm tiếp xúc với internet.
Tại sao khoảng cách lại quan trọng
Khoảng cách khai thác cắt giảm cả hai chiều cho người phòng thủ. Một mặt, nó cho thấy khả năng khám phá do AI điều khiển đang đi trước sự áp dụng của kẻ tấn công: những người bảo vệ vá các sự cố do AI tìm thấy đang sửa các lỗ hổng có thể đã ẩn giấu chưa được phát hiện trong nhiều năm. Mặt khác, nó cảnh báo rằng nút thắt về bảo mật đang thay đổi. Khi việc khám phá trở nên gần như miễn phí, việc phân loại, phân phối bản vá và xác minh trở thành những nguồn tài nguyên khan hiếm.
“Không phải mọi lỗ hổng bảo mật mà AI phát hiện đều nhất thiết phải bị các tác nhân đe dọa khai thác hoặc có khả năng gây ra tác động đáng kể”, như The Hacker News đã tóm tắt các phát hiện của VulnCheck trong bài tiết lộ hôm thứ Ba.
Ngoài ra còn có một lá cờ cảnh báo được gắn vào phía khắc phục của phương trình. Nghiên cứu từ 1Password và Veracode đã chứng minh rằng các bản vá lỗ hổng do AI tạo ra có thể tự tạo ra các lỗ hổng mới, nghĩa là ngành không thể chỉ đơn giản trỏ các mô hình vào hàng đợi CVE và coi vấn đề đã được giải quyết. Xác minh của con người vẫn cần thiết ở mọi bước.
Tiếp nhận hệ sinh thái
Glasswing đã thu hút được sự chú ý vượt xa cơ sở khách hàng của Anthropic. Cloudflare, một trong những đối tác của chương trình, đã xuất bản tài khoản riêng của mình về hoạt động với sáng kiến này vào tháng 5, mô tả những gì các mô hình xuất hiện trên cơ sở hạ tầng mà nó vận hành. Các nhà bình luận bảo mật bao gồm nhà mật mã học Bruce Schneier đã theo dõi các bản cập nhật của chương trình và thông báo ban đầu đã thu hút một trong những cuộc thảo luận lớn nhất của Hacker News trong mùa xuân.
Bản thân con số bị bóc lột 0,67% là đáng chú ý trong nền kinh tế dễ bị tổn thương. Các phân tích lịch sử về hoạt động khai thác CVE cho thấy rằng chỉ một phần nhỏ các lỗ hổng được tiết lộ từng bị lợi dụng trong các cuộc tấn công được quan sát — nhưng khối lượng khổng lồ mà Glasswing đang bổ sung có nghĩa là ngay cả một phần nhỏ bị khai thác cũng có thể đại diện cho các sự cố thực sự và mỗi lỗ hổng chưa được vá trong phần mềm truy cập internet là một tấm vé số cho những kẻ tấn công cơ hội.
Từ chương trình nghiên cứu đến thực tế hoạt động
Dự án Glasswing bắt đầu vào tháng 4 năm 2026 với mục tiêu bảo mật phần mềm quan trọng cho kỷ nguyên AI và các bản cập nhật ban đầu của nó đã báo cáo sự tiến bộ nhanh chóng trong việc tìm ra các vấn đề về an toàn bộ nhớ và lỗi ứng dụng web. Chương trình hiện nằm ở trung tâm của chiến lược bảo mật rộng hơn của Anthropic, cùng với Chương trình xác minh mạng mới được cơ cấu lại, cung cấp cho các nhóm bảo mật đã được hiệu đính quyền truy cập theo cấp độ vào các mô hình với mức độ bảo vệ được giảm bớt.
Tiết lộ của Anthropic rằng tác động do đối tác báo cáo "có thể bị tính thiếu" cũng gợi ý về độ trễ báo cáo vốn có trong việc phối hợp tiết lộ lỗ hổng. Nhiều trong số 129.000 phát hiện có lẽ vẫn đang trải qua các chu kỳ vá lỗi của nhà cung cấp - một quá trình thường mất hàng tháng và ở quy mô mà Glasswing đang sản xuất, có thể gây căng thẳng cho chính cơ sở hạ tầng tiết lộ.
Đối với các nhóm bảo mật đang quyết định dành nỗ lực vá lỗi khan hiếm vào đâu, việc khai thác vẫn tập trung vào một số lượng nhỏ các lớp lỗi dễ dàng được vũ khí hóa trên Internet - trong đó có các lỗi chèn SQL và xử lý phiên - trong khi hàng loạt vấn đề do AI tìm thấy đang chờ đợi.
Đối với các nhà bảo trì phần mềm, thông điệp rất thẳng thắn: thời đại mà những sai sót khó hiểu có thể vẫn được che giấu một cách an toàn đang kết thúc. Đối với các nhóm bảo mật quyết định nơi dành nỗ lực vá lỗi khan hiếm, dữ liệu VulnCheck cung cấp một hướng dẫn phản trực giác — tồn đọng lỗ hổng do AI tìm thấy là rất lớn, nhưng việc khai thác vẫn tập trung vào một số lượng nhỏ các lớp lỗi dễ dàng được trang bị vũ khí trên Internet.
Những con số trong sáu tháng đầu tiên của Glasswing cho thấy một điều rõ ràng: AI không chỉ tham gia cuộc đua phát hiện lỗ hổng mà còn phá vỡ quy mô mà cuộc đua được đo lường. Điều vẫn còn phải xem là liệu việc vá lỗi, tiết lộ và khai thác có thể theo kịp sự phát hiện hay không - hay liệu danh sách việc cần làm của ngành này có tăng nhanh hơn mức bất kỳ ai có thể làm được hay không.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →