Anthropic đã ra mắt OSS Scanner, một dịch vụ chọn tham gia miễn phí sử dụng các mô hình AI mạnh nhất của công ty - bao gồm cả Claude Mythos - để quét định kỳ các dự án nguồn mở đủ điều kiện để tìm lỗ hổng bảo mật và cung cấp báo cáo lỗi đầy đủ do mô hình tạo trực tiếp cho người bảo trì.
Dịch vụ này, được công bố hôm thứ Tư trong một bài đăng trên blog của công ty, là sản phẩm của một sự thay đổi thầm lặng trong công việc bảo mật của Anthropic: các mô hình của nó gần đây đã tìm ra các lỗ hổng nhanh hơn khả năng mà nhóm bảo mật của Anthropic có thể xác minh chúng. Đối với các nhà phát triển đang theo dõi các công cụ định hình lại tính bảo mật của phần mềm, sự ra mắt này là thời điểm quan trọng để chúng tôi đưa tin về sự phát triển AI trong cơ sở hạ tầng nguồn mở.
Từ Dự án Glasswing đến Dịch vụ Công
OSS Scanner được thông báo dựa trên kinh nghiệm của Anthropic khi sử dụng Claude để tìm kiếm các lỗ hổng trong Dự án Glasswing, nỗ lực phát hiện lỗ hổng nội bộ của công ty. Những con số từ công việc đó giải thích tại sao Anthropic lại mở đường cho công chúng.
Trong sáu tháng qua, Anthropic cho biết các mô hình mới nhất của họ đã phát hiện hơn 29.000 lỗ hổng tiềm năng trong một số dự án phần mềm quan trọng nhất thế giới — nhưng công ty chỉ có thể xem xét và phân loại thủ công khoảng 6.000 trong số đó. Năng lực xác nhận của con người, chứ không phải năng lực của mô hình, đã trở thành nút thắt cổ chai.
Phía cầu kể một câu chuyện tương tự. Báo cáo của Anthropic cho thấy những người bảo trì nhận được báo cáo đầu tiên ngày càng yêu cầu mọi thứ công ty có: gần 5.000 báo cáo đã được gửi trực tiếp đến những người bảo trì đã yêu cầu gửi hàng loạt các phát hiện chưa được xác minh, bao gồm cả các bản vá.
Bối cảnh năng lực rất rõ ràng. Trên CyberGym, một tiêu chuẩn tìm kiếm lỗ hổng mang tính học thuật, các mô hình ngôn ngữ lớn đã đi từ việc tìm thấy dưới 20% lỗ hổng vào đầu năm ngoái lên hơn 85% trong năm nay, theo Anthropic – một bước nhảy vọt đã biến các báo cáo lỗi AI từ tiếng ồn thành những phát hiện có thể hành động được.
Các con số được giữ vững như thế nào trong quá trình thử nghiệm
Trước khi ra mắt, Anthropic đã xác thực quy trình với hàng chục dự án nguồn mở, tạo ra hàng trăm báo cáo lỗi — bao gồm cả các lỗ hổng mà công ty cho biết có thể bị xâu chuỗi thành các hoạt động khai thác thực thi mã từ xa không được xác thực.
Bài kiểm tra đáng chú ý nhất liên quan đến sự giám sát bên ngoài. Anthropic đã yêu cầu các chuyên gia kiểm tra thâm nhập xem xét các phát hiện phối hợp tiết lộ lỗ hổng bảo mật (CVD) để kiểm tra 97 phát hiện quan trọng và có mức độ nghiêm trọng cao từ máy quét, được rút ra từ 48 dự án. Trong số đó, 85 - 88 phần trăm - đáp ứng tiêu chuẩn cho quy trình CVD của Anthropic. Trong số 12 vấn đề còn lại, 11 vấn đề là có thật nhưng bị trùng lặp hoặc các phát hiện khác từ cùng một lần quét. Chỉ có một trường hợp là dương tính giả hoàn toàn.
Công ty cho biết mỗi báo cáo đều chứa một bản sao độc lập và phần giải thích về lỗ hổng, bao gồm cả phần chia đôi để xác định thời điểm lỗ hổng được đưa ra.
Sự đánh đổi: Tốc độ hơn là sự chắc chắn
Quyết định thiết kế trung tâm của OSS Scanner cũng là rủi ro lớn nhất của nó: các báo cáo được tạo hoàn toàn bằng mô hình, không có sự xem xét hoặc phân loại của con người. Anthropic nói rõ rằng điều này cho phép quét nhanh hơn, thường xuyên hơn nhưng cũng có một số báo cáo sẽ không chính xác hoặc không hợp lệ.
Công ty coi sự đánh đổi là đáp ứng nhu cầu của người bảo trì. Vì các hoạt động khai thác giờ đây có thể được phát triển trong vài phút nên các dự án ngày càng thích nhận được mọi phát hiện chưa được xác minh ngay lập tức — kèm theo các bản vá được đề xuất — hơn là chờ đợi sự kiểm tra của con người. Lấy cảm hứng từ OSS-Fuzz của Google, phần mềm đã quét phần mềm nguồn mở bằng bộ làm mờ trong nhiều năm, OSS Scanner áp dụng logic tương tự cho việc phân tích mã do AI điều khiển.
Các dự án ưu tiên xử lý theo cách truyền thống cũng không bị loại bỏ: Anthropic cho biết họ sẽ tiếp tục tiết lộ thủ công các báo cáo về lỗ hổng đã được con người xác minh thông qua quy trình CVD hiện có, đặc biệt là đối với các dự án không có nguồn lực để tự phân loại báo cáo. Một bản theo dõi nhanh tùy chọn có sẵn cho những ai muốn tìm kiếm thô ngay khi chúng được tạo.
Ai có thể đăng ký - và những gì khác Anthropic đã công bố
Những người duy trì cốt lõi của các dự án đủ điều kiện có thể đăng ký bằng cách gửi yêu cầu kéo tới kho lưu trữ GitHub theo mẫu dự án tiêu chuẩn. Tính đủ điều kiện phản ánh tiêu chí OSS-Fuzz: các dự án phải có tác động quan trọng đến cơ sở hạ tầng và bảo mật người dùng, với việc tiếp nhận được quyết định theo từng trường hợp.
Máy quét đi kèm với một loạt các sáng kiến an ninh nhân loại rộng hơn. Chương trình Xác minh Mạng của công ty cung cấp các khả năng mạng nâng cao và giảm khả năng phân loại chặn cho các chuyên gia bảo mật đủ điều kiện - một chương trình Anthropic đã mở rộng vào đầu tuần này với ba cấp độ truy cập Claude dành cho các nhóm bảo mật. Một nỗ lực riêng biệt của Claude dành cho OSS cung cấp đăng ký Claude Max 20x miễn phí để giúp các nhà bảo trì khắc phục các lỗ hổng và cải thiện dự án của họ. SiliconANGLE cũng báo cáo một chương trình Anthropic mới tập trung vào việc bảo vệ cơ sở hạ tầng quan trọng, coi các thông báo trong tuần là một động thái phối hợp thúc đẩy an ninh mạng phòng thủ.
Ý nghĩa của bảo mật nguồn mở
Nếu OSS Scanner hoạt động như quảng cáo, nó đánh dấu sự thay đổi cấu trúc trong bảo mật nguồn mở: AI tìm ra lỗi và con người chuyển từ săn lùng sang xác minh. Sự thay đổi đó đặt gánh nặng thực sự lên những người bảo trì, những người phải phân loại các báo cáo do máy tạo ra — một số báo cáo sai — trong khi quyết định xem có nên tin cậy các bản vá tự động hay không.
Tỷ lệ xác thực 88% cho thấy tỷ lệ tín hiệu trên nhiễu hiện đủ tốt để xứng đáng với thời gian của người bảo trì, ít nhất là đối với các dự án cơ sở hạ tầng quan trọng. Liệu hệ sinh thái rộng lớn hơn có đồng ý hay không sẽ hiển thị trong số lượng đăng ký - và trong số lượng dự án đã đăng ký lặng lẽ từ chối sau đợt báo cáo đầu tiên của họ.
---
Đi trước AINhận tin tức, phân tích và đột phá mới nhất về AI — tất cả ở cùng một nơi.
Đọc thêm tin tức về AI →