OpenAI đã phát hành một mô hình tập trung vào an ninh mạng mới có tên là GPT-5.6-Cyber, mở rộng chương trình đối tác Daybreak với cấu trúc truy cập hai tầng được thiết kế để trao khả năng tấn công AI vào tay các nhóm bảo mật đã được hiệu đính trong khi vẫn giữ công cụ này ngoài tầm với của công chúng.
Thông báo được đưa ra hôm thứ Hai, nhấn mạnh tốc độ AI được đưa vào công việc nghiên cứu lỗ hổng bảo mật hàng ngày và OpenAI đang cố gắng vạch ra ranh giới giữa việc sử dụng phòng thủ và khả năng lạm dụng ở mức độ nào. Động thái này diễn ra chỉ vài ngày sau khi công ty cảnh báo mẫu máy sắp ra mắt, Astra, có khả năng đạt đến ngưỡng rủi ro an ninh mạng “nghiêm trọng”.
Một mô hình được xây dựng để khai thác chuỗi và săn lùng zero-day
GPT-5.6-Cyber được xây dựng trên mô hình lý luận GPT-5.6-Sol của OpenAI nhưng được đào tạo và điều chỉnh cho các nhiệm vụ bảo mật chuyên biệt như tìm kiếm zero-day và tập hợp các chuỗi khai thác. Sự khác biệt chính so với mô hình mục đích chung là tỷ lệ từ chối của nó.
Theo OpenAI, GPT-5.6-Sol có khả năng cao nhưng thường từ chối các lời nhắc thử nghiệm thâm nhập đối với các hệ thống sản xuất và các yêu cầu "sử dụng kép" khác có thể phục vụ mục đích tấn công cũng như phòng thủ. GPT-5.6-Cyber được định cấu hình để giảm tỷ lệ từ chối đối với công việc được ủy quyền.
Thử nghiệm nội bộ được công ty trích dẫn cho thấy tỷ lệ hoàn thành 95% đối với các lời nhắc liên quan đến phát triển chuỗi khai thác, leo thang đặc quyền và bỏ qua xác thực, so với chỉ 1,5% của GPT-5.6-Sol. Thế hệ trước, GPT-5.5-Cyber, chỉ hoàn thành 57,3% số yêu cầu như vậy, một lỗ hổng mà OpenAI cho biết họ đã giải quyết sau phản hồi từ các nhà nghiên cứu bảo mật liên tục bị từ chối.
OpenAI cũng cho biết GPT-5.6-Cyber đã chứng tỏ giá trị thực tế trong việc khám phá. Mô hình này được cho là đã xác định được lỗ hổng nghiêm trọng cao trong công cụ JavaScript V8 được trình duyệt Chrome của Google sử dụng và tìm thấy các lỗi bảo mật bổ sung trong hệ điều hành di động, cơ sở dữ liệu và nhân hệ điều hành chưa được đặt tên.
Bình minh chia thành Đỏ và Xanh
Để ngăn chặn hành vi lạm dụng, GPT-5.6-Cyber sẽ không được cung cấp cho người dùng thông thường. Thay vào đó, OpenAI đang phân phối nó thông qua chương trình Daybreak mở rộng, cho phép các tổ chức xây dựng, đồng bán và phân phối các sản phẩm an ninh mạng bằng cách sử dụng các mô hình của OpenAI.
Giờ đây Daybreak có hai cấp độ truy cập. Daybreak Blue cung cấp quyền truy cập vào Sol và các mô hình biên giới có mục đích chung khác với các lan can được tùy chỉnh cho công việc phòng thủ an ninh mạng. Daybreak Red cung cấp quyền truy cập vào các mẫu có khả năng tấn công như GPT-5.6-Cyber. Việc phân chia này được thiết kế để cho phép các công ty dịch vụ lớn và nhà cung cấp bảo mật nhúng AI vào các sản phẩm phòng thủ mà không nhất thiết phải trao cho mọi nhân viên khả năng khai thác.
Danh sách đối tác của Daybreak giống như một ai đó về công nghệ và bảo mật doanh nghiệp. Nó bao gồm các công ty tư vấn khổng lồ Accenture, Capgemini, EY, IBM, KPMG và PwC, cùng với các chuyên gia an ninh mạng Palo Alto Networks, Sophos, CrowdStrike, Fortinet, Akamai và Cloudflare.
Cảnh báo của Astra và nỗi lo hack tự động
Việc ra mắt diễn ra trong bối cảnh ngày càng có nhiều lo ngại về các hệ thống AI có thể hoạt động tự chủ trong không gian mạng. OpenAI tiết lộ rằng GPT-5.6-Sol đã đạt đến ngưỡng rủi ro "cao", nhưng mô hình Astra sắp ra mắt có thể đạt đến mức "nghiêm trọng", nghĩa là nó có thể tự động xây dựng các hoạt động khai thác zero-day và thiết kế cũng như thực hiện độc lập các cuộc tấn công mạng từ đầu đến cuối chỉ từ một mục tiêu cấp cao.
Những lo ngại đó không hoàn toàn là lý thuyết. Các sự cố gần đây trong đó các mô hình do OpenAI, Anthropic và Meta tạo ra đã tấn công các tổ chức thực trong quá trình thử nghiệm an ninh mạng đã thu hút sự giám sát chặt chẽ từ các nhà lập pháp cũng như các nhà nghiên cứu. Các báo cáo cho thấy hệ thống AI, trong môi trường thử nghiệm biệt lập, đã thực hiện các bước để vượt qua trở ngại theo cách mà người vận hành không lường trước được đã trở thành chủ đề thường xuyên vào năm 2026.
Sự căng thẳng đối với OpenAI rất rõ ràng: các khả năng tương tự khiến GPT-5.6-Cyber trở nên có giá trị đối với người kiểm tra thâm nhập sẽ khiến nó trở nên nguy hiểm nếu bị rò rỉ hoặc sử dụng sai mục đích. Bằng cách kiểm soát quyền truy cập thông qua Daybreak Red và hạn chế phân phối cho các đối tác đã được kiểm duyệt, công ty đang đặt cược rằng việc phát hành có kiểm soát sẽ an toàn hơn so với truy cập mở hoặc không có quyền truy cập nào cả.
Tại sao mô hình mạng chuyên dụng lại quan trọng
An ninh mạng đã trở thành một trong những trường hợp sử dụng rõ ràng nhất của doanh nghiệp đối với các mô hình lý luận lớn. Tìm kiếm các lỗ hổng mới, viết và gỡ lỗi mã khai thác cũng như sàng lọc các cơ sở mã lớn để tìm các lỗi nhỏ là những nhiệm vụ phát huy điểm mạnh của các hệ thống được đào tạo trên lượng lớn tài liệu kỹ thuật. Một mô hình từ chối một nửa thời gian, như GPT-5.5-Cyber được cho là đã làm, sẽ ít có tác dụng đối với nhóm bảo mật đúng thời hạn.
Bằng cách đẩy tỷ lệ hoàn thành lên 95% đối với các nhiệm vụ được ủy quyền, OpenAI đang trực tiếp giải đáp khiếu nại phổ biến nhất từ người dùng chuyên nghiệp: rằng các mô hình biên giới quá thận trọng để trở thành công cụ hiệu quả cho các đội đỏ.
Rủi ro là ranh giới giữa "được ủy quyền" và "lạm dụng" phụ thuộc hoàn toàn vào người vận hành. Đặt cược của OpenAI là việc kiểm tra, giám sát việc sử dụng và quyền truy cập theo cấp độ của đối tác có thể giữ được mục tiêu đó. Việc các cơ quan quản lý và cộng đồng bảo mật rộng lớn hơn có đồng ý hay không có khả năng định hình giai đoạn tiếp theo của cuộc tranh luận về AI và các hoạt động tấn công mạng.
Để biết những phát triển mới nhất về các mô hình AI, công cụ doanh nghiệp và chính sách, hãy theo dõi tin tức nóng hổi về AI của chúng tôi.
