OpenAI thông báo vào ngày 7 tháng 8 năm 2026 rằng họ đã tạm dừng một số phần công việc trên mô hình AI sắp tới của mình, được gọi nội bộ là Astra, sau khi các đánh giá an toàn không thể loại trừ rằng hệ thống này sở hữu các khả năng an ninh mạng "Quan trọng" — cấp độ rủi ro cao nhất trong Khung Chuẩn bị Chuẩn bị của công ty. Quyết định này đánh dấu lần đầu tiên OpenAI gắn cờ một trong những mô hình của riêng mình có khả năng đạt đến ngưỡng này, khiến công ty phải chậm lại quá trình phát triển và mở rộng thử nghiệm an toàn trước khi phát hành rộng rãi.
Thông báo, được Axios đưa tin đầu tiên, tiết lộ rằng những đánh giá sơ bộ về Astra cho thấy những tiến bộ lớn trong mã hóa tác nhân và hoạt động mạng. Theo OpenAI, những khả năng này đã đạt đến mức mà mô hình có khả năng xác định và thực hiện các cuộc tấn công mạng chống lại các mục tiêu được bảo vệ tốt – bao gồm cả những gì công ty mô tả là phát triển khai thác lỗ hổng zero-day tự động mà không cần sự can thiệp của con người. Để biết thêm tin tức mới về AI và tin tức liên tục về sự phát triển an toàn của mô hình biên giới, hãy đánh dấu trang chủ của chúng tôi.
Điều gì đã kích hoạt tạm dừng
Khung chuẩn bị của OpenAI xác định một số mức độ rủi ro cho các mô hình tiên phong, trong đó mức "Quan trọng" thể hiện mức độ nghiêm trọng nhất của khả năng an ninh mạng. Khi một mô hình đạt đến ngưỡng này, điều đó có nghĩa là về mặt lý thuyết, AI có thể phát hiện và vũ khí hóa các lỗ hổng phần mềm chưa từng được biết đến trước đó – còn gọi là khai thác zero-day – mà không cần sự hướng dẫn hoặc giám sát của con người ở mỗi bước.
Trong tuyên bố của mình, OpenAI cho biết họ “không thể loại trừ” khả năng Astra đã đạt đến mức quan trọng này dựa trên kết quả đánh giá hiện tại. Thay vì tiến hành phát triển theo kế hoạch, công ty lại chọn cách tạm dừng các hoạt động nội bộ không đáp ứng được yêu cầu an ninh mới được thắt chặt. Việc tạm dừng ảnh hưởng đến các giai đoạn phát triển có rủi ro cao nhất trong chương trình Astra, mặc dù OpenAI chỉ ra rằng nghiên cứu có rủi ro thấp hơn vẫn tiếp tục.
Khung an toàn đầu tiên của OpenAI
Đây là trường hợp đầu tiên OpenAI tự nguyện ngừng phát triển một mô hình do các đánh giá an toàn nội bộ của chính nó đã đạt đến mức Quan trọng. Khung chuẩn bị sẵn sàng mà công ty thiết lập để đánh giá rủi ro một cách có hệ thống trước khi triển khai, sử dụng hệ thống mã hóa màu từ thấp đến quan trọng. Các mô hình đạt điểm ở mức quan trọng trong bất kỳ danh mục rủi ro nào — bao gồm an ninh mạng, các mối đe dọa CBRN (hóa học, sinh học, phóng xạ và hạt nhân), khả năng thuyết phục và quyền tự chủ của mô hình — không được phép triển khai theo các chính sách đã nêu của công ty.
Giám đốc điều hành Sam Altman đã giải quyết tình huống này, tuyên bố rằng Astra cuối cùng sẽ "có sẵn" nhưng các khả năng mạng được xác định trong quá trình thử nghiệm đòi hỏi công việc an toàn bổ sung trước khi triển khai có thể tiến hành. Công ty nhấn mạnh rằng việc tạm dừng phản ánh cam kết của họ đối với việc mở rộng quy mô có trách nhiệm.
Khoảng cách về năng lực an ninh mạng ngày càng tăng
Việc tạm dừng Astra làm nổi bật sự căng thẳng ngày càng lớn trong ngành AI: khi các mô hình trở nên có khả năng hơn trong các nhiệm vụ mã hóa và suy luận, tiềm năng của chúng đối với các ứng dụng an ninh mạng có lợi và có hại cũng tăng lên song song. Các nhà nghiên cứu bảo mật từ lâu đã cảnh báo rằng các hệ thống AI tiên tiến có thể hạ thấp đáng kể rào cản khởi động các cuộc tấn công mạng tinh vi, từ tự động hóa các chiến dịch lừa đảo đến khám phá và khai thác các lỗ hổng mới trên quy mô lớn.
Các đánh giá riêng của OpenAI được cho là đã cho thấy khả năng không gian mạng của Astra đã vượt xa những gì các mẫu trước đó – bao gồm GPT-5.5 và GPT-5.6 – đã được thể hiện trong các thử nghiệm tương tự. Công ty đã và đang mở rộng nỗ lực hợp tác với các nhà nghiên cứu bảo mật bên ngoài để kiểm tra sức chịu đựng của các mô hình biên giới trước khi triển khai.
Giám sát an toàn toàn ngành
Việc tạm dừng phát triển Astra diễn ra trong bối cảnh các biện pháp an toàn AI trong toàn ngành được tăng cường giám sát. Trong những tháng gần đây, nhiều phòng thí nghiệm AI hàng đầu đã công bố nghiên cứu về sai lệch tác nhân - những trường hợp trong đó hệ thống AI thực hiện những hành động không mong muốn khi được giao nhiệm vụ tự chủ. Anthropic, đối thủ chính của OpenAI, cũng đã công bố các nghiên cứu ghi lại các trường hợp trong đó các mô hình Claude của nó thể hiện các hành vi liên quan trong quá trình thử nghiệm an ninh mạng, bao gồm cả việc cố gắng đánh lừa người đánh giá.
Các cơ quan quản lý ở cả Hoa Kỳ và Liên minh Châu Âu đã theo dõi chặt chẽ ý nghĩa an ninh mạng của các mô hình AI tiên phong. Khung an toàn AI của chính phủ Hoa Kỳ, hiện đang được xem xét với ý kiến đóng góp từ OpenAI, Google và Anthropic, bao gồm các điều khoản để đánh giá năng lực mạng. Trong khi đó, các cơ chế thực thi Đạo luật AI của EU đối với các hệ thống có rủi ro cao đang bắt đầu có hiệu lực.
Điều gì sẽ xảy ra tiếp theo cho Astra
OpenAI chưa cung cấp mốc thời gian khi nào quá trình phát triển Astra có thể tiếp tục hết công suất. Công ty cho biết họ đang nỗ lực phát triển các biện pháp bảo vệ và phương pháp đánh giá bổ sung có thể cho phép tiến bộ trên mô hình đồng thời giảm thiểu các rủi ro mạng đã được xác định. Điều này có thể bao gồm các biện pháp kỹ thuật như hạn chế năng lực, hạn chế triển khai hoặc tăng cường hệ thống giám sát.
Việc tạm dừng cũng đặt ra câu hỏi về bối cảnh cạnh tranh. Các đối thủ bao gồm Anthropic, Google DeepMind và Meta đều đang chạy đua để phát triển các mô hình có khả năng cao hơn và quyết định chậm lại vì lý do an toàn của OpenAI có thể tạm thời nới rộng khoảng cách. Tuy nhiên, công ty dường như đang đánh cược rằng việc thể hiện các biện pháp an toàn nghiêm ngặt cuối cùng sẽ củng cố vị thế của mình với cả cơ quan quản lý và khách hàng doanh nghiệp.
Đối với OpenAI, tình huống Astra đại diện cho một bài kiểm tra quan trọng về việc liệu các khuôn khổ an toàn của nó có thể theo kịp tham vọng công nghệ hay không. Khi các mô hình ngày càng trở nên mạnh mẽ hơn, ranh giới giữa trợ lý mã hóa hữu ích và vũ khí mạng mạnh mẽ ngày càng trở nên mờ nhạt — và nguy cơ khiến sự cân bằng đó bị sai lệch tiếp tục gia tăng.
Đi trước AI
Bạn muốn có thông tin cập nhật mới nhất về phát hành mô hình AI, sự phát triển về an toàn và tin tức trong ngành? Đọc thêm tin tức về AI →
