OpenAI đã tạm dừng một số công việc trên mô hình thế hệ tiếp theo của mình, được gọi nội bộ là Astra, sau khi thử nghiệm an toàn nội bộ phát hiện ra những gì công ty mô tả là rủi ro an ninh mạng nghiêm trọng. Quyết định này được Reuters đưa tin lần đầu tiên vào ngày 7 tháng 8 năm 2026 và được Axios, The Guardian và Wall Street Journal xác nhận, đánh dấu một trong những sự chậm trễ quan trọng nhất của mô hình gắn liền cụ thể với ngưỡng năng lực mạng tại một phòng thí nghiệm AI lớn. Để biết thông tin liên tục về sự an toàn của mô hình và ngành công nghiệp AI, hãy theo dõi tin tức mới nhất về AI của chúng tôi.

Biên giới năng lực mạng mới

Công ty tiết lộ việc tạm dừng trong một bài đăng trên blog xuất bản cùng ngày có tiêu đề “Đáp ứng với biên giới tiếp theo của các khả năng mạng quan trọng”. Theo OpenAI, các đánh giá về mô hình Astra đã xác định các khả năng đã vượt qua mức cao nhất trong khuôn khổ chuẩn bị của nó – một hệ thống mà công ty sử dụng để phân loại rủi ro trên các lĩnh vực như an ninh mạng, thuyết phục và quyền tự chủ.

OpenAI đã không công bố chi tiết kỹ thuật đầy đủ về các khả năng mạng cụ thể có liên quan, một thông lệ phổ biến khi tiết lộ các rủi ro mô hình nhạy cảm. Tuy nhiên, công ty mô tả những phát hiện này là đủ quan trọng để đảm bảo làm chậm tiến độ phát triển của mô hình và thực hiện các biện pháp bảo vệ bổ sung trước khi có bất kỳ bản phát hành tiềm năng nào. Reuters đưa tin rằng OpenAI “đã đánh dấu một rủi ro an ninh mạng nghiêm trọng có thể xảy ra trong mô hình sắp tới” và chuyển sang “thắt chặt kiểm soát”.

Khung chuẩn bị có ý nghĩa gì

Khung chuẩn bị của OpenAI được thiết kế để đánh giá các mô hình biên giới dựa trên các ngưỡng rủi ro đã xác định trước khi chúng đến tay công chúng. Hệ thống sử dụng thang điểm và các mô hình đạt đến hoặc vượt quá mức "quan trọng" trong một miền nhất định sẽ kích hoạt các đánh giá bắt buộc, bổ sung nhóm đỏ và — như trong trường hợp của Astra — khả năng chậm triển khai.

Khung này được thành lập vào năm 2023 và đã được cập nhật định kỳ. Theo cấu trúc hiện tại, các mô hình phải có các đánh giá an toàn rõ ràng để mô phỏng các tình huống sử dụng sai có thể xảy ra. Cụ thể đối với an ninh mạng, các đánh giá sẽ đánh giá liệu một mô hình có thể hỗ trợ một cách có ý nghĩa cho các hoạt động tấn công như phát hiện lỗ hổng, viết mã khai thác hay thực hiện các chiến dịch lừa đảo quy mô lớn hay không.

Thực tế là Astra đã kích hoạt các tín hiệu ngưỡng quan trọng mà các mô hình tiên phong hiện đang đạt đến mức khả năng trong đó khoảng cách giữa các ứng dụng có lợi và có hại đang thu hẹp trong phạm vi mạng — một thách thức mà toàn bộ ngành đang phải đối mặt.

Điều này so sánh với sự chậm trễ trong quá khứ như thế nào

Sự chậm trễ của mô hình do lo ngại về an toàn không phải là chưa từng có tại OpenAI, nhưng chúng thường tập trung vào các rủi ro như tạo ra nội dung không được phép hoặc tạo ra kết quả đầu ra lừa đảo. Sự tạm dừng của Astra là đáng chú ý vì nó đặc biệt gắn liền với khả năng mạng đạt đến mức mà chính công ty xếp vào loại quan trọng.

TechCrunch, đã xác nhận câu chuyện, lưu ý rằng OpenAI "đã làm chậm quá trình phát triển mô hình Astra vì những lo ngại về bảo mật", coi quyết định này là một phần trong cách tiếp cận đang phát triển của công ty đối với việc mở rộng quy mô có trách nhiệm. The Guardian đưa tin rằng OpenAI đã quyết định "tạm dừng một số công việc" trên mô hình thay vì hủy bỏ hoàn toàn, cho thấy công ty có ý định tiếp tục phát triển với các biện pháp bảo vệ nâng cao được áp dụng.

Đài truyền hình công cộng NHK của Nhật Bản cũng đưa tin về sự phát triển này, phản ánh tầm quan trọng toàn cầu của câu chuyện đối với cơ sở người dùng quốc tế của OpenAI và sự giám sát ngày càng tăng về an toàn của mô hình biên giới trên khắp các khu vực pháp lý.

Ý nghĩa toàn ngành

Sự chậm trễ của Astra xảy ra trong bối cảnh cuộc tranh luận ngày càng gay gắt về cách các công ty AI nên đánh giá và tiết lộ rủi ro mô hình. Các cơ quan quản lý ở Hoa Kỳ, Liên minh Châu Âu và Vương quốc Anh đều thúc đẩy sự minh bạch hơn về khả năng của mô hình biên giới và một số chính phủ đã thành lập các viện an toàn AI đặc biệt để thử nghiệm các mô hình tiên tiến về rủi ro mạng, sinh học và các rủi ro khác.

Quyết định của OpenAI tiết lộ công khai phát hiện về khả năng quan trọng - thay vì âm thầm giải quyết nội bộ - phù hợp với xu hướng rộng hơn của ngành hướng tới sự minh bạch tự nguyện. Các công ty bao gồm Anthropic và Google DeepMind đã công bố các cam kết về sự chuẩn bị và mở rộng quy mô có trách nhiệm tương tự, mặc dù chi tiết cụ thể về phương pháp đánh giá của họ khác nhau.

Đối với cộng đồng an ninh mạng, tập phim nhấn mạnh mối lo ngại ngày càng tăng: khi các mô hình trở nên có năng lực hơn, các biện pháp phòng thủ và khung đánh giá cần thiết để theo kịp cũng phải được nâng cao. Một mô hình có thể xác định các lỗ hổng zero-day hoặc tự động hóa các phần của chuỗi tấn công vừa là cơ hội cho các nhóm bảo mật phòng thủ vừa là rủi ro rơi vào tay kẻ xấu.

Điều gì sẽ xảy ra tiếp theo cho Astra

OpenAI chưa công bố mốc thời gian sửa đổi cho việc phát hành Astra. Công ty chỉ ra rằng quá trình phát triển sẽ tiếp tục với các biện pháp bảo vệ bổ sung, cho thấy mô hình cuối cùng có thể ra mắt sau khi các rủi ro đã xác định được giảm thiểu thỏa đáng.

Các nhà phân tích trong ngành sẽ theo dõi chặt chẽ để xem liệu sự chậm trễ này có ngắn hạn hay không - chỉ mất vài tuần hoặc vài tháng để bổ sung đội đỏ - hay cho thấy một thách thức cơ bản hơn trong việc đưa các mô hình có khả năng mạng cấp độ quan trọng ra thị trường một cách an toàn.

Tập phim cũng đặt ra những câu hỏi mang tính cạnh tranh. OpenAI phải đối mặt với áp lực từ các đối thủ bao gồm Anthropic, Google, Meta và các phòng thí nghiệm mới nổi của Trung Quốc, tất cả đều đang chạy đua để phát hành các mô hình có khả năng hơn. Sự chậm trễ vì lý do an toàn, mặc dù có trách nhiệm, có thể nhường chỗ cho một thị trường chuyển động nhanh - một sự căng thẳng nằm ở trung tâm của cuộc đua mô hình biên giới.

Đi trước AI

Sự giao thoa giữa khả năng AI và bảo mật đang trở thành một trong những câu chuyện mang tính quyết định của ngành. Để có báo cáo rõ ràng, có nguồn gốc về độ an toàn của mô hình, các bước phát triển tiên phong và các công ty đang định hình lĩnh vực này, hãy đánh dấu trang chủ của chúng tôi và đọc thêm tin tức về AI → tại https://aibuzzwire.news.