OpenAI đã làm chậm việc phát hành mô hình Astra sắp tới của mình sau khi mô hình này thể hiện khả năng an ninh mạng đủ mạnh để gây ra sự tạm dừng nội bộ, công ty xác nhận vào ngày 7 tháng 8 năm 2026. Astra được cho là đã tiếp cận ngưỡng mà OpenAI phân loại là ngưỡng rủi ro mạng "nghiêm trọng", khiến nó trở thành mô hình đầu tiên đạt gần mức này trong khuôn khổ an toàn của công ty.
Để biết tin tức mới nhất về an toàn AI và thông tin chính sách, hãy truy cập AI Buzz Wire.
Chuyện gì đã xảy ra
Axios lần đầu tiên báo cáo sự phát triển này vào ngày 7 tháng 8, mô tả đây là một tiết lộ độc quyền rằng OpenAI đang làm chậm quá trình phát hành của Astra do khả năng mạng. The Verge mô tả tình huống này là OpenAI đã dừng phát triển một mô hình mới vì nó được cho là quá mạnh trong một số lĩnh vực liên quan đến bảo mật.
Bloomberg báo cáo rằng OpenAI đã tạm dừng một số công việc trên mô hình Astra, đặc biệt là do lo ngại về mạng. The Guardian xác nhận rằng việc tạm dừng liên quan đến những cân nhắc về bảo mật xung quanh khả năng của mô hình.
Phản hồi của OpenAI
OpenAI đã xuất bản một bài đăng trên blog có tiêu đề “Đáp ứng với giới hạn tiếp theo của các khả năng mạng quan trọng” vào ngày 7 tháng 8, nêu rõ cách tiếp cận của họ để quản lý các mô hình đạt đến ngưỡng nguy hiểm trong lĩnh vực an ninh mạng.
Forbes đưa tin vào ngày 9 tháng 8 rằng OpenAI đã tạm dừng Astra sau khi mô hình này tiến gần đến mức rủi ro mạng "nghiêm trọng" đầu tiên trong khuôn khổ chuẩn bị của công ty. Điều này đánh dấu một thời điểm quan trọng trong quản lý an toàn AI, vì chưa có mô hình nào trước đó đạt được phân loại này.
CNBC đưa tin vào ngày 10 tháng 8 rằng OpenAI đã thắt chặt các biện pháp kiểm soát đối với mô hình mới khi cuộc tranh luận về bảo mật AI trên diện rộng ngày càng gay gắt. Mạng lưu ý rằng quyết định này được đưa ra trong bối cảnh các vụ hack mô hình AI đang bùng phát và sự giám sát ngày càng tăng về cách các mô hình biên giới xử lý các nhiệm vụ an ninh mạng.
Ngưỡng khả năng quan trọng
Khung chuẩn bị của OpenAI phân loại rủi ro mô hình trên một số lĩnh vực, bao gồm cả an ninh mạng và chỉ định các mức rủi ro từ thấp đến nghiêm trọng. Cấp độ quan trọng thể hiện các khả năng có thể hỗ trợ một cách có ý nghĩa trong các cuộc tấn công mạng tinh vi, chẳng hạn như phát hiện các lỗ hổng mới, viết mã khai thác hoặc tự động hóa các hoạt động tấn công trên quy mô lớn.
Theo Help Net Security, OpenAI đã khóa Astra vì các khả năng mạng quan trọng tiềm ẩn. Khuôn khổ của công ty yêu cầu các biện pháp an toàn bổ sung, đánh giá và khả năng xem xét từ bên ngoài trước khi có thể đưa ra mô hình ở mức rủi ro này.
Việc Astra tiến gần đến ngưỡng này phản ánh sự tiến bộ nhanh chóng của các mô hình biên giới. Khi các mô hình trở nên có khả năng mã hóa, lý luận và phân tích hệ thống cao hơn, tiện ích tiềm năng của chúng trong cả an ninh mạng phòng thủ và tấn công sẽ tăng lên tương ứng.
Tại sao điều này lại quan trọng
Việc tạm dừng Astra là một trường hợp thử nghiệm quan trọng đối với các cam kết tự nguyện về an toàn AI. Quyết định của OpenAI về việc làm chậm quá trình phát hành mô hình hàng đầu dựa trên các đánh giá an toàn nội bộ chứng tỏ rằng ngưỡng năng lực biên giới không chỉ đơn thuần là cấu trúc lý thuyết. Chúng đang được kích hoạt bởi các mô hình thực tế.
Sự phát triển này diễn ra vào thời điểm mối lo ngại ngày càng tăng về các mối đe dọa mạng do AI hỗ trợ. Hacker News lưu ý rằng mô hình tiếp theo của OpenAI cho thấy hiệu suất mạng đủ mạnh để gây ra sự tạm dừng. Cộng đồng an ninh mạng đang theo dõi chặt chẽ xem liệu các mô hình AI biên giới có thể được sử dụng để tự động phát hiện lỗ hổng hoặc tạo mã khai thác trên quy mô lớn hay không.
Gizmodo đưa ra một khuôn khổ hoài nghi hơn, cho thấy rằng những mô hình mạnh nhất không phải là những mô hình duy nhất có khả năng gây ra các sự cố an ninh mạng lớn, đồng thời chỉ ra rằng các mô hình kém hơn đã có liên quan đến các cuộc tấn công trong thế giới thực.
Bối cảnh chính sách rộng hơn
Việc tạm dừng Astra diễn ra trong bối cảnh bối cảnh pháp lý ngày càng gia tăng. Đạo luật AI của Liên minh Châu Âu bao gồm các điều khoản dành cho các hệ thống AI có rủi ro cao và Hoa Kỳ đang phát triển khuôn khổ riêng để quản lý các khả năng AI tiên phong. Các nhà quan sát trong ngành lưu ý rằng việc tạm dừng an toàn tự nguyện của các công ty như OpenAI có thể cung cấp thông tin cho các phương pháp tiếp cận quy định trong tương lai.
Quyết định này cũng đặt ra câu hỏi cạnh tranh. Nếu OpenAI làm chậm nhịp độ phát hành do lo ngại về an toàn trong khi các đối thủ cạnh tranh di chuyển nhanh hơn, thì động lực thị trường có thể thay đổi. Tuy nhiên, OpenAI dường như đang đánh cược rằng việc triển khai có trách nhiệm sẽ tạo dựng được niềm tin lâu dài với khách hàng doanh nghiệp và cơ quan quản lý.
Điều gì xảy ra tiếp theo
OpenAI chưa công bố mốc thời gian sửa đổi cho việc phát hành Astra. Bài đăng trên blog của công ty cho thấy họ đang phát triển các phương pháp đánh giá và giao thức an toàn mới được thiết kế đặc biệt cho các mô hình tiếp cận các cấp độ năng lực mạng quan trọng.
Việc tạm dừng cũng làm nổi bật sự căng thẳng ngày càng tăng trong ngành AI. Khi các mô hình trở nên có năng lực hơn, ranh giới giữa các công cụ an ninh mạng hữu ích và khả năng tấn công nguy hiểm ngày càng trở nên khó xác định. Cách các công ty điều hướng đường này có thể xác định không chỉ lộ trình sản phẩm của riêng họ mà còn cả hình thức quản trị AI trong nhiều năm tới.
Đi trước AI
Để biết thông tin chi tiết về chính sách AI, sự an toàn và sự phát triển của mô hình biên giới, hãy theo dõi AI Buzz Wire.
Đọc thêm tin tức về AI