OpenAI đang nói chuyện với nhiều nhà đánh giá độc lập để giúp tăng số lượng công ty có chuyên môn về an toàn AI tiên tiến và có thể cung cấp các đánh giá hiệu quả của bên thứ ba, công ty cho biết trong một bài đăng trên blog xuất bản hôm thứ Ba, ngày 22 tháng 9, theo báo cáo của PYMNTS.

Bài đăng đưa ra các ưu tiên và nguyên tắc được đề xuất của OpenAI để giám sát hiệu quả của bên thứ ba - một khuôn khổ mà OpenAI cho rằng nên áp dụng cho tất cả các phòng thí nghiệm AI hàng đầu khi họ đào tạo, đánh giá và triển khai các mô hình ngày càng có năng lực. Thông báo này được đưa ra vào giữa một tháng bị tính phí bất thường đối với chính sách an toàn AI và nó được coi là sự nhượng bộ đối với các nhà phê bình vừa là nỗ lực định hình các quy tắc trước khi chính phủ viết ra chúng. Đối với những ai theo dõi tin nóng về AI, đây là động thái mới nhất trong cuộc thi kéo dài hàng tuần giữa các phòng thí nghiệm, các nhà phê bình và cơ quan quản lý về việc ai sẽ xác minh rằng các mô hình tiên phong là an toàn.

OpenAI đang đề xuất điều gì

Theo PYMNTS, OpenAI cho biết trong bài đăng: “Chúng tôi cam kết hỗ trợ các đánh giá viên độc lập và thiết lập các tiêu chuẩn quốc tế chung, rõ ràng hơn – cả thông qua luật pháp trong tương lai và các sáng kiến quản trị tư nhân – để đánh giá hiệu quả của bên thứ ba”.

Vấn đề cốt lõi mà OpenAI mô tả là một thất bại của thị trường: đơn giản là có quá ít tổ chức có chiều sâu kỹ thuật để kiểm tra mô hình biên giới. Đánh giá an toàn có ý nghĩa đòi hỏi quyền truy cập vào các hệ thống chưa được phát hành, chuyên môn trong các lĩnh vực từ an ninh mạng đến an toàn sinh học và sự độc lập về thể chế để công bố những phát hiện không mong muốn. Bằng cách tuyển dụng và hỗ trợ nhiều người đánh giá thay vì một người đánh giá đặc quyền duy nhất, OpenAI cho biết họ muốn xây dựng một hệ sinh thái trong đó việc đánh giá của bên thứ ba là một phần thường xuyên trong việc triển khai các hệ thống biên giới - không phải là hoạt động quan hệ công chúng chỉ diễn ra một lần.

Công ty không nêu tên những người đánh giá mà họ đang nói chuyện và vẫn còn phải xem liệu các thỏa thuận sau đó có mang lại cho người đánh giá quyền truy cập, tài trợ độc lập và quyền xuất bản mà các nhà nghiên cứu an toàn cho là có ý nghĩa hay không.

Một tuần quan trọng về chính sách AI

Đề xuất được đưa ra trong bối cảnh một chuỗi phát triển chính sách nhanh chóng đã xác định cuộc tranh luận về AI vào tháng 9:

  • Thứ Hai, ngày 21 tháng 9: OpenAI kêu gọi Hoa Kỳ dẫn đầu nỗ lực quốc tế nhằm phát triển các tiêu chuẩn kỹ thuật toàn cầu cho AI tiên phong - bao gồm cả khả năng tự cải thiện đệ quy, thời điểm mà các hệ thống AI tự cải thiện. Công ty cảnh báo rằng việc phát triển AI hoàn toàn tự động có thể vượt xa khả năng hiểu và kiểm soát nó của con người, đồng thời cho biết các quyết định về việc có nên tiến hành hay không và tiến hành như thế nào cần phải được đưa ra ngay bây giờ.
  • Thứ Sáu, ngày 18 tháng 9: Thống đốc California Gavin Newsom đã ký lệnh hành pháp triệu tập các chuyên gia quốc gia để củng cố luật an toàn AI của bang, nhằm mục đích đẩy nhanh việc thực hiện giám sát mới của bên thứ ba về các rủi ro an toàn và bảo mật trong hệ thống AI.
  • Thứ Bảy, ngày 19 tháng 9: Tổng thống Donald Trump bác bỏ những lo ngại về an toàn của ngành trong một bài đăng trên Truth Social, viết: "Chúng tôi sẽ không cản trở hay kìm hãm sự phát triển của ngành công nghiệp đáng kinh ngạc này bằng bất kỳ cách nào. AI là Cuộc cách mạng công nghiệp tiếp theo hoặc Internet, nhưng sẽ thậm chí còn lớn hơn và có tác động nhiều hơn, có thể lên tới 25% GDP của đất nước chúng ta."

Như chúng tôi đã báo cáo vào đầu tuần này, đề xuất tiêu chuẩn do OpenAI dẫn đầu tại Hoa Kỳ đã đánh dấu một sự thay đổi đáng chú ý đối với một công ty đã dành nhiều năm chống lại sự giám sát ràng buộc - và các nguyên tắc đánh giá mới của bên thứ ba mở rộng quan điểm đó sang mặt trận quản trị tư nhân.

Vấn đề độc lập

Việc OpenAI tiếp nhận các cơ quan giám sát bên ngoài tuân theo đề xuất song song từ đối thủ chính của nó. Khoảng một tuần trước đó, Giám đốc điều hành Anthropic Dario Amodei đã xuất bản một bài luận đề xuất một kế hoạch an toàn AI được xây dựng dựa trên các nhà đánh giá độc lập được nhúng trong các công ty AI hàng đầu, sự phối hợp giữa các công ty ở các nước dân chủ và cuối cùng là một thỏa thuận quốc tế bao gồm cả Trung Quốc.

Cả hai đề xuất đều ngay lập tức thu hút sự hoài nghi từ các chuyên gia. CNBC đưa tin rằng một liên minh gồm hơn 100 chuyên gia AI đang thúc giục sự độc lập và minh bạch từ Anthropic, OpenAI và các phòng thí nghiệm mô hình nền tảng khác tiến hành đánh giá, đồng thời cảnh báo rằng những người đánh giá thuộc — hoặc được trả tiền bởi — các công ty mà họ kiểm toán sẽ phải đối mặt với những xung đột lợi ích không thể tránh khỏi. Các cơ quan giám sát được hỗ trợ bởi nhà tiên phong về AI Geoffrey Hinton đã thúc ép cả hai công ty về các chi tiết trong kế hoạch an toàn của họ và các nhà bình luận đã đánh dấu cánh cửa quay vòng giữa các tổ chức đánh giá an toàn AI và chính các phòng thí nghiệm: những người chấm điểm bài tập về nhà về an toàn cũng có thể là những người đã viết nó.

Sự căng thẳng đó là mấu chốt của cuộc tranh luận mà bài đăng mới của OpenAI cố gắng xoa dịu. Câu trả lời của công ty — nhiều người đánh giá hơn, các tiêu chuẩn quốc tế được chia sẻ và sự giám sát được thực thi thông qua cả luật pháp trong tương lai và các sáng kiến ​​tư nhân — là một khuôn khổ, chưa phải là một sự đảm bảo. Các nhà phê bình sẽ chỉ ra rằng các phòng thí nghiệm đề xuất các quy tắc đều là những phòng thí nghiệm tuân theo chúng và việc quản trị tự định hình về mặt lịch sử đã ưu ái các công ty thực hiện việc định hình.

Tại sao nó lại quan trọng

Các mô hình biên giới tiếp theo đang được đào tạo và cơ hội thiết kế giám sát trước khi triển khai đang đóng lại. Nếu việc tuyển dụng các chuyên gia đánh giá độc lập của OpenAI tạo ra các kiểm toán viên có quyền truy cập thực sự và tính độc lập thực sự, thì nó có thể trở thành khuôn mẫu cho cách AI biên giới được quản lý trên toàn thế giới – một chế độ riêng tư mà các nhà lập pháp ở Washington, Brussels và các nơi khác cho đến nay vẫn chưa tự xây dựng được. Nếu nó tạo ra các hoạt động tư vấn liên kết với NDA, nó sẽ xác nhận nhận định tồi tệ nhất của những người hoài nghi.

Dù bằng cách nào, việc OpenAI đang cạnh tranh với Anthropic để xem ai có thể đề xuất chế độ giám sát đáng tin cậy nhất là điều mới mẻ. Một năm trước, các phòng thí nghiệm đã thống nhất chủ yếu là phản đối quy định. Bây giờ họ đang chạy đua để xác định nó.

---

Đi trước AI

Nhận tin tức, phân tích và đột phá mới nhất về AI — tất cả ở cùng một nơi.

Đọc thêm tin tức về AI →