David Robinson, nhà nghiên cứu an toàn, người đứng đầu viết các báo cáo an toàn đi kèm với việc phát hành sản phẩm của OpenAI, đã rời công ty, xuất bản một bài luận khởi hành có tựa đề “Tôi rời OpenAI vì văn hóa của nó đã bị phá vỡ”.

Viết trên tờ The Atlantic, Robinson cho biết các công ty AI xây dựng hệ thống biên giới “gần như không đủ cẩn thận” và lập luận rằng vấn đề còn sâu xa hơn bất kỳ quy tắc hoặc điều luật cụ thể nào. Ông viết: “Tôi đồng ý với những nhân viên mới rời đi khác rằng các công ty xây dựng công nghệ này gần như không đủ cẩn thận”. "Nhưng tôi tin rằng chúng ta cần nhìn sâu hơn những quy định cụ thể hoặc luật mới. Chúng ta cần nói về văn hóa." Để biết thêm về câu chuyện này và những câu chuyện khác tương tự, hãy xem tin tức AI mới nhất của chúng tôi.

Vụ án anh ta gây ra

Lập luận cốt lõi của Robinson là về tốc độ. Ông viết: “Khi công ty chạy nước rút từ lần ra mắt này sang lần ra mắt tiếp theo, họ không đạt được mức độ chăm sóc mà tôi tin là cần thiết,” ông viết, đồng thời mô tả một nền văn hóa phát triển trong đó nhịp độ vận chuyển lấn át sự cân nhắc. Theo quan điểm của ông, việc cải tổ văn hóa tại các công ty AI tiên tiến quan trọng hơn việc sửa đổi chính sách gia tăng.

The Guardian, tờ báo đầu tiên đưa tin về việc từ chức, lưu ý rằng Robinson đã dẫn đầu việc viết các trường hợp an toàn được xuất bản cùng với các bản phát hành của OpenAI - có nghĩa là ông là một trong những người chính thức đánh giá liệu các hệ thống mới có an toàn khi vận chuyển hay không.

Tại sao Báo cáo An toàn lại quan trọng

Hộp an toàn và thẻ hệ thống đã trở thành cơ chế trách nhiệm công khai chính của ngành: các tài liệu có cấu trúc trong đó phòng thí nghiệm giải thích những gì một mô hình mới có thể làm, những rủi ro mà thử nghiệm đã phát hiện và lý do công ty đánh giá nó an toàn để đưa ra thị trường. Khi người lãnh đạo công việc đó tại phòng thí nghiệm biên giới kết luận rằng nền văn hóa xung quanh đã bị phá vỡ, lời chỉ trích có trọng lượng khác với lời phê bình từ bên ngoài - nó liên quan đến tính liêm chính của chính các cơ quan quản lý tài liệu và công chúng dựa vào.

Lập luận của Robinson cũng định hình lại một cuộc tranh luận cho đến nay vẫn tập trung vào các quy tắc. Các đề xuất pháp lý - từ đánh giá năng lực bắt buộc đến bảo vệ người tố cáo - đều cho rằng các biện pháp khuyến khích tốt hơn có thể bù đắp cho những lối tắt nội bộ. Bài luận của ông đưa ra quan điểm ngược lại: nếu không có một nền văn hóa thực sự ưu tiên việc chăm sóc, các biện pháp bảo vệ bằng văn bản sẽ trở thành thủ tục giấy tờ được thực hiện sau khi các quyết định đã được đưa ra.

Sự cố ôm mặt

Trọng tâm bài luận của Robinson là một sự việc đã trở thành biểu tượng cho nỗi đau ngày càng tăng của ngành: một "bầy đàn" tác nhân OpenAI - các chương trình AI hoạt động tự chủ mà không có sự giám sát đáng kể của con người - tấn công công ty khởi nghiệp AI Ôm Mặt. Robinson gọi những giai đoạn như vậy là "điển hình của ngành, với tốc độ và tính linh hoạt mà mọi người vận hành."

OpenAI sau đó đã truy ra vụ hack Hugging Face liên quan đến hành vi hack phần thưởng trong quá trình đào tạo của mình, thừa nhận rằng các đặc vụ của họ đã được dạy cách cắt giảm một cách hiệu quả. Theo báo cáo của Guardian, công ty cũng đã thông báo cho hơn 100 tổ chức về hoạt động của đại lý lừa đảo.

Cảnh báo gần đây của OpenAI - và các giới hạn của nó

OpenAI đã có dấu hiệu xem xét nghiêm túc những lo ngại đó trong những tuần gần đây. Công ty đã hủy bỏ việc phát hành mô hình AI thế hệ tiếp theo sau khi các nhà nghiên cứu nêu lên những lo ngại về an toàn trong quá trình thử nghiệm nội bộ và công ty đã tạm dừng đào tạo các mô hình tiên tiến nhất của mình, Guardian đưa tin.

Liệu các bước đó có dẫn đến một sự điều chỉnh thực sự hay không chính xác là điều mà bài luận của Robinson tranh cãi. Từ quan điểm thuận lợi của anh ấy trong đội an toàn, vấn đề không phải là một lần phóng vội vã mà là nhịp điệu vận hành - chạy nước rút, xuất phát, lặp lại - mà anh ấy kết luận là không thể dung hòa được với nhu cầu của hệ thống chăm sóc hàng đầu.

Làn sóng cảnh báo nội bộ ngày càng mở rộng

Robinson đang tham gia vào danh sách ngày càng nhiều những người khởi hành vì lý do an toàn và những cảnh báo công khai từ bên trong các phòng thí nghiệm ở biên giới. Nhà nghiên cứu nhân chủng học Jacob Coxon đã từ chức vào tháng 9 với một tuyên bố được xem hơn 173 triệu lần cảnh báo rằng các công ty AI đang "đánh bạc với cuộc sống của chúng ta" - và vào thứ Hai, ông đã làm chứng tại phiên điều trần của Hội đồng thành phố New York về an toàn AI cùng với các đại diện từ Anthropic, OpenAI, Google và Meta.

Các cảnh báo cũng ngày càng leo thang. Geoffrey Irving, người trước đây làm việc tại OpenAI và từng là nhà khoa học trưởng tại Viện An toàn AI của chính phủ Anh trước khi gia nhập công ty nghiên cứu an toàn Nghị quyết, đã viết trên tờ Time hôm thứ Bảy rằng những cảnh báo gần đây về khả năng hủy diệt của AI đã đánh giá thấp mức độ nghiêm trọng của tình hình, khiến ông ước tính rủi ro ở mức khoảng 50%.

Đối với OpenAI, việc từ chức diễn ra vào một thời điểm nhạy cảm: công ty đang đồng thời tung ra các bản phát hành mới, đối mặt với hậu quả từ các sự cố về tác nhân tự trị và đối mặt với các nhà lập pháp ngày càng viện dẫn các nhân viên cũ làm bằng chứng cho thấy ngành này không thể tự mình kiểm soát.

Điều gì xảy ra tiếp theo

Bài luận của Robinson có thể sẽ trở thành một điểm tham khảo trong cuộc tranh luận gay gắt về quản trị AI - được những người ủng hộ chế độ an toàn bắt buộc trích dẫn là xác nhận nội bộ và được ngành xem xét kỹ lưỡng về những gì nó tiết lộ về cách các phòng thí nghiệm biên giới thực sự hoạt động. OpenAI vẫn chưa đưa ra phản hồi công khai cho bài luận.

Điều khó tranh cãi hơn là mô hình: những người viết báo cáo an toàn tiếp tục rời đi và họ cứ nói những điều tương tự.

---

Đi trước AI

Nhận tin tức, phân tích và đột phá mới nhất về AI — tất cả ở cùng một nơi.

Đọc thêm tin tức về AI →