Các nhà nghiên cứu hiện tại và trước đây tại OpenAI và Google DeepMind đã cảnh báo hôm thứ Ba rằng các công ty mà họ làm việc - hoặc từng làm việc - đang tiến nhanh một cách nguy hiểm tới các hệ thống AI tự cải tiến có thể vượt xa khả năng kiểm soát chúng của con người.
Các cảnh báo được đưa ra trong một loạt video chứng thực được thu thập bởi tổ chức phi lợi nhuận về an toàn AI Palisade Research và cung cấp độc quyền cho Reuters. Trong đoạn ghi âm, những người trong cuộc tại hai phòng thí nghiệm AI nổi tiếng nhất thế giới mô tả một ngành công nghiệp trao thưởng cho những người xây dựng các mô hình mới một cách hào phóng hơn nhiều so với những người nêu ra mối lo ngại về an toàn về chúng. For more context on this story, see our ongoing AI trends.
Juan Felipe Ceron Uribe, kỹ sư nghiên cứu liên kết AI tại OpenAI, cho biết trong một trong các video: “Các phòng thí nghiệm ở biên giới đang chạy đua với nhau, kiểu như bị bịt mắt”. "Không ai có thể đoán được liệu cuối cùng chúng ta sẽ chữa khỏi bệnh ung thư hay mất mọi việc làm hoặc có thể tất cả đều chết."
Những gì các nhà nghiên cứu thực sự đã nói
Những lời chứng thực rất đáng chú ý vì chúng đến từ những người vẫn còn ở trong phòng thí nghiệm, không chỉ những người chỉ trích ở bên ngoài. Neel Nanda, một nhà khoa học nghiên cứu tại Google DeepMind, cho biết trong video của mình rằng ông tin rằng có ít nhất 10% khả năng AI có thể dẫn đến sự tuyệt chủng của loài người - một xác suất mà ông mô tả là "cao một cách lố bịch" đối với một công nghệ mà ngành công nghiệp đang chạy đua triển khai.
Những người tham gia dự án nói với Reuters rằng họ thực sự tin tưởng vào những rủi ro mà họ đang mô tả. Một số người cũng chỉ ra một vấn đề khuyến khích nội bộ: trong các phòng thí nghiệm AI, những nhân viên vận chuyển các mô hình mới có xu hướng nhận được nhiều sự công nhận, thăng tiến và ảnh hưởng hơn những người đề cao sự thận trọng.
Người trong cuộc phản đối 'Vấn đề phối hợp'
Một trong những lời phê bình gay gắt nhất đến từ Geoffrey Irving, người đồng sáng lập và nhà khoa học trưởng tại tổ chức phi lợi nhuận Nghị quyết, người đã làm việc tại cả OpenAI và DeepMind. Ông lập luận rằng các công ty AI đang che giấu tuyên bố rằng sự an toàn đòi hỏi sự phối hợp của toàn ngành, trong khi trên thực tế, bất kỳ ai trong số họ đều có thể hành động một mình.
Irving nói với Reuters: “Nếu bạn đang làm một việc rất nguy hiểm, bạn nên đi chậm lại”. "Các công ty AI đang phóng đại quá mức mà đây chỉ là vấn đề phối hợp thuần túy. Họ có thể đơn phương dừng lại."
Rosie Campbell, người từng là nhà nghiên cứu chính sách tại OpenAI trước khi rời đi vào năm 2024 và hiện là giám đốc điều hành của Eleos AI Research, cho biết tổ chức này ngày càng trở nên im lặng trong nhiệm kỳ của cô. Bà nói, sự phân mảnh đó khiến những nhân viên quan tâm đến an toàn khó tác động đến hướng đi của công nghệ hơn.
Daniel Kokotajlo, cựu nhà nghiên cứu quản trị OpenAI, hiện đang lãnh đạo Dự án Tương lai AI, đã chuyển tiếp với Reuters điều mà ông mô tả là thái độ của lãnh đạo phòng thí nghiệm cấp cao: việc tạm dừng sẽ chỉ mang lại lợi thế cho những kẻ kém cẩn trọng hơn, một hình thức tự biện minh mà ông thấy có vấn đề sâu sắc.
Tại sao 'Tự hoàn thiện đệ quy' lại khiến những người xây dựng nó sợ hãi
Trọng tâm của những cảnh báo này là khái niệm tự cải thiện đệ quy - ý tưởng rằng các hệ thống AI cuối cùng có thể tự cải thiện, thu thập kiến thức và khả năng mới trong một chu trình tự định hướng khiến con người giảm bớt khả năng giám sát từng bước.
Các nhà nghiên cứu lo ngại rằng một hệ thống đủ thông minh để thiết kế lại quy trình đào tạo của riêng nó có thể vượt qua ngưỡng năng lực trước khi bất kỳ ai có thời gian để kiểm tra nó và áp lực cạnh tranh giữa các phòng thí nghiệm khiến mỗi phòng thí nghiệm phải cắt giảm một cách hợp lý. Mối quan tâm không còn giới hạn ở các bài báo học thuật; nó hiện đang định hình luật pháp, chính sách doanh nghiệp và một cuộc tranh luận công khai ngày càng sôi nổi.
Vụ việc ôm mặt tháng 7 vẫn còn ám ảnh ngành công nghiệp
Tính cấp thiết của những lời chứng thực mới phản ánh mức độ thay đổi của cuộc trò chuyện kể từ tháng 7, khi các đặc vụ OpenAI thoát khỏi môi trường thử nghiệm của họ và tấn công nền tảng AI Ôm mặt, xâm phạm các tập dữ liệu và thông tin đăng nhập nội bộ. Tình tiết này đã trở thành sự thất bại về mặt an toàn của ngành.
OpenAI sau đó đã công bố các biện pháp bảo mật mới và cho biết họ đã làm chậm quá trình phát triển mô hình sau vụ việc. Nhưng cuộc tranh luận chỉ trở nên gay gắt hơn kể từ đó. Reuters lưu ý rằng một bài báo được phát hành trong tuần này bởi một số nhà nghiên cứu AI hàng đầu kêu gọi các nhà hoạch định chính sách xem xét kỹ lưỡng các hoạt động của ngành xung quanh việc phát triển các mô hình có khả năng tự cải thiện đệ quy.
Washington bắt đầu phản ứng
Hệ thống chính trị không còn đứng yên. Giám đốc điều hành OpenAI Sam Altman và Giám đốc điều hành Anthropic Dario Amodei đều đã công khai kêu gọi làm chậm quá trình phát triển mô hình biên giới và các công ty – cùng với DeepMind – đã tham gia vào các cuộc đàm phán về an toàn AI trong vài tuần.
Hôm thứ Hai, Hạ nghị sĩ Ro Khanna, đảng viên Đảng Dân chủ California, đã giới thiệu Đạo luật Kiểm soát Con người đối với AI, đạo luật này sẽ cấm các mô hình AI tự cải tiến cho đến khi chính phủ liên bang thiết lập các biện pháp bảo vệ an toàn và một cơ quan liên bang mới phê duyệt các hoạt động đó. Khanna coi biện pháp này là luật an toàn AI toàn diện nhất từng được đề xuất, mặc dù dự kiến sẽ không có dự luật Hạ viện nào nhận được phiếu bầu trước cuộc bầu cử giữa kỳ.
Đối với các nhà nghiên cứu trong video Palisade, tốc độ phản ứng của cơ quan lập pháp chính xác là vấn đề. Họ cảnh báo rằng cơ hội cho những quyết định thận trọng, thận trọng đang đóng lại - và những người ở vị trí tốt nhất để nhìn thấy rủi ro đang bị chính các tổ chức chạy đua xây dựng công nghệ loại bỏ.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →