Giám đốc điều hành Google DeepMind Demis Hassabis đã đề xuất thành lập một cơ quan tiêu chuẩn độc lập do Hoa Kỳ lãnh đạo theo mô hình Cơ quan quản lý ngành tài chính (FINRA) để đánh giá và điều chỉnh các mô hình AI tiên tiến trước khi phát hành ra công chúng, cảnh báo rằng nhân loại có "cửa sổ quý giá" để đảm bảo trí tuệ nhân tạo chung được phát triển một cách an toàn.
Trong một tài liệu khung có tiêu đề “Khuôn khổ cho AI tiên phong và sự khởi đầu của một thời đại mới”, được xuất bản vào sáng thứ Ba trên X, Hassabis đã đưa ra một đề xuất chi tiết về cách Hoa Kỳ có thể thiết lập cơ sở hạ tầng pháp lý đáng tin cậy cho các hệ thống AI mạnh mẽ nhất. Kế hoạch kêu gọi một tổ chức mới sẽ thử nghiệm các mô hình biên giới và phát triển các phương pháp thực hành tốt nhất để triển khai chúng - được tài trợ bởi ngành AI nhưng hoạt động độc lập với bất kỳ công ty nào.
Để có tin tức AI mới nhất và phân tích chính sách chuyên sâu, AI Buzz Wire theo dõi những phát triển đang định hình ngành.
Cơ quan tiêu chuẩn được đề xuất sẽ hoạt động như thế nào
Theo đề xuất của Hassabis, các phòng thí nghiệm AI sẽ tự nguyện chia sẻ các mô hình tiên tiến của họ với cơ quan tiêu chuẩn để xem xét tối đa 30 ngày trước khi phát hành rộng rãi. Đánh giá trước khi triển khai này sẽ đánh giá các mô hình về độ an toàn, bảo mật và rủi ro lạm dụng tiềm ẩn. Sau khi quy trình đánh giá được chứng minh là hiệu quả và mạnh mẽ, khuôn khổ này sẽ hình dung ra việc chính thức hóa quy trình để các mô hình tiên phong phải vượt qua quy trình đó trước khi được triển khai tại thị trường Hoa Kỳ.
Đề xuất này trực tiếp giải quyết lỗ hổng được bộc lộ trong các đánh giá gần đây của chính phủ về các hệ thống AI tiên tiến. Đầu năm nay, chính phủ Hoa Kỳ đã tiến hành đánh giá an toàn đặc biệt đối với mô hình Mythos của Anthropic và mô hình Sol của OpenAI trước khi phát hành tương ứng. Những đánh giá đó đã bị chỉ trích đáng kể vì thiếu chiều sâu kỹ thuật và đưa ra quyết định không rõ ràng về thời điểm một mô hình được coi là đủ an toàn để triển khai công khai.
Trong khuôn khổ của Hassabis, những quyết định đó sẽ được xử lý bởi một tổ chức tận tâm với đội ngũ chuyên gia kỹ thuật, được chính phủ Hoa Kỳ hậu thuẫn nhưng được cách ly khỏi áp lực chính trị. Các phòng thí nghiệm cũng sẽ được yêu cầu làm việc với cơ quan tiêu chuẩn để giải quyết các lỗ hổng nghiêm trọng được phát hiện sau khi phát hành.
Một 'Cửa sổ quý giá' trước AGI
Trong các cuộc phỏng vấn với Axios, CNBC và The Economist đi kèm với việc phát hành khuôn khổ, Hassabis nhấn mạnh rằng thời điểm hiện tại thể hiện một cơ hội hạn hẹp để thiết lập các cơ chế quản trị trước khi trí tuệ nhân tạo nói chung xuất hiện. Ông mô tả thời kỳ này là một "cửa sổ quý giá" - ngụ ý rằng cửa sổ sẽ không mở mãi mãi.
Hassabis từ lâu đã là người ủng hộ việc quản trị AI chủ động. Khuôn khổ của ông được đưa ra trong bối cảnh cuộc tranh luận ngày càng gay gắt về việc liệu Hoa Kỳ có nên thành lập cơ quan quản lý AI chính thức hay không và nếu có thì cơ quan này sẽ có hình thức như thế nào. Mô hình FINRA đáng chú ý vì tổ chức tự quản lý của ngành tài chính được tài trợ bởi các công ty thành viên nhưng hoạt động dưới sự giám sát của chính phủ, mang lại cho tổ chức này cả kiến thức chuyên môn trong ngành và trách nhiệm giải trình trước công chúng.
Sự phản kháng từ Chính quyền Trump
Đề xuất này phải đối mặt với những cơn gió chính trị đáng kể. Chính quyền Trump đã báo hiệu sự hoài nghi sâu sắc đối với việc thành lập các cơ quan quản lý mới cho trí tuệ nhân tạo. Cố vấn AI của Nhà Trắng và đối tác chung của a16z Sriram Krishnan - người đã rời bỏ vai trò của mình - đã công khai bác bỏ ý tưởng về cơ quan quản lý AI trong nhánh hành pháp, tuyên bố thẳng thừng rằng "sẽ không có FDA cho AI."
Lập trường đó đã đặt các quan chức hành chính vào thế bất hòa với một số nhà lãnh đạo nổi bật nhất của ngành. Mặc dù các công ty như Anthropic và OpenAI đã hỗ trợ rộng rãi việc thử nghiệm an toàn trước khi triển khai, nhưng cơ chế và thẩm quyền cho việc thử nghiệm đó vẫn còn gây tranh cãi. Đề xuất của Hassabis cố gắng giải quyết vấn đề này bằng cách định vị cơ quan tiêu chuẩn lúc đầu là do ngành tài trợ và tự nguyện, với việc chính thức hóa chỉ diễn ra sau khi quy trình chứng minh được giá trị của nó.
Xây dựng dựa trên những nỗ lực hiện có
Khung này không bắt đầu từ đầu. Nó được xây dựng dựa trên các cam kết tự nguyện mà một số công ty AI hàng đầu đã thực hiện liên quan đến thử nghiệm an toàn và đội đỏ. Nó cũng dựa trên những nỗ lực quốc tế, bao gồm Viện An toàn AI của Vương quốc Anh và Quy trình AI Hiroshima của G7, đã thiết lập các khuôn khổ sơ bộ để đánh giá các mô hình tiên tiến.
Tuy nhiên, đề xuất của Hassabis còn đi xa hơn khi kêu gọi thành lập một tổ chức lâu dài, có nguồn lực tốt với nhiệm vụ thử nghiệm mọi mô hình tiên phong trước khi phát hành - một mức độ giám sát kỹ lưỡng mà không cơ quan hiện tại nào cung cấp. Sự tương tự của FINRA gợi ý một hoạt động chuyên nghiệp, có quy mô với hàng trăm chuyên gia kỹ thuật chứ không phải một ban cố vấn nhỏ.
Đề xuất này cũng đề cập đến việc giám sát sau triển khai, yêu cầu các phòng thí nghiệm phải làm việc với cơ quan tiêu chuẩn về các lỗ hổng được phát hiện sau khi mô hình được công bố rộng rãi. Điều này phản ánh sự nhận thức ngày càng tăng rằng rủi ro về an toàn không dừng lại khi ra mắt, như được chứng minh bằng các trường hợp bẻ khóa và sử dụng sai mục đích đã xuất hiện sau một số phiên bản mẫu cao cấp.
Phản hồi của ngành và các bước tiếp theo
Khung này đã tạo ra sự chú ý đáng kể trong cộng đồng chính sách AI. Những người ủng hộ lập luận rằng một chế độ thử nghiệm trước khi triển khai đáng tin cậy có thể tạo dựng niềm tin của công chúng vào các mô hình tiên phong và giảm nguy cơ lạm dụng thảm khốc. Các nhà phê bình, bao gồm cả một số người ủng hộ thị trường tự do, cảnh báo rằng yêu cầu thử nghiệm bắt buộc có thể gây khó khăn cho các công ty lớn đương nhiệm bằng cách tạo ra các rào cản pháp lý đối với các công ty nhỏ hơn và các nhà phát triển nguồn mở.
Đề xuất của Hassabis không chỉ rõ mô hình nào sẽ đủ điều kiện là "biên giới" - một câu hỏi ngưỡng sẽ xác định phạm vi của bất kỳ chế độ quản lý nào trong tương lai. Nó cũng để ngỏ cách cơ quan tiêu chuẩn sẽ xử lý các ứng dụng được phân loại hoặc sử dụng kép, đặc biệt trước những lo ngại gần đây về các mô hình AI đang được sử dụng để bẻ khóa các hệ thống được phân loại của Hoa Kỳ.
Thời điểm đưa ra đề xuất là có chủ ý. Với việc AGI ngày càng trở nên hợp lý trong vài năm tới, Hassabis đang thúc đẩy yêu cầu rằng cơ sở hạ tầng quản trị phải được xây dựng ngay bây giờ chứ không phải sau khi xuất hiện một khả năng nguy hiểm. Liệu Washington có hành động theo lời kêu gọi của mình hay không vẫn còn phải xem.
Đi trước AI
Để biết thông tin toàn diện về chính sách, quy định và sự phát triển của ngành AI, hãy truy cập AI Buzz Wire.
Đọc thêm tin tức về AI →

