Google DeepMind đã ra mắt một viện nghiên cứu mới chuyên mở rộng cuộc trò chuyện xung quanh trí tuệ nhân tạo nói chung - và các bài tiểu luận khai mạc của viện này bao gồm một đề xuất cụ thể từ Demis Hassabis về một cơ quan do Hoa Kỳ lãnh đạo sẽ đánh giá các mô hình AI hàng đầu trước khi triển khai.
Viện DeepMind, được thành lập hôm thứ Tư bởi các nhà nghiên cứu của Google và Google DeepMind, liệt kê Shane Legg, người đồng sáng lập DeepMind, làm biên tập viên quản lý, cùng với giám đốc điều hành Google James Manyika và chủ tịch Google DeepMind Demis Hassabis làm giám đốc, theo TechCrunch. For more context on this story, see our ongoing AI industry coverage.
Phòng không đồng ý
Mục đích đã nêu của viện là nêu lên sự bất đồng thực sự - kể cả trong chính Google. Thông báo cho biết: “Không phải lúc nào họ cũng đồng ý và có thể họ sẽ thay đổi quyết định khi có nhiều dữ liệu và thông tin hơn được đưa ra ánh sáng ở biên giới đang chuyển động nhanh”.
Bộ sưu tập đầu tiên của nó bao gồm bốn bài tiểu luận về các chính sách kinh tế để quản lý sự gián đoạn AGI tiềm ẩn, bảo tồn lý luận mô hình mà con người có thể đọc được, các nguyên tắc cho sự phát triển của con người và khuôn khổ để đánh giá các mô hình AI tiên phong.
Thể chế hóa sự bất đồng công khai là một động thái bất thường đối với phòng thí nghiệm AI của công ty, nơi thông điệp công khai có xu hướng được kiểm soát chặt chẽ. Theo thiết kế, viện này cung cấp cho các nhà nghiên cứu của Google một địa điểm để tranh luận về các quan điểm có thể xung đột với lợi ích thương mại của công ty - hoặc với lợi ích của nhau.
Tiểu luận về tính minh bạch: Xem 'Độ sâu nối tiếp mờ đục'
Một trong bốn bài tiểu luận của các nhà nghiên cứu an toàn DeepMind, Rohin Shah và Anca Dragan, lập luận rằng việc thu hẹp cửa sổ minh bạch của AI – khả năng xem và kiểm tra lý luận từng bước của mô hình – là không thể tránh khỏi, ngay cả khi các kiến trúc mới làm cho các mô hình mạnh mẽ nhất khó giám sát hơn.
Các tác giả cho rằng các nhà phát triển và cơ quan quản lý nên trực tiếp đối mặt với sự đánh đổi về an toàn. Cụ thể, điều đó có thể có nghĩa là hạn chế cái mà họ gọi là "độ sâu nối tiếp mờ đục" - lượng tính toán tuần tự mà một mô hình có thể thực hiện mà không tạo ra dấu vết lý luận có thể đọc được - hoặc yêu cầu các nhà phát triển chứng minh rằng các hệ thống kém minh bạch hơn vẫn có thể giám sát được như các hệ thống có thể diễn giải được.
Đề xuất này đáng chú ý vì nó coi việc mất khả năng diễn giải là một lựa chọn về thiết kế và chính sách chứ không phải là hậu quả không thể tránh khỏi của quy mô, mở ra cánh cửa cho các yêu cầu có thể được đưa vào quy định.
Đề xuất của Hassabis: Cơ quan Tiêu chuẩn Biên giới của Hoa Kỳ
Bài luận có ý nghĩa quan trọng nhất có thể là của Hassabis. Ông đề xuất một cơ quan tiêu chuẩn AI hàng đầu do Hoa Kỳ lãnh đạo có nhiệm vụ đánh giá các mô hình AI tiên tiến nhất. Theo khuôn khổ này, ban đầu các nhà phát triển sẽ tự nguyện gửi mô hình để xem xét tối đa 30 ngày trước khi phát hành. Một khi hệ thống đánh giá đã tỏ ra hiệu quả, việc vượt qua các bài kiểm tra của nó có thể trở thành một yêu cầu để triển khai các mô hình tiên phong ở Hoa Kỳ.
Cơ quan này sẽ bắt đầu bằng cách thiết kế các đánh giá với sự tham vấn của các công ty AI, nhưng cuối cùng sẽ phát triển các đánh giá độc lập, không được tiết lộ - điều mà bài tiểu luận gọi là các bài kiểm tra "tổ chức" - để ngăn các phòng thí nghiệm điều chỉnh mô hình của họ theo các tiêu chuẩn đã biết, một chế độ thất bại được ghi chép rõ ràng của các chế độ đánh giá công khai.
Hassabis cũng để ngỏ khả năng leo thang: khuôn khổ này có thể được "tăng cường nếu tình hình nghiêm trọng đòi hỏi", có khả năng bao gồm cả sự phối hợp chậm lại giữa các nhà phát triển AI hàng đầu.
Tại sao hai bài luận còn lại lại quan trọng
Hai bài tiểu luận còn lại – về các chính sách kinh tế để quản lý sự gián đoạn của AGI và về các nguyên tắc cho sự phát triển của con người – hoàn thiện một bộ sưu tập coi AGI là một vấn đề toàn xã hội chứ không phải là vấn đề thuần túy kỹ thuật. Sự dịch chuyển kinh tế từ lâu đã là mối quan tâm rõ ràng nhất của công chúng xung quanh AI tiên tiến và việc đóng khung nó cùng với chính sách đánh giá và khả năng diễn giải cho thấy viện muốn các nhà hoạch định chính sách coi các phần là một chương trình nghị sự thay vì các cuộc tranh luận riêng biệt.
Bề rộng đó cũng là một tín hiệu về định vị của Google. Công ty đang cạnh tranh để giành được khách hàng doanh nghiệp và hợp đồng với chính phủ, đồng thời lập luận rằng các hệ thống biên giới cần có sự giám sát kỹ lưỡng từ bên ngoài. Công khai sự căng thẳng, thay vì xoa dịu nó, là tiền đề cốt lõi của viện.
Từ quan ngại đến đề xuất cụ thể
Các bài tiểu luận xuất hiện khi cuộc tranh luận về an toàn trong ngành chuyển từ những tuyên bố chung về mối quan ngại sang các cơ chế cụ thể: yêu cầu công bố thông tin, sự giám sát từ bên ngoài và - nếu các biện pháp bảo vệ bị tụt lại phía sau - sự chậm lại phối hợp. Sự thay đổi đó đã tăng tốc trong tuần này khi các nhà lãnh đạo ngành tán thành các yếu tố trong lời kêu gọi của Giám đốc điều hành Anthropic Dario Amodei về việc "tăng tốc" phát triển AI biên giới, theo TechCrunch.
Vấn đề thời gian. Chính phủ ở cả hai bờ Đại Tây Dương đang cân nhắc cách giám sát các hệ thống có khả năng phát triển nhanh hơn cơ sở hạ tầng đánh giá. Một đề xuất bắt nguồn từ phòng thí nghiệm AI hàng đầu - và bao gồm đánh giá trước khi phát hành bằng răng - cung cấp cho các nhà hoạch định chính sách một khuôn mẫu mà chính ngành này đã thông qua trên danh nghĩa, vốn trước đây là điều kiện tiên quyết cho quy định AI có ý nghĩa.
Xem gì
Sự độc lập về mặt biên tập của viện với Google sẽ là thử nghiệm đầu tiên. Nếu các bài luận tiếp tục bao gồm các quan điểm đi ngược lại lộ trình thương mại của Google - như bài luận về tính minh bạch được cho là đã làm - thì địa điểm có thể trở thành yếu tố đóng góp nghiêm trọng cho cuộc tranh luận về chính sách AGI. Nếu nó hướng tới thông điệp của công ty, nó sẽ là một kênh PR nữa trong một lĩnh vực đông đúc.
Dù bằng cách nào, vấn đề này hiện đã được đặt lên bàn cân: các yêu cầu đánh giá trước khi phát hành, các thử nghiệm được tổ chức và thậm chí cả sự chậm lại phối hợp đang được tranh luận công khai bởi một trong những nhân vật quyền lực nhất trong lĩnh vực AI. Câu hỏi không còn là liệu các mô hình biên giới có nên được đánh giá độc lập hay không mà là ai thực hiện việc đánh giá - và theo thời gian biểu nào.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →