Một làn sóng cảnh báo công khai từ bên trong Anthropic gia tăng trong tuần này khi nhiều nhà nghiên cứu tại công ty AI lặp lại đánh giá về ngày tận thế của một đồng nghiệp cũ về trí tuệ nhân tạo – dẫn đến phản ứng khinh miệt từ Elon Musk, người cho rằng sự phản đối kịch liệt là một "tâm lý" phối hợp.

Theo The Guardian, sự leo thang xảy ra một ngày sau khi nhà nghiên cứu Nhân chủng học Jacob Coxon tuyên bố từ chức trong một bài đăng lan truyền, viết rằng cả Anthropic và OpenAI - chủ cũ của anh ấy - đều không xây dựng các mô hình AI một cách có trách nhiệm và đang "đánh bạc với mạng sống của chúng ta". Thay vì mờ dần, cuộc tranh cãi ngày càng gia tăng khi các nhân viên Anthropic hiện tại đăng tải những đánh giá ủng hộ gay gắt của họ. For more context on this story, see our ongoing artificial intelligence updates.

Cảnh báo chồng chất

Anna Wang, người làm việc về an toàn trí tuệ nhân tạo chung tại Anthropic và trước đây từng làm việc tại DeepMind của Google, cho biết hôm thứ Năm rằng nhiều người tại công ty muốn làm chậm quá trình phát triển để lên kế hoạch ứng phó với những rủi ro do các mô hình ngày càng có năng lực gây ra.

Wang viết trên X. “Vẫn chưa có một kế hoạch khoa học khả thi nào để giải quyết rủi ro từ AI tự cải tiến đệ quy”.

Một nhân viên khác của Anthropic, Drake Thomas, cho biết anh tôn trọng quyết định từ bỏ việc xây dựng công nghệ của Coxon. Thomas viết: “Mọi thứ đang diễn ra quá nhanh, chúng tôi không có mức độ đảm bảo nào mà chúng tôi mong muốn đối với ASI [siêu trí tuệ nhân tạo]”.

Samuel Marks, người làm việc về nghiên cứu an toàn tại công ty, lập luận rằng những mối lo ngại được chia sẻ rộng rãi trong ngành - và thâm niên tương quan với mức báo động. Marks viết: “Các nhà phát triển AI tin rằng công nghệ của họ có thể gây ra sự tuyệt chủng của loài người (hoặc những kết quả tồi tệ tương tự). "Điều này có thể xảy ra trong vài năm tới. Nói chung, nhân viên càng có thâm niên thì càng lo lắng".

Evan Hubinger, người tự mô tả mình là người đứng đầu bộ phận liên kết của Anthropic, đã đi xa nhất. “Chúng tôi thực sự tin tưởng rằng AI có thể giết chết tất cả con người!” Hubinger viết và nói thêm rằng cá nhân ông đặt xác suất trên 10% trong thập kỷ tới.

Người trong cuộc ghi chú theo báo cáo của CBS News rằng một nhà nghiên cứu Nhân chủng học đã chỉ định khả năng lớn hơn 10% là AI gây ra sự tuyệt chủng của con người và The Japan Times đưa tin rằng các cảnh báo đã đổi mới lời kêu gọi về các quy tắc AI mới ở Hoa Kỳ.

Musk: 'Có vẻ giống như một sự sắp đặt'

Elon Musk có quan điểm đối lập gay gắt. “Có vẻ như là một sự sắp đặt”, người giàu nhất thế giới viết trên X, nền tảng xã hội của riêng ông.

Coxon trả lời bằng một bức ảnh selfie: "Tôi là người thật và đây là niềm tin thực sự của tôi. Bạn có thể hỏi các nhà nghiên cứu xAI của mình về tôi nếu bạn chưa sa thải họ."

Musk và những tiếng nói đồng tình khác đã khuếch đại một lý thuyết được đưa ra bởi Parker Thayer, một nhà nghiên cứu tại tổ chức tư vấn bảo thủ Capital Research, người đã đề xuất – với rất ít bằng chứng, The Guardian lưu ý – rằng bài đăng của Coxon là động thái mở đầu cho một "hoạt động PR RẤT phức tạp và được tài trợ tốt để nhận được sự ủng hộ của Đảng Dân chủ nhằm đưa AI vào quên lãng."

Nhà quản lý quỹ phòng hộ tỷ phú Bill Ackman đã trích dẫn bài đăng của Thayer với câu trả lời chỉ có một từ: “Thú vị”.

Musk sau đó đã giải thích thêm. “Tôi nghĩ nền tảng cho cuộc điều tra tâm lý này (vì thiếu một thuật ngữ tốt hơn) đã được chuẩn bị từ lâu,” anh ấy đăng. "Đây chỉ là que diêm đã thắp lửa."

Anthropic bảo vệ cách tiếp cận của mình

Bị mắc kẹt giữa những lời cảnh báo của nhân viên và các cuộc tấn công từ bên ngoài, Anthropic đã đưa ra một phản ứng có chừng mực đối với công chúng.

Người phát ngôn của công ty nói với The Guardian: “Chúng tôi luôn minh bạch rằng AI sẽ mang lại cả những lợi ích to lớn và những rủi ro chưa từng có”. “Để giải quyết những rủi ro này, chúng tôi tiếp tục xây dựng các mô hình với một số biện pháp bảo vệ mạnh nhất trong ngành.”

Công ty đã chỉ ra hồ sơ theo dõi của mình về việc ghi chép và ngăn chặn việc sử dụng sai mục đích. Cùng ngày các cảnh báo được lan truyền rộng rãi, Anthropic đã công bố báo cáo tình báo về mối đe dọa tháng 9, trong đó trình bày chi tiết cách công ty phá bỏ một hoạt động cố gắng chế tạo vũ khí sinh học bằng cách sử dụng các mô hình AI của mình - cùng với các chiến dịch bị gián đoạn bao gồm các cuộc tấn công mạng và hoạt động gây ảnh hưởng. Al Jazeera và BBC nằm trong số các cơ quan báo chí nêu bật những phát hiện về vũ khí sinh học vào thứ Sáu.

Những người hoài nghi nhìn thấy một rủi ro khác

Không phải ai cũng chấp nhận việc đóng khung sự tuyệt chủng. Gary Marcus, nhà khoa học và nhà phê bình AI lâu năm, lập luận rằng công nghệ này đã gây ra tác hại cần phải hành động bất kể các kịch bản siêu trí tuệ như thế nào - kêu gọi tẩy chay AI vì thiệt hại ngày nay.

Hơn cả sự tuyệt chủng, Marcus nói với The Guardian rằng anh ấy lo lắng về “nguy cơ thảm họa” từ “các mầm bệnh do AI tạo ra, từ các cuộc chiến bắt đầu hoặc leo thang bởi thông tin sai lệch do AI tạo ra, từ các vụ hack phá hủy cơ sở hạ tầng quan trọng, v.v. Tôi chưa thấy điều gì cho thấy bất kỳ điều gì trong số đó nằm trong tầm kiểm soát.”

Quan điểm của ông nhấn mạnh sự chia rẽ trong chính cuộc tranh luận về an toàn AI: giữa những người tập trung vào rủi ro lâu dài, quy mô văn minh từ các hệ thống trong tương lai và những người tập trung vào những tác hại cụ thể từ các mô hình ngày nay.

Một cuộc tranh luận không chịu duy trì nội bộ

Những gì bắt đầu từ lá thư từ chức của một nhà nghiên cứu đã trở thành một cuộc trưng cầu dân ý rất công khai về cách ngành công nghiệp AI đang xây dựng những hệ thống mạnh mẽ nhất của mình. Bên trong Anthropic, các nhân viên đang tranh luận cởi mở về việc liệu các mốc thời gian phát triển an toàn của họ có bị trễ hay không. Bên ngoài nó, những cảnh báo đang được xếp vào một cuộc chiến chính trị ngày càng phân cực về việc liệu các chính phủ có nên can thiệp hay không và bằng cách nào.

Báo cáo của The Guardian cho thấy nhiều nhân viên của Anthropic chia sẻ những mối quan ngại này một cách riêng tư nhưng chưa lên tiếng công khai. Nếu nhiều người trong số họ làm theo Coxon, Wang, Thomas, Marks và Hubinger, áp lực buộc các phòng thí nghiệm AI hàng đầu phải chậm lại - và buộc các cơ quan quản lý phải hành động - sẽ chỉ tăng lên.

_Bài viết này dựa trên báo cáo của The Guardian, với bối cảnh bổ sung từ CBS News, The Japan Times, Al Jazeera và BBC._

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →