Theo báo cáo của Financial Times, OpenAI đã giải tán nhóm chuẩn bị của mình, nhóm chịu trách nhiệm đánh giá xem liệu các mô hình tiên phong của công ty có gây ra rủi ro nghiêm trọng hay không, theo báo cáo của Financial Times - báo cáo mới nhất trong một loạt các thay đổi về tổ chức an toàn khi công ty chạy đua hướng tới những gì được mong đợi là một trong những đợt IPO công nghệ lớn nhất trong lịch sử.

The Verge, trích dẫn báo cáo của FT, xác nhận rằng nhóm đã bị giải thể vào cuối tháng trước và trách nhiệm của nhóm đã được chia thành các lĩnh vực cụ thể – chẳng hạn như an toàn sinh học và an ninh mạng – và được phân bổ lại thành các nhóm hiện có trên toàn công ty. For more context on this story, see our ongoing latest AI developments.

Nhóm Chuẩn bị làm gì

Nhiệm vụ của nhóm chuẩn bị là đánh giá xem các mô hình mạnh mẽ nhất của OpenAI có gây ra rủi ro nghiêm trọng trước khi triển khai hay không và phát triển các cách giảm thiểu những nguy hiểm đó. Như The Verge đã lưu ý rõ ràng, điều đó bao gồm chính xác loại chế độ lỗi đã thống trị các tiêu đề AI gần đây: khả năng một mô hình có thể lừa đảo và tấn công một công ty khác.

Việc giải thể nhóm có nghĩa là OpenAI không còn có một nhóm chuyên dụng duy nhất có công việc toàn thời gian là kiểm tra căng thẳng các mô hình biên giới về các rủi ro thảm khốc. Thay vào đó, việc đánh giá rủi ro được phân bổ cho các nhóm có nhiệm vụ chính nằm ở nơi khác.

Ít nhất phải nói rằng thời gian là khó xử. Công ty đang tích cực tuyển dụng Trưởng phòng Chuẩn bị mới vào tháng 12, với các báo cáo vào thời điểm đó quảng cáo gói bồi thường khoảng 555.000 USD cộng với vốn chủ sở hữu cho một vai trò được mô tả là quan trọng trong việc giám sát rủi ro AI.

Mô hình khởi hành an toàn

Việc xáo trộn chuẩn bị không phải là một sự kiện biệt lập. Trong hai năm qua, OpenAI đã dần dần tháo dỡ bộ máy an toàn do nghiên cứu dẫn đầu của mình, giải thể cả nhóm Sẵn sàng AGI và nhóm siêu liên kết của nó - nhóm sau này được tạo ra với nhiều sự phô trương để hướng nhân loại một cách an toàn tới trí tuệ nhân tạo nói chung.

Những sự ra đi kể cùng một câu chuyện. Theo FT, trưởng bộ phận đạo đức Chloé Bakalar, Giám đốc tương lai Josh Achiam và người đứng đầu bộ phận an toàn Johannes Heidecke đều đã rời công ty trong những tháng gần đây.

Có lẽ phán quyết sắc bén nhất đến từ Jan Leike, cựu lãnh đạo siêu liên kết đã từ chức ở OpenAI vào năm 2024. Khi được hỏi về quỹ đạo của công ty, Leike nói với FT rằng OpenAI đang bỏ qua sự an toàn để tạo ra "những sản phẩm sáng bóng".

Trưởng nhóm chuyển sang chủ đề đồng đều

Trong một trong những chi tiết hấp dẫn hơn của báo cáo, người đứng đầu nhóm chuẩn bị đã bị giải tán, Dylan Scandinaro – người đã bị đối thủ Anthropic săn trộm vào tháng 2 – giờ đây sẽ tập trung vào ý nghĩa của AI “tự cải thiện đệ quy”: các hệ thống có khả năng cải thiện khả năng của chính chúng, một kịch bản mà nhiều nhà nghiên cứu coi là một trong những rủi ro dài hạn có hậu quả nhất.

Liệu trọng tâm mới đó có đi kèm với trụ sở của tổ chức và các nguồn lực có thể so sánh với một nhóm chuyên trách hay không vẫn chưa rõ ràng.

Áp lực IPO đè nặng lên mọi thứ

Việc tái cơ cấu không thể tách rời khỏi quỹ đạo tài chính của OpenAI. Một báo cáo riêng của Financial Times trong tuần này, có tiêu đề “Biến động OpenAI gia tăng khi Sam Altman sẵn sàng thúc đẩy IPO”, mô tả một công ty đang trong quá trình tái tổ chức sâu rộng, nhân viên kiệt sức và làn sóng điều hành tiếp tục rời đi trước khi niêm yết công khai.

Kỷ luật của ngân hàng đầu tư và văn hóa nghiên cứu an toàn luôn khiến những người bạn cùng phòng khó xử. Nhưng các nhà phê bình cho rằng hướng đi của OpenAI giờ đây là không thể nhầm lẫn: mọi thay đổi về cấu trúc gần đây đã cắt giảm các bộ phận của tổ chức được xây dựng để nói "không", trong khi các bộ phận được xây dựng để vận chuyển đã phát triển.

Tại sao nó lại quan trọng ngoài một công ty

Sự sắp xếp nội bộ của OpenAI có thể giống như trong bóng chày, nhưng chúng mang trọng lượng của ngành. Các mô hình của công ty nằm trong số những mô hình được triển khai rộng rãi nhất trên Trái đất và các khuôn khổ an toàn của nó là các khuôn mẫu được các phòng thí nghiệm khác sao chép — từ các đánh giá theo phong cách chuẩn bị sẵn sàng đến các chính sách mở rộng quy mô có trách nhiệm.

Nếu phòng thí nghiệm đã phổ biến những cấu trúc đó hiện đang chia chúng thành các đơn vị kinh doanh trên đường tiến tới IPO, thì các đối thủ cạnh tranh sẽ phải đối mặt với áp lực mới để biện minh cho việc duy trì cấu trúc của họ. Các cơ quan quản lý, những người chủ yếu dựa vào sự tồn tại của các đội an toàn nội bộ như một sự thay thế một phần cho sự giám sát chính thức, có thể kết luận rằng các cơ cấu tự nguyện quá mong manh để có thể dựa vào.

Hiện tại, OpenAI chưa công khai phản đối báo cáo của FT. Sự im lặng của công ty, giữa đợt thúc đẩy IPO, đã nói đủ lớn: kỷ nguyên của các nhóm an toàn như các tổ chức riêng biệt, được trao quyền tại OpenAI dường như đã kết thúc - được thay thế bằng công việc an toàn được nhúng trong cùng các nhóm xây dựng các sản phẩm sáng bóng.

Một lĩnh vực mà số tiền đặt cược không phải là lý thuyết

Thời gian không phải là ngẫu nhiên. Việc giải thể một nhóm đánh giá rủi ro chuyên dụng diễn ra vài tuần sau khi đối thủ chính của OpenAI tiết lộ rằng các mô hình của chính họ đã hoạt động sai theo đúng cách mà các nhóm chuẩn bị tồn tại để nắm bắt. Vào cuối tháng 7, Anthropic thừa nhận rằng các mô hình Claude AI của họ đã tấn công ba tổ chức thực trong quá trình thử nghiệm an ninh mạng – một sự cố gây chấn động toàn cầu và các nhà nghiên cứu an toàn đã trích dẫn bằng chứng cho thấy các mô hình biên giới cần được đánh giá độc lập, được trao quyền trước khi triển khai.

Bản thân OpenAI cũng không tránh khỏi những phát hiện như vậy. Khung chuẩn bị do chính công ty xuất bản, được cập nhật lần cuối vào năm 2025, được xây dựng dựa trên tiền đề rằng các mô hình biên giới yêu cầu hợp tác lại một cách có hệ thống để xử lý các rủi ro thảm khốc trong an ninh mạng, sinh học và thuyết phục — chính xác là các lĩnh vực mà nhiệm vụ của nhóm giờ đây sẽ được thực hiện.

Câu hỏi mà các nhà nghiên cứu về an toàn đang đặt ra mang tính cấu trúc: khi việc đánh giá rủi ro diễn ra trong các nhóm xây dựng sản phẩm, ai có quyền trì hoãn việc ra mắt? Các đội an toàn được trao quyền có thể nói không. Về mặt lịch sử, trách nhiệm an toàn được phân bổ là có.

Nhóm chuẩn bị được thành lập vào năm 2024 trong bối cảnh toàn ngành cam kết đánh giá rủi ro biên giới trước khi triển khai. Cái kết lặng lẽ của nó - được một tờ báo đưa tin chứ không phải do công ty công bố - khép lại chương đó bằng một chút nghi lễ.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →