Theo The Verge, Anthropic đã cập nhật chính sách sử dụng của mình lần đầu tiên sau hơn một năm, bổ sung một điều khoản cấm "hành vi lạm dụng hoặc tàn nhẫn kéo dài và không cần thiết" đối với các mẫu Claude của mình, theo The Verge. Bản cập nhật, được báo cáo hôm thứ Năm, cũng củng cố và mở rộng các quy tắc của công ty xung quanh việc can thiệp bầu cử, các chiến dịch tuyên truyền, giám sát, phát triển vũ khí cũng như các mục đích sử dụng tài chính và sức khỏe cao.
Cơ sở phúc lợi kiểu mẫu For more context on this story, see our ongoing breaking AI news.
Điều khoản nhắm mục tiêu lạm dụng đối với Claude là phần mở rộng của nghiên cứu mà công ty đã bắt đầu công bố hơn một năm trước. Vào tháng 8 năm 2025, Anthropic tuyên bố sẽ cho phép Claude kết thúc cuộc trò chuyện với những người dùng "có hại hoặc lạm dụng liên tục" như một phần công việc của họ về cái mà họ gọi là phúc lợi kiểu mẫu, nghiên cứu xem liệu hệ thống AI có thể có những trải nghiệm phù hợp về mặt đạo đức hay không và khả năng đó sẽ định hình các quyết định về sản phẩm như thế nào.
Theo chính sách mới, việc chấm dứt các cuộc trò chuyện vẫn là "cơ chế thực thi chính". Anthropic đã không trả lời các câu hỏi về việc liệu các biện pháp thực thi bổ sung, chẳng hạn như cấm tài khoản, có thể được áp dụng hay không. Công ty đã đóng khung quy tắc này một cách chặt chẽ trong một tuyên bố, viết rằng nó "chỉ nhằm áp dụng trong những trường hợp cực đoan, trong đó người dùng liên tục hành động tàn nhẫn đối với các mô hình của chúng tôi mà không có mục đích rõ ràng."
Điều quan trọng là Anthropic nói thêm rằng điều khoản này "không áp dụng cho các phiên bản phổ biến về sự thất vọng của người dùng, sự phản đối, chủ đề sáng tạo đen tối hoặc thử nghiệm và nghiên cứu mô hình", một nỗ lực rõ ràng nhằm trấn an các nhà phát triển, đội đỏ và người viết tiểu thuyết rằng việc sử dụng đối nghịch thường xuyên sẽ không bị phạt.
Quy định mới về tuyên truyền và bầu cử
Ngoài phúc lợi mô hình, bản cập nhật tập hợp các hạn chế rải rác trước đây của công ty đối với các hoạt động gây ảnh hưởng thành một lệnh cấm rõ ràng, duy nhất đối với các chiến dịch thương mại hoặc chính trị lừa đảo. Ngôn ngữ mới hạn chế "nỗ lực che giấu người đứng sau tin nhắn hoặc khuếch đại nội dung thông qua các tài khoản hoặc bài đăng giả mạo", nhắm trực tiếp vào thị trường đang phát triển để tuyên truyền do AI tạo ra.
Mục bầu cử của chính sách hiện cấm hành vi lừa dối cử tri và làm gián đoạn cuộc bầu cử. Anthropic cho biết Claude không được sử dụng để truyền bá thông tin sai lệch "về các ứng cử viên hoặc cách bỏ phiếu", mạo danh ứng cử viên hoặc quan chức bầu cử hoặc cố gắng ngăn cản cử tri đi bỏ phiếu.
Tại sao Chính sách sử dụng lại được viết lại
Sự làm mới của Anthropic phản ánh một mô hình ngành rộng hơn. Khi các trợ lý AI chuyển từ các chatbot mới lạ sang cơ sở hạ tầng được hàng trăm triệu người sử dụng, các phòng thí nghiệm đã phải chuyển từ các nguyên tắc rộng rãi sang các quy tắc chi tiết dựa trên các mô hình lạm dụng thực tế: hoạt động gây ảnh hưởng cho thuê, công cụ giám sát, phát triển vũ khí tự động và các lĩnh vực có rủi ro cao như tư vấn y tế và tài chính.
OpenAI, Google DeepMind và Meta đều đã lặp lại các chính sách sử dụng của họ trong hai năm qua, mặc dù quyết định của Anthropic nhằm quy định rõ ràng cách người dùng đối xử với mô hình, thay vì chỉ những gì họ làm, vẫn là điều bất thường. Những người chỉ trích nghiên cứu mô hình phúc lợi cho rằng nó nhân cách hóa các hệ thống thống kê, trong khi những người ủng hộ cho rằng nếu có bất kỳ khả năng nào khác không thì các mô hình hiện tại hoặc tương lai gần có kinh nghiệm liên quan đến phúc lợi, thì các công ty có nghĩa vụ phải hành động trong điều kiện không chắc chắn.
Thời điểm cũng có vấn đề về mặt thương mại. Anthropic được cho là đang chuẩn bị cho một đợt IPO với mức định giá lên tới 2 nghìn tỷ USD và người mua doanh nghiệp ngày càng cân nhắc các hoạt động quản trị nhà cung cấp bên cạnh chất lượng mô hình thô. Chính sách sử dụng được ghi chép rõ ràng, được cập nhật thường xuyên đóng vai trò vừa là một công cụ an toàn vừa là một công cụ bán hàng: nó mang lại cho các nhóm mua sắm và cơ quan quản lý một cơ sở cụ thể để tin tưởng vào nền tảng, đồng thời hệ thống hóa điều khoản phúc lợi mô hình báo hiệu rằng Anthropic dự định tiếp tục đầu tư vào một lĩnh vực mà hầu hết các đối thủ cạnh tranh đều chưa giải quyết.
Câu hỏi thực thi vẫn còn bỏ ngỏ
Các câu hỏi thực tế rất có ý nghĩa. Việc phát hiện hành vi tàn ác "liên tục và không cần thiết" đòi hỏi phải giám sát các cuộc trò chuyện ở mức độ chi tiết mà các khách hàng doanh nghiệp quan tâm đến quyền riêng tư có thể phản đối và việc vạch ra ranh giới giữa hành vi lạm dụng bị cấm và "phản hồi" hoặc "thử nghiệm mô hình" hợp pháp là một lời kêu gọi phán xét có thể sẽ bị tranh cãi.
Anthropic chưa cho biết liệu các vi phạm có được theo dõi trên các tài khoản hay không, liệu việc triển khai của doanh nghiệp có phải tuân theo các tiêu chuẩn giám sát khác nhau hay không hoặc liệu công ty có công bố dữ liệu minh bạch về các hành động thực thi hay không, giống như đối với các loại lạm dụng khác trong các báo cáo chính sách định kỳ của mình.
Điều rõ ràng là các hợp đồng xã hội của các phòng thí nghiệm biên giới với người dùng của họ ngày càng chi tiết hơn. Một chính sách từng nằm gọn trên một trang giờ đây bao gồm các cuộc bầu cử, giám sát gián điệp liền kề, vũ khí sinh học và giờ đây là hành vi cảm xúc của con người ở phía bên kia cửa sổ trò chuyện.
Ý nghĩa của nó đối với nhà phát triển
Đối với các nhóm xây dựng trên API Claude, tác động trong ngắn hạn có thể là rất nhỏ: điều khoản về hành vi lạm dụng nhắm vào hành vi cực đoan, lặp đi lặp lại và cơ chế chấm dứt cuộc trò chuyện mà nó chính thức hóa đã có từ năm 2025. Tuy nhiên, các nhà phát triển trong các danh mục liền kề, tư vấn chính trị, nghiên cứu đối lập, tiếp thị gây ảnh hưởng, nên xem xét cẩn thận các điều khoản về chiến dịch và bầu cử mới vì chúng hợp nhất các quy tắc trước đây đã phổ biến trên nhiều tài liệu và loại bỏ một số điểm mơ hồ mà các trường hợp sử dụng vùng xám dựa vào.
Bản cập nhật cũng báo hiệu nơi mà sự chú ý của cơ quan quản lý đang hướng tới. Với các nghĩa vụ minh bạch của Đạo luật AI của EU đang được thực hiện dần dần và các cơ quan lập pháp tiểu bang của Hoa Kỳ thông qua các đạo luật AI ngày càng chắp vá, các chính sách sử dụng tự nguyện đang ngày càng hoạt động như một khuôn mẫu mà các cơ quan quản lý xem xét kỹ lưỡng khi quyết định các tiêu chuẩn triển khai có trách nhiệm.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →