Anthropic đã bắt đầu yêu cầu người dùng Claude tự nguyện chia sẻ các cuộc trò chuyện bằng giọng nói của họ để giúp đào tạo và cải thiện các mô hình AI của mình. Theo báo cáo của BleepingComputer, lời nhắc mới xuất hiện khi mọi người sử dụng tính năng giọng nói của Claude và yêu cầu rõ ràng quyền sử dụng dữ liệu giọng nói của họ để đào tạo.

Lời nhắc có nội dung: "Cho phép chúng tôi sử dụng dữ liệu giọng nói của bạn để cải thiện các mô hình AI của chúng tôi", sau đó là lời giải thích rằng "bản ghi âm và dữ liệu trò chuyện bằng giọng nói giúp cải thiện cách các mô hình Anthropic AI hiểu và phản hồi lời nói. Hãy tắt tính năng này hoặc xóa dữ liệu này bất cứ lúc nào trong cài đặt." Người dùng có thể chọn Cho phép hoặc Không phải bây giờ và yêu cầu cũng có thể được quản lý sau này thông qua nút chuyển đổi chuyên dụng bên trong cài đặt quyền riêng tư của Claude. Nếu bạn đang theo dõi cách các phòng thí nghiệm AI lớn xử lý sự đồng ý của người dùng, thì đây là một trong những ví dụ cụ thể hơn về việc kiểm soát dữ liệu chi tiết, có thể đảo ngược trong việc vận chuyển trong trợ lý chính thống. Để biết thêm bối cảnh, hãy xem tin tức của chúng tôi về những phát triển AI mới nhất.

Một công tắc riêng cho giọng nói

Chi tiết đáng chú ý nhất là việc đào tạo giọng nói được xử lý riêng biệt với tùy chọn hiện có của Anthropic để sử dụng các cuộc trò chuyện và phiên mã hóa để cải thiện mô hình. Điều đó có nghĩa là người dùng có thể cho phép Anthropic đào tạo các cuộc trò chuyện bằng giọng nói của họ trong khi loại trừ các cuộc trò chuyện thông thường và các phiên Mã Claude khỏi quá trình đào tạo hoặc ngược lại.

Bên trong Cài đặt > Quyền riêng tư, Anthropic mô tả tùy chọn là "Cho phép chúng tôi sử dụng dữ liệu giọng nói của bạn" với văn bản hỗ trợ nêu rõ: "Đối với các phiên được phê duyệt, hãy cho phép sử dụng bản ghi âm và dữ liệu trò chuyện thoại của bạn để cải thiện các mô hình AI của Anthropic."

Theo BleepingComputer, cài đặt này bị tắt theo mặc định trong giao diện mà cửa hàng đã xem xét, do đó Anthropic không tự động đăng ký người dùng chia sẻ dữ liệu giọng nói. Những người chọn tham gia cũng có thể tắt tùy chọn này sau và công ty cho biết dữ liệu giọng nói có thể bị xóa khỏi cài đặt bất kỳ lúc nào.

Tại sao dữ liệu giọng nói lại quan trọng đối với việc đào tạo

Giọng nói là một loại dữ liệu cơ bản khác với văn bản. Lời nói mang trọng âm, nhịp điệu, cảm xúc và tiếng ồn xung quanh, tất cả đều khó tổng hợp một cách thuyết phục và tốn kém để dán nhãn. Đào tạo về các cuộc trò chuyện thực tế là một trong những cách trực tiếp nhất để phòng thí nghiệm giúp trợ lý giọng nói phát ra âm thanh tự nhiên hơn, xử lý các gián đoạn một cách khéo léo và phục hồi sau khi nghe nhầm.

Giá trị đó chính xác là lý do tại sao dữ liệu giọng nói lại nhạy cảm. Bản ghi âm giọng nói của ai đó có bản chất sinh trắc học, có thể tiết lộ thông tin mà người nói không bao giờ có ý định chia sẻ và thường thu hút những người khác trong phòng không bao giờ đồng ý với bất cứ điều gì. Các cơ quan quản lý ở một số khu vực pháp lý xử lý các bản ghi âm giọng nói một cách thận trọng hơn so với văn bản và bất kỳ việc xử lý sai nào đối với chúng đều có xu hướng thu hút sự giám sát quá mức.

Bằng cách làm cho việc chuyển đổi giọng nói trở nên khác biệt với lựa chọn tham gia đào tạo chung, Anthropic thừa nhận rằng người dùng có thể muốn có các quy tắc khác nhau cho các loại dữ liệu khác nhau. Đó là một lựa chọn thiết kế mà những người dùng quan tâm đến quyền riêng tư đã yêu cầu từ lâu: thay vì một công tắc chung gộp văn bản, mã và âm thanh lại với nhau, mỗi danh mục có thể được đánh giá theo các điều kiện riêng.

Chọn tham gia theo mặc định, nhưng vẫn có câu hỏi

Việc triển khai cũng phản ánh trọng tâm của ngành đã chuyển dịch đến đâu. Trong thời kỳ đầu của chatbot, các cuộc trò chuyện của người dùng thường được sử dụng để đào tạo mà không cần nhiều nghi thức. Làn sóng phản ứng dữ dội của người dùng, sự chú ý của cơ quan quản lý và các yêu cầu của khách hàng doanh nghiệp đã thúc đẩy các phòng thí nghiệm lớn hướng tới các biện pháp kiểm soát từ chối và trong một số trường hợp, mặc định chọn tham gia đối với dữ liệu nhạy cảm.

Cách tiếp cận của Anthropic ở đây chắc chắn nằm trong trại chọn tham gia: không có gì được chia sẻ trừ khi người dùng chủ động cho phép, lời nhắc được hiển thị tại thời điểm ai đó sử dụng tính năng giọng nói và việc thu hồi có sẵn trong cài đặt. Các nhà phê bình vẫn sẽ lưu ý rằng lời nhắc xuất hiện trong luồng sản phẩm có xu hướng chuyển đổi một phần người dùng có ý nghĩa và áp lực thực tế phải nhấp vào Cho phép là có thật đối với những người muốn tính năng này hoạt động tốt.

Cách diễn đạt riêng của công ty cố gắng giải quyết những lo ngại đó bằng cách nhấn mạnh khả năng đảo ngược: dữ liệu có thể bị tắt hoặc xóa bất kỳ lúc nào và quyền được giới hạn trong các phiên đã được phê duyệt thay vì được coi là một khoản trợ cấp vĩnh viễn.

Những điều người dùng nên biết

Đối với người dùng Claude, bài học thực tế rất đơn giản. Nếu bạn sử dụng tính năng giọng nói của Claude, bạn sẽ thấy lời nhắc. Nếu bạn từ chối, bản thân tính năng giọng nói sẽ không có gì thay đổi; đơn giản là bạn sẽ không đóng góp các bản ghi âm cho việc đào tạo. Nếu bạn chấp nhận và sau đó thay đổi quyết định, các điều khiển sẽ nằm trong Cài đặt > Quyền riêng tư, nơi chuyển đổi giọng nói nằm cùng với các tùy chọn đào tạo về Mã Claude và trò chuyện hiện có.

Bất kỳ ai đặc biệt thận trọng về âm thanh cũng nên nhớ rằng việc chia sẻ dữ liệu giọng nói, chẳng hạn như đào tạo trò chuyện, là một lựa chọn có thể được xem xét lại. Kiểm tra cài đặt quyền riêng tư một cách có chủ ý là một tư thế tốt hơn là phản ứng với các lời nhắc khi chúng xuất hiện.

Đối với ngành, việc triển khai là một điểm dữ liệu khác trong cuộc đàm phán đang diễn ra giữa các phòng thí nghiệm AI và người dùng của họ về việc ai tài trợ cho việc cải tiến mô hình bằng dữ liệu của họ. Trợ lý giọng nói đang trở thành giao diện chính cho AI và cách các công ty yêu cầu dữ liệu giọng nói hiện nay sẽ định hình kỳ vọng của người dùng trong nhiều năm. Phiên bản yêu cầu của Anthropic là minh bạch, được phân đoạn và có thể đảo ngược, đây là một tiêu chuẩn cao hơn mức mà ngành đã đáp ứng chỉ vài năm trước. Việc điều đó có trở thành mẫu tiêu chuẩn hay mức sàn được nâng lên cao hơn hay không sẽ phụ thuộc vào cách các đối thủ cạnh tranh xử lý cùng một câu hỏi và cách các cơ quan quản lý cân nhắc dữ liệu sinh trắc học được thu thập thông qua các sản phẩm AI tiêu dùng.

---

Đi trước AI

Nhận tin tức, phân tích và đột phá mới nhất về AI — tất cả ở cùng một nơi.

Đọc thêm tin tức về AI →