Google đã âm thầm thay đổi cài đặt quyền riêng tư theo cách cho phép công ty lưu trữ nhiều dữ liệu cá nhân của bạn hơn, bao gồm hình ảnh, tệp cũng như bản ghi âm thanh và video, để cải thiện các mô hình AI của mình. Theo TechCrunch, bản cập nhật có nghĩa là nếu bạn tải bất kỳ phương tiện nào lên dịch vụ Tìm kiếm của Google, giờ đây nó có thể được sử dụng để đào tạo trí tuệ nhân tạo của công ty trừ khi bạn chọn không tham gia theo cách thủ công. Sự thay đổi này đã làm mới sự xem xét kỹ lưỡng về cách những gã khổng lồ công nghệ thu thập dữ liệu cho AI và đó là loại câu chuyện mà tin nóng về AI của chúng tôi theo dõi chặt chẽ khi các hoạt động dữ liệu phát triển.
Một lựa chọn tham gia được ngụy trang thành sự lựa chọn
Sự thay đổi này diễn ra thông qua một bản cập nhật ngầm đối với cài đặt quyền riêng tư của dịch vụ Tìm kiếm của Google, được công bố lần đầu tiên vào tháng 6 qua email của khách hàng. Như Sarah Perez của TechCrunch đã báo cáo, về cơ bản, công ty đã chọn mọi người tham gia chương trình đào tạo AI mở rộng đồng thời định hình sự thay đổi nhằm mang lại cho người dùng nhiều quyền kiểm soát hơn đối với lịch sử đã lưu và các đề xuất được cá nhân hóa của họ.
Bản cập nhật đã giới thiệu hai cài đặt mới: Lịch sử dịch vụ tìm kiếm và Đề xuất được cá nhân hóa. Chúng cùng nhau quản lý cách sử dụng hoạt động của người dùng để cá nhân hóa trải nghiệm Google cũng như thời gian lưu giữ hoạt động trên web và ứng dụng. Thay vì yêu cầu người dùng đồng ý với việc đào tạo AI, Google đã bật tính năng thu thập dữ liệu mới theo mặc định, yêu cầu người dùng tự tìm và vô hiệu hóa tính năng đó.
Những người ủng hộ quyền riêng tư đã chỉ trích thiết kế này là một "mô hình đen tối" cổ điển, trong đó con đường ít bị cản trở nhất khiến người dùng chia sẻ nhiều dữ liệu hơn họ có thể nhận ra.
Cái gì đang được chụp
Phạm vi đào tạo mở rộng vượt xa các truy vấn tìm kiếm văn bản. Theo TechCrunch, thay đổi này áp dụng trên toàn bộ hệ sinh thái tìm kiếm rộng hơn của Google, bao gồm:
- Google Maps
- Mua sắm
- Chuyến bay
- Khách sạn
- Dịch
- Tin tức
Bề rộng đó có nghĩa là phương tiện truyền thông chảy qua nhiều sản phẩm hàng ngày của Google giờ đây có thể cung cấp dữ liệu cho các mô hình AI của công ty. Bản cập nhật đặc biệt bao gồm hình ảnh, tập tin và bản ghi âm thanh và video.
Ví dụ cụ thể
Một số tương tác phổ biến hiện nay nằm trong tầm kiểm soát. Khi bạn sử dụng Google Lens để tìm kiếm nội dung nào đó một cách trực quan bằng cách chụp ảnh, hình ảnh đó có thể được lưu để đào tạo về AI. Nếu bạn sử dụng tính năng Tìm kiếm trực tiếp mới hơn để tìm kiếm thông qua tính năng nhập giọng nói trong ứng dụng Google thì những bản ghi âm đó có thể được lưu trữ. Và nếu bạn sử dụng Google Dịch để luyện nói một ngôn ngữ thì âm thanh đó cũng sẽ được lưu.
Đối với những người dùng cho rằng tìm kiếm bằng giọng nói hoặc tra cứu ảnh của họ chỉ là tạm thời, việc mở rộng đánh dấu một sự thay đổi có ý nghĩa về những gì Google giữ lại và cho mục đích gì.
Tại sao Google muốn dữ liệu
Sự thay đổi này phản ánh xu hướng rộng hơn của ngành trong việc thu thập dữ liệu đào tạo bằng bất kỳ phương tiện cần thiết nào. Như TechCrunch đã lưu ý, thay vì chỉ dựa vào thông tin được lấy từ web mở, Google và các đối thủ cạnh tranh ngày càng muốn dữ liệu của bên thứ nhất được thu thập trực tiếp từ các sản phẩm của chính họ.
Dữ liệu đa phương thức, chất lượng cao, hình ảnh được ghép nối với ngữ cảnh, âm thanh với bản ghi và tệp có siêu dữ liệu, đã trở thành một trong những tài nguyên quý giá nhất để cải thiện các mô hình AI. Đối với Google, công ty cạnh tranh với OpenAI, Anthropic và các công ty khác về AI văn bản, hình ảnh và giọng nói, các dịch vụ của riêng họ là nguồn dữ liệu phong phú độc đáo. Thay đổi về quyền riêng tư biến hàng tỷ tương tác hàng ngày của người dùng thành tài liệu đào tạo tiềm năng một cách hiệu quả.
Động thái này cũng diễn ra khi các nhà xuất bản web ngày càng tích cực hơn trong việc chặn trình thu thập thông tin AI, thúc đẩy các công ty tìm nguồn dữ liệu thay thế.
Cách chọn không tham gia
Người dùng lo ngại về thay đổi có thể vô hiệu hóa bộ sưu tập mới thông qua cài đặt tài khoản Google của họ. Các nút chuyển đổi có liên quan là cài đặt Lịch sử dịch vụ tìm kiếm và Đề xuất được cá nhân hóa, kiểm soát cách lưu trữ và sử dụng hoạt động từ các dịch vụ tìm kiếm của Google.
Các bước hạn chế thu thập dữ liệu
1. Mở cài đặt bảo mật Tài khoản Google của bạn.
2. Xác định vị trí cài đặt Lịch sử dịch vụ tìm kiếm và tắt cài đặt này để ngăn lưu phương tiện cho mục đích đào tạo.
3. Xem xét Đề xuất được cá nhân hóa, điều này cũng ảnh hưởng đến cách hoạt động của bạn cung cấp thông tin cho việc cá nhân hóa.
4. Kiểm tra các điều khiển Hoạt động web và ứng dụng để điều chỉnh thời gian lưu giữ dữ liệu của bạn.
Việc tắt các cài đặt này sẽ giảm dữ liệu Google lưu trữ từ các tương tác dịch vụ tìm kiếm của bạn, mặc dù việc này cũng có thể hạn chế một số tính năng cá nhân hóa.
Phản ứng dữ dội về quyền riêng tư
Bản cập nhật đã gây ra những lời chỉ trích mới từ các nhà nghiên cứu về quyền riêng tư và các nhóm quyền kỹ thuật số, những người cho rằng việc đào tạo AI cần phải có sự đồng ý rõ ràng, đầy đủ thông tin thay vì đăng ký mặc định. Khiếu nại cốt lõi mang tính cấu trúc: bằng cách tự động bật tính năng thu thập dữ liệu, Google chuyển gánh nặng cho người dùng trong việc khám phá và vô hiệu hóa tính năng này vì biết rằng hầu hết sẽ không bao giờ thay đổi cài đặt mặc định.
Google đã bảo vệ sự thay đổi này như một phần nhằm mang lại cho người dùng sự minh bạch và quyền kiểm soát tốt hơn đối với cách sử dụng hoạt động của họ. Công ty cho biết các cài đặt được giải thích rõ ràng và người dùng có thể điều chỉnh chúng bất kỳ lúc nào.
Mô hình ngành rộng hơn
Google hầu như không đơn độc. Meta, X và các nền tảng khác có các điều khoản được cập nhật tương tự để cho phép đào tạo AI về nội dung người dùng, thường có cơ chế chọn không tham gia thay vì chọn tham gia. Khi cuộc tranh giành dữ liệu đào tạo ngày càng gia tăng, việc thu thập dữ liệu được đăng ký mặc định đang trở thành tiêu chuẩn chứ không phải là ngoại lệ trên internet tiêu dùng.
Các cơ quan quản lý ở Liên minh Châu Âu đã báo hiệu sự giám sát chặt chẽ các hoạt động như vậy theo GDPR, thường yêu cầu sự đồng ý rõ ràng để xử lý dữ liệu cá nhân. Cách các cơ quan quản lý Hoa Kỳ phản ứng vẫn là một câu hỏi mở, mặc dù luật về quyền riêng tư của tiểu bang ở California và các nơi khác cuối cùng có thể hạn chế việc thu thập dữ liệu mặc định.
Hiện tại, bài học thực tế dành cho người dùng rất đơn giản: nếu bạn sử dụng Google, bạn có thể đang đào tạo AI của nó và cách duy nhất để ngăn chặn điều đó là tự mình chọn không tham gia.
Đi trước AI
Để biết thông tin liên tục về quyền riêng tư của AI, đạo đức dữ liệu và cách các công ty công nghệ lớn nhất đang định hình lại hoạt động xử lý dữ liệu của họ, hãy theo dõi AI Buzz Wire để biết tin tức về ngành AI giúp bạn luôn cập nhật thông tin.
Đọc thêm tin tức về đạo đức AI →


