Anthropic telah mula meminta pengguna Claude untuk berkongsi perbualan suara mereka secara sukarela untuk membantu melatih dan menambah baik model AInya. Gesaan baharu muncul apabila orang menggunakan ciri suara Claude dan secara eksplisit meminta kebenaran untuk menggunakan data suara mereka untuk latihan, menurut laporan oleh BleepingComputer.
Gesaan itu berbunyi: "Benarkan kami menggunakan data suara anda untuk menambah baik model AI kami," diikuti dengan penjelasan bahawa "rakaman audio dan data sembang suara membantu memperbaik cara model AI Anthropic memahami dan bertindak balas terhadap pertuturan. Matikan ini atau padamkan data ini pada bila-bila masa dalam tetapan." Pengguna boleh memilih Benarkan atau Tidak sekarang, dan permintaan itu juga boleh diuruskan kemudian melalui togol khusus dalam tetapan privasi Claude. Jika anda menjejaki cara makmal AI utama mengendalikan persetujuan pengguna, ini adalah salah satu contoh yang lebih konkrit bagi data berbutir dan boleh balik mengawal penghantaran dalam pembantu arus perdana. Untuk lebih banyak konteks, lihat liputan kami tentang perkembangan AI terkini.
Suis berasingan untuk suara
Perincian yang paling ketara ialah latihan suara dikendalikan secara berasingan daripada pilihan sedia ada Anthropic untuk menggunakan sesi sembang dan pengekodan untuk penambahbaikan model. Ini bermakna pengguna boleh membenarkan Anthropic melatih perbualan suara mereka sambil mengekalkan sembang biasa dan sesi Claude Code dikecualikan daripada latihan, atau sebaliknya.
Dalam Tetapan > Privasi, Anthropic menerangkan pilihan sebagai "Benarkan kami menggunakan data suara anda," dengan teks sokongan yang menyatakan: "Untuk sesi yang diluluskan, benarkan penggunaan rakaman audio dan data sembang suara anda untuk memperbaik model AI Anthropic."
Menurut BleepingComputer, tetapan dilumpuhkan secara lalai dalam antara muka yang disemak oleh saluran keluar, jadi Anthropic tidak secara automatik mendaftarkan pengguna ke dalam perkongsian data suara. Orang yang ikut serta juga boleh mematikan pilihan kemudian, dan syarikat itu berkata data suara boleh dipadamkan daripada tetapan pada bila-bila masa.
Mengapa data suara penting untuk latihan
Suara ialah jenis data yang berbeza secara asas daripada teks. Pertuturan membawa aksen, irama, emosi dan bunyi latar belakang, yang semuanya sukar untuk disintesis dengan meyakinkan dan mahal untuk dilabel. Latihan tentang perbualan sebenar ialah salah satu cara paling langsung untuk makmal untuk membuat pembantu suara berbunyi lebih semula jadi, mengendalikan gangguan dengan anggun dan pulih daripada salah dengar.
Nilai itulah sebabnya data suara sensitif. Rakaman seseorang yang bercakap bersifat biometrik, boleh mendedahkan maklumat yang tidak pernah ingin dikongsi oleh penceramah, dan sering menangkap orang lain di dalam bilik yang tidak pernah bersetuju dengan apa-apa. Pengawal selia dalam beberapa bidang kuasa merawat rakaman suara dengan lebih berhati-hati daripada teks, dan sebarang salah pengendaliannya cenderung menarik perhatian yang terlalu besar.
Dengan membuat togol suara berbeza daripada ikut serta latihan am, Anthropic mengakui bahawa pengguna mungkin mahukan peraturan yang berbeza untuk jenis data yang berbeza. Ia merupakan pilihan reka bentuk yang telah lama diminta oleh pengguna yang mementingkan privasi: bukannya satu suis selimut yang menggabungkan teks, kod dan audio bersama-sama, setiap kategori boleh dinilai mengikut syaratnya sendiri.
Ikut serta secara lalai, tetapi soalan itu ada
Pelancaran itu juga mencerminkan di mana pusat graviti industri telah bergerak. Pada era awal chatbots, perbualan pengguna kerap digunakan untuk latihan dengan sedikit majlis. Gelombang tindak balas pengguna, perhatian kawal selia dan keperluan pelanggan perusahaan mendorong makmal utama ke arah kawalan memilih keluar, dan dalam beberapa kes lalai ikut serta untuk data sensitif.
Pendekatan Anthropic di sini terletak dengan kukuh dalam kem ikut serta: tiada apa yang dikongsi melainkan pengguna secara aktif membenarkannya, gesaan ditunjukkan pada masa seseorang menggunakan ciri suara dan pembatalan tersedia dalam tetapan. Pengkritik masih akan menyedari bahawa gesaan yang muncul dalam aliran produk cenderung untuk menukar bahagian pengguna yang bermakna dan tekanan praktikal untuk mengklik Benarkan adalah nyata untuk orang yang mahu ciri itu berfungsi dengan baik.
Kata-kata syarikat itu sendiri cuba mengatasi kebimbangan tersebut dengan menekankan kebolehbalikan: data boleh dimatikan atau dipadamkan pada bila-bila masa dan kebenaran itu dirangkumkan kepada sesi yang diluluskan dan bukannya dianggap sebagai geran kekal.
Perkara yang perlu diketahui oleh pengguna
Bagi pengguna Claude, pengambilan praktikal adalah mudah. Jika anda menggunakan ciri suara Claude, jangkakan untuk melihat gesaan. Jika anda menolak, tiada apa-apa tentang ciri suara itu sendiri harus berubah; anda tidak akan menyumbang rakaman untuk latihan. Jika anda menerima dan kemudian mengubah fikiran anda, kawalan akan disiarkan dalam Tetapan > Privasi, di mana togol suara berada di samping pilihan latihan sembang dan Kod Claude sedia ada.
Sesiapa sahaja yang sangat berhati-hati tentang audio juga harus ingat bahawa perkongsian data suara, seperti latihan sembang, ialah pilihan yang boleh dilawati semula. Menyemak tetapan privasi sekali, dengan sengaja, adalah postur yang lebih baik daripada bertindak balas terhadap gesaan semasa ia muncul.
Bagi industri, pelancaran adalah satu lagi titik data dalam rundingan berterusan antara makmal AI dan pengguna mereka mengenai siapa yang membiayai penambahbaikan model dengan data mereka. Pembantu suara menjadi antara muka utama untuk AI, dan cara syarikat meminta data pertuturan sekarang akan membentuk jangkaan pengguna selama bertahun-tahun. Versi pertanyaan Anthropic adalah telus, bersegmen dan boleh diterbalikkan, yang merupakan bar yang lebih tinggi daripada yang ditemui industri hanya beberapa tahun lalu. Sama ada ia menjadi templat standard, atau tingkatan dinaikkan lagi, bergantung pada cara pesaing mengendalikan soalan yang sama dan cara pengawal selia mengambil kira data biometrik yang dikumpul melalui produk AI pengguna.
---
Kekal Mendahului AIDapatkan berita, analisis dan penemuan terkini AI — semuanya di satu tempat.
Baca lebih banyak berita AI →