Компанія Anthropic почала просити користувачів Claude добровільно ділитися своїми голосовими розмовами, щоб допомогти навчати та вдосконалювати її моделі ШІ. Відповідно до звіту BleepingComputer, новий запит з’являється, коли люди використовують голосові функції Клода, і явно запитує дозвіл на використання їхніх голосових даних для навчання.

Підказка звучить так: «Дозвольте нам використовувати ваші голосові дані для покращення наших моделей штучного інтелекту», а потім пояснюється, що «аудіозаписи та дані голосового чату допомагають покращити те, як моделі антропічного штучного інтелекту розуміють і реагують на мову. Вимкніть це або видаліть ці дані в будь-який час у налаштуваннях». Користувачі можуть вибрати «Дозволити» або «Не зараз», а запитом можна керувати пізніше за допомогою спеціального перемикача в налаштуваннях конфіденційності Клода. Якщо ви відстежуєте, як великі лабораторії штучного інтелекту обробляють згоду користувачів, це один із більш конкретних прикладів детальних оборотних елементів керування даними, які надходять у стандартний помічник. Для отримання додаткової інформації дивіться наше висвітлення [останніх розробок ШІ] (https://aibuzzwire.news).

Окремий перемикач для голосу

Найпомітнішою деталлю є те, що навчання голосу обробляється окремо від існуючої можливості Anthropic використовувати чати та сеанси кодування для вдосконалення моделі. Це означає, що користувач може дозволити Anthropic тренуватися на їхніх голосових розмовах, виключаючи звичайні чати та сеанси Клода Коду з навчання, або навпаки.

У розділі «Налаштування» > «Конфіденційність» Anthropic описує цю опцію як «Дозвольте нам використовувати ваші голосові дані» з супровідним текстом: «Для схвалених сеансів дозвольте використовувати ваші аудіозаписи та дані голосового чату для покращення моделей штучного інтелекту Anthropic».

За даними BleepingComputer, цей параметр вимкнено за замовчуванням в інтерфейсі, який розглянула розетка, тому Anthropic не реєструє користувачів автоматично для обміну голосовими даними. Люди, які погодилися, також можуть вимкнути опцію пізніше, і компанія каже, що голосові дані можна видалити з налаштувань у будь-який час.

Чому голосові дані важливі для навчання

Голос — принципово відмінний від тексту тип даних. Мова несе в собі акцент, каденцію, емоції та фоновий шум, усе це важко переконливо синтезувати та дорого позначити. Навчання реальним розмовам є одним із найпряміших способів для лабораторії зробити голосовий помічник звучанні природнішим, витонченіше обробляти переривання та відновлюватися після помилок.

Саме через це значення голосові дані є чутливими. Запис розмови має біометричний характер, може виявити інформацію, якою спікер ніколи не збирався ділитися, і часто записує інших людей у ​​кімнаті, які ніколи ні на що не погоджувалися. Регулятори в кількох юрисдикціях ставляться до записів голосу з більшою обережністю, ніж до тексту, і будь-яке неправильне поводження з ними, як правило, привертає надмірну увагу.

Виділяючи голосове перемикання від загального навчання, Anthropic визнає, що користувачам можуть знадобитися різні правила для різних типів даних. Користувачі, які піклуються про конфіденційність, давно вимагали цього вибору дизайну: замість одного загального перемикача, який об’єднує текст, код і аудіо, кожну категорію можна оцінювати за власними умовами.

Увімкнено за умовчанням, але запит є

Розгортання також відображає, куди перемістився центр ваги галузі. На початку ери чат-ботів розмови користувачів часто використовувалися для навчання з невеликими урочистостями. Хвиля негативної реакції користувачів, регуляторна увага та вимоги корпоративних клієнтів підштовхнули великі лабораторії до засобів контролю відмови, а в деяких випадках і до стандартних умов для конфіденційних даних.

Підхід Anthropic тут твердо тримається в таборі згоди: ніщо не ділиться, якщо користувач активно не дозволив це, підказка відображається в момент, коли хтось використовує голосові функції, а відкликання доступне в налаштуваннях. Критики все одно зауважуватимуть, що підказки, які з’являються всередині потоку продукту, як правило, перевертають значну частку користувачів, і що практичний тиск, щоб натиснути кнопку «Дозволити», реальний для людей, які хочуть, щоб функція працювала добре.

Власне формулювання компанії намагається усунути ці занепокоєння, наголошуючи на оборотності: дані можна вимкнути або видалити в будь-який час, а дозвіл поширюється на схвалені сеанси, а не розглядається як постійний грант.

Що повинні знати користувачі

Для користувачів Claude практичний висновок простий. Якщо ви використовуєте голосові функції Клода, очікуйте, що побачите підказку. Якщо ви відмовитеся, нічого в самій голосовій функції не зміниться; ви просто не будете вносити записи в навчання. Якщо ви погодитесь і пізніше передумаєте, елементи керування з’являться в меню «Налаштування» > «Конфіденційність», де голосовий перемикач розміщено поруч із наявними параметрами чату та навчання Клода Коду.

Усім, хто особливо обережно ставиться до аудіо, слід також пам’ятати, що обмін голосовими даними, як і навчання в чаті, є вибором, до якого можна повернутися. Навмисно один раз перевірити налаштування конфіденційності – це краще, ніж реагувати на підказки, щойно вони з’являться.

Для галузі розгортання є ще однією точкою даних у поточних переговорах між лабораторіями штучного інтелекту та їхніми користувачами щодо того, хто фінансує вдосконалення моделі за допомогою їхніх даних. Голосові помічники стають основним інтерфейсом для штучного інтелекту, і те, як компанії запитують мовні дані зараз, впливатиме на очікування користувачів протягом багатьох років. Версія запиту від Anthropic є прозорою, сегментованою та оборотною, що є вищою планкою, ніж галузь досягла лише кілька років тому. Чи стане це стандартним шаблоном, чи мінімальна кількість буде підвищена далі, залежатиме від того, як конкуренти вирішать це питання та як регулятори оцінять біометричні дані, зібрані за допомогою споживчих продуктів ШІ.

---

Будьте попереду ШІ

Отримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.

Читати більше новин AI →