У середу OpenAI оголосила, що пропонує Zero Data Retention (ZDR) для своїх передових моделей, і представила нову систему під назвою Private Safety Processing, призначену для виявлення зловживань під час кількох взаємодій, не надаючи компанії доступу до клієнтського вмісту. Цей крок різко протиставляє конкурентам: Axios повідомили, що оголошення відбувається, оскільки Anthropic тепер вимагає від клієнтів дозволити журнали даних, а Firstpost відзначив контраст із переходом Anthropic на 30-денне зберігання даних.

Час не є тонким. У своєму оголошенні OpenAI зазначив, що «деякі нещодавні розгортання передової моделі вимагали від клієнтів дозволити своїм постачальникам штучного інтелекту зберігати конфіденційний вміст для моніторингу безпеки» — вимоги, за словами компанії, «суперечають їхнім зобов’язанням щодо безпеки або зобов’язанням перед людьми, яких вони обслуговують». Компанія позиціонує конфіденційність як конкурентну зброю в боротьбі за регульованих корпоративних клієнтів. For more context on this story, see our ongoing breaking AI news.

Що обіцяє Zero Data Retention

Відповідно до пропозиції ZDR відповідні клієнти API отримують те, що OpenAI описує як «чітку обіцянку»: OpenAI не зберігає підказок або моделює відповіді після обробки запиту. Вміст клієнта недоступний для перегляду персоналом OpenAI, а корпоративні дані клієнтів не використовуються для навчання моделей OpenAI, якщо клієнти явно не погодяться.

Для банків, лікарень і юридичних фірм, які зважують впровадження штучного інтелекту, ці зобов’язання спрямовані на вирішення найпоширенішої проблеми: ризик того, що конфіденційний матеріал, який проходить через системи постачальника штучного інтелекту, може бути збережений, зчитаний або абсорбований у майбутніх моделях. OpenAI зазначає, що організації, з якими він співпрацює, обробляють «фінансові записи, дані про здоров’я, конфіденційні бізнес-плани та власні дослідження».

Вирішено проблему збереження безпеки

Оголошення також визнає справжню технічну напругу. Як описує сам OpenAI, найсерйозніші ризики безпеки ШІ не завжди помітні в одній взаємодії. Шкідливі наміри можуть стати очевидними лише тоді, коли багато взаємодій розглядаються разом — коли зловмисники неодноразово перевіряють заходи безпеки, координують облікові записи, маскують загрози під рутинні дослідження або коли агент ШІ продовжує діяти після того, як йому наказано зупинитися.

Існуючі ZDR-сумісні системи безпеки оцінюють кожну взаємодію окремо, що означає, що ризики на основі шаблонів прослизають. Постачальники, які у відповідь вимагали утримання, вирішували одну проблему, створюючи іншу, змушуючи клієнтів вибирати між моніторингом безпеки та власними зобов’язаннями щодо конфіденційності.

Як працює приватна безпека

Запропоноване рішення OpenAI є архітектурним. У рамках обробки приватної безпеки вміст клієнта залишається в інфраструктурі, якою керує клієнт, або, у варіанті, що ще розробляється, зберігається в інфраструктурі OpenAI, зашифрованою за допомогою ключів, якими керує клієнт. Автоматизовані системи потім аналізують шаблони пов’язаних взаємодій і повертають «обмежені сигнали безпеки» — позначки про потенційне зловживання — без надання персоналу OpenAI основних підказок або відповідей.

Клієнти досліджують сповіщення, використовуючи інформацію, доступну в їхніх власних системах. Якщо вони хочуть оскаржити рішення про примусове виконання, пояснити законну діяльність або підтримати розслідування перевірених зловживань, вони можуть поділитися відповідною інформацією з OpenAI. Іншими словами, конфіденційність стає опцією клієнта за умовчанням і розкриття інформації.

Зараз система тестується з першими клієнтами. OpenAI каже, що планує розпочати розгортання обробки приватної безпеки та опублікувати технічну документацію у вересні.

Довіра підприємства як ринок

Оголошення надійшло з відгуком клієнта, який читається як аргумент щодо закупівлі. «Впровадження штучного інтелекту на підприємстві залежить виключно від контролю даних клієнтами, без прямого чи похідного використання за межами вибраної служби», — сказав Суніл Агравал, директор з інформаційної безпеки компанії Glean, чию цитату OpenAI опублікував разом із публікацією. «У міру того, як моделі стають дедалі ефективнішими, OpenAI показує, що безпека може підвищуватися без шкоди для конфіденційності та контролю, які підтримують довіру підприємства».

OpenAI розглядає попередній перегляд як відповідь на попит, кажучи, що клієнти «голосно й чітко почули, що їм потрібна передбачуваність щодо того, як їхній контент буде захищений, коли системи штучного інтелекту стануть більш спроможними». Компанія додає, що підхід формується клієнтами «в різних галузях, регіонах і розмірах компаній», і що він інформуватиме клієнтів, маючи достатньо часу для планування розгортання відповідно до змін.

Дебати, які це спровокує

Дослідники безпеки вже давно стверджують, що видимість моделей використання є важливою для виявлення зловживань, перш ніж вони заподіють шкоду, і деякі сумніваються, чи може автоматичний зашифрований аналіз відповідати якості виявлення перевірці людиною. Тим часом прихильники конфіденційності вітатимуть архітектуру, яка розглядатиме доступ до даних клієнтів як рішення клієнта, а не прерогативу постачальника.

Очевидно лише те, що управління даними перемістилося з легального дрібного шрифту в центр конкуренції ШІ. Оскільки передові моделі беруть на себе більш тривалі й більш автономні завдання в регульованих галузях, питання про те, хто може бачити сліди, які залишають за собою ці системи — клієнт, постачальник чи ніхто — стає основною віссю, на якій виграють і програють угоди корпоративного штучного інтелекту. Тепер OpenAI дав чітку відповідь і поставив своїх суперників у положення захищати свої.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →