OpenAI a anunțat miercuri că oferă Zero Data Retention (ZDR) pentru modelele sale de frontieră și a previzualizat un nou sistem numit Private Safety Processing, conceput pentru a detecta utilizarea greșită în mai multe interacțiuni fără a oferi companiei acces la conținutul clienților. Mișcarea trasează o linie clară împotriva concurenților: Axios a raportat că anunțul vine în momentul în care Anthropic cere acum clienților să permită jurnalele de date, iar Firstpost a remarcat contrastul cu trecerea Anthropic la păstrarea datelor pe 30 de zile.

Momentul nu este subtil. În anunțul său, OpenAI a observat că „unele implementări recente de model de frontieră au cerut clienților să permită furnizorului lor de AI să păstreze conținut sensibil pentru monitorizarea siguranței” – cerințe pe care compania spune că „intră în conflict cu obligațiile sau angajamentele lor de securitate față de oamenii pe care îi servesc”. Compania poziționează confidențialitatea ca o armă competitivă în concursul pentru clienții întreprinderi reglementate. For more context on this story, see our ongoing latest AI developments.

Ce promite Zero Data Retention

În cadrul ofertei ZDR, clienții API eligibili primesc ceea ce OpenAI descrie drept „o promisiune clară”: OpenAI nu reține solicitări sau răspunsuri model după procesarea unei cereri. Conținutul clienților nu este disponibil personalului OpenAI pentru revizuire, iar datele clienților întreprinderii nu sunt folosite pentru a antrena modelele OpenAI decât dacă clienții se angajează în mod explicit.

Pentru băncile, spitalele și firmele de avocatură care cântăresc adoptarea AI, aceste angajamente abordează cel mai comun deal-breaker: riscul ca materialele sensibile care circulă prin sistemele unui furnizor de AI să poată fi stocate, citite sau absorbite în modelele viitoare. OpenAI observă că organizațiile cu care lucrează se ocupă de „înregistrări financiare, date de sănătate, planuri de afaceri confidențiale și cercetări de proprietate”.

Reținerea problemei de siguranță se rezolva

Anunțul admite și o tensiune tehnică reală. După cum OpenAI însuși îl descrie, cele mai grave riscuri de siguranță AI nu sunt întotdeauna vizibile într-o singură interacțiune. Intențiile dăunătoare pot deveni clare numai atunci când interacțiunile multiple sunt privite împreună - atunci când actorii răi verifică în mod repetat măsurile de protecție, se coordonează între conturi, maschează amenințările ca cercetări de rutină sau când un agent AI continuă să acționeze după ce i se spune să se oprească.

Sistemele de siguranță existente compatibile cu ZDR evaluează fiecare interacțiune în mod individual, ceea ce înseamnă că riscurile bazate pe modele scapă. Furnizorii care au răspuns solicitând reținerea au rezolvat o problemă creând alta, forțând clienții să aleagă între monitorizarea siguranței și propriile obligații de confidențialitate.

Cum funcționează procesarea de siguranță privată

Rezoluția propusă de OpenAI este arhitecturală. În cadrul Private Safety Processing, conținutul clienților rămâne pe infrastructura controlată de client sau, într-o opțiune încă în dezvoltare, este stocat pe infrastructura OpenAI criptată cu chei controlate de client. Sistemele automate analizează apoi modelele în interacțiunile aferente și returnează „semnale de siguranță limitate” – semnale despre potențiala utilizare greșită – fără a expune solicitările sau răspunsurile de bază personalului OpenAI.

Clienții investighează alertele folosind informațiile disponibile în propriile lor sisteme. Dacă doresc să conteste o decizie de executare, să clarifice o activitate legitimă sau să sprijine o investigație privind abuzul verificat, pot alege să partajeze informații relevante cu OpenAI. Cu alte cuvinte, confidențialitatea devine opțiunea implicită și dezvăluie clientului.

Sistemul este în prezent testat cu primii clienți. OpenAI spune că intenționează să înceapă să lanseze Private Safety Processing și să publice o carte albă tehnică în septembrie.

Încrederea în întreprinderi ca piață

Anunțul a sosit cu o mărturie a clientului care se citește ca un argument de achiziție. „Adoptarea IA pentru întreprinderi depinde exclusiv de controlul datelor de către clienți, fără o utilizare directă sau derivată dincolo de serviciul ales”, a declarat Sunil Agrawal, Chief Information Security Officer la Glean, al cărui citat OpenAI a publicat alături de postare. „Pe măsură ce modelele devin mai capabile, OpenAI arată că siguranța poate avansa fără a compromite confidențialitatea și controlul care susțin încrederea întreprinderii”.

OpenAI încadrează previzualizarea ca un răspuns la cerere, spunând că a auzit de la clienți „tare și clar că au nevoie de predictibilitate cu privire la modul în care conținutul lor va fi protejat pe măsură ce sistemele AI devin mai capabile”. Compania adaugă că abordarea este modelată de clienți „din industrii, regiuni și dimensiuni ale companiei” și că va ține clienții informați cu suficient timp pentru a planifica implementările în jurul schimbărilor.

Dezbaterea aceasta va declanșa

Cercetătorii în domeniul siguranței au susținut de mult timp că vizibilitatea asupra tiparelor de utilizare este esențială pentru a surprinde utilizarea greșită înainte de a provoca rău, iar unii se vor întreba dacă analiza automată, criptată se poate potrivi cu calitatea detectării evaluării umane. Susținătorii confidențialității, între timp, vor saluta o arhitectură care tratează accesul la datele clienților mai degrabă o decizie a clientului decât o prerogativă a furnizorului.

Ceea ce este clar este că guvernarea datelor s-a mutat de la amprenta legală la centrul competiției AI. Pe măsură ce modelele de frontieră preiau sarcini mai lungi și mai autonome în industriile reglementate, întrebarea cine poate vedea urmele pe care acele sisteme le lasă în urmă - clientul, furnizorul sau nimeni - devine o axă principală pe care se câștigă și se pierd ofertele de IA pentru întreprinderi. OpenAI și-a făcut acum răspunsul explicit și și-a pus rivalii în situația de a-și apăra pe ai lor.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →