Lideri de opinie

Ce nu spune Actul UE privind IA despre datele de antrenament pentru fondatori

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Articolul 50 din Actul UE privind IA cere unui sistem de inteligență artificială să dezvăluie faptul că o persoană vorbește cu o mașină. Nu spune nimic despre ce se întâmplă cu acea conversație odată ce dezvăluirea a fost făcută.

Fondatorii care construiesc produse pe baza unui model de bază se concentrează pe precizie și preț. Întrebarea despre ce se întâmplă cu datele utilizatorilor lor odată ce acestea părăsesc produsul și sunt procesate de un model terț nu apare de obicei în timpul selecției furnizorului.

Regula a devenit aplicabilă la 2 august 2026, și amenzi pentru neconformitate pot ajunge până la 15 milioane de euro sau 3% din cifra de afaceri anuală globală, oricare dintre acestea este mai mare. Păstrarea și antrenamentul se află complet în afara domeniului său de aplicare. Dacă aplicația dvs. trimite conversații ale utilizatorilor către un model terț, practicile de date ale acelui furnizor devin parte a produsului dvs., chiar dacă nu ați intenționat să facă acest lucru.

Regula implicită în industrie este antrenamentul, nu întrebarea

Cercetătorii de la Institutul pentru Inteligență Artificială Centrată pe Uman de la Stanford au examinat politicile de confidențialitate ale a șase mari dezvoltatori de IA din SUA, inclusiv Amazon (AMZN ), Anthropic, Google, Meta, Microsoft (MSFT ) și OpenAI, și au constatat că toți aceștia foloseau datele de conversație ale clienților pentru a-și antrena modelele, cu unii păstrând aceste date indefinit. Cercetătorul principal Jennifer King a fost direct atunci când a fost întrebată dacă utilizatorii sistemelor de chat cu IA ar trebui să se îngrijoreze cu privire la confidențialitatea lor, răspunzând “absolut da”. Prin urmare, antrenamentul ar trebui să fie considerat ipoteza implicită, cu excepția cazului în care documentația furnizorului spune altceva. Detaliile, totuși, variază de la un furnizor la altul și merită o atenție deosebită înainte de a se angaja să utilizeze o platformă.

Odată lăudat pentru abordarea sa conștientă din punct de vedere al confidențialității, Anthropic a modificat termenii săi pentru consumatori astfel încât conversațiile cu Claude sunt acum utilizate pentru antrenament în mod implicit, utilizatorii putând să opteze pentru a nu face acest lucru. Acest lucru ilustrează modul în care rapidă poate schimba o politică de antrenament a unui furnizor, chiar și atunci când confidențialitatea a făcut parte din prezentarea sa inițială.

În alte modele, optarea pentru a nu face acest lucru nu funcționează pe deplin. Google păstrează conversațiile Gemini examinate de annotatori umani timp de până la trei ani, și dezactivarea setării Activitatea aplicațiilor Gemini nu anulează acest lucru. Odată ce o conversație a fost marcată pentru examinare umană, aceasta rămâne în sistemele Google pe o pistă de reținere separată, indiferent ce face utilizatorul ulterior.

Character.AI a fost antrenat pe conversații ale utilizatorilor în mod implicit și a oferit o posibilitate de a opta pentru a nu face acest lucru doar utilizatorilor din SEE și Regatul Unit, ceea ce îl plasează la capătul permisiv al practicilor de date prezentate aici. În mod separat, compania a înfruntat provocări legale și de imagine. În ianuarie 2026, Character.AI și Google au ajuns la un acord de principiu pentru a soluționa un grup de procese care afirmă că au cauzat prejudicii din interacțiunile platformei cu minori, fără legătură cu politica sa de antrenament cu date. Google a fost numit co-pârât din cauza legăturilor sale cu fondatorii Character.AI, și deși nu s-a recunoscut nicio răspundere și termenii nu au fost divulgați, cazul arată că expunerea legală legată de un furnizor de IA poate ajunge la companiile care îl sprijină.

Ferestrele de reținere, declanșatoarele examinării umane și accesul subcontractorilor rareori apar în afara fine-tipăriturii unei politici de confidențialitate. Companiile care integrează aceste API-uri trebuie adesea să investigheze amănunțit pentru a afla cât timp rămân datele utilizatorilor în examinare sau cine altcineva le poate vedea. Aproape niciunul dintre aceste detalii nu ajunge la utilizatorii finali, ceea ce înseamnă că o companie poate moșteni practicile de date ale unui furnizor și poate transmite aceeași expunere fără ca niciuna dintre părți să realizeze că s-a întâmplat.

De ce este aceasta o problemă a fondatorilor și nu doar o dezbatere politică

Dacă produsul dvs. direcționează conversațiile utilizatorilor către un model de bază cu antrenament implicit activat, ați acceptat o politică de date în numele utilizatorilor dvs. fără să le spuneți, chiar dacă nu ați intenționat să faceți acest lucru. Articolul 50 nu cere să dezvăluiți această decizie, deoarece acoperă doar faptul că aceștia vorbesc cu un sistem de IA.

Accesul terților extinde și mai mult această expunere. Furnizorii de modele își subcontractează în mod regulat anotarea datelor și examinarea securității. În mai 2026, procurorul general din Texas, Ken Paxton, a deschis o investigație cu privire la ochelarii de IA ai Meta după ce anotatorii de date de la un subcontractor cu sediul în Kenya, Sama, au declarat că pot accesa imagini cu momente private ale utilizatorilor, inclusiv vizite la baie. Meta a contestat că acest lucru reflectă imaginea completă a practicilor sale, și investigația este în curs de desfășurare. Deși exemplul implică camere purtabile, aceeași problemă se poate aplica și sistemelor de conversație cu IA. O promisiune că o companie nu vinde datele dvs. nu spune nimic despre cine altcineva le poate citi intern înainte de a ajunge la un flux de antrenament.

Ce să verificați înainte de a alege un furnizor

Înainte de a conecta un model de bază la date reale ale utilizatorilor, există câteva întrebări pe care fiecare fondator ar trebui să le răspundă.

Acordul de prelucrare a datelor este un punct de plecare. Acest acord este documentul care guvernează modul în care datele utilizatorilor dvs. sunt gestionate, și merită să fie citit în întregime.

Contractul însuși merită o atenție deosebită. Furnizorii oferă adesea termene de antrenament mai stricte pe contracte enterprise sau API decât pe produsele de chat pentru consumatori, așa că confirmați în scris care termene se aplică integrării dvs. specifice. Multe companii fac adesea ipoteza greșită că limbajul de confidențialitate de nivel enterprise îi acoperă în mod implicit.

Prevederile de opt-out sunt și ele demne de examinat. Setările Gemini ilustrează de ce, deoarece în acel model, dezactivarea urmăririi activității nu oprește examinarea umană. Un furnizor ar trebui să poată spune în mod clar dacă o posibilitate de a opta pentru a nu face acest lucru oprește antrenamentul, examinarea umană sau ambele.

În cele din urmă, cartografiați unde merg datele în aval de la furnizor. Anotarea și examinarea securității sunt adesea subcontractate, și promisiunile de confidențialitate ale unui furnizor nu se extind în mod automat la fiecare subcontractor din acea lanț.

Niciuna dintre aceste întrebări nu ar trebui să fie tratate ca o exercițiu unic. Termenele furnizorului se pot schimba, uneori rapid, și furnizorul cu care ați semnat anul trecut poate nu funcționează în modul în care erau stabilite regulile în ziua de azi.

Piața poate stabili un standard pe care reglementarea nu l-a atins încă

Articolul 50 este puțin probabil să fie ultimul cuvânt cu privire la guvernanța datelor IA din partea UE, și fondatorii nu ar trebui să aștepte următoarea rundă de reglementare pentru a recupera decalajul pe care l-a lăsat în urmă. Companiile pot depăși acest decalaj acum prin crearea unui opt-in explicit și vizibil pentru antrenament pe datele utilizatorilor lor. Există o linie clară între îmbunătățirea unui model și obținerea de beneficii din încrederea utilizatorilor în mod tăcut. Multe servicii de IA încă traversează această linie prin utilizarea conversațiilor pentru antrenament fără să ceară niciodată consimțământ explicit și informat. Fondatorii care trag această linie pentru ei înșiși acum nu vor trebui să se conformeze ulterior.

Este o mișcare cu precedent. Aplicațiile de mesagerie criptate și gestionarii de parole nu au așteptat ca regulatorii să facă standarde puternice standard. Ei au făcut aceste alegeri pe cont propriu și le-au transformat într-o poziție pe piață. Produsele de IA au aceeași oportunitate. Fondatorii care trag această linie înainte de a deveni obligatorie sunt cei care vor fi încredințați cu următoarea conversație sensibilă a utilizatorilor lor.

Andrew Frost Moroz este fondatorul Aloha Browser, un browser cu prioritate pentru confidențialitate, cu peste 320 de milioane de descărcări și 10 milioane de utilizatori activi lunar. Moroz a creat aplicații mobile și a lucrat la Condé Nast Publishing, ceea ce i-a întărit convingerea puternică că confidențialitatea este un drept uman. El a fondat Aloha în 2015 pe principiul de a nu colecta, stoca, vinde sau monetiza niciodată datele utilizatorilor.