Interviuri

Bobby Samuels, Co-Fondator și CEO al Protege – Seria de Interviuri

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Bobby Samuels conduce strategia și execuția Protege în domeniile produs, marketing și formare de capital. El a co-fondat Protege în 2024 și a ocupat funcția de CEO de la înființare. Sub conducerea sa, Protege a strâns 35 de milioane de dolari și a ajuns la 30 de milioane de dolari în valoare brută de marfă în primul an complet de funcționare. Anterior, Bobby a fost director general al Privacy Hub la Datavant, unde a contribuit la creșterea companiei înainte de fuziunea acesteia cu Ciox Health, în valoare de 7,0 miliarde de dolari, pentru a crea cel mai mare sistem neutralsănătos de date din Statele Unite. Mai devreme, el a condus parteneriatele la LiveRamp (RAMP ), unde a dezvoltat expertiză în construirea de rețele de date neutre. Bobby deține un master în administrarea afacerilor de la Școala de Afaceri Stanford și un bacalaureat de la Harvard College, unde a fost președintele The Harvard Crimson. El aduce o expertiză profundă în schimbul de date reglementate și în transformarea infrastructurii complexe într-un sistem de încredere pentru partenerii de întreprinzători.

Protege este o companie de infrastructură de date care conectează deținătorii de seturi de date de înaltă valoare și cu caracteristică de proprietate cu dezvoltatorii de modele de inteligență artificială, oferind o modalitate guvernată și cu prioritate pentru confidențialitate de a licenția și a accesa datele de antrenament la scară. Fondată în 2024, platforma se concentrează pe deblocarea datelor multimodale – cum ar fi înregistrările medicale, imaginile, videourile și înregistrările audio – care sunt, în mod tradițional, dificil de accesat de către echipele de inteligență artificială, în timp ce oferă furnizorilor de date control deplin asupra confidențialității, conformității și monetizării. Pentru constructorii de inteligență artificială, Protege simplifică descoperirea și achiziționarea prin intermediul unui catalog curatoriat și a unor instrumente pentru filtrarea și combinarea seturilor de date, ajutând la accelerarea dezvoltării în domenii precum sănătatea, mass-media și altele. În esență, compania își propune să devină stratul de date de încredere pentru inteligența artificială, reducând una dintre cele mai mari blocaje din dezvoltarea modernă a modelelor.

Ce v-a inspirat să înființați Protege și cum au influențat experiențele dvs. de conducere a datelor, confidențialității și transformării organizaționale la Datavant, precum și rolurile anterioare de la LiveRamp, viziunea dvs. de a construi această companie?

Experiența mea de la Datavant mi-a arătat atât puterea, cât și complexitatea conectării datelor într-un mod responsabil la scară. Datavant a construit o platformă care a ajutat la legarea informațiilor sensibile de sănătate, menținând în același timp confidențialitatea pacienților, și a devenit clar pentru mine că datele bine guvernate pot conduce la progrese sociale masive. Dar atunci când nu este așa, poate face un rău real.

Pe măsură ce inteligența artificială s-a accelerat, am văzut același model repetându-se: o concentrare pe calcul și arhitecturi de inteligență artificială, dar nu neapărat pe datele care alimentează modelele însele. Ipoteza noastră este că următorul blocaj masiv este accesul la datele potrivite. Am vrut să construiesc un strat de infrastructură de date care face schimbul de date sigur, transparent și reciproc benefic pentru deținătorii de date și constructorii de inteligență artificială, oferind în același timp expertiză specifică datelor de inteligență artificială pentru a sprijini progresele cercetării bazate pe inteligență artificială. Acesta este ceea ce a condus la Protege.

Protege se descrie ca fiind în proces de construire a “coloanei vertebrale a economiei datelor de inteligență artificială.” Cum definiți acest strat și ce reprezintă, în practică, o infrastructură de date reală pentru inteligența artificială?

Protege este țesutul conjunctiv care permite colaborarea în siguranță și eficientă între deținătorii de date și dezvoltatorii de inteligență artificială. O infrastructură de date reală pentru inteligența artificială face mai mult decât să stocheze sau să mute date; verifică proveniența, gestionează permisiunile și asigură că fiecare set de date este utilizat în mod etic și cu consimțământ. În practică, este o platformă unică în care deținătorii de conținut pot licenția datele cu încredere și pot fi compensați corespunzător, iar constructorii de inteligență artificială pot accesa seturile de date esențiale din diverse industrii, domenii, modalități și formate pe care le necesită pentru a antrena și evalua modelele în mod responsabil.

Una dintre misiunile dvs. cheie este asigurarea faptului că modelele sunt antrenate pe seturi de date licențiate, reprezentative și bazate pe consimțământ. Cum operaționalizează Protege sursa etică la scară?

Noi operaționalizăm etica prin sisteme, nu prin sloganuri. Cu fiecare sursă de date și conținut pe care le agregăm și livrăm, ne asigurăm că deținătorii drepturilor păstrează proprietatea, cu termeni de licență și protecții de confidențialitate clari.

Platforma noastră combină expertiza noastră umană, orientată spre cercetare, cu fluxurile de date și sistemele care se extind pentru a livra datele protejate de drepturi. De asemenea, lucrăm cu clienții noștri cumpărători de date pentru a ne asigura că datele sunt reprezentative pentru populațiile din lumea reală și reflectă cazuri de utilizare din lumea reală. Prin abordarea atât a furnizorilor de date, cât și a cumpărătorilor de date cu claritate și consecvență, suntem capabili să menținem conformitatea, echitatea și încrederea.

Industria inteligenței artificiale a fost condusă de mult timp de o mentalitate “extrage mai întâi, întreabă mai târziu”. Cum vedeți licențierea transparentă a datelor remodelând relațiile dintre furnizorii de date și dezvoltatorii de inteligență artificială?

Transparența transformă extragerea în colaborare. În loc să extragă date, companiile de inteligență artificială au opțiunea de a licenția date etic de la furnizorii de date verificați, ceea ce creează stimulente mai bune pentru ambele părți. Furnizorii de date câștigă venituri și control, iar dezvoltatorii de inteligență artificială primesc seturi de date mai curate și de înaltă calitate, fără probleme legale și de proprietate intelectuală.

Acest schimbare construiește încredere, care, la rândul său, deblochează viteza în dezvoltarea inteligenței artificiale. Când organizațiile văd că inteligența artificială poate fi construită în mod responsabil, cu consimțământ clar și compensație pentru deținătorii de drepturi, aceasta deblochează mai multe cazuri de utilizare și nevoi de date. Acest lucru creează o cerere mai mare pentru seturi de date de înaltă calitate, pornind un ciclu natural: cele mai bune surse de date atrag cumpărători, iar cumpărătorii atrag mai multe surse de date de înaltă fidelitate. Toată lumea beneficiază.

Datele sintetice sunt adesea văzute ca o soluție pentru provocările legate de confidențialitate și prejudecăți. Unde credeți că se află echilibrul corect între seturile de date sintetice și cele din lumea reală, în special în sectoarele puternic reglementate, cum ar fi sănătatea?

Datele sintetice sunt utile pentru testare și completare, dar nu pot înlocui în totalitate complexitatea și nuanța activităților din lumea reală care generează datele de antrenament și evaluare. Acest lucru este valabil, în special, în domeniul sănătății, unde istoricul îngrijirii pe termen lung a pacienților și rezultatele în contextul abordării îngrijirii contează.

Noi credem, în mod fundamental, că inteligența artificială care nu a fost antrenată pe complexitatea deplină a lumii reale nu poate, brusc, să producă date sintetice reprezentative pentru lumea reală. Probabil, echilibrul corect va fi o abordare hibridă, în care vom avea nevoie de multe surse de date de înaltă calitate care sunt, în prezent, izolate și trebuie deblocate, și apoi le vom combina cu date sintetice generate de inteligența artificială pentru cazuri de utilizare specifice.

Cum permite Protege organizațiilor să partajeze date valoroase din lumea reală în mod sigur, fără a expune informații proprietare, date de pacienți sau proprietate intelectuală?

Securitatea și confidențialitatea sunt integrate în fiecare etapă a parcursului. Indiferent dacă este vorba de sistemele noastre interne sau de partenerii noștri de deidentificare și confidențialitate care verifică transferurile noastre de date, ne asigurăm că datele noastre rămân în limitele intenționate.

În domeniul sănătății, acest lucru înseamnă respectarea cadrului de confidențialitate și conformitate pentru toate transferurile noastre de date. În mass-media, acest lucru înseamnă asigurarea că conținutul este licențiat numai pentru utilizări intenționate, pe termene de licențiere și perioade de timp preconcordate.

Pe măsură ce modelele de bază continue să evolueze, ce va defini următoarea generație de conducte de date de antrenament de înaltă calitate?

Trei principii vor conduce: proveniența, precizia și scopul.

Proveniența înseamnă trasabilitate deplină la sursă și termeni. Precizia înseamnă curățarea pentru modalități sau cazuri de utilizare specifice, mai degrabă decât corpora generice de date sau date care nu reflectă pe deplin situațiile din lumea reală. Scopul înseamnă alinierea selecției de date cu rezultate concrete, nu doar cu indicatori de vanitate.

Împreună, acestea creează o cale către utilizarea datelor de înaltă calitate pentru a conduce la modele mai bune.

Cum influențează reglementările emergente, cum ar fi Legea privind inteligența artificială a UE și cadrul viitor al SUA, abordarea Protege în ceea ce privește conformitatea și colaborarea transfrontalieră a datelor?

Aceste reglementări validează abordarea noastră pe care am bazat compania. Ele subliniază transparența, proveniența și gestionarea riscurilor, care sunt încorporate în produsele și platforma noastră din start.

Credem că oportunitățile viitoare de inteligență artificială trebuie să protejeze deținătorii de drepturi și să mențină controale stricte de confidențialitate. Prin tratarea acestor aspecte ca fiind nelimitate, ajutăm partenerii noștri de date și clienții să progreseze cu încredere și încredere în peisajul în schimbare al inteligenței artificiale. Scopul nostru este de a face dezvoltarea responsabilă a inteligenței artificiale nu doar corectă, ci și mai ușoară de realizat.

Ce rol credeți că joacă transparența și proveniența datelor în reconstruirea încrederii publice în sistemele de inteligență artificială?

Încrederea începe cu trasabilitatea. Când oamenii înțeleg de unde provin datele și cum sunt utilizate, sunt mai predispuși să aibă încredere în rezultatele inteligenței artificiale.

Transparența și proveniența creează responsabilitate de la deținătorul de date la dezvoltatorul de modele și până la utilizatorul final. Ele transformă inteligența artificială dintr-o cutie neagră în ceva mai inteligibil și explicabil.

După o creștere de 20 de ori și un serie A de 25 de milioane de dolari, cum echilibrați creșterea rapidă cu menținerea angajamentelor etice și de securitate ale Protege – și ce urmează, pe măsură ce continuați să modelați modul în care organizațiile antrenează modele de inteligență artificială în mod responsabil?

Etica și securitatea sunt fundația care ne permite să ne extindem. Fiecare nou proces, parteneriat și produs este măsurat împotriva funcționării ca și cum alții ar fi martori. Dacă toată lumea ar vedea cum operăm și ar vedea deciziile pe care le luăm, aș vrea ca ei să fie mândri.

Pe măsură ce ne uităm spre 2026, ne extindem în noi domenii de activitate, dincolo de sănătate și mass-media, și creăm noi produse de date, cum ar fi datele de evaluare pentru benchmarking, în timp ce organizațiile de inteligență artificială se străduiesc să îmbunătățească măsurarea performanței inteligenței artificiale pentru cazuri de utilizare din lumea reală. Scopul nostru este de a fi singura platformă de încredere pentru date și expertiză de inteligență artificială din lumea reală, construită pentru a alimenta progresul inteligenței artificiale pe termen lung.

 Mulțumim pentru acest interviu minunat; cititorii care doresc să afle mai multe pot vizita Protege.

Antoine este un lider vizionar și partener fondator al Unite.AI, condus de o pasiune neclintită pentru modelarea și promovarea viitorului inteligenței artificiale și roboticii. Un întreprinzător serial, el crede că inteligența artificială va fi la fel de disruptivă pentru societate ca și electricitatea și este adesea prins vorbind entuziast despre potențialul tehnologiilor disruptive și AGI.

Ca futurist, el este dedicat explorării modului în care aceste inovații vor modela lumea noastră. În plus, el este fondatorul Securities.io, o platformă axată pe investiții în tehnologii de ultimă generație care redefinesc viitorul și reshapă întregi sectoare.