Interviuri
Fabiana Clemente, Co-fondator și Șef al Departamentului de Date la YData – Seria de Interviuri

Fabiana Clemente este co-fondator și Șef al Departamentului de Date la YData. YData este o companie de inteligență artificială care a creat prima soluție de dezvoltare centrată pe date pentru a combina descoperirea, îmbunătățirea și scalabilitatea datelor pe o singură platformă.
Ce v-a atras inițial către inteligența artificială și învățarea automată?
Backgroundul meu este în Matematică Aplicată, unde am avut ocazia să învăț și să înțeleg cum putem extrage informații din date, precum și să facem acest lucru folosind cod. La acea vreme, nu era la fel de atractiv ca învățarea automată, dar a fost cu siguranță ceea ce a aprins pasiunea mea pentru acest domeniu.
Puteți să împărtășiți povestea de fond a YData?
Ca specialist în știința datelor care a lucrat atât pentru startup-uri, cât și pentru întreprinderi, am avut parte de lupte – uneori, accesul la date a fost blocat sub pretextul securității sau al confidențialității, iar alteori, accesul a fost ușor, dar calitatea datelor nu a fost niciodată aproape de ceea ce era necesar pentru a construi soluții bazate pe inteligență artificială. Știind că aceste lupte sunt foarte frecvente în majoritatea organizațiilor, ne-a inspirat să începem compania cu scopul de a ajuta aceste echipe să depășească aceste obstacole, accelerând dezvoltarea inteligenței artificiale cu date îmbunătățite.
Puteți să descrieți pentru publicul nostru ce este datele sintetice?
Datele sintetice sunt considerate a fi orice date care nu au fost generate în lumea reală, adică orice date create artificial. Există metode care permit generarea de date sintetice – de la strategii bazate pe reguli până la utilizarea modelelor de învățare automată sau a modelelor de învățare profundă pentru a învăța “regulile” pentru noi. La YData, am adoptat și ne-am specializat într-o strategie bazată pe învățare profundă pentru a genera date noi care păstrează comportamentul evenimentelor din lumea reală, fără a fi preocupate de confidențialitate.
Ce face datele sintetice atât de importante?
Pe măsură ce organizațiile realizează importanța datelor pentru a-și îmbunătăți afacerile, importanța și rolul datelor sintetice vor fi mai bine înțelese. Colectarea de date reale nu este doar consumatoare de timp și scumpă, ci uneori, imposibilă. Pentru a construi aplicații de inteligență artificială, datele sunt o cerință strictă – aici intervine datele sintetice. Capacitatea de a genera scenarii neobservate sau de a debloca accesul la date este cheia pentru a evolua într-o lume în care pionierii, precum Andrew Ng, afirmă că a deveni centrat pe date este cheia pentru o adoptare de succes a inteligenței artificiale.
În mașinile autonome sau în alte activități de automatizare a mașinilor, putem deja percepe importanța datelor sintetice, așa că aș spune că este doar natural ca această înțelegere să se răspândească în toate verticalele industriale.
Cum generează YData date sintetice?
YData se bazează în principal pe modele generative profunde pentru a învăța atributele statistice și corelațiile dintre variabilele datelor originale. Acest lucru permite modelului să genereze un set de date statistic relevant care are aceeași valoare de afaceri ca și cel original, fără a permite urmărirea înregistrărilor originale.
YData este o companie care promovează această tehnologie și este compania din spatele Comunității Datelor Sintetice – un grup de experți în știința datelor care sunt dedicați să evanghelizeze și să ajute pe oricine care dorește să învețe și să utilizeze această tehnologie.
Cum ajută platforma YData la descoperirea și deblocarea de noi surse de date?
Platforma YData include conectori încorporați pentru orice tip de bază de date, depozit de date sau lac de date, care permite utilizatorilor să aibă acces ușor la metadate relevante și să înțeleagă dacă datele existente sunt utile pentru a răspunde la întrebarea de afaceri pe care o au la dispoziție – fără a fi nevoie să vadă înregistrările reale.
Puteți să împărtășiți detalii despre Comunitatea Deschisă a Datelor Sintetice?
Datele sintetice sunt abia la început și, din acest motiv, conștientizarea modului în care sunt generate, beneficiile sau limitările lor sunt încă relativ necunoscute pentru un public mai larg. Din acest motiv, la YData am decis să urmăm o cale mai educativă, creând Comunitatea Datelor Sintetice – un loc în care, pe lângă faptul că este un loc pentru a schimba idei sau a obține ajutor de la experți în domeniul datelor sintetice, este și un loc în care specialiștii în știința datelor și alte profiluri tehnice pot începe călătoria lor în datele sintetice, cu unele dintre cele mai interesante algoritmi din literatura de specialitate.
În plus, oferim și o perspectivă asupra calității datelor, astfel încât specialiștii în știința datelor să poată înțelege mai întâi datele cu care lucrează, înainte de a sintetiza sau de a îmbunătăți sintetizarea datelor. Suntem cu adevărat dedicați să ajutăm echipele de date să devină din ce în ce mai centrate pe date.
YData a anunțat recent 2,7 milioane de dolari în finanțare pentru a-și accelera expansiunea internațională. Puteți să împărtășiți detalii despre ce înseamnă acest lucru pentru viitorul companiei și strategia de expansiune?
YData s-a născut deja internațional – știam că această tehnologie are nevoie de early adopters care sunt, de obicei, în țările cele mai sofisticate. Din acest motiv, primii noștri clienți au fost deja din afara Portugaliei, în toată Europa, și acum stabilim o prezență și în America de Nord. Această finanțare ne va permite să consolidăm prezența noastră pe ambele continente, nu doar comercial, ci și să creștem echipa: suntem o echipă complet distribuită, ceea ce ne permite să angajăm cei mai buni talente, indiferent de locul în care se află.
Există altceva pe care ați dori să-l împărtășiți despre YData?
YData este o companie care promovează bariera inteligenței artificiale centrate pe date și creează o nouă categorie: DataPrepOps – deși este un nume urât, este o durere pe care majoritatea companiilor o resimt în prezent atunci când vine vorba de dezvoltarea științei datelor. Tendința calității datelor continuă să crească și, după pipeline-urile de date și observabilitatea datelor, calitatea datelor pentru echipele de știință a datelor este încă în stadiu de început, iar YData este o companie care emerge ca lider de gândire în pregătirea datelor.
Mulțumim pentru acest interviu minunat; cititorii care doresc să afle mai multe despre YData ar trebui să viziteze YData.












