Intervjuer

Fabiana Clemente, medgrunnlegger og Chief Data Officer i YData – Intervju-serie

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Fabiana Clemente er medgrunnlegger og Chief Data Officer i YData. YData er et AI-startup som har utviklet den første data-sentriske utviklingsløsningen som kombinerer dataoppdagelse, forbedring og skalerbarhet på ett enkelt plattform.

Hva var det som først tiltalte deg om AI og maskinlæring?

Min bakgrunn er i anvendt matematikk, der jeg fikk mulighet til å lære og forstå hvordan vi kan trekke informasjon ut av data, samt gjøre det ved hjelp av kode. På den tiden var det ikke like “sexy” som maskinlæring, men det var definitivt det som antente min lidenskap for området.

Kunne du dele historien bak Ydata?

Som en data-vitenskapsmann som har arbeidet for både startup-selskaper og større bedrifter, har jeg hatt min del av utfordringer – noen ganger var tilgangen til data blokkert under påskudd av sikkerhet eller personvern, andre ganger var tilgangen enkel, men kvaliteten på dataene var ikke nær så god som det som trengs for å bygge AI-baserte løsninger. Vitende at disse utfordringene er svært vanlige i de fleste organisasjoner, inspirerte oss til å starte selskapet med målet om å hjelpe disse teamene å overvinne disse hindrene, ved å akselerere deres AI-utvikling med forbedret data.

Kunne du beskrive for vårt publikum hva syntetisk data er?

Syntetisk data regnes som enhver data som ikke er generert i den virkelige verden, så enhver data som er skapt kunstig. Det finnes metoder som muliggjør generering av syntetisk data – fra regelbaserte strategier til å bruke maskin- eller dyp-læringmodeller til å lære disse “reglene” for oss. I YData har vi adoptert og spesialisert oss i en dyp-læring-basert strategi for å generere ny data som beholder oppførselen fra virkelige hendelser uten bekymringer omkring personvern.

Hva gjør syntetisk data så viktig?

Jo mer organisasjoner innser viktigheten av data for å fremme sine forretninger, jo mer vil viktigheten og rollen til syntetisk data bli forstått. Å samle inn ekte data er ikke bare tidskrevende og dyrt, men også noen ganger umulig. For å bygge AI-applikasjoner, er data et hardt krav – her er det syntetisk data kommer til unnsetning. Evnen til å generere usette scenarier eller å låse opp tilgangen til data, er nøkkel til å utvikle seg i en verden der pionerer som Andrew Ng, sier at å bli data-sentrisk er nøkkel til en vellykket AI-adoptsjon.

I selvkjørende biler eller andre maskin-automatiseringsaktiviteter kan vi allerede se viktigheten av syntetisk data, så jeg ville si at det er bare naturlig at denne forståelsen sprenger seg over alle industrielle vertikaler.

Hvordan genererer Ydata syntetisk data?

YData bygger på hovedsakelig dyp-generative modeller for å lære de statistiske attributtene og korrelasjonene mellom variablene i de opprinnelige dataene. Dette muliggjør at modellen kan generere en statistisk relevant datasett som har samme forretningsverdi som de opprinnelige, uten å tillate sporbarhet til de opprinnelige postene.

YData driver denne teknologien fremover og er selskapet bak Syntetisk Data-fellesskapet – en gruppe data-vitenskapsmenn som er dedikert til å forkynne og hjelpe alle som ønsker å lære og bruke denne teknologien.

Hvordan hjelper Ydata-plattformen å oppdage og låse opp nye datakilder?

YData-plattformen inkluderer innebygde koblinger til alle typer databaser, data-warehouse eller data-sjøer, som gjør det mulig for brukerne å enkelt få tilgang til relevante metadata og forstå om de eksisterende dataene er nyttige for å svare på forretnings-spørsmålet de har i hendene – uten å se på de faktiske postene.

Kunne du dele noen detaljer om Synthetic Data Open Source-fellesskapet?

Syntetisk data er bare i sin barndom, og derfor er bevisstheten om hvordan det genereres, fordeler eller begrensninger ennå ikke fullt ut kjent for et større publikum. Derfor har vi i YData besluttet å ta en mer pedagogisk rute ved å opprette Synthetic Data-fellesskapet – foruten å være et sted for å utveksle ideer eller å få hjelp fra eksperter på syntetisk data-feltet, er det også et sted der data-vitenskapsmenn og andre tekniske profiler kan starte sin reise inn i syntetisk data, med noen av de mest interessante algoritmene fra litteraturen.

Vi tilbyr også et perspektiv på datakvalitet, så data-vitenskapsmenn kan først forstå data de arbeider med, før de syntetiserer eller forbedrer datasynthetisering. Vi er virkelig dedikert til å hjelpe data-team til å bli mer og mer data-sentriske.

YData annonserte nylig 2,7 millioner dollar i finansiering for å akselerere sin internasjonale utvidelse. Kunne du dele noen detaljer om hva dette betyr for fremtiden til selskapet og dens utvidelsesstrategi?

YData ble født internasjonalt allerede – vi visste at denne type teknologi trenger tidlige adoptanter som vanligvis er i de mest sofistikerte landene. Derfor var våre første kunder allerede utenfor Portugal, over hele Europa, og vi etablerer nå en tilstedeværelse i Nord-Amerika også. Denne finansieringen vil gjøre det mulig for oss å styrke vår tilstedeværelse i begge disse kontinentene, ikke bare kommersielt, men også å vokse teamet: vi er et fullstendig distribuert team som gjør det mulig for oss å ansette de beste talentene, uansett hvor de er.

Er det noe annet du ønsker å dele om YData?

YData driver grensen for data-sentrisk AI og skaper en ny kategori: DataPrepOps – selv om det er et stygt navn, er det en smerte de fleste selskaper står overfor nå når det gjelder data-vitenskapsutvikling. Datakvalitetstrenden fortsetter å vokse, og etter Data Pipelines og Data Observability, er Datakvalitet for Data Science-team ennå i sin barndom, og YData er i ferd med å bli en tankeleder innen datapreparasjon.

Takk for det flotte intervjuet, lesere som ønsker å lære mer, bør besøke YData.

Antoine er en visjonær leder og medgrunnlegger av Unite.AI, drevet av en urokkelig lidenskap for å forme og fremme fremtiden for AI og robotikk. En serial entrepreneur, han tror at AI vil være like disruptiv for samfunnet som elektrisitet, og blir ofte fanget i å prise potensialet for disruptive teknologier og AGI.

Som en futurist, er han dedikert til å utforske hvordan disse innovasjonene vil forme vår verden. I tillegg er han grunnlegger av Securities.io, en plattform som fokuserer på å investere i banebrytende teknologier som definerer fremtiden og omformer hele sektorer.