Intervjuer
Edward Cui, Grunnlegger og CEO av Graviti – Intervju-serie

Edward Cui er grunnlegger og CEO av Graviti, et selskap som bygger neste generasjons dataplatform som vil fundamentalt endre hvordan utviklere samhandler med ustrukturert data. Med Graviti kan AI-utviklere tilegne seg, lagre og prosessere data raskere og enklere – grunnlaget for å utnytte kunstig intelligens til å styrke alle bransjer.
Du startet din bachelorstudium som maskiningeniør, hva var årsaken til skiftet til datavitenskap og kunstig intelligens?
Jeg studerte faktisk maskiningeniør som bachelor i 2012. Jeg tok en klasse i maskinlæring ved University of Pennsylvania, som var tankevekkende, og jeg visste at det var fremtiden og hva jeg ville gjøre i min karriere. Etter den klassen, byttet jeg til datavitenskap.
Etter eksamen, gjorde jeg forskning på forsterkingslæring ved University of Pennsylvania. I 2015, ble min tidligere sjef, Jeff Snyder, med i Uber og inviterte meg til å bli med i Uber ATG. Det var begynnelsen på min karriere i selvkjørende bilindustrien.
Kan du dele historien bak Graviti?
Å jobbe i Uber var veldig komplisert i begynnelsen fordi folk ikke brukte store maskinlæringsmodeller og vi manglet beregningskraft og en dataplatform for å trene modeller. Dataene vi samlet inn for selvkjørende biler var alle ustrukturert. For eksempel, var de bilder, videoer, LIDAR-punkter. All den type data fra sanntidsensorer og vi samlet inn tonnevis av ustrukturert data hver dag. Vi gjorde en statistikk som viste at mengden data vi samlet inn i en selvkjørende bilavdeling på en uke var lik mengden data vi samlet inn for hele restaurantbransjen globalt på ett år. Tonnevis av ustrukturert data ble samlet inn hver eneste dag og det skapte store problemer med hvordan vi skulle lagre dataene, håndtere dataene og bruke dataene til å skape verdier for ulike organisasjoner.
Etter tre år i Uber, så jeg muligheten til å forbedre hvordan stor skala ustrukturert data kunne håndteres. Så, grunnla jeg Graviti i 2019 for å akselerere innovasjoner i AI ved å bygge en ustrukturert dataplatform.
Kan du diskutere hvordan Graviti er en plattform for å håndtere og strukturere data i stor skala?
Graviti har som mål å lansere den første dataplatformen som muliggjør at organisasjoner kan arbeide med store mengder ustrukturert data for å drive innovative AI-applikasjoner. Denne plattformen eliminerer besværet og hjelper utviklere å håndtere store mengder ustrukturert data med teamet.
Mens majoriteten av tilgjengelig informasjon i AI-utvikling er lavkvalitets og ustrukturert, bruker utviklingsteamene vanligvis over 50% av sin tid – ikke på å bygge modeller – men på å identifisere, forbedre eller rense ustrukturert data, og det er bare begynnelsen på deres arbeid. Graviti tilbyr en mer ekspert dataplatform for å frigjøre utviklere og gi dem mer tid til å analysere ustrukturert data og trene kunstig intelligensmodeller.
Vi hjelper utviklere på tre måter: dataoppdagelse, dataiterasjon og arbeidsflytautomatisering.
Dataoppdagelse:
Graviti tilbyr en datahosting-funksjon som gjør det enklere å organisere rådata, annotasjoner og metadata ved å samordne datasett og annotasjonsformater. Når AI-utviklere får tilgang til ulike datasett gjennom Graviti, trenger de ikke å konvertere dataformatene, noe som forenkler håndtering, spørring, tilgang og andre operasjoner knyttet til annotasjon. Graviti hjelper til å redusere muligheten for feilaktig rådata eller tap av annotasjoner. Videre kan Graviti-plattformen hjelpe utviklere å evaluere kvaliteten på datasettene med en datavisualiseringsfunksjon, som sparer minst åtte timer per uke for utviklere.
Dataiterasjon:
Når utviklere trener sine kunstig intelligensmodeller, må de teste med datasett i ulike versjoner for å se resultater og markere ned annotasjoner. Utfordringen er å spore ulike redigeringer og versjoner med teammedlemmene som arbeider på samme prosjekt. Graviti tilbyr løsningen ved å aktivere tildeling av ulike tilgangsrettigheter til ansatte for å la dem laste opp annotasjoner og spore prosjektets fremdrift og arbeide samtidig.
Arbeidsflytautomatisering:
Med en funksjon kalt “Handling”, kan ingeniører automatisere arbeidsflyter og redusere repetitive, tidskrevende og manuelle sysler. Det frigjør utviklere fra å skrive store manuelle skript for å oppnå disse arbeidsflytene og åpner opp tid for dem til å gjøre det arbeidet de trenger å gjøre.
Hvorfor er ustrukturert data fremtiden for AI?
Over 80% av bedriftsdata er ustrukturert nå, inkludert bilder, opptak, videoer, sosiale medieinnlegg osv. AI er nøkkelen til å levere verdier fra ustrukturert data. Bedrifter begynner å utnytte ustrukturert data til å støtte dyptgående forskning og videre analyse.
Graviti lanserte nylig OpenBytes, et non-profit åpent dataprosjekt som er vertet under Linux Foundation. Kan du diskutere hva OpenBytes er?
Oppdraget til OpenBytes er å lette videre deling av data i AI-samfunnet gjennom å opprette datastandarder, formater og prosesser som muliggjør bidrag av data. Omfanget av OpenBytes inkluderer kurasjon av åpne datasett, åpne dataspesifikasjoner og samarbeidende utvikling under åpne lisenser som støtter oppdraget, inkludert dokumentasjon, testing, integrasjon og opprettelse av andre artefakter som hjelper utvikling, distribusjon, drift eller tilpasning av det åpne kildeprosjektet.
OpenBytes kan redusere risikoen for dataleverandører. Datasetteiere er motvillige til å dele datasettene offentlig på grunn av manglende kunnskap om datalicenser. Når datasettbidragsytere blir med i OpenBytes, vil deres data være beskyttet, og mer åpent data blir tilgjengelig.
Vi genererer også en standard datasettformat når vi publiserer, deler og bytter data. Et standardformat vil hjelpe dataleverandører å forstå datasettene og finne relevante data de trenger, noe som fører til høykvalitets åpne datasettbidrag.
Hva er noen av fordelene med åpne datasett?
De fordelene forskere fordi vitenskapsmenn har flere gratis ressurser å bruke til å trene modeller og fullføre forskning.
De fordelene bedrifter, som bruker datasettene til å bygge AI-evner og styrke overgangen fra tradisjonelle bedrifter til AI-bedrifter.
Hvordan autentiserer Graviti kvaliteten på datasettene?
Selv populære datasett som COCO og KITTI er ikke perfekte for utviklere. Feil oppstår alltid når utviklere trener modeller og ingen har funnet en god måte å forbedre datasettkvaliteten på. Graviti tror at en datasettevalueringmodell vil bli etablert eller en annen teknisk revolusjon vil hjelpe samfunnet å løse problemet, og det er også en del av Gravitis oppdrag å oppnå i fremtiden.
Hva er din visjon for fremtiden for hvordan utviklere vil få tilgang til data?
For en liten mengde data, bør utviklere kunne få tilgang til dataene enkelt. For større mengder data, som mer diverse datasett for å trene modeller, vil føderert læringsteknologi hjelpe til å arbeide på en samarbeidende måte ved å kopple evnen til å gjøre maskinlæring fra å lagre data i en sentral server.
Er det noe annet du ville like å dele om Graviti?
Graviti utvikler seg også. Vi lytter til tilbakemeldinger fra våre kunder, inkludert start-ups, bedrifter, enkeltutviklere og forskere. Vi ønsker også å samarbeide eller inngå partnerskapsavtaler med alle.
Vi ser store muligheter i AI-utvikling fra åpent data i en svært nær fremtid. Vi bygger et samfunn for å dele og bidra med åpent data. Dette vil ikke bare fordelen forskere til å drive grensene for vitenskapen videre, men også bedrifter til å forbedre modellene og utvikle teknologien i et gjensidig fordelaktig miljø.
Takk for det flotte intervjuet, lesere som ønsker å lære mer, bør besøke Graviti.












