Rozhovory
Edward Cui, zakladatel a CEO Graviti – rozhovor

Edward Cui je zakladatel a CEO společnosti Graviti, která buduje novou generaci datové platformy, která zásadně změní, jak vývojáři pracují s nestrukturovanými daty. Díky Graviti mohou vývojáři AI získat, uložit a zpracovat data rychleji a snadněji – základ, který je potřebný pro využití umělé inteligence ve všech odvětvích.
Začal jste své vysokoškolské studium jako strojní inženýr, co vás vedlo ke změně na počítačovou vědu a umělou inteligenci?
V roce 2012 jsem studoval strojní inženýrství. Absolvoval jsem kurz o strojovém učení na Univerzitě v Pensylvánii, který byl ohromující, a věděl jsem, že je to budoucnost a chtějí dělat kariéru. Po tomto kurzu jsem přešel na počítačovou vědu.
Po absolvování studia jsem prováděl výzkum o učení s posilováním na Univerzitě v Pensylvánii. V roce 2015 můj bývalý šéf, Jeff Snyder, nastoupil do Uberu a pozval mě, abych se k němu připojil. To je začátek mé kariéry v průmyslu samořiditelných vozidel.
Můžete sdílet příběh o vzniku Graviti?
Práce v Uberu byla velmi složitá na začátku, protože lidé nepoužívali velké modely strojového učení a chyběla nám výpočetní síla a platforma pro správu dat pro školení modelů. Data, která jsme sbírali pro samořiditelná vozidla, bylaすべて nestrukturovaná. Například to byly obrázky, videa, LIDAR body. Všechny typy dat z reálných senzorů a sbírali jsme obrovské množství nestrukturovaných dat každý den. Provedli jsme statistiku, která nám řekla, že množství dat, které jsme sbírali v divizi samořiditelných vozidel za týden, je rovno množství dat, které sbíráme pro celou restaurační podnikání globálně za celý rok. Obrovské množství nestrukturovaných dat se hromadilo každý den a to vytvořilo velké problémy s tím, jak uložit tato data, jak je spravovat a jak je použít, aby skutečně vytvořily hodnoty pro různé organizace.
Po třech letech práce v Uberu jsem viděl příležitost zlepšit, jak lze spravovat velké množství nestrukturovaných dat. Proto jsem v roce 2019 založil Graviti, aby urychlil inovace v oblasti AI budováním platformy pro správu nestrukturovaných dat.
Můžete diskutovat, jak Graviti je platformou pro správu a strukturování dat ve velkém měřítku?
Graviti má za cíl spustit první datovou platformu, která umožní organizacím pracovat s velkými objemy nestrukturovaných dat pro inovativní aplikace AI. Tato platforma eliminuje problémy a pomáhá vývojářům spravovat velké množství nestrukturovaných dat s týmem.
Zatímco většina dostupných informací ve vývoji AI je nízké kvality a nestrukturovaná, vývojářské týmy obvykle tráví více než 50 % svého času – ne budováním modelů – ale identifikací, doplňováním nebo čištěním nestrukturovaných dat, a to je teprve začátek jejich práce. Graviti nabízí odbornější způsob správy dat, aby vývojáře osvobodil a dal jim více času na analýzu nestrukturovaných dat a školení modelů AI.
Pomáháme vývojářům ve třech dimenzích: objevování dat, iteraci dat a automatizaci pracovních postupů.
Objevování dat:
Graviti nabízí funkci hostování dat, která usnadňuje organizování surových dat, anotací a metadat sjednocením formátu dat a anotací. Když vývojáři AI přistupují k různým datovým sadám prostřednictvím Graviti, nemusí měnit formáty dat, což usnadňuje správu, dotazování, přístup a další operace spojené s anotacemi. Graviti pomáhá snižovat riziko nesouladu surových dat nebo ztráty anotací. Kromě toho může platforma Graviti pomoci vývojářům vyhodnotit kvalitu datových sad pomocí funkce vizualizace dat, což šetří vývojářům alespoň osm hodin týdně.
Iterace dat:
Když vývojáři školí své modely AI, musí testovat s datovými sadami v různých verzích, aby viděli výsledky a zaznamenali anotace. Výzvou je sledování různých úprav a verzí s členy týmu, kteří pracují na stejném projektu. Graviti nabízí řešení, umožňující přidělit různé úrovně přístupových práv zaměstnancům, aby mohli nahrát své anotace a sledovat pokrok projektu a pracovat současně.
Automatizace pracovních postupů:
S funkcí nazvanou “Akce” mohou inženýři automatizovat pracovní postupy a snížit opakující se, časově náročné a manuální úkoly. To osvobozuje vývojáře od psaní velkých manuálních skriptů pro dosažení těchto pracovních postupů a otevírá jim čas pro práci, kterou potřebují dělat.
Proč je nestrukturovaná data budoucností AI?
Více než 80 % firemních dat je nyní nestrukturovaných, včetně obrázků, nahrávek, videí, příspěvků na sociálních sítích atd. AI je klíčem k poskytování hodnot z nestrukturovaných dat. Společnosti začínají využívat nestrukturovaná data k podpoře hlubších výzkumů a dalších analýz.
Graviti nedávno spustila OpenBytes, neziskový otevřený projekt dat hostovaný v Linux Foundation. Můžete diskutovat, co je OpenBytes?
Cílem OpenBytes je usnadnit širší sdílení dat v komunitě AI prostřednictvím vytváření standardů dat, formátů a procesů, které umožňují přispívat data. Rozsah OpenBytes zahrnuje kuraci otevřených datových sad, otevřených specifikací dat a spolupráci při vývoji pod otevřenými licencemi, které podporují misi, včetně dokumentace, testování, integrace a vytváření dalších artefaktů, které pomáhají při vývoji, nasazení, provozu nebo přijetí otevřeného projektu.
OpenBytes může snížit rizika pro přispěvatele dat. Držitelé datových sad jsou váhaví sdílet své datové sady veřejně kvůli nedostatku znalostí o licencích na data. Jakmile se přispěvatelé dat připojí k OpenBytes, jejich data budou chráněna a bude dostupnější více otevřených dat.
Také generujeme standardní formát datových sad při publikování, sdílení a výměně dat. Ujednocený formát pomůže přispěvatelům dat pochopit datové sady a najít relevantní data, která potřebují, což povede k vyšším kvalitám příspěvků otevřených dat.
Jaké jsou některé výhody otevřených datových sad?
Prospěchují výzkumníkům, protože vědci mají více volných zdrojů, které mohou použít pro školení modelů a dokončení výzkumu.
Prospěchují podnikům, které používají datové sady k zahájení budování schopností AI a posílení přechodu z tradičních podniků na podniky AI.
Jak Graviti ověřuje kvalitu datových sad?
Dokonce i populární datové sady, jako je COCO a KITTI, nejsou pro vývojáře dokonalé. Chyby vždy nastávají, když vývojáři školí modely a nikdo nezjistil excelente způsob, jak zlepšit kvalitu datových sad. Graviti věří, že bude zaveden model hodnocení datových sad nebo jiná technická revoluce, která pomůže komunitě vyřešit problém, a je to také část mise Graviti, kterou chce dosáhnout v budoucnu.
Jaký je váš výhled do budoucnosti, jak vývojáři budou přistupovat k datům?
Pro malé množství dat by vývojáři měli mít snadný přístup k těmto datům. Pro větší množství dat, jako jsou více rozmanité datové sady pro školení modelů, by technologie federovaného učení pomohla pracovat ve spolupráci tím, že oddělí schopnost provádět strojové učení od ukládání dat na centrálním serveru.
Je něco jiného, co byste rádi sdíleli o Graviti?
Graviti se také vyvíjí. Nasloucháme zpětné vazbě od našich klientů, včetně startupů, podniků, jednotlivých vývojářů a výzkumníků. Také vítáme jakoukoli spolupráci nebo partnerství od každého.
Vidíme velké příležitosti ve vývoji AI z otevřených dat v blízké budoucnosti. Budujeme komunitu pro sdílení a přispívání otevřených dat. To bude prospěšné nejen výzkumníkům, aby posunuli hranice vědy dále, ale také podnikům, aby vylepšily své modely a vyvinuly technologii ve vzájemně prospěšném prostředí.
Děkuji za skvělý rozhovor, čtenáři, kteří chtějí se dozvědět více, by měli navštívit Graviti.












