Rozhovory

Fabiana Clemente, spoluzakladatelka a Chief Data Officer ve společnosti YData – rozhovor

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Fabiana Clemente je spoluzakladatelka a Chief Data Officer ve společnosti YData. YData je startup, který vytvořil první datové centrické vývojové řešení, které kombinuje objevování, zlepšování a škálování dat na jedné platformě.

Co vás最初 přitáhlo k umělé inteligenci a strojovému učení?

Můj background je v aplikované matematice, kde jsem měla příležitost se naučit a pochopit, jak lze z dat extrahovat informace a dělat to pomocí kódu. V té době to nebylo tak sexy jako strojové učení, ale určitě to byla věc, která mě přitáhla k této oblasti.

Můžete sdílet příběh o vzniku Ydata?

Jako Data Scientist, který pracoval pro startupy i podniky, jsem měl svou část problémů – někdy byl přístup k datům blokován z důvodu bezpečnosti nebo ochrany osobních údajů, jindy byl přístup snadný, ale kvalita dat nebyla ani zdaleka taková, aby se dala použít pro xây dựng řešení založených na umělé inteligenci. Vědomí, že tyto problémy jsou velmi časté ve většině organizací, nás inspirovalo k založení společnosti s cílem pomoci těmto týmům překonat tyto překážky a urychlit vývoj umělé inteligence s vylepšenými daty.

Můžete vysvětlit našim čtenářům, co je syntetická data?

Syntetická data jsou považována za jakákoliv data, která nebyla generována v reálném světě, tedy jakákoliv data, která jsou vytvořena umělým způsobem. Existují metody, které umožňují generovat syntetická data – od rule-based strategií až po použití modelů strojového učení nebo hlubokého učení k naučení těchto “pravidel” pro nás. Ve společnosti YData jsme přijali a specializovali se na strategii založenou na hlubokém učení k generování nových dat, která zachovávají chování z reálných událostí bez obav kolem ochrany osobních údajů.

Co dělá syntetická data tak důležitá?

Čím více organizace chápou důležitost dat pro posílení svého podnikání, tím více bude důležitost a role syntetických dat pochopitelná. Sběr reálných dat je nejen časově náročný a nákladný, ale sometimes i nemožný. Pro xây dựng aplikací umělé inteligence jsou data tvrdým požadavkem – zde přichází syntetická data na pomoc. Schopnost generovat neviditelné scénáře nebo jednoduše odemknout přístup k datům je klíčová pro vývoj v světě, kde průkopníci, jako Andrew Ng, prohlašují, že stát se datově centrickým je klíčové pro úspěšné přijetí umělé inteligence.

V samořízených autech nebo jiných aktivitách automatizace již můžeme vnímat důležitost syntetických dat, takže bych řekl, že je pouze přirozené, že toto pochopení se rozšíří napříč všemi průmyslovými vertikálami.

Jak Ydata generuje syntetická data?

YData využívá především hluboké generativní modely k naučení statistických atributů a korelací mezi proměnnými původních dat. To umožňuje modelu generovat statisticky relevantní datový soubor, který má stejnou obchodní hodnotu jako původní, bez možnosti stopovat původní záznamy.

YData tlačí tuto technologii kupředu a je společnost za Komunitou syntetických dat – skupinou odborníků na data science, kteří se zavázali k evangelizaci a pomoci každému, kdo chce se naučit a použít tuto technologii.

Jak platforma Ydata pomáhá objevovat a odemknout nové zdroje dat?

Platforma YData obsahuje vestavěné konektory pro jakýkoliv typ databáze, datového skladu nebo jezera dat, které umožňují uživatelům snadno získat přístup k relevantním metadatům a pochopit, zda existující data jsou užitečná pro zodpovězení obchodního dotazu, který mají v rukou – aniž by museli sledovat skutečné záznamy.

Můžete sdílet některé detaily o Komunitě syntetických dat?

Syntetická data jsou teprve v počátcích a z tohoto důvodu je povědomí o tom, jak jsou generována, jaké jsou jejich výhody nebo omezení, stále somewhat neznámé pro širší publikum. Z tohoto důvodu jsme ve společnosti YData rozhodli o vzdělávání a vytvořili Komunitu syntetických dat – kromě toho, že je to místo, kde lze vyměňovat nápady nebo získat pomoc od odborníků na syntetická data, je to také místo, kde mohou data scientisti a další technické profily začít svou cestu do syntetických dat, s některými z nejzajímavějších algoritmů z literatury.

Dále také nabízíme perspektivu na kvalitu dat, aby data scientisti mohli nejdříve pochopit data, se kterými pracují, předtím, než je syntetizují nebo vylepší syntetizaci. Jsme skutečně zavázáni k pomoci datovým týmům stát se více a více datově centrickými.

YData nedávno ohlásila 2,7 milionu dolarů ve financování k urychlení mezinárodní expanze. Můžete sdílet některé detaily o tom, co to znamená pro budoucnost společnosti a její expanzní strategii?

YData se narodila mezinárodně – věděli jsme, že tato technologie potřebuje rané adoptéry, kteří jsou obvykle v nejrozvinutějších zemích. Z tohoto důvodu byli naši první zákazníci již mimo Portugalsko, po celé Evropě, a nyní zakládáme přítomnost v Severní Americe. Toto financování nám umožní posílit naši přítomnost v obou kontinentech, nejen komerčně, ale také růst našeho týmu: jsme plně distribuovaným týmem, který nám umožňuje najmout nejlepší talenty, kdekoliv jsou.

Je něco jiného, co byste chtěli sdílet o YData?

YData tlačí hranice datově centrické umělé inteligence a vytváří novou kategorii: DataPrepOps – i když to není hezké jméno, je to bolest, kterou většina společností currently faces, když jde o vývoj datově vědeckých řešení. Trend kvality dat pokračuje a po datech potrubí a pozorovatelnosti dat je kvalita dat pro týmy datově vědeckých stále v plenkách a YData se stává thought leaderem v přípravě dat.

Děkuji za skvělý rozhovor, čtenáři, kteří chtějí se naučit více, by měli navštívit YData.

Antoine je vizionářský líder a spoluzakladatel Unite.AI, který je poháněn neotřesitelnou vášní pro formování a propagaci budoucnosti umělé inteligence a robotiky. Jako sériový podnikatel věří, že umělá inteligence bude mít na společnost stejně disruptivní vliv jako elektřina, a často se chvála na potenciál disruptivních technologií a AGI.