Entretiens

Edward Cui, Fondateur et PDG de Graviti – Série d’entretiens

mm
Ajouter Unite.AI à vos sources préférées sur Google

Edward Cui est le fondateur et le PDG de Graviti, une entreprise qui construit la prochaine génération de plateforme de données qui va fondamentalement changer la façon dont les développeurs interagissent avec les données non structurées. Avec Graviti, les développeurs d’IA peuvent acquérir, stocker et traiter les données plus rapidement et plus facilement – la base nécessaire pour exploiter l’intelligence artificielle pour autonomiser toutes les industries.

Vous avez commencé vos études universitaires en tant qu’ingénieur mécanicien, qu’est-ce qui a causé le changement vers l’informatique et l’intelligence artificielle ?

J’ai effectivement étudié l’ingénierie mécanique en 2012. J’ai suivi un cours sur l’apprentissage automatique à l’Université de Pennsylvanie, qui m’a bluffé, et j’ai su que c’était l’avenir et ce que je voulais faire pour ma carrière. Après ce cours, j’ai changé pour l’informatique.

Après l’obtention de mon diplôme, j’ai effectué des recherches sur l’apprentissage par renforcement à l’Université de Pennsylvanie. En 2015, mon ancien patron, Jeff Snyder, a rejoint Uber et m’a invité à rejoindre Uber ATG. C’est le début de ma carrière dans l’industrie de la voiture autonome.

Pouvez-vous partager l’histoire de la création de Graviti ?

Travailler chez Uber était très compliqué au début, car les gens n’utilisaient pas de grands modèles d’apprentissage automatique et nous manquions de puissance de calcul et d’une plateforme de gestion de données pour former des modèles. Les données que nous avons collectées pour les voitures autonomes étaient toutes non structurées. Par exemple, il s’agissait d’images, de vidéos, de points LIDAR. Tout ce type de données provenant de capteurs du monde réel et nous collections des tonnes de données non structurées chaque jour. Nous avons effectué une statistique qui nous a indiqué que la quantité de données que nous collections dans une division de voitures autonomes en une semaine était égale à la quantité de données que nous collections pour l’ensemble du secteur de la restauration dans le monde entier pendant une année entière. Des tonnes de données non structurées s’accumulaient chaque jour et cela créait de gros problèmes pour stocker ces données, les gérer et les utiliser pour générer des valeurs pour différentes organisations.

Après trois ans passés chez Uber, j’ai vu l’opportunité d’améliorer la façon dont les grandes quantités de données non structurées pouvaient être gérées. J’ai donc fondé Graviti en 2019 pour accélérer les innovations dans l’IA en construisant la plateforme de gestion de données non structurées.

Pouvez-vous discuter de la façon dont Graviti est une plateforme pour gérer et structurer les données à grande échelle ?

Graviti vise à lancer la première plateforme de données qui permet aux organisations de travailler avec de grandes quantités de données non structurées pour alimenter des applications d’IA innovantes. Cette plateforme élimine les tracas et aide les développeurs à gérer de grandes quantités de données non structurées avec leur équipe.

Alors que la grande majorité des informations disponibles dans le développement de l’IA est de mauvaise qualité et non structurée, les équipes de développement passent généralement plus de 50 % de leur temps – non à construire des modèles – mais à identifier, à augmenter ou à nettoyer les données non structurées, et c’est juste le début de leur travail. Graviti offre une façon plus experte de gérer les données pour libérer les développeurs et leur donner plus de temps pour analyser les données non structurées et former des modèles d’IA.

Nous aidons les développeurs dans trois dimensions : la découverte de données, l’itération de données et l’automatisation des flux de travail.

Découverte de données :

Graviti offre une fonctionnalité d’hébergement de données qui facilite l’organisation des données brutes, des annotations et des métadonnées en unifiant les formats de données et d’annotations. Lorsque les développeurs d’IA accèdent à différents ensembles de données via Graviti, ils n’ont pas besoin de convertir les formats de données, ce qui simplifie la gestion, la requête, l’accès et les autres opérations liées aux annotations. Graviti aide à réduire la possibilité de données brutes non correspondantes ou de perte d’annotations. De plus, la plateforme Graviti peut aider les développeurs à évaluer la qualité des ensembles de données avec une fonctionnalité de visualisation de données, ce qui économise au moins huit heures par semaine pour les développeurs.

Itération de données :

Lorsque les développeurs forment leurs modèles d’IA, ils doivent tester avec des ensembles de données dans différentes versions pour voir les résultats et noter les annotations. Le défi consiste à suivre les différentes éditions et les versions avec les membres de l’équipe qui travaillent sur le même projet. Graviti offre la solution en permettant l’attribution de différents niveaux de droits d’accès aux employés pour leur permettre de télécharger leurs annotations et de suivre les progrès du projet et de travailler en parallèle.

Automatisation des flux de travail :

Avec une fonctionnalité appelée « Action », les ingénieurs peuvent automatiser les flux de travail et réduire les tâches répétitives, fastidieuses et manuelles. Cela libère les développeurs de l’obligation d’écrire de grands scripts manuels pour réaliser ces flux de travail et leur permet de se consacrer au travail qu’ils doivent faire.

Pourquoi les données non structurées sont-elles l’avenir de l’IA ?

Plus de 80 % des données d’entreprise sont non structurées, y compris les images, les enregistrements, les vidéos, les publications sur les réseaux sociaux, etc. L’IA est la clé pour délivrer des valeurs à partir de données non structurées. Les entreprises commencent à exploiter les données non structurées pour soutenir la recherche et l’analyse approfondies.

Graviti a récemment lancé OpenBytes, un projet de données ouvertes à but non lucratif hébergé sous la fondation Linux. Pouvez-vous discuter de ce qu’est spécifiquement OpenBytes ?

La mission d’OpenBytes est de faciliter le partage plus large de données dans la communauté de l’IA grâce à la création de normes de données, de formats et de processus permettant les contributions de données. La portée d’OpenBytes inclut la curation d’ensembles de données ouverts, de spécifications de données ouvertes et de développement collaboratif sous des licences ouvertes qui soutiennent la mission, y compris la documentation, les tests, l’intégration et la création d’autres artefacts qui aident au développement, au déploiement, à l’exploitation ou à l’adoption du projet open source.

OpenBytes peut réduire les risques de responsabilité des contributeurs de données. Les détenteurs de données hésitent à partager leurs ensembles de données publiquement en raison du manque de connaissance des licences de données. Une fois que les contributeurs de données rejoignent OpenBytes, leurs données seront protégées et plus de données ouvertes seront accessibles.

Nous générons également un format de données standardisé lors de la publication, du partage et de l’échange de données. Un format unifié aidera les contributeurs de données à comprendre les ensembles de données et à trouver les données pertinentes dont ils ont besoin, ce qui conduira à des contributions de données ouvertes de meilleure qualité.

Quels sont les avantages des ensembles de données open source ?

Ils bénéficient aux chercheurs, car les scientifiques ont plus de ressources gratuites à utiliser pour former des modèles et compléter la recherche.

Ils bénéficient aux entreprises, qui utilisent les ensembles de données pour commencer à construire des capacités d’IA et à accélérer la transition des entreprises traditionnelles aux entreprises d’IA.

Comment Graviti authentifie-t-il la qualité des ensembles de données ?

Même les ensembles de données populaires tels que COCO et KITTI ne sont pas parfaits pour les développeurs. Des bogues se produisent toujours lorsque les développeurs forment des modèles et personne n’a trouvé de bonne façon d’améliorer la qualité des ensembles de données. Graviti croit qu’un modèle d’évaluation des ensembles de données sera établi ou qu’une autre révolution technique aidera la communauté à résoudre le problème, et c’est également une partie de la mission de Graviti à réaliser à l’avenir.

Quelle est votre vision pour l’avenir de la façon dont les développeurs accèdent aux données ?

Pour une petite quantité de données, les développeurs devraient être en mesure d’accéder à ces données facilement. Pour des quantités de données plus importantes, comme des ensembles de données plus diversifiés pour la formation de modèles, la technologie d’apprentissage fédéré aiderait à travailler de manière collaborative en déconnectant la capacité de faire de l’apprentissage automatique du stockage des données sur un serveur central.

Y a-t-il autre chose que vous aimeriez partager sur Graviti ?

Graviti évolue également. Nous écoutons les commentaires de nos clients, y compris les startups, les entreprises, les développeurs individuels et les chercheurs. Nous accueillons également toute opportunité de collaboration ou de partenariat avec tout le monde.

Nous voyons de grandes opportunités dans le développement de l’IA à partir de données ouvertes dans un avenir très proche. Nous construisons une communauté pour partager et contribuer des données ouvertes. Cela bénéficiera non seulement aux chercheurs pour repousser les limites de la science plus loin, mais également aux entreprises pour affiner leurs modèles et faire évoluer la technologie dans un environnement mutuellement bénéfique.

Merci pour cette grande interview, les lecteurs qui souhaitent en savoir plus peuvent visiter Graviti.

Antoine est un leader visionnaire et associé fondateur d'Unite.AI, animé par une passion inébranlable pour façonner et promouvoir l'avenir de l'IA et de la robotique. Un entrepreneur en série, il croit que l'IA sera aussi perturbatrice pour la société que l'électricité, et se fait souvent prendre en train de vanter le potentiel des technologies perturbatrices et de l'AGI.

En tant que futuriste, il se consacre à explorer comment ces innovations vont façonner notre monde. En outre, il est le fondateur de Securities.io, une plateforme axée sur l'investissement dans les technologies de pointe qui redéfinissent l'avenir et remodelent des secteurs entiers.