Modèles et plateformes d’IA
Nouvelles Outils d’Analyse de Données Utilisant une Interface Basée sur le Langage Naturel

Récemment, une équipe d’ingénieurs et de chercheurs de la faculté d’ingénierie de visualisation et d’analyse (VIDA) de l’Université de New York (NYU) a créé un outil de visualisation de données appelé VisFlow, ainsi qu’une extension pour cet outil appelée FlowSense. Selon ScienceDaily, FlowSense permet aux utilisateurs de créer des pipelines d’exploration de données simplement en fournissant des commandes en langage naturel à l’appareil.
Les données sont partout, constamment collectées et générées par des machines, des chercheurs, des systèmes et même des personnes ordinaires. La capacité de manipuler et d’analyser les données est essentielle pour résoudre des problèmes tels que la prévision du temps, le contrôle de la circulation routière, la surveillance de la propagation des maladies et l’amélioration de la croissance des cultures. L’utilisation de tactiques et d’outils d’apprentissage automatique est un élément crucial de la création de modèles de données complexes basés sur des ensembles de données massifs. Cependant, de nombreux chercheurs, scientifiques et ingénieurs ne possèdent pas les compétences nécessaires en informatique.
Claudio Silva est professeur d’informatique et d’ingénierie affilié au laboratoire VIDA de l’Université de New York. Silva et son équipe ont voulu créer un outil pour ceux qui sont capables de visualiser et d’analyser les données de manière importante, mais qui ne possèdent pas les compétences nécessaires en informatique. C’est pourquoi ils ont créé le cadre VisFlow. En outre, FlowSense est une extension pour VisFlow qui permet à l’utilisateur d’interagir avec VisFlow pour créer des pipelines d’analyse de données simplement via une interface basée sur le langage naturel.
Le laboratoire VIDA a déjà une histoire établie de direction et de collaboration sur des projets de modélisation de données. Les projets résultant de collaborations avec le laboratoire VIDA incluent Open Space et Motion Browser. Open Space est un projet de modélisation de données utilisé dans des musées et des planétariums du monde entier pour créer des modèles possibles de l’univers et du système solaire. Pendant ce temps, Motion Browser est un projet visant à trouver de nouveaux traitements pour les blessures du nerf brachial. Le Motion Browser – Visualisation et Compréhension du Mouvement Complex du Membre Supérieur sous les Blessures du Plexus Brachial Obstétrical – est une collaboration entre des médecins de rééducation, des chirurgiens orthopédiques et des informaticiens. Enfin, VIDA a conduit à la création de l’Effet des Échelles de Couleur sur les Performances Objectives et Subjectives des Scientifiques du Climat dans les Tâches d’Analyse de Données Spatiales, une étude qui analyse l’efficacité de l’utilisation d’échelles de couleurs dans le contexte de cartes géographiques.
En ajoutant à cette liste de projets, VIDA a créé VisFlow en 2017, produit avec le financement du programme de découverte de modèles basés sur les données de la DARPA, ainsi que d’autres sources de financement. VisFlow permet à l’utilisateur de créer des modèles et de visualiser des données basées sur de nombreux concepts analytiques prédéfinis tels que la localisation géographique, les réseaux et les séries chronologiques. Le programme VisFlow a une interface de glisser-déposer simple, et l’extension FlowSense offre à l’utilisateur encore plus de façons de visualiser les données. Bowen Yu, un chercheur qui a travaillé dans le laboratoire de Silva et a travaillé sur le projet VIDA, a expliqué à ScienceDaily qu’un utilisateur pouvait simplement taper ou dire une commande au programme et activer une fonction d’analyse de données.
“Cette capacité rendrait les non-experts plus à l’aise, tout en offrant aux utilisateurs expérimentés des raccourcis. Nous croyons que, avec le support du langage naturel, nous pouvons atténuer la courbe d’apprentissage pour un système comme celui-ci et rendre le flux de données plus accessible” a expliqué Yu à ScienceDaily.
Les deux FlowSense et VisFlow seront mis à la disposition des chercheurs en tant que cadre open source. Les chercheurs espèrent que FlowSense stimulera davantage la collaboration et l’innovation dans la création de plateformes de flux de données plus faciles à utiliser.
Bien que VisFlow/FlowSense soit probablement le premier programme à permettre aux utilisateurs d’utiliser le langage naturel pour visualiser les données, il existe d’autres nouveaux outils de visualisation de données qui visent également à faciliter l’analyse de données. Le cabinet de conseil global Deloitte a récemment créé un puissant outil d’analyse et de visualisation de données publiques, appelé la Boussole Open Source (OSC). Selon Deloitte, l’OSC est destiné à permettre aux développeurs de mieux comprendre les tendances technologiques. L’OSC évalue les validations de code et aide les utilisateurs à explorer et à comprendre les langages et les plateformes de développement pertinents.












