Entretiens

Sohaib Khan, Co-Fondateur et PDG de Hazen.ai – Série d’entretiens

mm
Ajouter Unite.AI à vos sources préférées sur Google

Sohaib Khan est le co-fondateur et le PDG de Hazen.ai, une entreprise qui utilise la vision par ordinateur et l’apprentissage automatique pour concevoir des logiciels d’analyse de trafic intelligents qui sont conçus pour « comprendre » le mouvement de chaque véhicule.

Qu’est-ce qui vous a initialement attiré dans le domaine de l’IA ?

C’était pendant mes études de premier cycle que j’ai lu pour la première fois comment la vision stéréo (ou vision binoculaire – estimation de la profondeur à partir de deux caméras) fonctionne. Cela m’a accroché pour explorer davantage la vision par ordinateur. Intéressant, j’ai lu cela dans un livre que j’ai acheté dans un marché traditionnel du vendredi où ils vendaient des livres usagés sur un trottoir en bordure de route dans notre ville natale. J’ai ensuite fait un doctorat dans ce domaine aux États-Unis.

Vous étiez précédemment professeur à l’une des plus grandes universités du Pakistan, The Lahore University of Management Sciences (LUMS). Quels étaient vos domaines d’enseignement et de recherche ?

Lorsque j’ai rejoint LUMS après mon doctorat, j’ai créé ce qui était le premier laboratoire de recherche de cycle supérieur de l’université, grâce à un financement que j’ai reçu d’une grande subvention d’une organisation de défense. Le programme de master en informatique était très nouveau, et il n’y avait pas de laboratoires de recherche à cette époque. J’ai enseigné la vision par ordinateur pendant 12 ans à LUMS, et j’avais un laboratoire actif dans ce domaine. Au début, la vision par ordinateur n’était enseignée dans aucune université pakistanaise, mais plus tard, elle est devenue un sujet standard, et en fait, beaucoup de mes étudiants enseignent maintenant également dans des universités pakistanaises.

Pouvez-vous discuter de ce qui vous a inspiré pour lancer une startup spécialisée dans la vision par ordinateur et les algorithmes d’apprentissage automatique pour l’analyse de vidéos ?

La vision par ordinateur, pendant longtemps, a été principalement un domaine de recherche expérimentale, avec des applications limitées dans les produits. Cela était principalement dû au fait que la maturité des algorithmes nécessaires pour construire des produits n’était pas là. Pour un produit, l’algorithme de compréhension d’images doit fonctionner dans une variété de conditions d’imagerie et d’éclairage, et non dans des expériences très contrôlées. Nous avions une blague parmi les étudiants de cycle supérieur dans notre laboratoire lorsque j’ai fait mon doctorat en 2000, que si vous pouvez trouver trois images sur lesquelles votre algorithme fonctionne, vous pouvez écrire un article. Si cela fonctionne sur trois vidéos, vous obtenez un très bon article ! Le point est que de nombreux algorithmes de vision fonctionnaient uniquement dans des scénarios de laboratoire soigneusement contrôlés et n’étaient pas très robustes.

Mais maintenant, les choses ont changé. Avec l’avènement de l’apprentissage automatique en 2012, nous avons vu des progrès très rapides et fascinants dans la compréhension des images. Lorsque nous avons vu cela, nous avons senti que maintenant, le moment est venu de peut-être construire des produits solides qui puissent avoir un impact significatif.

Quels types d’infractions au code de la route peut Hazen.ai surveiller ?

Notre objectif est d’être en mesure d’identifier tous les types de comportements de conduite dangereux sur les routes. Cela est motivé par notre objectif global de réduire les décès sur la route. Toutes les 24 secondes, quelqu’un meurt dans un accident de la route, ce qui équivaut à environ 15 avions 787-8 qui s’écrasent chaque jour ! Donc, c’est vraiment ce qui nous motive. C’est pourquoi nous construisons un logiciel qui peut détecter différents types de comportements dangereux et non sécuritaires, comme les changements de voie non sécuritaires, les virages illégaux, le franchissement d’un feu rouge ou d’un stop, le blocage d’un passage piéton ou le non-port de la ceinture de sécurité ou la conduite tout en textant. Nous travaillons également à la construction de fonctionnalités dans notre logiciel spécifiquement pour la sécurité des piétons et des cyclistes, car plus de la moitié des décès sur la route se produisent dans le segment des usagers de la route vulnérables que sont les piétons, les cyclistes et les motocyclistes.

Quels sont certains des défis uniques liés à l’utilisation de la vision par ordinateur pour surveiller les objets en mouvement à des vitesses élevées ?

Il existe deux types de défis : Premièrement, la performance des algorithmes de vision par ordinateur eux-mêmes – vous voulez avoir un produit qui puisse fonctionner dans des conditions de trafic difficiles 24h/24 et 7j/7 dans toutes les variations d’éclairage. Même si des progrès techniques importants ont été réalisés dans ce but, il existe encore des pays où la densité des usagers de la route est si élevée, comme des grappes de motos ou de piétons à proximité, qu’il est encore difficile pour les algorithmes de les suivre individuellement et de comprendre la scène. Mais deuxièmement, un défi plus important est de faire un produit solide à partir d’algorithmes de vision par ordinateur, qui puisse être déployé sur des ressources matérielles limitées au niveau de la périphérie, et qui puisse être surveillé et géré facilement malgré être réparti dans toute la ville. Puisque les produits de vision par ordinateur gèrent une grande quantité de données vidéo, les déployer à la périphérie, en tant que dispositif IoT, et les gérer efficacement, reste une tâche difficile.

Quel est le processus pour que l’utilisateur final configure le logiciel pour différents types de routes ?

Chaque intersection fournit un scénario unique, en termes de volume de trafic, de configuration de voie et de type de véhicule, de cyclistes ou d’interactions piétonnières. De plus, les intérêts des gestionnaires de trafic peuvent être spécifiques, pour identifier un type particulier de comportement de trafic à chaque site. Par exemple, la police de trafic peut interdire un demi-tour à une intersection pour fluidifier le trafic, et est intéressée à capturer cette statistique. C’est pourquoi nous avons rendu notre logiciel configurable pour différents scénarios. Lorsqu’une caméra est configurée avec notre logiciel, nous la configurons à travers un processus simple pour ce que l’utilisateur final nécessite sur ce site. Intérieurement, nous avons construit un langage de haut niveau dans lequel nous pouvons décrire de manière compacte les scénarios de trafic qui nous intéressent de manière simple. Cela nous permet de configurer un site rapidement pour nos clients.

Quel type de matériel est nécessaire pour exploiter ce système ?

L’analyse de vidéo nécessite une puissance de calcul importante. Nous avons optimisé notre code pour fonctionner sur les petites cartes graphiques Nvidia qui peuvent être déployées à la périphérie, comme leur série Jetson, et également sur les processeurs Intel pour certaines fonctionnalités que nous proposons. Ces dernières années, des matériel plus puissants sont devenus disponibles à un prix raisonnable, ce qui pousse vraiment de nombreuses applications excitantes.

Pouvez-vous discuter si certaines juridictions utilisent actuellement ou testent la technologie Hazen.ai ?

Nous avons actuellement des essais en cours dans plusieurs pays, Royaume-Uni, États-Unis, Égypte, Arabie saoudite, Pakistan, Oman, Pérou, et nous nous engageons avec des clients potentiels dans d’autres pays également.

Y a-t-il autre chose que vous aimeriez partager sur Hazen.ai ?

Dans l’ensemble, nous pensons que les technologies de sécurité routière n’ont pas suffisamment progressé, par rapport à l’ampleur du problème. Cependant, maintenant, le moment est venu, grâce aux progrès massifs de la vision par ordinateur et de l’apprentissage automatique, ainsi qu’à la disponibilité bon marché de matériel de caméra et de calcul. Nous allons voir de nombreuses applications supplémentaires de la vision par ordinateur basée sur la périphérie dans les années à venir. Ce sont les fondements qui animent Hazen.ai.

Je vous remercie pour l’entretien, les lecteurs qui souhaitent en savoir plus peuvent visiter Hazen.ai

Antoine est un leader visionnaire et associé fondateur d'Unite.AI, animé par une passion inébranlable pour façonner et promouvoir l'avenir de l'IA et de la robotique. Un entrepreneur en série, il croit que l'IA sera aussi perturbatrice pour la société que l'électricité, et se fait souvent prendre en train de vanter le potentiel des technologies perturbatrices et de l'AGI.

En tant que futuriste, il se consacre à explorer comment ces innovations vont façonner notre monde. En outre, il est le fondateur de Securities.io, une plateforme axée sur l'investissement dans les technologies de pointe qui redéfinissent l'avenir et remodelent des secteurs entiers.