Santé
Comment l’IA est utilisée dans la lutte contre le coronavirus de Wuhan

L’intelligence artificielle est utilisée dans la lutte contre le coronavirus de Wuhan. Les chercheurs utilisent l’intelligence artificielle pour suivre la propagation de la maladie et pour rechercher des traitements potentiels pour le virus.
Le coronavirus de Wuhan est apparu en Chine en décembre et, depuis deux mois, il s’est propagé en Chine et dans d’autres parties du monde. On ne sait pas encore exactement à quel point le virus est contagieux et à quel rythme il peut se propager, bien qu’il y ait actuellement plus de 40 000 cas confirmés en Chine. Pour mieux comprendre comment le virus pourrait se propager et à quel rythme il peut se propager, les chercheurs utilisent des algorithmes d’apprentissage automatique basés sur les données collectées sur les sites de réseaux sociaux et d’autres parties du web.
Au cours de la semaine dernière, le taux d’infection semble avoir diminué quelque peu, mais il n’est pas clair si la maladie est en train de être maîtrisée ou si de nouveaux cas sont devenus plus difficiles à détecter. Alors que d’autres pays du monde n’ont vu que quelques cas de coronavirus, par rapport à la Chine, la communauté mondiale de la santé reste préoccupée par la capacité du virus à se propager. Les chercheurs essaient de devancer la propagation du virus en utilisant l’apprentissage automatique et les grandes données collectées sur Internet.
Selon un article de Wired, une équipe internationale de chercheurs a extrait des données de diverses parties d’Internet, notamment des publications de médecins et de groupes médicaux, des canaux de santé publique, des publications sur les réseaux sociaux et des rapports d’actualité, en compilant une base de données de textes qui pourraient être liés au coronavirus. Les chercheurs analysent ensuite les données à la recherche de signes que le virus pourrait se propager en dehors des frontières chinoises, en utilisant des techniques d’apprentissage automatique pour trouver des modèles pertinents dans les données qui pourraient indiquer comment le virus se comporte.
Les chercheurs passent au crible les publications sur les réseaux sociaux à la recherche de symptômes potentiels de coronavirus, en se concentrant sur les régions où les médecins pensent que des cas pourraient apparaître. Les publications sur les réseaux sociaux sont traitées à l’aide de techniques de traitement du langage naturel, qui peuvent distinguer les publications où une personne mentionne ses propres symptômes de celles où quelqu’un utilise des mots liés aux symptômes dans un autre contexte (comme lorsqu’il discute de l’actualité sur le coronavirus).
Selon Alessandro Vespignani, comme le rapporte Wired, professeur à l’Université Northeastern et expert en analyse de la contagion, même avec des techniques d’apprentissage automatique avancées, il est souvent difficile de suivre la propagation du virus parce que les caractéristiques du virus sont encore en partie inconnues, et que la plupart des publications sur les réseaux sociaux proviennent de sociétés de médias et concernent actuellement l’épidémie en Chine. Cependant, Vespignani pense que si le virus devait se propager aux États-Unis, il serait plus facile à suivre grâce à davantage de publications concernant le virus.
Malgré les défis pour obtenir des informations pertinentes sur le comportement potentiel du coronavirus, le modèle créé par les chercheurs semble être raisonnablement efficace pour trouver des indices dans un grand nombre de publications sur les réseaux sociaux. Le modèle utilisé par les chercheurs a pu trouver des preuves d’une épidémie virale le 30 décembre, bien qu’il ait fallu du temps pour déterminer à quel point la situation allait devenir grave. Les informations collectées par crowdsourcing pourraient améliorer encore l’efficacité des modèles de suivi des maladies, car elles permettent une collecte plus efficace de données pertinentes sur le virus. Par exemple, une analyse des données collectées par des médecins chinois suggère que les personnes âgées de moins de 15 ans sont plus résistantes au virus.
L’intelligence artificielle peut également être combinée avec des données collectées à partir d’appareils mobiles pour construire des modèles qui pourraient potentiellement prédire la direction dans laquelle un virus se propage ainsi que le rythme de propagation. Par exemple, des chercheurs de l’Université de Southampton ont utilisé des données mobiles pour déterminer le chemin que le virus a pu emprunter lorsqu’il est sorti de Wuhan dans les jours suivant son apparition. D’autres chercheurs ont analysé des données collectées par Tencent, un développeur d’applications mobiles chinois, et ont constaté que les restrictions imposées par le gouvernement chinois pourraient potentiellement réduire la propagation du virus, en gagnant un temps précieux pour élaborer un plan d’attaque.
Selon un article de Fortune, la startup Insilico Medicine a utilisé l’intelligence artificielle pour identifier des molécules qui pourraient potentiellement traiter le coronavirus. L’IA d’Insilico a identifié des milliers de molécules de médicaments potentielles au cours de quatre jours. Insilico a expliqué que les 100 candidats les plus prometteurs seront synthétisés et que toutes leurs recherches sur les structures moléculaires seront publiées pour que d’autres chercheurs puissent en tirer parti. Les chercheurs médicaux et les sociétés sont en train d’accélérer le développement et les tests de traitements, la société biotechnologique américaine Gilead prévoyant de commencer immédiatement les tests d’un nouveau médicament antiviral dans la région de Wuhan.
Après que Insilico ait décidé de commencer à rechercher des traitements, il s’est concentré sur une enzyme appelée 3C-like protéase. Le coronavirus dépend de cette enzyme pour se reproduire et se propager. Selon Insilico, il a choisi cette enzyme spécifique parce qu’elle est très similaire à d’autres protéases virales dont les structures ont déjà été documentées, et parce que l’Université de technologie de Shanghai avait développé un modèle de la 3C-like protéase du 2019-nCoV. En l’espace de quatre jours, Insilico a pu générer des centaines de milliers de molécules candidates et choisir seulement les cent ou environ qui étaient les plus susceptibles d’être utiles. Les résultats de la recherche ont été récemment publiés dans le référentiel bioRxiv et sur le site Web d’Insilico.












