Modèles et plateformes d’IA

Rédefinition de la recherche : Comment les moteurs de recherche conversationnels émergents surpassent les LLM obsolètes et les moteurs de recherche traditionnels sans contexte

mm
Ajouter Unite.AI à vos sources préférées sur Google

L’avènement des moteurs de recherche conversationnels redéfinit la façon dont nous récupérons les informations en ligne, en passant des recherches traditionnelles par mots clés à des interactions plus naturelles et conversationnelles. En combinant les grands modèles de langage (LLM) avec des données web en temps réel, ces nouveaux systèmes résolvent les problèmes clés trouvés dans les LLM obsolètes et les moteurs de recherche standard. Dans cet article, nous examinerons les défis auxquels sont confrontés les LLM et les recherches basées sur des mots clés, et explorerons comment les moteurs de recherche conversationnels offrent une solution prometteuse.

Les défis de connaissance obsolètes et de fiabilité dans les LLM

Les grands modèles de langage (LLM) ont considérablement amélioré nos méthodes d’accès et d’interprétation des informations, mais ils sont confrontés à une limitation majeure : leur incapacité à fournir des mises à jour en temps réel. Ces modèles sont formés sur des ensembles de données étendus qui incluent du texte provenant de livres, d’articles et de sites Web. Cependant, ces données de formation ne reflètent que les connaissances jusqu’à la date à laquelle elles ont été collectées, ce qui signifie que les LLM ne peuvent pas se mettre à jour automatiquement avec de nouvelles informations. Pour résoudre ce problème, les LLM doivent subir une réformation, un processus qui est à la fois gourmand en ressources et coûteux. Cela implique la collecte et la curation de nouvelles données, la réformation du modèle et la validation de ses performances. Chaque itération nécessite une puissance de calcul, de l’énergie et un investissement financier importants, ce qui soulève des inquiétudes quant à l’impact environnemental en raison des émissions de carbone importantes.

La nature statique des LLM conduit souvent à des inexactitudes dans leurs réponses. Lorsqu’ils sont confrontés à des requêtes sur des événements récents ou des développements, ces modèles peuvent générer des réponses basées sur des informations obsolètes ou incomplètes. Cela peut entraîner des “hallucinations“, où le modèle produit des faits incorrects ou fabriqués, sapant la fiabilité des informations fournies. De plus, malgré leurs vastes données de formation, les LLM ont du mal à comprendre le contexte complet des événements actuels ou des tendances émergentes, limitant ainsi leur pertinence et leur efficacité.

Une autre lacune importante des LLM est le manque de transparence dans les citations ou les sources. Contrairement aux moteurs de recherche traditionnels, qui fournissent des liens vers les sources originales, les LLM génèrent des réponses basées sur des informations agrégées sans spécifier leur origine. Cette absence de sources non seulement entrave la capacité des utilisateurs à vérifier l’exactitude des informations, mais limite également la traçabilité du contenu, rendant plus difficile la détermination de la fiabilité des réponses fournies. Par conséquent, les utilisateurs peuvent trouver difficile de valider les informations ou d’explorer les sources originales du contenu.

Les défis de surcharge d’informations et de contexte dans les moteurs de recherche Web traditionnels

Bien que les moteurs de recherche Web traditionnels restent essentiels pour accéder à une large gamme d’informations, ils sont confrontés à plusieurs défis qui impactent la qualité et la pertinence de leurs résultats. Un défi majeur avec cette recherche Web est sa difficulté à comprendre le contexte. Les moteurs de recherche s’appuient fortement sur la correspondance de mots clés, ce qui conduit souvent à des résultats qui ne sont pas pertinents dans le contexte. Cela signifie que les utilisateurs reçoivent un flux d’informations qui ne répondent pas directement à leur requête spécifique, ce qui rend difficile la recherche des réponses les plus pertinentes. Bien que les moteurs de recherche utilisent des algorithmes pour classer les résultats, ils échouent souvent à fournir des réponses personnalisées en fonction des besoins ou des préférences uniques de l’utilisateur. Ce manque de personnalisation peut conduire à des résultats génériques qui ne correspondent pas au contexte ou aux intentions spécifiques de l’utilisateur. De plus, les moteurs de recherche sont sensibles à la manipulation via le référencement et les fermes de liens. Ces pratiques peuvent fausser les résultats, en promouvant du contenu moins pertinent ou de moindre qualité vers le haut des classements de recherche. Les utilisateurs peuvent se retrouver exposés à des informations trompeuses ou biaisées en conséquence.

L’émergence des moteurs de recherche conversationnels

Un moteur de recherche conversationnel représente un changement de paradigme dans la façon dont nous interagissons avec et récupérons les informations en ligne. Contrairement aux moteurs de recherche traditionnels qui s’appuient sur la correspondance de mots clés et le classement algorithmique pour fournir des résultats, les moteurs de recherche conversationnels utilisent des modèles de langage avancés pour comprendre et répondre aux requêtes des utilisateurs de manière naturelle et conversationnelle. Cette approche vise à fournir une façon plus intuitive et efficace de trouver des informations en engageant les utilisateurs dans un dialogue plutôt que de présenter une liste de liens.

Les moteurs de recherche conversationnels utilisent la puissance des grands modèles de langage (LLM) pour traiter et interpréter le contexte des requêtes, permettant ainsi des réponses plus précises et plus pertinentes. Ces moteurs sont conçus pour interagir dynamiquement avec les utilisateurs, en posant des questions de suivi pour affiner les recherches et en offrant des informations supplémentaires au besoin. Cela améliore non seulement l’expérience utilisateur, mais améliore également considérablement la qualité des informations récupérées.

L’un des principaux avantages des moteurs de recherche conversationnels est leur capacité à fournir des mises à jour en temps réel et une compréhension contextuelle. En intégrant les capacités de récupération d’informations avec des modèles génératifs, ces moteurs peuvent récupérer et intégrer les dernières données du Web, garantissant que les réponses sont actuelles et exactes. Cela répond à l’une des principales limitations des LLM traditionnels, qui s’appuient souvent sur des données de formation obsolètes.

De plus, les moteurs de recherche conversationnels offrent un niveau de transparence que les moteurs de recherche traditionnels ne possèdent pas. Ils relient directement les utilisateurs à des sources crédibles, en fournissant des citations claires et des liens vers le contenu pertinent. Cette transparence favorise la confiance et permet aux utilisateurs de vérifier les informations qu’ils reçoivent, promouvant une approche plus éclairée et critique de la consommation d’informations.

Moteur de recherche conversationnel vs. Génération augmentée de récupération (RAG)

De nos jours, l’un des systèmes de récupération d’informations basés sur l’IA les plus couramment utilisés est connu sous le nom de RAG. Bien que les moteurs de recherche conversationnels partagent des similitudes avec les RAG, ils ont des différences clés, en particulier dans leurs objectifs. Les deux systèmes combinent la récupération d’informations avec des modèles de langage génératifs pour fournir des réponses précises et contextuellement pertinentes. Ils extraient des données en temps réel de sources externes et les intègrent dans le processus génératif, garantissant que les réponses générées sont actuelles et complètes.

Cependant, les systèmes RAG, tels que Bing, se concentrent sur la fusion des données récupérées avec des sorties génératives pour fournir des informations précises. Ils ne possèdent pas de capacités de suivi qui permettent aux utilisateurs de raffiner systématiquement leurs recherches. En revanche, les moteurs de recherche conversationnels, tels que le prototype SearchGPT d’OpenAI, engagent les utilisateurs dans un dialogue. Ils utilisent des modèles de langage avancés pour comprendre et répondre aux requêtes de manière naturelle, en offrant des questions de suivi et des informations supplémentaires pour raffiner les recherches.

Exemples du monde réel

Voici deux exemples réels de moteurs de recherche conversationnels :

  • Perplexity : Perplexity est un moteur de recherche conversationnel qui permet aux utilisateurs d’interagir de manière naturelle et contextuelle avec les informations en ligne. Il propose des fonctionnalités telles que l’option “Focus” pour restreindre les recherches à des plateformes spécifiques et la fonction “Related” pour suggérer des questions de suivi. Perplexity fonctionne sur un modèle freemium, avec la version de base offrant des capacités LLM autonomes et la version payante Perplexity Pro fournissant des modèles avancés comme GPT-4 et Claude 3.5, ainsi que des capacités de raffinement de requête et de téléchargement de fichiers améliorées.
  • SearchGPT : OpenAI a récemment introduit SearchGPT, un outil qui combine les capacités conversationnelles des grands modèles de langage (LLM) avec des mises à jour Web en temps réel. Cela aide les utilisateurs à accéder à des informations pertinentes de manière plus intuitive et plus directe. Contrairement aux moteurs de recherche traditionnels, qui peuvent être accablants et impersonnels, SearchGPT fournit des réponses concises et engage les utilisateurs de manière conversationnelle. Il peut poser des questions de suivi et offrir des informations supplémentaires au besoin, rendant l’expérience de recherche plus interactive et plus conviviale. Une fonction clé de SearchGPT est sa transparence. Il relie les utilisateurs directement à des sources crédibles, en offrant des citations claires et des liens vers le contenu pertinent. Cela permet aux utilisateurs de vérifier les informations et d’explorer les sujets de manière plus approfondie.

En résumé

Les moteurs de recherche conversationnels redéfinissent la façon dont nous trouvons des informations en ligne. En combinant des données Web en temps réel avec des modèles de langage avancés, ces nouveaux systèmes résolvent de nombreux problèmes des LLM obsolètes et des recherches basées sur des mots clés traditionnels. Ils fournissent des informations plus actuelles et plus précises et améliorent la transparence en reliant directement les utilisateurs à des sources crédibles. À mesure que les moteurs de recherche conversationnels comme SearchGPT et Perplexity.ai évoluent, ils offrent une approche plus intuitive et plus fiable pour la recherche, allant au-delà des limites des méthodes plus anciennes.

Dr. Tehseen Zia est un professeur associé titulaire à l'Université COMSATS d'Islamabad, titulaire d'un doctorat en intelligence artificielle de l'Université technique de Vienne, en Autriche. Spécialisé en intelligence artificielle, apprentissage automatique, science des données et vision par ordinateur, il a apporté des contributions significatives avec des publications dans des revues scientifiques réputées. Dr. Tehseen a également dirigé divers projets industriels en tant que chercheur principal et a servi en tant que consultant en intelligence artificielle.