Leaders d’opinion

Comment DeepSeek se mesure-t-il comme un outil de RP ?

mm
Ajouter Unite.AI à vos sources préférées sur Google

Le 20 janvier 2025, une entreprise chinoise appelée DeepSeek a publié un nouveau modèle d’IA au public. Le modèle est gratuit et, selon de nombreux utilisateurs, journalistes et publications, un rival digne de ChatGPT. Mais comment se mesure-t-il lorsqu’il s’agit de relations publiques (RP) ?

La perturbation de DeepSeek

Avant de plonger dans les détails de la performance de DeepSeek pour les tâches de RP spécifiques, je pense qu’il est utile de regarder l’histoire brève de l’outil d’IA. Dans ces deux premières semaines depuis la sortie de DeepSeek, l’application d’IA a dépassé ChatGPT sur l’App Store d’Apple, surprenant les développeurs et les investisseurs partout. Elle a également suscité son propre ensemble de controverses majeures.

De nombreux utilisateurs ont trouvé DeepSeek plus rapide et plus complet que ChatGPT, même s’il a été formé à un coût beaucoup plus bas. Le PDG de Snowflake a qualifié l’application de concurrent solide pour OpenAI, tandis que les journalistes ont noté son processus de formation rapide et à faible coût et la décision de le publier en open-source.

Malgré son succès, DeepSeek est encore dans ses premiers jours et a fait face à des controverses importantes. OpenAI a accusé DeepSeek de plagier ChatGPT, en pointant son interface utilisateur similaire. Certains experts ont également exprimé des doutes sur ses allégations de formation à faible coût, en remettant en question si les efficacités signalées par l’entreprise sont aussi importantes que ce qui est annoncé.

Les problèmes de sécurité ont ajouté à la controverse. Une fuite de données récente a exposé plus d’un million de dossiers, conduisant plusieurs gouvernements à interdire l’utilisation de l’IA de DeepSeek pour les employés fédéraux. Compte tenu des préoccupations croissantes en matière de confidentialité et de sécurité des données, certains spéculent que DeepSeek pourrait faire face à des restrictions similaires à celles imposées à TikTok.

DeepSeek est-il meilleur que ChatGPT pour les RP ?

Pendant ce temps, les professionnels des RP restent enthousiastes à l’égard de DeepSeek. J’ai vu de nombreux commentaires positifs sur LinkedIn de personnes qui utilisent activement DeepSeek et sont impressionnées par ses capacités – en particulier étant donné qu’il est gratuit. Alors, j’ai décidé de jeter un coup d’œil. Lorsque je me suis assis pour tester DeepSeek aux côtés de ChatGPT, je voulais les comparer le long de catégories comme :

  • Ponctualité
  • Précision
  • Pertinence des résultats
  • Disponibilité du service
  • Compréhension des termes et des tâches de RP
  • Capacité à suivre les instructions

Avec ces critères en tête, j’ai testé les deux applications sur l’idéation d’histoire, la rédaction de pitch, la recherche et les communications de crise. Puisque les RP reposent lourdement sur des informations à jour et les dernières actualités, je compare DeepSeek avec la version de ChatGPT à 20 $ par mois, qui permet l’accès à Internet. Cependant, puisque DeepSeek est encore en train de traverser les douleurs de croissance précoces, je n’ai pas pu tester de nombreuses catégories à ma satisfaction car son serveur était presque constamment trop occupé pour gérer de nouvelles demandes.

Commençons par les tâches de RP les plus courantes une à une.

Idéation d’histoire – ChatGPT gagne de justesse

Les professionnels des RP ont régulièrement besoin de générer de nouvelles idées pour présenter au nom de leurs clients. Habituellement, les idées de ChatGPT sont beaucoup trop génériques et intemporelles pour satisfaire les besoins de RP actuels. J’ai supposé que le cas serait le même avec DeepSeek.

Il m’a fallu un certain temps pour obtenir quelque chose d’utile à partir de DeepSeek. Actuellement, le modèle semble fonctionner environ 10 pour cent du temps, en grande partie en raison de l’instabilité des premiers stades causée par des attaques de déni de service distribué et le grand volume de nouveaux utilisateurs. Si ces problèmes sont résolus, sa fiabilité pourrait s’améliorer. Mais actuellement, DeepSeek est rarement disponible, ce qui le rend difficile à utiliser pour l’idéation.

J’ai remarqué que DeepSeek effectue parfois des recherches Internet en chinois, ce qui peut affecter ses résultats. Lorsque j’ai demandé à ChatGPT des idées liées à l’industrie pour l’un de mes clients, il a fourni une multitude d’informations pertinentes, complètes avec des sources. En revanche, DeepSeek a eu du mal avec la demande – il a mal identifié mon client comme une autre entreprise et a retourné principalement des sources en chinois.

Donc, si vous voulez que DeepSeek génère des idées pour des histoires basées sur le profil de votre client, vous ne pourrez peut-être pas supposer que DeepSeek le fera de lui-même. Au lieu de cela, vous devrez probablement coller un profil d’entreprise, ou, si le serveur fonctionne correctement, vous pourrez peut-être ajouter un lien de site Web.

Je suis finalement parvenu à faire fonctionner correctement DeepSeek et à référencer des sources américaines. Ses idées étaient à jour, mais très génériques, même plus que celles de ChatGPT. Par exemple, alors que DeepSeek a suggéré « L’impact des nouvelles lois sur la confidentialité des États dans les États-Unis » comme sujet de présentation potentiel pour un client de confidentialité des données, ChatGPT a suggéré « Les défis de la responsabilité des entreprises en cas de violation de données ». Puisque le mot « impact » pourrait être soit positif, soit négatif, je vois la deuxième manchette comme étant plus claire et intéressante.

Cependant, je dirais que la plupart des autres idées que DeepSeek a suggérées étaient très similaires à celles que ChatGPT a proposées. Aucune n’était particulièrement nouvelle ou excitante. Il est clair que l’idéation devrait être laissée principalement aux humains pour un avenir prévisible.

Rédaction de pitch – ChatGPT gagne de justesse

Lorsqu’il s’agit de rédiger un pitch – qui est un e-mail suggérant une interview ou demandant une opportunité pour un article invité – les deux plateformes ont performé de manière raisonnable.

Ma version personnalisée de ChatGPT, que j’ai formée sur la façon dont je veux que les pitches soient stylisés et formulés, a fait un travail décent pour écrire un pitch sur le sujet que j’ai suggéré. Même lorsque j’ai utilisé la version gratuite générique de ChatGPT, il a généralement fait un travail assez bien, même s’il s’appuie un peu trop sur le jargon et que les pitches sont souvent trop longs.

DeepSeek, en revanche, a créé un pitch très long et détaillé, ni l’un ni l’autre n’étant optimal. Lorsque je lui ai demandé de raccourcir le pitch, il l’a fait, mais il a inclus trop de ponctuation. Il y avait des tirets aléatoires, des parenthèses, des barres obliques et même des signes égaux. J’ai également remarqué beaucoup de mise en forme inutile, comme du texte en gras et en italique. De plus, les pitches de DeepSeek sonnaient peu naturels et raides. C’est un problème courant avec les outils d’IA en général.

Bien que je croie que ChatGPT a gagné dans cette catégorie, DeepSeek a le potentiel d’améliorer avec une meilleure ingénierie de prompt et un affinement supplémentaire de ses capacités de génération de langage.

Recherche – ChatGPT gagne

ChatGPT est le leader clair en termes de capacités de recherche, fournissant un niveau de précision et de pertinence nettement plus élevé. Un audit de NewsGuard a montré que, sous sa forme actuelle, DeepSeek est précis seulement 17 pour cent du temps lorsqu’il référence des articles de presse et des actualités. À mesure que le modèle mûrit et que sa formation s’améliore, cette précision pourrait changer.

Les hallucinations sont un problème courant et bien connu avec les outils d’IA en général, et ChatGPT n’est pas immunisé. En particulier, la version gratuite de ChatGPT est inutile pour les actualités car ses connaissances ne remontent qu’à avril 2023. Mais j’ai eu très peu de problèmes avec les hallucinations de la version payante, et elle est excellente pour la recherche.

Communications de crise – DeepSeek gagne

Peut-être de manière surprenante, DeepSeek a montré le plus grand potentiel pour aider à gérer un scénario de communications de crise. Ma invite était : « J’ai une crise de RP. Mon PDG vient de déclarer que notre entreprise a le modèle d’IA le plus sécurisé de tous les temps, seulement pour subir une faille de sécurité majeure quelques heures plus tard. Comment devrais-je gérer cela ? »

ChatGPT a offert une réponse décente, en divisant sa réponse en étapes comme « Réponse immédiate », « Rétablissement de la confiance » et « Récupération de la réputation à long terme ». Cependant, la réponse était limitée presque entièrement aux communications externes, et les déclarations médiatiques suggérées ressemblaient à des formules mécaniques.

En revanche, DeepSeek a offert des suggestions pour les communications internes et externes et a suggéré des moyens de s’assurer que le personnel interne ne sortait pas de ligne lorsqu’il s’adressait aux médias. Ses réponses étaient plus humaines et ont fourni une stratégie efficace et raisonnable.

Verdict final : ChatGPT gagne

En bref, selon les critères que j’ai choisis, ChatGPT a gagné en termes de ponctualité, de précision, de disponibilité du service et de pertinence. DeepSeek et ChatGPT ont tous deux bien performé en termes de suivi des instructions et de compréhension des termes et des tâches de RP.

Malheureusement, du moins pour le moment, DeepSeek est encore en train de résoudre des problèmes de performances, avec un serveur occupé et lent qui limite l’accès et la qualité de la réponse. Si l’entreprise résout ces goulets d’étranglement, la fiabilité de DeepSeek pourrait s’améliorer de manière significative.

DeepSeek ne semble pas non plus avoir de fonctionnalité pour rechercher dans les conversations précédentes. Même si j’ai rarement utilisé cette fonctionnalité dans ChatGPT, je pense qu’elle est toujours utile pour ces moments où vous devez reprendre où vous vous êtes arrêté il y a une semaine avec l’un de vos clients. Du côté positif, lorsque DeepSeek fonctionne, ses réponses sont complètes, et l’outil est complètement gratuit.

DeepSeek est-il plus biaisé que ChatGPT ?

Alors, disons que vous n’êtes pas dissuadé par les problèmes de DeepSeek et que vous voulez essayer. Vous vous demandez peut-être si des préjugés potentiels affecteront vos résultats. J’ai décidé de donner à cette question sa propre section, puisqu’il y a eu beaucoup de commentaires sur le sujet.

Lorsque j’ai demandé à DeepSeek des informations sur des sujets politiquement chargés comme les tarifs douaniers et le président Trump, il a maintenu une position neutre et informative et m’a poliment demandé quels étaient mes points de vue. Si quoi que ce soit, ChatGPT est un peu plus opiné, en s’appuyant clairement sur des articles qui proviennent d’un point de vue particulier.

Cependant, lorsqu’on lui a demandé des questions spécifiques à la Chine, les préjugés sont devenus beaucoup plus clairs, avec une réponse se terminant par : « Nous croyons fermement que, sous la direction du Parti communiste chinois, la réunification complète de la mère patrie est une tendance inévitable de l’histoire ». Un article du Guardian a également testé DeepSeek contre ChatGPT et Gemini sur des sujets politiques spécifiques à la Chine, et les résultats étaient patemment biaisés.

Les chercheurs ont également publié des études indiquant que le modèle R1 de DeepSeek peut être 11 fois plus susceptible de générer du contenu nocif que ChatGPT ou un modèle similaire. Je pense qu’il est juste de dire que, comme pour tout modèle d’IA, vous devrez être très prudent pour que les préjugés ne s’infiltrent pas dans votre produit final.

DeepSeek est-il sécuritaire à utiliser ?

Il y a une autre question qui devrait être très pertinente pour les professionnels des RP. Puis-je faire confiance à DeepSeek avec mes données, ou avec les données de mes clients alors que je crée des plans de six mois ou que je travaille sur l’affinement d’annonces qui sont encore sous embargo ?

Je ne suis pas convaincu que DeepSeek est sécuritaire à utiliser en termes de cybersécurité, et je pense que les préoccupations vont au-delà de celles de TikTok. DeepSeek est encore dans les premiers stades de la sécurisation de ses systèmes. Outre la fuite de données récente, les chercheurs ont montré que DeepSeek a un taux d’échec de 100 pour cent lorsqu’il s’agit de se défendre contre des invites nocives – c’est-à-dire qu’il ne bloque pas efficacement les tentatives de générer des informations erronées, du contenu biaisé ou des contournements de sécurité qui pourraient être exploités. De plus, les journalistes ont récemment révélé que la politique de confidentialité de DeepSeek permet explicitement à DeepSeek d’envoyer des données utilisateur à des entreprises chinoises.

Je dirai que la plupart des outils d’IA ont des problèmes similaires : ils ne sont pas suffisamment sécurisés pour gérer des données sensibles comme les informations financières, et ils sont exploités par des entreprises qui n’ont pas nécessairement les meilleurs intérêts de l’utilisateur à cœur. Alors, si votre client vous donne des informations ou des données sensibles, il est probablement préférable d’éviter de saisir ces informations dans les outils d’IA, que vous utilisiez DeepSeek ou ChatGPT.

DeepSeek ou ChatGPT ?

Malgré l’hype, DeepSeek reste en grande partie un modèle en développement. Il est souvent indisponible ou submergé par trop d’utilisateurs et de demandes en même temps. Il n’a pas encore réussi à se différencier efficacement, et il semble plus robotique et terne que ChatGPT à certains moments, ce qui est déjà beaucoup dire. L’outil a également des problèmes de préjugés et de sécurité flagrants. Alors, même si cela peut être bon pour les équipes avec un budget très limité, ma recommandation personnelle est de payer les 20 $ pour ChatGPT ou de jeter un coup d’œil à l’un des rivaux plus établis d’OpenAI. Finalement, n’oublions pas que ceci est le premier grand modèle de DeepSeek, et qu’ils devraient être donnés un peu de temps pour s’établir, tout comme OpenAI et même Google qui ont fait face à des défis avec leurs modèles initiaux.

Saad est un ingénieur en traitement automatique des langues et un responsable technique en intelligence artificielle générative, titulaire d'un master en informatique de la LUMS, spécialisé dans les modèles de langage pour les langues à faibles ressources. Il excelle dans les tâches de traitement automatique des langues, allant de la génération de texte et de la similarité sémantique aux chatbots et au traitement de la parole, en utilisant des outils tels que Python, PyTorch et Keras. Avec une expérience dans la conduite d'innovations en intelligence artificielle dans les domaines des relations publiques, de la technologie juridique et de l'industrie automobile, il développe des solutions médias intelligentes et impactantes en créant des plateformes d'intelligence artificielle et de logiciels en tant que service, telles que Preston.