Éthique

Google Révèle l’Utilisation de Données Publiques du Web pour la Formation de son IA

mm
Ajouter Unite.AI à vos sources préférées sur Google

Dans une mise à jour récente de sa politique de confidentialité, Google (GOOGL ) a ouvertement admis utiliser des informations publiques disponibles sur le web pour former ses modèles d’IA. Cette divulgation, repérée par Gizmodo, inclut des services comme Bard et Cloud AI. Un porte-parole de Google, Christa Muldoon, a déclaré à The Verge que la mise à jour clarifie simplement que de nouveaux services comme Bard sont également inclus dans cette pratique, et que Google intègre des principes et des garanties de confidentialité dans le développement de ses technologies d’IA.

La transparence dans les pratiques de formation de l’IA est un pas dans la bonne direction, mais elle soulève également une multitude de questions. Comment Google assure-t-il la confidentialité des individus lorsqu’il utilise des données publiques ? Quelles mesures sont en place pour prévenir l’utilisation abusive de ces données ?

Les Implications des Méthodes de Formation de l’IA de Google

La politique de confidentialité mise à jour indique maintenant que Google utilise des informations pour améliorer ses services et développer de nouveaux produits, fonctionnalités et technologies qui profitent à ses utilisateurs et au public. La politique spécifie également que l’entreprise peut utiliser des informations publiques pour former les modèles d’IA de Google et créer des produits et des fonctionnalités comme Google Translate, Bard et les capacités Cloud AI.

Cependant, la politique ne clarifie pas comment Google préviendra l’inclusion de matériaux protégés par le droit d’auteur dans le pool de données utilisé pour la formation. De nombreux sites web accessibles au public ont des politiques qui interdisent la collecte de données ou le scraping de données à des fins de formation de grands modèles de langage et d’autres ensembles d’outils d’IA. Cette approche pourrait potentiellement entrer en conflit avec les réglementations mondiales comme le RGPD qui protègent les personnes contre l’utilisation abusive de leurs données sans leur permission expresse.

L’utilisation de données publiques pour la formation de l’IA n’est pas en soi problématique, mais elle le devient lorsqu’elle enfreint les lois sur le droit d’auteur et la confidentialité des individus. C’est un équilibre délicat que des entreprises comme Google doivent naviguer avec soin.

L’Impact Plus Large des Pratiques de Formation de l’IA

L’utilisation de données publiques pour la formation de l’IA a été une question controversée. Des systèmes d’IA génératifs populaires comme OpenAI’s GPT-4 ont été réticents à propos de leurs sources de données et à savoir si elles incluent des publications sur les réseaux sociaux ou des œuvres protégées par le droit d’auteur d’artistes et d’auteurs humains. Cette pratique se situe actuellement dans une zone grise juridique, déclenchant divers procès et poussant les législateurs de certaines nations à introduire des lois plus strictes pour réguler la façon dont les entreprises d’IA collectent et utilisent leurs données de formation.

Le plus grand éditeur de journaux aux États-Unis, Gannett, poursuit Google et sa société mère, Alphabet (GOOG ), affirmant que les progrès de la technologie d’IA ont aidé le géant de la recherche à détenir un monopole sur le marché publicitaire numérique. Pendant ce temps, des plateformes sociales comme Twitter et Reddit ont pris des mesures pour empêcher d’autres entreprises de récolter librement leurs données, ce qui a déclenché des réactions négatives de la part de leurs communautés respectives.

Ces développements soulignent la nécessité de lignes directrices éthiques solides dans l’IA. À mesure que l’IA continue d’évoluer, il est crucial pour les entreprises d’équilibrer le progrès technologique avec les considérations éthiques. Cela inclut le respect des lois sur le droit d’auteur, la protection de la confidentialité des individus et la garantie que l’IA profite à l’ensemble de la société, et non à un groupe sélectionné.

La mise à jour récente de la politique de confidentialité de Google a jeté une lumière sur les pratiques de formation de l’IA de l’entreprise. Cependant, elle soulève également des questions sur les implications éthiques de l’utilisation de données publiques pour la formation de l’IA, la violation potentielle des lois sur le droit d’auteur et l’impact sur la confidentialité des utilisateurs. À mesure que nous avançons, il est essentiel pour nous de poursuivre cette conversation et de travailler vers un avenir où l’IA est développée et utilisée de manière responsable.

Alex McFarland est un journaliste et écrivain en intelligence artificielle qui explore les derniers développements en intelligence artificielle. Il a collaboré avec de nombreuses startups et publications en intelligence artificielle dans le monde entier.