Empêcher l’intelligence artificielle de devenir Pac-Man

0
14

Depuis l’explosion de l’intelligence artificielle, une question continue de s’imposer : son entraînement. Par essence, elle fonctionne aujourd’hui de façon plus ou moins autonome, d’où sa dénomination de « générative », mais nécessite tout de même des modèles pour soutenir sa capacité de réflexion.

Tribune Netskope – Récemment, la réglementation sur cette question a franchi un cap, lorsqu’un juge fédéral américain a établi qu’Anthropic, entreprise américaine, pouvait utiliser des livres achetés légalement mais sans accord de leurs auteurs pour nourrir Claude, son IA maison. Néanmoins, l’entraînement des outils d’IA requiert une consommation colossale de données, ce à quoi rechignent souvent les utilisateurs de services informatiques et de sites web.

Ray Canzanese, Threat Research Director du Netskope Threat Labs, offre l’analyse suivante :

« La croissance rapide de l’IA voit la technologie se comporter comme Pac-Man – avalant tout sur son passage. Nous commençons à voir un ajustement, au fur et à mesure que les entreprises reprennent le contrôle sur leurs données, ayant réalisé la valeur qu’elles possèdent. Que celles-ci soient publiques (de larges quantités de prix disponibles sur les sites d’e-commerce), copyrightées mais non protégées (une newsletter numérique), ou privées (documentation interne, code source), les données représentent une valeur conséquente à la fois pour l’organisation qui les possède et pour les systèmes d’IA qui peuvent les utiliser, notamment pour l’entraînement de leurs modèles.

Bloquer l’accès au contenu d’un site sans la permission de ses propriétaires aux robots d’indexation de l’IA s’inscrit dans la continuité des efforts de l’industrie pour rendre le pouvoir à ceux qui le détiennent : les propriétaires des données.

Ce blocage doit devenir l’option par défaut, permettant ainsi aux entreprises de réaffirmer leur contrôle et leur propriété sans aucune autre action nécessaire, ce qui leur donne le temps de réfléchir à la construction d’une relation aux bénéfices mutuels avec l’intelligence artificielle. Nous espérons que cela ne représentera que l’un des multiples changements que nous verrons dans les mois à venir pour aider les organisations à gérer pleinement leurs flux de données. »