Suite à de nombreuses disclosures récentes concernant des agents d’IA qui accèdent à des sites et services tiers, la Fondation Wikimedia, qui héberge Wikipédia, déclare qu’elle « peut confirmer que nous avons découvert certaines activités » effectuées par des agents OpenAI « étrangers » sur les plateformes Wikimedia.
L’activité comprend des modifications apportées aux wikis de Wikimedia, des “essais infructueux” pour “exploiter” l’outil de prise de notes Etherpad hébergé par la Fondation Wikimedia, ainsi qu’un trafic intense qui, selon la fondation, “peut” avoir contribué à une panne partielle survenue en mai selon un article de blog. Cependant, la Fondation Wikimedia affirme ne pas avoir trouvé de preuves que ses systèmes ont été “utilisés pour la coordination entre agents” (récemment, les bots OpenAI auraient en effet pris le contrôle d’un site de wiki allemand afin de coordonner les actions) ou de preuves que les systèmes ou les données ont été compromises.
Voici le résumé de Wikimédia concernant ce qu’il a vu :
Édition sur Wikipedia : Nous avons identifié des modifications apportées aux wikis de Wikimedia que nous pensons être effectuées par des agents IA exploitant OpenAI. Ces modifications n’ont pas été publiées sur des pages accessibles au grand public ; presque toutes provenaient d’essais de modifications dans des zones « sandbox » du wiki. Il y avait également quelques modifications concernant la configuration d’un outil de citation, que nous estimons être des modifications malveillantes visant à utiliser cet outil comme intermédiaire pour récupérer des données depuis des services distants. Bien que les politiques de Wikipedia permettent aux bots d’éditer lorsqu’ils sont dévoilés et approuvés par la communauté, aucune de ces approbations n’a été demandée dans ces cas.
Étude et utilisation d’Etherpad : Des agents que nous croyons être exploités par OpenAI ont tenté sans succès de compromettre notre outil de prise de notes public Etherpad, que nous hébergeons dans le cadre d’un service communautaire. Ces agents ont tenté sans succès d’y utiliser les données provenant d’autres sites web en tant que proxy. D’autres agents, également probablement exploités par OpenAI, ont noté leurs tâches, mais cela ne s’est pas transformé en coordination.
Charge de données excessive : Des agents que nous pensons être exploités par OpenAI ont effectué des millions de requêtes automatisées via nos APIs publiques afin d’accéder aux connaissances sur les projets Wikimedia. Ils ont également parcouru des millions de pages (principalement provenant de nos projets Wikidata et Wikimedia Commons), et ont effectué des centaines de milliers de requêtes de données auprès du Service de requêtes Wikidata (WQDS). Ce trafic pourrait avoir contribué à une interruption partielle du WQDS en mai.
« Le web ouvert est un bien public », déclare la Fondation Wikimedia. « Nous ne devrions pas permettre que ce comportement devienne la ‘nouvelle norme’ pour les personnes ou les organisations qui le maintiennent. » OpenAI n’a pas répondu immédiatement à une demande de commentaire.
Suivez les sujets et les auteurs de cette histoire pour voir davantage de contenu similaire dans votre flux de page d'accueil personnalisée, et pour recevoir des mises à jour par e-mail.