OpenAIMis à jour le

Perturber des opérations de « fausse façade » assistées par l'IA

OpenAI a perturbé deux opérations d'influence assistées par l'IA qui utilisaient des journalistes de fausse façade et un groupe de réflexion pour diffuser des messages géopolitiques.

Matrix of 30 influence operations by primary distribution method and Breakout Scale category. Operations using external publications reached categories 4 and 5; social-media-led operations reached categories 1 to 3.
Source de l’image · OpenAI

Au cours des deux dernières années et demie, nous avons publié des rapports sur nombre des manières dont des acteurs de menace ont tenté d'utiliser nos modèles pour mener des cyberattaques, des opérations d'influence covert (IO), des escroqueries et d'autres violations de nos politiques d'utilisation. Nous publions ces rapports pour informer les régulateurs, nos pairs du secteur et la société au sens large de la manière dont nous voyons les acteurs de menace tenter d'exploiter l'IA, et pour mettre en lumière les vulnérabilités qu'ils tentent d'exploiter.

Nous avons récemment interdit deux IO—l'une russe et l'une iranienne—qui utilisaient nos modèles en combinaison avec des techniques et technologies plus traditionnelles pour soutenir des entités de « fausse façade » sophistiquées. Elles utilisaient ces entités pour blanchir des messages géopolitiques liés aux conflits auprès de leurs publics cibles. L'opération iranienne comprenait une écurie de sept personas de « journalistes » qu'elle utilisait pour proposer des articles de fond à des médias en ligne petits et moyens du monde entier ; l'opération russe semble avoir exploité à leur insu des personnes en Amérique latine pour diriger un « groupe de réflexion » sur place.

Les deux opérations étaient multidimensionnelles, essayant une gamme de tactiques différentes pour atteindre leurs objectifs. En plus d'articles de fond, l'opération iranienne générait des lots de commentaires sur les réseaux sociaux, généralement sur des sujets liés à la guerre américano-iranienne. En plus de contrôler le « groupe de réflexion », l'opération russe a créé de faux documents « fuités » et des scripts audio, dont certains que nous avons identifiés comme étant diffusés en ligne. Les deux opérations ont également fait un usage intensif de l'IA pour rédiger des rapports internes (l'opération russe l'a fait plus que tout autre chose) ; dans les deux cas, les acteurs ont utilisé des méthodologies discutables ou carrément trompeuses pour exagérer l'efficacité des opérateurs.

Ce qui est le plus frappant dans ces opérations, c'est qu'elles ressemblaient étroitement aux opérations d'influence complexes de l'avant-ère de l'IA, mais utilisaient l'IA pour faciliter certains flux de travail. Les personas de journalistes gérés par l'opération iranienne présentaient une ressemblance familiale avec la fausse journaliste «Alice⁠(s'ouvre dans une nouvelle fenêtre) Donovan⁠(s'ouvre dans une nouvelle fenêtre)», une couverture du renseignement militaire russe dont les articles ont été publiés par une gamme de médias occidentaux en 2016-17. En 2020, des individus associés à des activités passées de l'Internet Research Agency russe ont dirigé un faux média d'« actualités » appelé «PeaceData⁠(s'ouvre dans une nouvelle fenêtre)», qui a exploité à leur insu des journalistes du monde entier pour écrire pour lui.

Ces opérations étaient également inhabituelles par leur portée potentielle. En utilisant l' Breakout Scale⁠(s'ouvre dans une nouvelle fenêtre), qui évalue les IO sur une échelle de 1 (la plus basse) à 6 (la plus haute), nous évaluerions l'opération d'origine russe comme appartenant à la catégorie 5. C'est la première opération de catégorie 5 que nous perturbons depuis le début de nos rapports. L'opération d'origine iranienne atteignait Catégorie 4. Tous deux ont réussi à faire publier leur contenu (dont une partie n'était pas générée par nos modèles) dans des médias grand public, plutôt que de simplement le publier sur les réseaux sociaux. Cela est conforme à un schéma que nous avons observé à travers les 30 opérations d'influence clandestines que nous avons dévoilées au cours des deux dernières années et demie : les opérations qui tentent de faire publier leur contenu dans de véritables médias, plutôt que de s'appuyer sur une distribution via de faux comptes sur les réseaux sociaux, tendent à avoir la plus grande portée et le plus grand impact potentiels.

Matrix of 30 influence operations by primary distribution method and Breakout Scale category. Operations using external publications reached categories 4 and 5; social-media-led operations reached categories 1 to 3.

Matrice des 30 IO que nous avons dévoilées depuis le début de 2024, évaluées selon la méthode de distribution principale (réseaux sociaux, site web géré par l'opération, publications externes) et le score sur l'échelle Breakout. Les opérations qui ont utilisé plus d'une méthode de distribution, comme gérer un site web et le promouvoir sur les réseaux sociaux, sont classées selon la méthode qui semblait constituer le cœur de l'opération.

L'IA peut conférer à ces opérations de façade une plus grande ampleur, une meilleure efficacité, une aisance linguistique et des compétences éditoriales accrues. Les opérateurs peuvent utiliser ces avantages pour exploiter des victimes sans méfiance, comme des employés ou des rédacteurs, et placer leur contenu devant des publics qui n'ont aucune idée de qui en était à l'origine ni de leurs motivations. Ces opérations démontrent également la complexité et la sophistication de l'utilisation de fausses identités et entités par des acteurs de la menace pour atteindre leurs objectifs. Comprendre les vulnérabilités que les acteurs de la menace exploitent dans ces efforts, et la manière dont ces vulnérabilités peuvent se traduire en audience et en portée, sera essentiel pour maintenir des défenses robustes au sein des organisations.

Mais la nature clandestine de ces opérations à façade les rend également particulièrement vulnérables à la divulgation responsable. « Alice Donovan » comme « PeaceData » ont cessé leur activité après avoir été dévoilées. C'est pourquoi notre objectif, en rapportant ces opérations à façade, est de faciliter la recherche et la perturbation ultérieures — et de rendre la poursuite de ces opérations plus difficile.

Russie : Opération « Dark Clark »

Des acteurs d'origine russe menant des campagnes d'influence à travers l'Amérique latine.

Acteur

Nous avons banni un groupe de comptes ChatGPT originaires de Russie. Ils ont utilisé ChatGPT pour une série de tâches liées à des opérations d'influence covert visant des pays d'Amérique latine. Une grande partie de cette activité semblait destinée à nuire à la réputation de l'Ukraine dans la région, mais certaines semblaient viser à influencer des résultats politiques locaux, notamment en Argentine et en Bolivie. La plupart des opérateurs formulaient leurs requêtes en russe ; l'un d'eux utilisait l'espagnol, mais semblait néanmoins se trouver en Russie. Nous avons partagé les informations concernant ce cas avec les autorités compétentes.

Les opérateurs ont utilisé ChatGPT pour accomplir trois tâches principales : rédiger des rapports internes sur leurs activités (et sur les activités d'autres personnes dont ils pouvaient plausiblement s'attribuer le mérite), créer du contenu pour leurs opérations, et rédiger des rapports sur les performances d'une « plateforme de recherche » autoproclamée en Amérique latine appelée le Social Research Center (SRC). Ils semblent avoir contrôlé le SRC via un faux personnage nommé « Mia Clark » ; en hommage à ce nom, nous avons surnommé cette opération « Dark Clark ». Comme nous n'autorisons pas l'accès à nos modèles depuis la Russie, ils ont utilisé des VPN pour se connecter à nos services.

Dans leurs rapports internes, les opérateurs affirmaient avoir diffusé de fausses histoires à travers l'Amérique latine pour discréditer l'Ukraine ou des dirigeants locaux. Certaines de ces informations fallacieuses ont été attribuées par open source⁠(s’ouvre dans une nouvelle fenêtre) chercheurs⁠(s'ouvre dans une nouvelle fenêtre) à une entité russe connue sous le nom de « Politology » ou « La Compania », un successeur déclaré du groupe Wagner et d'autres entités fondées par l'oligarque russe Yevgeniy Prigozhin. Les opérateurs ont également demandé à nos modèles de traduire ou d'expliquer des reportages publics sur Politology et Wagner, bien plus souvent que pour tout autre réseau d'origine russe.

Cette opération était inhabituelle à deux égards. Premièrement, elle semble avoir réussi à coopter des individus en Amérique latine pour travailler pour le SRC. Les rapports des opérateurs russes sur le SRC faisaient référence à des décisions concernant des questions telles que les barèmes salariaux, l'embauche et le licenciement, ce qui suggère qu'ils contrôlaient cette entité plutôt que de coopérer avec elle. Les éléments disponibles indiquent que les employés du SRC en Amérique latine ignoraient qu'ils travaillaient pour un groupe russe. Contrairement à un autre « think tank » lié à la Russie que nous récemment exposé, le SRC semble avoir produit une majorité de contenu original via son personnel coopté. Cela ressort comme la tentative la plus complexe de gérer une identité de façade que nous ayons démantelée au cours des deux dernières années et demie.

Deuxièmement, des preuves en source ouverte suggèrent que les faux de Dark Clark se sont suffisamment répandus pour provoquer vérifications de faits(s’ouvre dans une nouvelle fenêtre) et démentis officiels⁠(ouvre dans une nouvelle fenêtre), ce qui indique un degré de pénétration qui dépasse toutes les opérations d'influence que nous avons perturbées au cours des deux dernières années. Un faux que l'opération prétendait avoir planté au Pérou a même alimenté les tensions publiques entre l'Ukraine et la Pologne.

Rapports internes

La principale manière dont les opérateurs utilisaient ChatGPT était de rédiger et de mettre à jour des rapports internes destinés à un supérieur inconnu. Ces rapports réguliers décrivaient les efforts visant à mener des campagnes d'influence clandestines à travers l'Amérique latine. Elles englobaient trois grands axes de travail : des efforts pour dénigrer l'Ukraine et saper le recrutement pour les forces armées ukrainiennes ; des efforts pour s'immiscer dans la politique intérieure de certains pays, en particulier la Bolivie et l'Argentine ; et la gestion du SRC. Dans la majorité des cas, nous n'avons pas observé que les acteurs de la menace utilisaient nos modèles pour créer du contenu pour les campagnes, mais seulement pour en rendre compte (les quelques exceptions sont décrites ci-dessous⁠).

Les rapports étaient riches en détails tactiques, mettant en lumière comment l'opération cherchait à saper l'Ukraine et certains dirigeants nationaux, notamment les présidents de l'Argentine, de la Bolivie et de l'Équateur. Certains décrivaient des efforts pour tromper les habitants afin qu'ils mènent des activités que les opérateurs pourraient utiliser comme armes ; d'autres décrivaient de fausses « fuites » que les opérateurs prétendaient avoir répandues.

Dans deux cas, les preuves relient les opérateurs à des reportages publics sur « Politology ». Les opérateurs ont déclaré qu'en 2024, ils avaient mené deux campagnes visant le président argentin Javier Milei. Premièrement, ils ont dit avoir répandu un faux rapport selon lequel Milei avait acheté des colliers sertis de bijoux Cartier pour ses chiens. Deuxièmement, ils ont affirmé avoir payé des acteurs locaux pour tagger des graffitis anti-Milei à Buenos Aires. Sur la base de documents divulgués, ces deux affirmations ont été publiquement⁠(s'ouvre dans une nouvelle fenêtre) attribué⁠(s'ouvre dans une nouvelle fenêtre) à « Politology » et « La Compania ».

Bien d'autres faux n'avaient pas été précédemment liés aux IO russes. Par exemple, les opérateurs ont affirmé qu'en mai 2026, ils avaient créé une fausse adresse électronique prétendant provenir de la Direction régionale de l'éducation de Lima, au Pérou. Ils l'ont utilisée pour ordonner aux écoles du district d'organiser des événements dédiés à l'Ukraine lors de la Journée nationale de la diversité culturelle et linguistique (21 mai). Les courriels contenaient des instructions explicites de mentionner, entre autres, le controversé nationaliste ukrainien du vingtième siècle Stepan Bandera, considéré par certains Ukrainiens comme une figure de l'indépendance, mais associé en Russie et en Pologne au fascisme, à la collaboration en temps de guerre et aux atrocités. Selon les opérateurs, certaines écoles ont répondu à la fausse adresse électronique, confirmant qu'elles avaient organisé de tels événements et fournissant même des photos.

Les opérateurs ont ensuite affirmé avoir placé des articles sur ces événements dans les médias, tant au Pérou qu'en Pologne, accompagnés d'allégations selon lesquelles l'Ukraine « exportait » des idéologies ultra-nationalistes, suscitant l'indignation. Des recherches en sources ouvertes ont identifié des articles correspondant à cette affirmation dans le Péruvien⁠(s'ouvre dans une nouvelle fenêtre) et⁠(s'ouvre dans une nouvelle fenêtre) Polonais⁠(s'ouvre dans une nouvelle fenêtre) presse⁠(s'ouvre dans une nouvelle fenêtre), et une publication en anglais dans Hongrie⁠(s'ouvre dans une nouvelle fenêtre) (certains des articles ont depuis été supprimés). Certains(s’ouvre dans une nouvelle fenêtre) articles⁠(s’ouvre dans une nouvelle fenêtre) « comprenait une réaction d'un député européen polonais proposant que les personnes ayant fait preuve d'« antipolonisme » soient déclarées » persona non grata en Pologne. Ce mensonge russe s'est donc à la fois nourri des tensions historiques entre Ukrainiens et Polonais, et les a alimentées.

De même, en juin, les opérateurs ont affirmé avoir utilisé une autre fausse adresse e-mail pour tromper des écoles en Équateur et les amener à organiser une cérémonie de serment d'allégeance au président Daniel Noboa et à Erik Prince, ancien chef de la société militaire privée Blackwater. Les opérateurs ont affirmé que l'incident avait suscité l'indignation en Équateur et exercé une pression sur le gouvernement pour qu'il démente le canular, l'amplifiant ainsi auprès d'un public national. Là encore, des recherches en sources ouvertes ont identifié médias⁠(s'ouvre dans une nouvelle fenêtre) couverture⁠(s’ouvre dans une nouvelle fenêtre) dans la presse équatorienne⁠(s’ouvre dans une nouvelle fenêtre) presse⁠(s’ouvre dans une nouvelle fenêtre) qui ressemblait étroitement à cette affirmation, et même un réfutation détaillée⁠(s’ouvre dans une nouvelle fenêtre) par le ministre de l’Équateur pour l’Éducation.

Les opérateurs ont utilisé une gamme de techniques pour étayer leurs fausses histoires. Selon leurs rapports internes, ils ont diffusé deux faux différents ciblant l'Équateur en mars. L'un utilisait un faux audio attribué au consul d'Ukraine en Équateur, dans lequel il aurait tenu des propos dédaigneux sur les Équatoriens. Notre enquête en sources ouvertes a identifié une publication sur TikTok correspondant précisément à cette affirmation ; elle ne semblait avoir suscité qu'un engagement limité. L'autre décrivait un faux clip vidéo diffusé sur X et TikTok sous le logo d'une véritable chaîne d'information, alléguant que le gouvernement de Noboa recrutait de jeunes hommes pour combattre en Ukraine. Des vérificateurs de faits⁠(s'ouvre dans une nouvelle fenêtre) en Équateur ont décrit au début du mois d'avril une campagne qui correspondait à cette description.

Redacted TikTok screenshot of an April 8, 2026 post spreading fabricated audio attributed to Ukraine’s consul in Ecuador.

Vidéo TikTok publiée le 8 avril 2026, avec l'audio falsifié revendiqué par cette opération et attribué au consul d'Ukraine.

Un autre rapport interne décrivait un faux qu'ils ont diffusé en Bolivie fin mai, au plus fort des manifestations antigouvernementales. Les opérateurs décrivaient explicitement l'objectif de cette campagne comme étant d'exacerber la crise autour des manifestations. La campagne mettait en scène un faux enregistrement audio d'un employé de la compagnie nationale des eaux, EPSAS, disant que le gouvernement allait couper l'eau de la capitale administrative, La Paz, et décréter un état d'urgence. Nos recherches en sources ouvertes ont identifié un démenti⁠(s'ouvre dans une nouvelle fenêtre) de l'affirmation correspondante et un déni officiel⁠(s'ouvre dans une nouvelle fenêtre) d'EPSAS.

D'autres rapports internes incluaient des faux que nous n'avons pas pu corroborer à partir de sources ouvertes, peut-être parce qu'ils avaient déjà été retirés ou n'avaient pas réussi à se propager. Par exemple, les opérateurs ont affirmé avoir diffusé en janvier une histoire alléguant qu'une influenceuse et mannequin brésilienne avait été victime de traite vers l'Ukraine par des représentants de l'ambassade d'Ukraine, et avait été tuée à Kyiv. En juin, ils ont affirmé avoir diffusé un autre faux clip audio en Bolivie, prétendument provenant d'un employé de la Banque centrale de Bolivie, avertissant que la Banque allait limiter les retraits d'espèces. Ils ont également affirmé avoir diffusé une fausse lettre de l'agence nationale des hydrocarbures du pays, avertissant de restrictions sur la vente de carburant aux voitures particulières.

Dans d'autres rapports, les opérateurs ont demandé à nos modèles de les aider à identifier des incidents dans les pays ciblés auxquels ils pourraient s'attribuer le mérite, même s'ils n'y avaient pas été impliqués. Par exemple, en Argentine, les opérateurs ont affirmé que le ministre argentin des Affaires étrangères avait cité leur opération lors d'une réunion d'un comité des Nations Unies sur les îles Malouines / Malvinas. Les opérateurs se sont attribué le mérite d'avoir semé les arguments selon lesquels le principe d'autodétermination ne s'applique pas aux îles, et selon lesquels le Royaume-Uni y maintient une présence militaire disproportionnée. En réalité, ces deux arguments font partie de la position officielle de l'Argentine depuis de nombreuses⁠(s'ouvre dans une nouvelle fenêtre) années⁠(s'ouvre dans une nouvelle fenêtre). De même, en juin, des médias brésiliens ont rapporté⁠(s'ouvre dans une nouvelle fenêtre) le cas d'un citoyen brésilien qui s'était rendu en Ukraine pour rejoindre l'armée, avait été capturé par les forces russes, puis avait fait une déclaration télévisée affirmant qu'il avait été trompé pour combattre. Les opérateurs de ChatGPT ont tenté de prétendre que ce rapport reprenait les messages de leur opération ; en réalité, il citant la propre vidéo du captif⁠(s'ouvre dans une nouvelle fenêtre). Cela suggère une tentative des opérateurs de mener une opération d'influence ciblant leurs propres employeurs, plutôt qu'un public extérieur.

La « plateforme de recherche »

Certains rapports des opérateurs faisaient référence à une « plateforme de recherche » autoproclamée appelée Social Research Center (en russe, Центр социологических исследований). Selon le site web du SRC, il se concentre sur la diaspora indienne en Amérique latine et sur les relations entre l'Inde et les pays de la région.

Les rapports internes suggéraient que les opérateurs contrôlaient ce groupe de réflexion, plutôt que de simplement collaborer avec lui. Ils faisaient référence, par exemple, à des décisions d'embauche et de licenciement, à des échelles salariales, à des plans de recrutement et à des projets de recherche en cours. Fait crucial, ils indiquaient également que les opérateurs avaient créé un faux personnage, nommé « Mia Clark », pour gérer l'activité de l'opération sur les réseaux sociaux et interagir avec le personnel sur le terrain en Amérique latine. Les preuves disponibles suggèrent que ces employés sur le terrain ignoraient totalement qu'ils travaillaient pour une opération russe et effectuaient des tâches de recherche de bonne foi. Cette utilisation d'intermédiaires involontaires ressemble fortement à la précédente opération russe également liée à l'univers de Prigojine, « PeaceData », que Meta a exposée⁠(s'ouvre dans une nouvelle fenêtre) en 2020.

À en juger par les rapports des opérateurs russes, leur personnel sur le terrain en Amérique latine a mené des entretiens avec des experts et des commentateurs dans toute la région, puis rédigé des documents de recherche à partir de leurs conclusions. Les sujets allaient d'une large analyse de l'opinion publique sur le groupe des BRICS à une comparaison détaillée de l'économie brésilienne sous les présidents Jair Bolsonaro et Luiz Inácio Lula da Silva. Parfois, les opérateurs russes rédigeaient des rapports d'avancement sur les projets de recherche avant même leur publication, ce qui indique une participation étroite au processus de production. Nous avons identifié plus de 60 articles sur le site web du SRC, dont la grande majorité semblaient être des compositions originales. Cela distingue Dark Clark de l'opération d'origine russe que nous avons récemment dévoilée, qui exploitait également un groupe de réflexion comme couverture, mais qui plagiait la plupart de ses contenus ; cela suggère une intention de construire une entité de couverture plus durable, avec des contacts dans toute l'Amérique latine.

Pour promouvoir le travail du SRC, les opérateurs russes ont affirmé avoir tenté de créer un réseau de comptes sur les réseaux sociaux. Selon leurs rapports, cette activité sur les réseaux sociaux s'est heurtée à des problèmes lorsque des opérateurs situés dans différentes parties du monde ont tenté d'accéder aux mêmes comptes, entraînant des restrictions de comptes. Des traces de cela sont visibles dans les données publiques : par exemple, les paramètres de transparence du compte principal du SRC sur X indiquaient une localisation en Allemagne (peut-être en raison de l'utilisation d'un VPN) mais une connexion via l'App Store de la Fédération de Russie, tandis que les paramètres de transparence de l'un de ses comptes Instagram indiquaient une localisation d'administrateur au Venezuela. Aucun des trois comptes Facebook à la marque SRC que nous avons identifiés n'avait suffisamment d'abonnés pour déclencher l'affichage des paramètres de localisation d'administrateur.

Account transparency screenshots for the Social Research Center: its X account connected through the Russian Federation App Store, while its Instagram account listed Venezuela.

À gauche, compte X lié au Social Research Center. Notez le paramètre de transparence qui montre que le compte est connecté via l'app store de la Fédération de Russie. À droite, compte Instagram du SRC : notez la localisation au Venezuela.

Les opérateurs ont signalé des problèmes particuliers sur LinkedIn, où ils ont dit avoir créé un compte explicitement faux pour représenter le SRC, mais ont ensuite eu du mal à bâtir un réseau pour celui-ci. Selon leurs rapports, la solution consistait à créer d'autres faux comptes pour suivre le premier et le rendre plus crédible. Au 17 août, un compte LinkedIn arborant la même marque Social Research Center comptait 961 abonnés et affirmait employer entre 200 et 500 personnes, mais ne listait que deux employés.

Création de faux

Occasionnellement, en plus d'utiliser l'IA pour mettre à jour des rapports, les opérateurs ont bien demandé à notre modèle de les aider à concevoir et créer des textes qu'ils pouvaient utiliser dans leurs opérations : par exemple, en demandant de l'aide pour s'assurer que leurs faux utilisaient l'accent, le vocabulaire et le style institutionnel corrects pour différents pays. Il s'agissait d'une proportion relativement faible de la charge de travail globale, probablement parce que l'opération semble avoir inclus au moins un hispanophone natif d'Amérique latine, et avait donc moins besoin de soutien linguistique de l'IA.

Par exemple, à une occasion, l'un des opérateurs russophones a demandé au modèle de l'aider à rédiger, en russe, une lettre qui impliquerait le consul honoraire d'Ukraine au Panama dans une affaire de corruption. L'opérateur hispanophone a ensuite demandé au modèle de traduire la lettre en espagnol et de générer un script audio pour l'accompagner. Une photo correspondant au texte de la lettre, avec une voix off correspondant au script de l'opérateur, a été publiée sur TikTok par un compte prétendant être un média d'information, mais avec le logo de TVN Noticias⁠(opens in a new window). La chaîne TikTok n'avait qu'un seul abonné et a cessé de publier après avoir semé ce faux.

Redacted TikTok screenshot showing a fabricated letter about Ukraine’s contacts with Panama’s financial sector, paired with an operation-generated voiceover.

Publication TikTok montrant la lettre dont le texte a été généré par cette opération, avec un script de voix off lui aussi généré par l'opération.

À une autre occasion, l'opérateur hispanophone en Russie a donné au modèle un script en langue russe affirmant que Noboa avait insulté les pauvres en Équateur, et a demandé au modèle de le traduire en espagnol équatorien. À une troisième occasion, en mars, le même utilisateur a demandé au modèle de relire un projet de contrat en espagnol entre une société nommée « International Security Solutions FZE » et un individu en Équateur, prétendant fournir des services d'infrastructure en Ukraine. Les questions de l'utilisateur portaient sur la manière d'améliorer le langage et la mise en page, notamment en demandant quels mots devraient être en gras.

Les prompts de l'utilisateur concernant le contrat ont cessé une fois la formulation finalisée. La recherche en sources ouvertes montre toutefois qu'une image du « contrat » a ensuite été diffusée sur les réseaux sociaux⁠(opens in a new window). Elle a été utilisée pour étayer l'affirmation selon laquelle le gouvernement de Noboa aurait travaillé avec une société écran pour duper des Équatoriens et les faire recruter dans l'armée ukrainienne. Le faux s'est suffisamment répandu pour déclencher une vérification des faits⁠(opens in a new window) début avril : les vérificateurs ont conclu que la société « n'apparaît pas au registre de la Superintendance des sociétés, des valeurs mobilières et des assurances de l'Équateur ».

Impact

L'impact de cette opération exige une évaluation particulièrement minutieuse. Comme indiqué ci-dessus, l'une des principales approches des opérateurs consistait à s'attribuer le mérite d'une activité qui n'avait rien à voir avec leur opération. En conséquence, leurs propres affirmations d'impact dans leurs rapports internes ne peuvent pas être prises pour argent comptant. De même, certaines des fausses histoires qu'ils prétendaient avoir semées n'apparaissaient pas dans la recherche en sources ouvertes, potentiellement parce qu'elles avaient été diffusées dans des canaux non publics, déjà supprimées, ou jamais réellement publiées.

Cependant, les preuves en sources ouvertes nous ont permis de corroborer certaines des affirmations qu'ils ont faites. Certains des faux que l'opération prétendait avoir diffusés ont ensuite été signalés par des vérificateurs de faits et démentis par des gouvernements, ce qui suggère qu'ils s'étaient suffisamment répandus pour mériter une réponse. Dans d'autres cas, nous avons pu identifier en ligne des contenus correspondant étroitement à ceux générés par cette opération. Plus particulièrement, l'affirmation de l'opération selon laquelle elle avait trompé une école péruvienne pour qu'elle organise un événement glorifiant Bandera a ensuite été rapportée en Amérique latine et en Europe, et semble avoir suscité des commentaires d'au moins un député européen polonais.

Utiliser l'échelle IO Breakout Scale⁠(opens in a new window), qui évalue les IO sur une échelle de 1 (la plus basse) à 6 (la plus élevée), nous considérons que cette opération appartient à la Catégorie 5, avec des preuves suggérant qu'elle a conduit à des commentaires publics de la part de politiciens dans un certain nombre de pays. Il s'agit de la première opération de Catégorie 5 que nous avons perturbée depuis le début de nos rapports.

Iran : Opération « Bogus Bylines »

Opération d'origine iranienne semant des articles de fond sous des signatures trompeuses dans des médias en ligne.

Acteur

Nous avons banni un groupe de comptes ChatGPT originaires d'Iran. Ils formulaient leurs requêtes en persan et généraient du contenu en persan et en anglais. Les acteurs ont masqué leur localisation en utilisant des VPN pour accéder à ChatGPT.

L'opération a utilisé nos modèles pour peaufiner des articles de fond et des propositions éditoriales, générer des commentaires sur les réseaux sociaux et affiner des rapports internes. Les opérateurs ont utilisé sept signatures différentes pour soumettre leurs articles, c'est pourquoi nous avons baptisé leur campagne « Bogus Bylines ». Les articles de fond se concentraient sur le conflit américano-iranien. La majorité des commentaires portaient également sur ce conflit ; une minorité traitait de la politique américaine, généralement dans le contexte plus large du conflit.

L'impact apparent de leurs principaux axes de travail variait considérablement. Nous avons identifié près de 100 articles publiés ou syndiqués sous les signatures de l'opération dans environ une douzaine de médias en ligne à travers le monde. Il s'agissait de médias petits ou moyens, généralement axés sur les affaires internationales, la géopolitique et les événements au Moyen-Orient. En revanche, aucun des commentaires sur les réseaux sociaux ne semble avoir généré d'engagement substantiel en termes de likes, de partages ou de réponses supplémentaires. En fait, les rapports internes des opérateurs utilisaient un calcul trompeur pour mesurer leur impact sur les réseaux sociaux, peut-être dans le but de gonfler leur efficacité apparente.

L'activité globale semblait cohérente avec un acteur commercial menant une campagne d'influence à la demande, mais nous ne sommes pas en mesure d'identifier l'acteur particulier impliqué. Nous avons partagé les informations sur ce cas avec les autorités compétentes.

Planter des articles

L'activité la plus vaste de cette opération consistait à demander à ChatGPT de réviser et de peaufiner des articles de fond en anglais sur la géopolitique du conflit américano-iranien. Les requêtes types demandaient au modèle d'évaluer un brouillon en anglais par rapport aux critères de soumission d'un média en ligne spécifique, et de suggérer des modifications pour garantir sa conformité. Une fois que les opérateurs avaient approuvé les modifications, ils demandaient au modèle de générer un courriel qu'ils pourraient utiliser pour soumettre l'article au rédacteur en chef du média en ligne concerné.

Ces messages de soumission ont été rédigés en utilisant sept fausses signatures différentes : Ervin B. Hoskins, Noah Lamington, Sophia Gonzalez, Michael Harrison, Ericka Feusier, Jenny Williams et Alice Johnson. Selon les biographies publiées en ligne aux côtés de certains de ces articles, chaque personnage se prétendait journaliste occidental (généralement américain, bien que la bio du personnage de Noah Lamington affirmait qu'il se trouvait en Nouvelle-Zélande), souvent spécialisé dans la politique internationale, le Moyen-Orient, les droits humains ou les conflits. Pour l'un des personnages, « Michael Harrison », les opérateurs ont demandé au modèle de rédiger la bio elle-même. (Fait notable, en mars, Meta a perturbé⁠(opens in a new window) une IO iranienne qui mettait également en scène un personnage de journaliste « Michael Harrison ».)

Certains de ces personnages étaient étayés par des comptes sur un éventail de plateformes de réseaux sociaux. Le personnage de Michael Harrison, par exemple, était présent sur Medium, X et Facebook. Le personnage d'Ervin B. Hoskins disposait de comptes sur X, Facebook, Instagram et Threads. La bio de ce personnage prétendait être « un rédacteur indépendant américain », mais les paramètres de transparence des réseaux sociaux situaient les comptes en Iran.

Ervin Hoskins persona’s Instagram biography and account transparency panels. X lists the West Asia Android App, while Instagram lists Iran as the account location.

En haut, bio Instagram du personnage d'Ervin Hoskins. En bas à gauche, informations de transparence du compte X, montrant l'utilisation de l'application Android West Asia. En bas à droite, informations de transparence du compte Instagram, indiquant une localisation en Iran. Meta a banni le compte Instagram en août.

En utilisant des techniques d'enquête en sources ouvertes, nous avons identifié près de 100 articles publiés sous l'une ou l'autre des signatures des opérateurs, dans plus d'une douzaine de publications différentes. Ces publications se concentraient généralement sur les affaires internationales, la géopolitique et les événements au Moyen-Orient, parfois d'un point de vue pacifiste ou progressiste. L'article le plus ancien que nous ayons identifié a été publié en juillet 2025, et le plus récent en octobre 2026. La fréquence des articles a fortement augmenté après le déclenchement du conflit américano-iranien.

Timeline of articles published under seven Bogus Bylines personas, grouped by topic and author. US-Iran coverage is the largest category and becomes concentrated from March 2026.

Chronologie des articles, par auteur et thème, de juillet 2025 à septembre 2026. Notez la densité des publications sur les relations américano-iraniennes à partir de mars 2026.

Five article headlines published under personas linked to the operation: Alice Johnson, Noah Lamington, Michael Harrison, Sophia Gonzalez, and Ervin Hoskins.

Exemples de titres d'articles publiés sous les signatures liées à cette opération entre février et juillet 2026 dans une gamme de médias en ligne.

Au moins certains des articles ont ensuite été promus par les comptes de réseaux sociaux des médias en question, offrant aux opérateurs iraniens un moyen potentiel d'accéder à des publics qu'ils n'auraient pas atteints autrement.

Commentaires de masse

Parallèlement aux articles, les acteurs de la menace ont demandé à ChatGPT de générer des lots de commentaires sur des sujets géopolitiques ou politiques en anglais ou en persan. L'approche typique des acteurs consistait à saisir le texte ou une capture d'écran d'une publication sur les réseaux sociaux, et à demander au modèle un ensemble de réponses correspondant à leur orientation générale. Celles-ci étaient ensuite publiées en ligne, souvent à quelques minutes d'intervalle. Les rapports internes des opérateurs mentionnaient à la fois des publications humaines et automatisées ; nous n'avons aucune preuve suggérant que cette automatisation ait été réalisée avec l'aide de nos modèles.

Side-by-side screenshots of operation-generated replies in English and Persian, posted in July, with account identities obscured.

Tweets en anglais, à gauche, et en persan, à droite, générés par cette opération et publiés en juillet. Les commentaires en langue anglaise répondaient à un tweet en anglais avertissant que les États-Unis préparaient une « offensive à grande échelle » contre l'Iran. Tous les commentaires de cette image ont été publiés en l'espace de 10 minutes. Les commentaires en langue persane répondaient à un tweet en persan sur les frappes américaines contre l'Iran, et ont été publiés en 13 minutes.

Une partie de cette activité de commentaires en lots consistait à générer des réponses à des publications sur les réseaux sociaux concernant les propres articles de l'opération. Ici, les opérateurs saisissaient des captures d'écran de publications faisant la promotion de leurs articles, puis généraient des commentaires qui les louaient ou les approuvaient, probablement pour donner aux articles une apparence de popularité.

Redacted Facebook screenshot of a local news page sharing an operation-generated article under Sophia Gonzalez’s byline, followed by four operation-generated comments.

Publication Facebook d'une Page d'actualités locale américaine partageant un article généré par l'opération, et commentaires sur cette publication générés par l'opération.

La majorité des lots de commentaires portaient plus généralement sur le conflit entre l'Iran, les États-Unis et Israël. Les utilisateurs demandaient des commentaires sur des sujets tels que les frappes de missiles, les cessez-le-feu et les manœuvres diplomatiques, en spécifiant des résultats dépeignant les États-Unis comme l'agresseur, Israël comme un allié peu fiable des États-Unis, et l'Iran comme une victime défiant mais résiliente. Les opérateurs ont généré un nombre particulièrement élevé de réponses aux publications d'Iran International, un réseau satellite basé au Royaume-Uni et critique du régime iranien, générant plus de deux douzaines de lots de réponses hostiles en langue persane. Une minorité des lots généraient des réponses à des publications sur les réseaux sociaux concernant des questions politiques américaines, généralement également dans le contexte plus large du conflit.

Two redacted Instagram comments generated by the operation in reply to posts about US politics.

Commentaires Instagram générés par cette opération en réponse à des publications sur la politique américaine.

Nous avons identifié un petit nombre de ces réponses publiées en ligne ; beaucoup d'autres n'apparaissaient pas dans nos recherches en sources ouvertes, potentiellement parce qu'elles n'avaient pas été publiées, ou publiées par des comptes déjà supprimés. (Par exemple, trois des personas de journalistes — Ericka Feusier, Alice Johnson et Jenny Williams — listaient des identifiants de comptes X dans leurs biographies publiées : tous avaient été suspendus en août 2026.) Certains des comptes qui publiaient effectivement des commentaires en ligne avaient des noms d'apparence occidentale, mais affichaient des localisations de comptes en Iran.

Redacted Instagram account transparency panels showing Iran as the location of both accounts that posted the preceding comments.

Les paramètres de transparence des comptes Instagram ayant fait les commentaires illustrés ci-dessus, montrant qu'ils étaient situés en Iran.

Là où nous avons effectivement trouvé ces réponses publiées, elles constituaient généralement une minorité du total des commentaires sur la publication en question, ce qui suggère que les opérateurs n'étaient pas une voix dominante parmi les réponses authentiques. Ils ne semblaient pas non plus avoir attiré d'engagement substantiel : en effet, une grande partie des mentions « j'aime » sur les réponses de l'opération provenaient de comptes eux-mêmes liés à l'opération. Nous avons partagé des informations sur ce cas avec des partenaires du secteur, qui sont les mieux placés pour fournir des évaluations globales de l'engagement.

Rapports internes

La tentative de donner à leur activité une apparence de popularité ne se limitait pas aux publications publiques. Parallèlement à leur génération de contenu, les opérateurs demandaient occasionnellement à ChatGPT d'affiner ce qui semblait être des rapports internes sur leur campagne sur les réseaux sociaux. Cela consistait généralement à fournir au modèle une série de statistiques, et à lui demander de les transformer en présentations soignées.

Ce n'est pas la première opération que nous démantelons ayant utilisé l'IA pour rédiger sa propre⁠(opens in a new window) auto-évaluation⁠(opens in a new window). Ce qui était le plus frappant dans les efforts des opérateurs iraniens pour corriger leurs propres copies, c'était la méthode qu'ils utilisaient pour ce faire. La principale métrique d'« impact » qu'ils utilisaient était le nombre de vues des publications auxquelles ils répondaient (et non le nombre de vues des réponses elles-mêmes), compté avant, et un laps de temps non précisé après, la publication des réponses. Ce calcul ne tenait pas compte des vues qui pouvaient résulter d'autres facteurs, tels que la popularité des publications originales ou d'autres commentaires. Ainsi, il exagérait considérablement les chiffres d'impact de l'opération, suggérant que les opérateurs ne connaissaient soit pas une méthode plus efficace pour les calculer, soit ne choisissaient pas de l'utiliser.

Impact

En fait, sur la base des éléments recueillables grâce à l'observation en sources ouvertes, les deux grands volets de travail de l'opération semblent avoir eu des degrés d'impact probable très différents.

Les réponses sur les réseaux sociaux que nous avons pu identifier ont généralement recueilli un faible nombre de likes, de vues et de commentaires (chiffres à un ou deux chiffres). Comme indiqué ci-dessus, les réponses constituaient généralement une minorité du total des commentaires sur la publication en question. En utilisant l' échelle de classification des IO⁠(opens in a new window), qui évalue les IO sur une échelle de 1 (la plus basse) à 6 (la plus haute), nous évaluerions cette partie de l'opération comme Catégorie 2, avec des commentaires sur plusieurs plateformes, mais peu de signes de percée ou de capacité à dominer les réponses.

En revanche, les personas de journalistes ont réussi à faire publier leurs articles par un éventail de médias, certains disposant d'une audience substantielle : par exemple, l'un des médias en ligne qui a publié les articles de cette opération comptait près de 2 millions d'abonnés sur Facebook, près de 355,000 abonnés sur X et plus de 544,000 sur Instagram en août 2026. Nous évaluerions cette partie de l'opération comme Catégorie 4, en raison de sa percée constante dans un certain nombre de médias.

Source originale

OpenAI

À propos du contenu

La publication originale et les droits appartiennent à la source.

Traduction automatique · Consultez l’original