OpenAI更新于

打击AI赋能的“虚假门面”行动

OpenAI封禁了俄罗斯和伊朗两起利用虚假记者人设与智库的AI辅助隐蔽影响力行动,俄方行动首次获评突破规模五级。上述评级与细节均出自OpenAI自查报告,操作方自称的效果未经独立核实。

Matrix of 30 influence operations by primary distribution method and Breakout Scale category. Operations using external publications reached categories 4 and 5; social-media-led operations reached categories 1 to 3.
配图来源 · OpenAI

在过去两年半时间里,我们 报道 开启 许多 的 the 方式 在 哪个 威胁 演员 试图利用我们的模型进行网络攻击、隐蔽影响力行动(IO)、诈骗以及违反我们使用政策的行为。我们发布这些报告,是为了让监管机构、行业同行和更广泛的社会了解我们如何看待威胁行为者试图利用AI,并揭示他们试图利用的漏洞。

我们最近封禁了两个影响行动(IO)——一个来自俄罗斯,一个来自伊朗——它们将我们的模型与更传统的技术和手段相结合,以支持精心打造的“门面”实体。它们利用这些实体将地缘政治和与冲突相关的信息包装后输送给目标受众。伊朗的行动包括七名“记者”人设,利用它们向世界各地的小型和中小型在线媒体投递长篇文章;俄罗斯的行动似乎则蒙蔽了拉丁美洲的一些不知情人士,在当地运营一个“智库”。

这两项行动都是多维度的,尝试了各种不同的策略以实现其目标。除了长篇文章外,伊朗行动还批量生成社交媒体评论,内容大多与美伊战争相关话题为主。除了控制那个“智库”之外,俄罗斯行动还制造了虚假的“泄露”文件和音频脚本,其中一些我们已发现在网上传播。两项行动还大量使用AI起草内部报告(俄罗斯行动在这方面做得比其他任何事都多);在这两起案例中,行动者都使用了可疑或完全欺骗性的方法来夸大行动者的成效。

这些行动最引人注目之处在于,它们与人工智能出现之前的复杂影响力行动极为相似,只是利用人工智能简化了部分工作流程。伊朗行动所运营的记者人设与虚假记者“爱丽丝(在新窗口中打开) Donovan(在新窗口中打开)”的网站,它是俄罗斯军事情报机构的一个幌子,其文章曾在2016-17年间被多家西方媒体发表。2020年,与俄罗斯互联网研究机构过去活动有关联的个人运营了一个名为“和平数据(PeaceData)(在新窗口中打开)”,它暗中利用世界各地不知情的记者为其撰稿。

这些行动还因其潜在影响范围而显得不同寻常。使用IO 突破规模(在新窗口中打开)(该框架以1(最低)到6(最高)的等级对影响力行动进行评级),我们会将这次源自俄罗斯的行动评定为 类别5。这是我们开始发布报告以来首次瓦解类别5的行动。源自伊朗的行动达到了 4级。两者都成功将其内容(并非全部由我们的模型生成)发布在主流媒体上,而不仅仅是在社交媒体上发帖。这符合我们在过去两年半中曝光的30次隐蔽影响力行动中观察到的一个模式:那些试图将内容投放至真实媒体渠道、而非依赖虚假社交媒体分发的行动,往往具有最高的潜在覆盖面和影响力。

Matrix of 30 influence operations by primary distribution method and Breakout Scale category. Operations using external publications reached categories 4 and 5; social-media-led operations reached categories 1 to 3.

自2024年初以来我们曝光的30次影响力行动(IO)矩阵,按主要分发方式(社交媒体、行动自建网站、外部出版物)及其突破规模(Breakout Scale)评分进行评估。使用多种分发方式的行动,例如运营网站同时在社交媒体上推广,则按看似构成该行动核心的方式进行分类。

人工智能可以使这类虚假门面行动获得更大的规模、效率和语言流畅度以及编辑能力。运营者可以利用这些优势来剥削毫无戒心的受害者(例如员工或编辑),并将其内容推送到完全不知道背后是谁、也不知道其动机为何的受众面前。这些行动还表明了威胁行为者利用虚假身份和实体来实现其目标的复杂性和精密程度。理解威胁行为者在这些行动中所利用的漏洞,以及这些漏洞如何转化为受众和影响力,对于在各组织间维持强大的防御至关重要。

但这些假门面行动的隐蔽性也使它们在面对负责任的披露时尤其脆弱。“Alice Donovan”和“PeaceData”在被曝光后都停止了活动。这就是为什么我们报道这些假门面行动的目标是让进一步研究和干扰变得更加容易——并让行动继续下去变得更加困难。

俄罗斯:“黑暗克拉克”行动

在整个拉丁美洲开展影响力行动的源自俄罗斯的行为者。

演员

我们封禁了一批源自俄罗斯的ChatGPT账户。这些账户利用ChatGPT执行了多项与针对拉丁美洲各国的隐蔽影响力行动相关的任务。其中大部分活动似乎旨在破坏乌克兰在该地区的声誉,但也有部分活动似乎旨在影响当地政治结果,尤其是在阿根廷和玻利维亚。大多数操作者使用俄语进行提示;有一人使用西班牙语,但看起来同样位于俄罗斯。我们已将此案的相关信息分享给有关当局。

操作者利用ChatGPT执行三项主要任务:撰写有关其活动(以及其他人的、他们可以合理地冒名邀功的活动)的内部报告,为其行动创作内容,以及起草关于一个自称位于拉丁美洲的“研究平台”——社会研究中心(SRC)——的绩效报告。他们似乎通过一个名为“Mia Clark”的虚假人设来控制SRC;为纪念这个名字,我们将此次行动昵称为“Dark Clark”。由于我们不向俄罗斯提供对模型的访问权限,他们使用了VPN连接到我们的服务。

在他们的内部报告中,运营者声称他们在整个拉丁美洲散布虚假故事,以破坏乌克兰或当地领导人的形象。其中一些虚假信息已被归因于 开源(在新窗口中打开) 研究人员(在新窗口中打开) 指向一个被称为“Politology”或“La Compania”的俄罗斯实体,据称是瓦格纳集团(Wagner Group)的后续组织,也是俄罗斯寡头叶夫根尼·普里戈任(Yevgeniy Prigozhin)创立的其他实体的后继者。运营者还要求我们的模型翻译或解释有关Politology和瓦格纳的公开报道,其数量远超对任何其他俄罗斯来源网络的询问。

此次行动在两个方面不同寻常。首先,它似乎成功地策反了拉丁美洲的一些人为SRC工作。俄罗斯操作人员关于SRC的报告提及了薪酬标准、招聘和解雇等问题的决策,这表明他们控制着该实体,而非与之合作。现有证据表明,SRC在拉丁美洲的员工并不知道自己是在为一个俄罗斯组织工作。与我们发现的另一个与俄罗斯有关联的“智库”不同 最近曝光,SRC 似乎通过其被收买的员工生产了大部分原创内容。这是我们过去两年半以来所打击的、运作掩护身份的最复杂尝试。

其次,一些开源证据表明,Dark Clark 的假信息传播范围足够广泛,足以引发 事实核查(在新窗口中打开) 和 官方否认(在新窗口中打开),其渗透程度超出了我们在过去两年中挫败的任何影响力行动。该行动声称在秘鲁植入的一则假信息甚至加剧了乌克兰与波兰之间的公开紧张关系。

内部举报

这些操作者使用ChatGPT的主要方式是起草和更新发给某位未知上级的内部报告。这些定期报告描述了在整个拉丁美洲开展隐蔽影响力行动的工作。这些工作包括三个主要方向:诋毁乌克兰并破坏乌克兰武装部队征兵的行动;干涉某些国家国内政治的行动,尤其是玻利维亚和阿根廷;以及对SRC的管理。在大多数情况下,我们没有观察到威胁行为者使用我们的模型为这些行动创建内容,而只是用其汇报行动情况(少数例外情况在 如下⁠).

这些报告包含丰富的战术细节,揭示了该行动如何企图破坏乌克兰以及一些国家领导人的声誉,尤其是阿根廷、玻利维亚和厄瓜多尔的总统。一些报告描述了诱骗当地人员开展活动、以便操作者加以利用的努力;另一些则描述了操作者声称已散布的虚假“泄密”。

在两起案例中,证据将操作者与关于“Politology”的公开报道联系起来。操作者报告称,2024年,他们开展了两场针对阿根廷总统哈维尔·米莱(Javier Milei)的行动。第一,他们称散布了米莱为其爱犬购买卡地亚(Cartier)珠宝项圈的虚假报道。第二,他们声称雇用当地演员在布宜诺斯艾利斯张贴反米莱涂鸦。根据泄露的文件,这两项说法已被 公开⁠(opens in a new window) 归因⁠(opens in a new window) 于“Politology”和“La Compania”。

还有更多虚假信息此前未被关联到俄罗斯信息行动。例如,操作者声称在2026年5月,他们创建了一个假冒秘鲁利马地区教育局的虚假电子邮件地址,并利用它指示该地区的学校在国家文化和语言多样性日(5月21日)举办献给乌克兰的活动。这些电子邮件包含明确的指示,要求提及其中之一的、备受争议的二十世纪乌克兰民族主义者斯捷潘·班杰拉(Stepan Bandera)——一些乌克兰人视其为独立人物,但在俄罗斯和波兰,他则与法西斯主义、战时合作以及暴行联系在一起。据操作者称,一些学校回复了这个虚假电子邮件地址,确认他们举办了此类活动,甚至提供了照片。

操作者随后声称已在秘鲁和波兰的媒体上植入有关这些事件的报道,并附上乌克兰“输出”极端民族主义意识形态的指控,从而引发愤怒。开源搜索在 秘鲁⁠(opens in a new window) 和⁠(opens in a new window) 波兰⁠(opens in a new window) 媒体⁠(opens in a new window)中发现了与这一说法相符的报道,以及 匈牙利⁠(opens in a new window) 的一篇英文出版物(其中一些文章后来已被删除)。 一些⁠(opens in a new window) 文章⁠(opens in a new window) 包含了一位波兰籍欧洲议会议员的回应,他提议将表现出“反波兰情绪”的人士宣布为波兰的 persona non grata (不受欢迎的人)。俄罗斯的虚假信息因此既利用了、又助长了乌克兰人和波兰人之间的历史紧张关系。

类似地,在六月,操作者声称他们使用另一个虚假电子邮件地址,诱骗厄瓜多尔的学校举办一场宣誓效忠总统丹尼尔·诺沃亚(Daniel Noboa)和私营军事承包商黑水公司(Blackwater)前负责人埃里克·普林斯(Erik Prince)的仪式。操作者声称该事件在厄瓜多尔引发了愤怒,并迫使政府否认这一虚假信息,从而将其放大到全国受众。同样,开源研究发现了相关 媒体⁠(opens in a new window) 报道⁠(在新窗口中打开) 在 厄瓜多尔⁠(在新窗口中打开) 媒体⁠(在新窗口中打开) 中有一篇与该说法极为相似的文章,甚至还有厄瓜多尔教育部长的 详细反驳⁠(在新窗口中打开) 。

这些运营者使用了一系列手段来支撑他们的虚假故事。根据他们的内部报告,他们在三月传播了两个针对厄瓜多尔的不同假消息。其中一条使用了伪造的音频,并嫁祸于乌克兰驻厄瓜多尔领事,声称他发表了贬低厄瓜多尔人的言论。我们的开源调查在 TikTok 上识别出一条与这一说法完全吻合的帖子;它似乎只获得了有限的互动。另一条则是一段在 X 和 TikTok 上以一家真实新闻频道标志传播的虚假视频片段,声称诺沃亚政府正在招募年轻人去乌克兰作战。 事实核查员(在新窗口中打开) 在厄瓜多尔描述了4月初一场符合此描述的行动。

Redacted TikTok screenshot of an April 8, 2026 post spreading fabricated audio attributed to Ukraine’s consul in Ecuador.

2026年4月8日发布的TikTok视频,其中包含本次信息行动所伪造并栽赃给乌克兰领事的音频。

另一份内部报告描述了他们在5月下旬玻利维亚反政府抗议高潮期间散布的一条假消息。操作者明确将此次行动的目标描述为加剧围绕抗议活动的危机。该行动包含一段伪造的音频录音,录音中一名国营水务公司EPSAS的员工声称政府将切断行政首都拉巴斯的供水并宣布进入紧急状态。我们的开源研究识别出一个 辟谣(在新窗口中打开) 匹配权利要求的一部分以及一个 官方否认(在新窗口中打开) 来自EPSAS。

其他内部报告中包含一些我们无法通过公开来源证实的虚假信息,可能是因为它们已被删除,或未能传播开来。例如,操作者声称在1月传播了一条新闻,声称一位巴西网红兼模特被乌克兰大使馆人员贩卖到乌克兰,并在基辅被害。6月,他们声称在玻利维亚传播了另一段伪造音频,这次据称来自玻利维亚中央银行的一名员工,警告该银行即将限制现金提取。他们还声称传播了一封伪造的该国碳氢化合物机构信函,警告将限制向私家车销售燃油。

在其他报告中,操作者要求我们的模型帮助识别目标国家中他们可以声称功劳的事件,即使他们并未参与其中。例如,在阿根廷,操作者声称阿根廷外交部长在联合国关于福克兰/马尔维纳斯群岛问题的委员会会议上引用了他们的行动。操作者声称功劳在于散布了以下论点:自决原则不适用于这些群岛,以及英国在那里维持着不成比例的军事存在。事实上,这两个论点早已是阿根廷官方立场的一部分。 许多(在新窗口中打开) 年(在新窗口中打开)。同样,在6月,巴西媒体 报道(在新窗口中打开) 关于一名巴西公民的案件:他前往乌克兰加入军队,被俄罗斯部队俘获,随后在电视讲话中声称自己是被欺骗才参战的。ChatGPT的操作者试图声称这篇报道复现了他们行动的宣传内容;实际上,它 引用了被俘者自己的视频(在新窗口中打开)。这表明运营者试图开展一场针对其自身雇主的影响行动,而非针对任何外部受众。

该“研究平台”

一些运营者的报告提到了一个自称“研究平台”的机构,名为社会研究中心(俄语:Центр социологических исследований)。根据SRC网站的信息,该机构专注于拉丁美洲的印度侨民群体,以及印度与该地区国家之间的关系。

内部报告显示,这些操作者控制着该智库,而不仅仅是与其合作。例如,报告中提到了招聘与解雇决定、薪酬标准、人员配置计划以及正在进行的研究项目。关键的是,报告还指出,操作者创建了一个名为“Mia Clark”的虚假身份,用于运营该行动的社交媒体活动,并与拉丁美洲当地的员工互动。现有证据表明,这些当地员工完全不知道自己是在为俄罗斯的行动工作,并且是善意地开展研究任务的。这种利用不知情中间人的手法,与早前同样与普里戈任的势力圈有关的俄罗斯行动“PeaceData”高度相似,Meta 暴露(在新窗口中打开) 在2020年。

从俄罗斯运营者的报告来看,他们在拉丁美洲的当地人员对该地区的专家和评论员进行了采访,然后根据调查结果撰写研究报告。主题范围从对金砖国家(BRICS)公众舆论的广泛分析,到对雅伊尔·博索纳罗(Jair Bolsonaro)和路易斯·伊纳西奥·卢拉·达席尔瓦(Luiz Inácio Lula da Silva)任内巴西经济的详细比较。有时,俄罗斯运营者在研究项目发布之前就起草了关于这些项目的状态报告,表明他们深度参与了制作过程。我们在SRC网站上识别出超过60篇文章,其中绝大多数似乎是原创作品。这将Dark Clark与我们最近揭露的一个源自俄罗斯的行动区分开来:后者也以智库为幌子,但其大部分内容都是剽窃的;这表明Dark Clark有意建立一个更持久的幌子实体,并在整个拉丁美洲建立联系。

为了推广SRC的工作,俄罗斯运营者声称他们曾尝试创建一个社交媒体账号网络。根据他们的报告,当世界各地的运营者试图访问相同的账号时,这项社交媒体活动遇到了问题,导致账号受到限制。开源记录中可以看到这方面的痕迹:例如,SRC在X上的主账号的透明度设置显示其位于德国(可能是使用VPN的结果),但通过俄罗斯联邦App Store连接,而其一个Instagram账号的透明度设置显示管理员位于委内瑞拉。我们识别出的三个SRC品牌Facebook账号中,没有一个拥有足够的粉丝来触发管理员位置设置的显示。

Account transparency screenshots for the Social Research Center: its X account connected through the Russian Federation App Store, while its Instagram account listed Venezuela.

左图:与Social Research Center相关联的X账号。注意显示该账号通过俄罗斯联邦应用商店连接的透明度设置。右图:SRC的Instagram账号:注意其位于委内瑞拉的位置。

运营者报告称在LinkedIn上遇到了特别的问题,他们表示曾创建了一个明确的虚假账号来代表SRC,但随后难以为其建立网络。根据他们的报告,解决办法是创建更多虚假账号来关注第一个账号,使其看起来更有说服力。截至8月17日,一个使用相同Social Research Center品牌的LinkedIn账号拥有961名粉丝,声称拥有200-500名员工,但只列出了两名雇员。

制造虚假内容

除了使用AI更新报告外,运营者偶尔也会要求我们的模型帮助设计和创建可用于其行动的文本:例如,寻求帮助以确保他们的虚假内容针对不同国家使用正确的口音、词汇和机构风格。这只占总体工作量的相对较小部分,可能是因为该行动似乎至少包括一名来自拉丁美洲的西班牙语母语人士,因此对AI语言支持的需求较少。

例如,有一次,一名讲俄语的运营者要求模型用俄语起草一封信,以将乌克兰驻巴拿马名誉领事牵连进腐败事件。讲西班牙语的运营者随后要求模型将这封信翻译成西班牙语,并生成配套的音频脚本。一张与信件内容相符的照片,配上与运营者脚本相符的画外音,由一个冒充新闻机构的账号发布在TikTok上,但使用了巴拿马 TVN Noticias(在新窗口中打开)的标志。该TikTok频道只有一名粉丝,并在发布这条虚假信息后停止了更新。

Redacted TikTok screenshot showing a fabricated letter about Ukraine’s contacts with Panama’s financial sector, paired with an operation-generated voiceover.

TikTok帖子展示了由此行动生成的信件文本,其画外音脚本同样由该行动生成。

另一次,位于俄罗斯的讲西班牙语的运营者向模型提供了一份俄语脚本,声称诺沃亚(Noboa)侮辱了厄瓜多尔的穷人,并要求模型将其翻译成厄瓜多尔西班牙语。第三次是在3月,同一用户要求模型校对一份西班牙语合同草案,合同双方是一家名为“International Security Solutions FZE”的公司和厄瓜多尔的一名个人,该合同声称在乌克兰提供基础设施服务。用户的提问集中在如何改进语言和排版,包括询问哪些词应该加粗。

在合同措辞确定后,用户关于合同的提问就结束了。然而,开源研究显示,这张“合同”的图片随后 在社交媒体上流传(在新窗口中打开)。它被用来支持一种说法,即诺沃亚政府与一家幌子公司合作,诱骗厄瓜多尔人加入乌克兰军队。这条虚假信息传播范围之广,以至于在4月初触发了 事实核查(在新窗口中打开) :核查人员得出结论,该公司“并未出现在厄瓜多尔公司、证券和保险监管局的登记册中”。

影响

评估此次行动的影响需要格外谨慎。如上所述,运营者的主要手段之一是将与其行动毫无关系的活动归功于自己。因此,他们在内部报告中声称的影响不能只看表面。同样,他们声称植入的某些虚假报道并未在开源研究中出现,可能是因为这些报道是在非公开渠道传播的、已被删除的,或者实际上根本没有发布。

然而,开源证据使我们能够证实他们所提出的一些说法。该行动声称传播的部分虚假内容后来被事实核查人员报道并被各国政府辟谣,这表明它们传播得足够广,以致引起了回应。在其他案例中,我们能够在网上找到与该行动所生成内容高度吻合的内容。最引人注目的是,该行动声称诱使一所秘鲁学校举办一场美化班德拉的活动,此事后来在拉丁美洲和欧洲均有报道,并且似乎促使至少一位波兰籍欧洲议会议员发表了评论。

使用 IO 突破规模⁠(在新窗口中打开)该评级将IO按1(最低)到6(最高)的等级进行评分,我们会将此次行动评为属于 5级并有证据表明这引发了多个国家政客的公开评论。这是我们开始报告以来所打击的第一个第五类(Category 5)行动。

伊朗:“虚假署名”(Bogus Bylines)行动

源自伊朗的行动,以欺骗性署名在网络新闻媒体上投放长篇文章。

行为者

我们封禁了一组源自伊朗的ChatGPT账户。他们用波斯语进行提示,并生成波斯语和英语内容。这些行为者通过使用VPN访问ChatGPT来掩盖其所在地。

该行动利用我们的模型润色长篇文章和编辑投稿提案、生成社交媒体评论,以及完善内部报告。运营者使用了七个不同的署名来投递文章,因此我们将他们的行动称为“虚假署名”(Bogus Bylines)。这些长篇文章聚焦于美伊冲突。大部分评论同样涉及这一冲突;少数评论涉及美国政治,通常是在冲突的更广泛背景下。

其主要工作内容表面的影响力差异很大。我们在全球约十几家网络媒体上发现了近100篇以该行动署名发表或转载的文章。这些媒体属于中小型媒体,通常聚焦于国际事务、地缘政治和中东地区的事件。相比之下,社交媒体评论似乎没有一条在点赞、转发或进一步回复方面产生了实质性互动。事实上,运营者的内部报告使用了一种欺骗性的计算方式来衡量其社交媒体影响力,可能是为了夸大运营者表面上的成效。

总体活动似乎符合一家商业行为者开展受雇影响力行动的特征,但我们无法确定所涉及的具体行为者。我们已就这一案例与相关当局共享了信息。

植入文章

该行动影响最深远的活动是让ChatGPT审阅和润色关于美伊冲突地缘政治的英语长篇文章。典型的提示要求模型根据某个特定网络媒体的投稿标准评估英语草稿,并建议修改以确保其符合要求。一旦运营者批准了修改,他们就会让模型生成一封可用于向该网络媒体编辑投稿推荐文章的电子邮件。

这些投稿信息使用了七个不同的虚假署名撰写:Ervin B. Hoskins、Noah Lamington、Sophia Gonzalez、Michael Harrison、Ericka Feusier、Jenny Williams和Alice Johnson。根据随其中一些文章一起在网上发布的个人简介,每个人设都声称自己是一名西方记者(通常是美国人,尽管Noah Lamington人设的简介声称其身在新西兰),往往专注于国际政治、中东、人权或冲突议题。对于其中一个人设“Michael Harrison”,运营者要求模型自己撰写简介。(值得注意的是,今年3月Meta曾 打击⁠(在新窗口中打开) 一个同样以“Michael Harrison”记者人设为特征的伊朗信息行动。)

其中一些人设得到了分布在多个社交媒体平台上账户的支撑。例如,Michael Harrison人设在Medium、X和Facebook上有配套账户。Ervin B. Hoskins人设在X、Facebook、Instagram和Threads上都有账户。该人设的简介声称自己是“一名美国自由撰稿人”,但社交媒体的透明度设置显示这些账户位于伊朗。

Ervin Hoskins persona’s Instagram biography and account transparency panels. X lists the West Asia Android App, while Instagram lists Iran as the account location.

上方,Ervin Hoskins人设的Instagram简介。左下,X账户透明度信息,显示使用了西亚Android应用。右下,Instagram账户透明度信息,显示位于伊朗。Meta已于8月封禁了该Instagram账户。

利用开源调查技术,我们发现了近100篇以运营者各种署名发表的文章,分布在十几家不同的出版物上。这些出版物通常聚焦于国际事务、地缘政治和中东地区的事件,有时持反战或进步派观点。我们发现的最早一篇文章发表于2025年7月,最新的一篇发表于2026年10月。在美伊冲突爆发后,文章发布频率大幅增加。

Timeline of articles published under seven Bogus Bylines personas, grouped by topic and author. US-Iran coverage is the largest category and becomes concentrated from March 2026.

2025年7月至2026年9月文章时间线,按作者和主题划分。注意2026年3月起有关美伊关系的发布密度。

Five article headlines published under personas linked to the operation: Alice Johnson, Noah Lamington, Michael Harrison, Sophia Gonzalez, and Ervin Hoskins.

2026年2月至7月期间以与此行动相关的署名在多家网络媒体上发表的文章标题示例。

其中至少一些文章随后由相关媒体的社交媒体账号进行了推广,使伊朗运营者有可能接触到他们原本无法触及的受众。

批量评论

除了文章之外,威胁行为者还要求ChatGPT以英文或波斯语批量生成关于地缘政治或政治话题的评论。这些行为者的典型做法是输入某条社交媒体帖子的文本或截图,然后要求模型提供一组与其总体方向一致的回复。这些评论随后被发布到网上,通常在几分钟内相继发布。运营者的内部报告同时提及了人工发布和自动化发布;我们没有证据表明这种自动化是借助我们的模型完成的。

Side-by-side screenshots of operation-generated replies in English and Persian, posted in July, with account identities obscured.

由该行动生成并于7月发布的英文推文(左)和波斯语推文(右)。英文评论回复了一条警告美国正准备对伊朗发动“大规模袭击”的英文推文。图中所有评论均在10分钟的时间跨度内发布。波斯语评论回复了一条关于美国对伊朗打击的波斯语推文,并在13分钟内发布。

部分批量评论活动的内容是为关于该行动自身新闻文章的社交媒体帖子生成回复。在这里,运营者输入推广其文章的帖子截图,然后生成赞美或认可这些文章的评论,很可能是为了让文章显得更受欢迎。

Redacted Facebook screenshot of a local news page sharing an operation-generated article under Sophia Gonzalez’s byline, followed by four operation-generated comments.

一个美国地方新闻主页分享该行动生成的文章的Facebook帖子,以及由该行动生成的针对该帖子的评论。

大多数评论批次更笼统地聚焦于伊朗、美国和以色列之间的冲突。用户要求就导弹打击、停火和外交斡旋等话题生成评论,并指定输出内容将美国描绘为侵略者、以色列为美国不可靠的盟友、伊朗为倔强但坚韧的受害者。运营者针对总部位于英国的卫星电视网络Iran International——伊朗政权的批评者——的帖子生成了数量特别多的回复,生成了超过两打批次的敌意波斯语回复。少数批次针对关于美国政治议题的社交媒体帖子生成回复,通常也是在冲突的更大背景下。

Two redacted Instagram comments generated by the operation in reply to posts about US politics.

由该行动生成的、回复有关美国政治帖子的Instagram评论。

我们发现其中少量评论被发布到了网上;更多评论未出现在我们的开源搜索中,可能是因为它们未被发布,或是由已被封禁的账号发布的。(例如,三名记者人设——Ericka Feusier、Alice Johnson和Jenny Williams——在其发布的个人简介中列出了X账号:截至2026年8月,这些账号均已被停用。)一些确实在网上发布评论的账号拥有看似西方的名字,但账号位置显示在伊朗。

Redacted Instagram account transparency panels showing Iran as the location of both accounts that posted the preceding comments.

发布上述评论的Instagram账号的透明度设置,显示它们位于伊朗。

在我们确实发现这些评论被发布的地方,它们通常仅占相关帖子评论总数的一小部分,表明这些运营者在真实回应中并非主导声音。它们似乎也没有获得实质性互动:事实上,该行动回复所获得的许多点赞来自本身就与该行动有关的账号。我们已与行业伙伴分享了此案例的相关信息,他们最有能力对互动情况提供全面评估。

内部报告

让自己的活动显得更受欢迎的尝试并不局限于面向公众的帖子。在生成内容的同时,运营者偶尔会要求ChatGPT润色看似是关于其社交媒体行动的内部报告。这通常包括向模型提供一系列统计数据,并要求其将这些数据制作成精美的演示文稿。

这不是我们首次捣毁使用AI撰写其 自身⁠(在新窗口中打开) 自我评估⁠(在新窗口中打开)的行动。伊朗运营者给自己批改作业的做法中最引人注目的是他们所使用的方法。他们使用的主要“影响力”指标是他们所回复的帖子的浏览量(而非 实际回复的浏览量),并在回复发布之前以及发布后一段未指明的时间进行统计。这一计算没有考虑可能由其他因素(如原帖的受欢迎程度或其他评论)产生的任何浏览量。因此,这极大地夸大了该行动的影响力数据,表明运营者要么不知道更有效的计算方法,要么选择不使用它。

影响力

事实上,根据可以从开源观察中收集到的证据,该行动的两个主要工作流在可能产生的影响力上似乎存在很大差异。

我们能够识别的社交媒体回复通常获得的点赞、浏览和评论数量较低(个位数或两位数)。如上所述,这些回复通常只占相关帖子总评论数的少数。根据IO Breakout Scale⁠(在新窗口中打开)——该量表以1(最低)到6(最高)为IO评级——我们将此次行动的这一部分评估为 Category 2,即在多个平台上发表评论,但几乎没有迹象表明其突破了原有范围或有能力主导回复。

相比之下,记者人设成功让他们的文章被一系列媒体 outlet 发表,其中一些拥有可观的关注者:例如,发表此次行动文章的其中一个在线媒体截至2026年8月在Facebook上拥有近2百万关注者,在X上拥有近355,000关注者,在Instagram上拥有超过544,000关注者。基于其持续突破到多家媒体,我们将此次行动的这一部分评估为 Category 4。

原始出处

OpenAI

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准