跳到正文
OpenAI News·· 18 小时前精选AI 评分78

OpenAI披露并封禁俄罗斯与伊朗的AI虚假前台影响行动

Disrupting AI-enabled “false front” operations

AI 导读

OpenAI披露已封禁两起分别源自俄罗斯和伊朗、利用其模型支持的隐蔽影响行动,并评估俄罗斯行动为IO Breakout Scale Category 5、伊朗行动为Category 4。俄罗斯行动借助拉美人员运营虚构研究机构并传播假消息;伊朗行动则通过七个虚假记者身份向媒体投稿,相关署名文章近100篇。OpenAI表示,这些行动沿用了AI出现前的影响行动模式,而AI让部分工作流程更容易扩展。

推荐理由

报告比较了两起行动的传播路径与影响等级,呈现AI如何降低虚假前台组织制作和传播内容的门槛。

正文 · AI 翻译

颠覆 AI 助力的“假面”行动

正在加载…

音频 1

分享

在过去两年半里,我们报告了许多关于威胁行为者试图利用我们的模型进行网络攻击、隐蔽影响行动(IO)、诈骗以及其他违反使用政策的行为。我们发布这些报告,是为了让监管机构、业内同行和更广泛的社会了解我们观察到的威胁行为者试图如何利用 AI,并揭示他们试图利用的漏洞。

我们最近封禁了两个影响行动——一个来自俄罗斯,一个来自伊朗。这些行动将我们的模型与更传统的技术和手段结合起来,为复杂的“假面”实体提供支持,并利用这些实体向目标受众传播经过包装的地缘政治和冲突相关信息。伊朗行动创建了一组由七个“记者”人设组成的团队,并借此向世界各地的中小型在线媒体推销长篇文章;俄罗斯行动似乎拉拢了拉丁美洲一些不知情的人士,在当地运营一个“智库”。

这两项行动都涉及多个层面,尝试了各种不同策略以实现目标。除了撰写长篇文章,伊朗行动还批量生成社交媒体评论,内容通常与美伊战争有关。俄罗斯行动除了运营这个“智库”,还伪造了“泄露”文件和音频脚本,其中一些被我们发现正在网上传播。两项行动还大量使用 AI 起草内部报告(俄罗斯行动尤甚);在这两种情况下,行动者都采用了可疑乃至公然欺骗的方法,夸大行动的成效。

这些行动最引人注目之处在于,它们与 AI 时代之前复杂的影响行动十分相似,只是利用 AI 简化了部分工作流程。伊朗行动使用的记者人设,与假记者“Alice⁠(在新窗口中打开)Donovan⁠(在新窗口中打开)”颇为相似。这个人设是俄罗斯军事情报部门的幌子,其文章曾于 2016-17 年间在多家西方媒体上发表。2020 年,与俄罗斯互联网研究局过往活动有关的个人运营了一个名为“PeaceData⁠(在新窗口中打开)”的假“新闻”媒体,诱使世界各地不知情的记者为其撰稿。

这些行动的潜在影响范围也很不寻常。使用 IO 突破规模⁠(在新窗口中打开)(该量表以 1(最低)至 6(最高)对 IO 进行评级),我们会将源自俄罗斯的行动评定为第 5 类。这是我们开始发布报告以来首次中断的第 5 类行动。源自伊朗的行动达到第 4 类。这两项行动都成功将其内容(并非全部由我们的模型生成)投放到主流媒体,而不是仅仅发布在社交媒体上。这与我们在过去两年半中披露的 30 项隐蔽影响行动所呈现的模式一致:试图将内容投放到真实媒体,而非依赖虚假的社交媒体传播的行动,往往具有最高的潜在影响范围和影响力。

Image 1: Matrix of 30 influence operations by primary distribution method and Breakout Scale category. Operations using external publications reached categories 4 and 5; social-media-led operations reached categories 1 to 3.

自 2024 年初以来我们披露的 30 项 IO 矩阵,按主要传播方式(社交媒体、行动方运营的网站、外部出版物)和突破规模评分进行评估。采用多种传播方式的行动(例如运营网站并在社交媒体上推广该网站),按最能体现行动核心的方式进行分类。

AI 可以让此类假身份行动实现更大的规模、更高的效率、更流畅的语言表达和更强的编辑能力。行动者可以利用这些优势欺骗毫无戒心的受害者(例如员工或编辑),将内容呈现在受众面前,而这些受众完全不知道内容背后的操纵者是谁,也不知道他们的动机。这些行动也展现了威胁行为者利用虚假身份和实体实现目标的复杂程度与高超手段。了解威胁行为者在这些行动中利用的漏洞,以及这些漏洞如何转化为受众规模和影响范围,对于维持各组织的强大防御至关重要。

然而,这些假身份行动具有隐蔽性,也因此特别容易受到负责任披露的影响。“Alice Donovan”和“PeaceData”都在被曝光后停止了活动。因此,我们报告这些假身份行动的目标是让后续调查和中断行动变得更容易,并让这些行动更难以继续。

俄罗斯:行动“Dark Clark”

源自俄罗斯的行为者在拉丁美洲各地开展影响行动。

行为者

我们封禁了一批源自俄罗斯的 ChatGPT 账号。它们使用 ChatGPT 执行与针对拉丁美洲各国的隐蔽影响行动相关的一系列任务。这些活动大多似乎旨在损害乌克兰在该地区的声誉,但有些似乎意在影响当地政治结果,尤其是在阿根廷和玻利维亚。大多数操作者使用俄语输入提示;其中一人使用西班牙语,但仍似乎位于俄罗斯。我们已与相关主管部门分享此案信息。

这些操作者使用 ChatGPT 执行三项主要任务:撰写关于自身活动(以及其他人活动——他们有理由声称这些活动是自己所为)的内部报告;为其行动创作内容;以及起草关于一个自称为“研究平台”的机构——拉丁美洲社会研究中心(SRC)——运作情况的报告。他们似乎通过一个名为“Mia Clark”的虚假身份控制 SRC;为纪念这个名字,我们将此行动昵称为“Dark Clark”。由于我们不允许从俄罗斯访问我们的模型,他们使用 VPN 连接我们的服务。

在内部报告中,这些操作者声称,他们在整个拉丁美洲散布虚假消息,以削弱乌克兰的影响力或打击当地领导人。其中一些虚假消息被开源⁠(在新窗口中打开)研究人员⁠(在新窗口中打开)归因于一个名为“Politology”或“La Compania”的俄罗斯实体。据报道,该实体是瓦格纳集团及俄罗斯寡头叶夫根尼·普里戈任创立的其他实体的继任者。操作者还要求我们的模型翻译或解释有关 Politology 和瓦格纳的公开报道,相关请求远多于他们对任何其他俄罗斯起源网络的询问。

这项行动有两处不同寻常。首先,他们似乎成功地招揽了拉丁美洲人士为 SRC 工作。俄罗斯操作者关于 SRC 的报告提到了薪酬标准、招聘和解雇等事项上的决策,这表明他们控制着该机构,而非与之合作。现有证据表明,SRC 在拉丁美洲的员工并不知道自己是在为一个俄罗斯组织工作。与我们最近揭露的另一个与俄罗斯有关联的“智库”不同,SRC 似乎通过其被招揽的员工制作了大部分原创内容。这是过去两年半中我们瓦解的最复杂的伪装身份运作企图。

其次,一些开源证据表明,Dark Clark 散布的虚假消息传播范围足够广,甚至引发了事实核查⁠(在新窗口中打开)和官方否认⁠(在新窗口中打开),显示其渗透程度超过了我们过去两年瓦解的任何影响力行动。该行动声称在秘鲁散布的一则虚假消息,甚至加剧了乌克兰与波兰之间的公开紧张关系。

内部报告

操作者使用 ChatGPT 的主要方式,是为一名身份不明的上级起草和更新内部报告。这些定期报告描述了在拉丁美洲各地开展秘密影响力行动的尝试,涵盖三项主要工作:诋毁乌克兰并阻挠乌克兰武装部队招募人员;干涉某些国家的国内政治,尤其是玻利维亚和阿根廷;以及管理 SRC。在大多数情况下,我们没有观察到威胁行为者使用我们的模型为这些行动创作内容,而只是用来汇报行动情况(少数例外情况见下文⁠)。

这些报告包含丰富的战术细节,揭示了该行动如何试图削弱乌克兰以及一些国家领导人的影响力,尤其是阿根廷、玻利维亚和厄瓜多尔的总统。部分报告描述了他们诱骗当地人执行某些活动的尝试,以便操作者将其用作武器;另一些则描述了操作者声称已散布的虚假“泄密”信息。

在两起事件中,证据将行动者与“Politology”的公开报道联系起来。行动者称,他们在2024年开展了两场针对阿根廷总统哈维尔·米莱的行动。首先,他们称散布了一则虚假消息,称米莱为他的狗买了卡地亚镶珠项圈。其次,他们声称花钱雇当地人,在布宜诺斯艾利斯张贴反米莱涂鸦。根据泄露的文件,这两项说法均已被公开⁠(在新窗口中打开)归因⁠(在新窗口中打开)于“Politology”和“La Compania”。

还有更多虚假信息此前未被认定与俄罗斯信息行动有关。例如,行动者声称,他们在2026年5月创建了一个虚假电子邮件地址,冒充秘鲁利马地区教育局。他们利用该地址指示该区的学校在5月21日全国文化与语言多样性日举办乌克兰主题活动。邮件明确要求提及包括20世纪颇具争议的乌克兰民族主义者斯捷潘·班德拉在内的人物。一些乌克兰人将班德拉视为独立运动人物,但在俄罗斯和波兰,他与法西斯主义、战时勾结及暴行有关。据行动者称,一些学校回复了这个虚假电子邮件地址,确认举办了此类活动,甚至还提供了照片。

行动者随后声称,他们在秘鲁和波兰媒体上发布了有关这些活动的报道,并指称乌克兰正在“输出”极端民族主义意识形态,引发了愤怒。开源检索发现,秘鲁⁠(在新窗口中打开)和⁠(在新窗口中打开)波兰⁠(在新窗口中打开)媒体⁠(在新窗口中打开)上有与这一说法相符的报道,匈牙利的一家英文出版物也有相关报道⁠(在新窗口中打开)(其中一些文章后来已被删除)。一些⁠(在新窗口中打开)文章⁠(在新窗口中打开)还引用了一名波兰欧洲议会议员的回应,他提议将表现出“反波兰情绪”的人宣布为在波兰的不受欢迎人物。因此,俄罗斯的虚假信息既利用了乌克兰人与波兰人之间的历史矛盾,也加剧了这些矛盾。

类似地,行动者声称,他们在6月使用另一个虚假电子邮件地址,诱骗厄瓜多尔的学校举行宣誓效忠总统丹尼尔·诺沃亚和前私营军事承包商黑水公司负责人埃里克·普林斯的仪式。行动者声称,这起事件在厄瓜多尔引发愤怒,并迫使政府出面否认这则虚假信息,反而使其传播给全国受众。开源调查再次发现,媒体⁠(在新窗口中打开)报道⁠(在新窗口中打开)中,厄瓜多尔⁠(在新窗口中打开)媒体⁠(在新窗口中打开)的相关报道与这一说法高度相似,厄瓜多尔教育部长甚至作出了详细驳斥⁠(在新窗口中打开)。

这些操作者使用了多种手段来支撑他们编造的故事。根据其内部报告,他们在3月散布了两条针对厄瓜多尔的不同虚假信息。其中一条是伪造音频,声称来自乌克兰驻厄瓜多尔领事,内容据称是他发表了贬损厄瓜多尔人的言论。我们的开源调查发现,TikTok 上有一条帖子与这一说法完全吻合;该帖获得的互动似乎有限。另一条则称,他们在 X 和 TikTok 上散布了一段伪造视频片段,视频使用一家正规新闻频道的标识,声称诺沃亚政府正在招募年轻男子前往乌克兰作战。厄瓜多尔的事实核查机构⁠(在新窗口中打开)称,4月初出现了一场与此描述相符的行动。

Image 2: Redacted TikTok screenshot of an April 8, 2026 post spreading fabricated audio attributed to Ukraine’s consul in Ecuador.

2026年4月8日发布的 TikTok 视频,包含该行动传播的伪造音频,并声称音频来自乌克兰领事。

另一份内部报告描述了他们在5月底、反政府抗议活动最激烈之际于玻利维亚散布的一则虚假信息。操作者明确表示,这场行动的目的是加剧抗议活动引发的危机。行动中出现了一段伪造音频,声称是国有供水公司 EPSAS 一名员工录制的,内容称政府将切断行政首都拉巴斯的供水,并宣布进入紧急状态。我们的开源调查找到了对这一说法的辟谣⁠(在新窗口中打开),以及 EPSAS 发布的官方否认⁠(在新窗口中打开)。

其他内部报告还提到了一些虚假信息,但我们无法通过公开来源证实,原因可能是相关内容已被删除,或未能传播开来。例如,操作者声称,他们在1月散布了一则消息,称一名巴西网红兼模特被乌克兰大使馆代表贩运至乌克兰,并在基辅遇害。6月,他们声称又在玻利维亚散布了一段伪造音频,这次音频据称来自玻利维亚中央银行的一名员工,警告该银行即将限制现金取款。他们还声称散布了一封伪造的信件,声称来自该国的碳氢化合物管理机构,警告将限制向私家车出售燃料。

在其他报告中,操作者要求我们的模型帮助识别目标国家发生的事件,以便他们将功劳据为己有,即使他们并未参与其中。例如,在阿根廷,操作者声称,阿根廷外交部长在联合国委员会关于福克兰群岛/马尔维纳斯群岛的会议上引用了他们的行动。操作者声称,他们散布了这样的论点:自决原则不适用于这些岛屿,且英国在当地维持着不成比例的军事存在。事实上,这两种论点多年来一直是阿根廷官方立场的一部分:许多⁠(在新窗口中打开)年⁠(在新窗口中打开)。类似地,6月,巴西媒体报道⁠(在新窗口中打开)了一名巴西公民的案例:他曾前往乌克兰参军,被俄军俘虏,随后在电视声明中称自己是被骗去参战的。ChatGPT 操作者试图声称,这篇报道照搬了他们行动的宣传内容;事实上,报道引用的是这名被俘者自己的视频⁠(在新窗口中打开)。这表明,操作者试图针对自己的雇主开展影响力行动,而非面向任何外部受众。

“研究平台”

操作者的一些报告提到了一个自称为“研究平台”的机构,即社会研究中心(俄语:Центр социологических исследований)。根据 SRC 网站介绍,该机构关注拉丁美洲的印度侨民,以及印度与该地区各国的关系。

内部报告显示,操作者控制着这个智库,而不只是与之合作。例如,报告提到了招聘和解雇决定、薪酬标准、人员配置计划以及正在进行的研究项目。至关重要的是,报告还称,操作者创建了一个名为“Mia Clark”的虚假身份,负责该行动的社交媒体活动,并与拉丁美洲当地员工互动。现有证据表明,这些当地员工并不知道自己是在为一项俄罗斯行动工作,并且是本着诚信完成研究任务的。这种利用不知情中间人的做法,与早先另一项同样与普里戈任阵营有关联的俄罗斯行动“PeaceData”极为相似。Meta 于2020年揭露了⁠(在新窗口中打开)该行动。

从俄罗斯操作者的报告来看,他们在拉丁美洲的当地员工采访了该地区各地的专家和评论员,随后根据调查结果撰写研究报告。研究主题从对公众如何看待金砖国家集团的广泛分析,到对雅伊尔·博索纳罗和路易斯·伊纳西奥·卢拉·达席尔瓦担任总统期间巴西经济的详细比较,不一而足。有时,俄罗斯操作者会在研究项目发表之前起草进度报告,这表明他们深入参与了内容制作过程。我们在 SRC 网站上发现了60多篇文章,其中绝大多数似乎都是原创作品。这使 Dark Clark 有别于我们近期揭露的另一项源自俄罗斯的行动:后者也以智库为掩护,但其内容大多抄袭而来;这表明,Dark Clark 意在打造一个更持久的掩护机构,并在整个拉丁美洲建立联系。

为了宣传 SRC 的工作,俄罗斯操作者声称他们曾尝试建立一组社交媒体账号。据他们报告,这些社交媒体活动遇到了问题:世界各地不同地区的操作者尝试访问同一账号,导致账号受到限制。开源记录中可以看到相关痕迹:例如,SRC 主账号在 X 上的透明度设置显示其所在地为德国(可能是使用 VPN 所致),但连接使用的是俄罗斯联邦 App Store;而其一个 Instagram 账号的透明度设置则显示管理员所在地为委内瑞拉。我们发现的三个带有 SRC 品牌标识的 Facebook 账号,粉丝数都不足以触发管理员所在地设置。

Image 3: Account transparency screenshots for the Social Research Center: its X account connected through the Russian Federation App Store, while its Instagram account listed Venezuela.

左:与社会研究中心相关联的 X 账号。请注意,其透明度设置显示该账号通过俄罗斯联邦 App Store 连接。右:SRC Instagram 账号;请注意其所在地显示为委内瑞拉。

操作者报告称,他们在 LinkedIn 上遇到了特别多的问题。他们说,自己创建了一个明确造假的账号来代表 SRC,但之后难以为其建立社交网络。据他们报告,解决办法是创建更多假账号来关注第一个账号,让它看起来更可信。截至 8 月 17 日,一个使用相同社会研究中心品牌标识的 LinkedIn 账号有 961 名关注者,并声称拥有 200 至 500 名员工,但只列出了两名员工。

制作假内容

除了使用 AI 更新报告外,操作者偶尔也会让我们的模型协助设计和创作可用于行动的文本,例如,请求帮助确保他们制作的假内容在不同国家使用正确的口音、词汇和机构风格。这部分工作在整体工作量中占比较小,这或许是因为该行动似乎至少有一名来自拉丁美洲的西班牙语母语者,因此对 AI 语言支持的需求较少。

例如,有一次,一名讲俄语的操作者请求模型用俄语起草一封信,目的是指控乌克兰驻巴拿马名誉领事腐败。随后,讲西班牙语的操作者让模型将信件翻译成西班牙语,并生成配套的音频脚本。一张与信件内容相符的照片,配上符合操作者脚本的配音,被一个冒充新闻媒体的账号发布在 TikTok 上,但该账号使用的是巴拿马 TVN Noticias⁠(在新窗口中打开) 的标志。该 TikTok 频道只有一名关注者,并在散布这条假消息后停止发布内容。

Image 4: Redacted TikTok screenshot showing a fabricated letter about Ukraine’s contacts with Panama’s financial sector, paired with an operation-generated voiceover.

这条 TikTok 帖子展示了由该行动生成文本的信件,并配有同样由该行动生成的配音脚本。

另一次,在俄罗斯的讲西班牙语操作者向模型提供了一段俄语脚本,声称 Noboa 侮辱了厄瓜多尔的穷人,并请求模型将其翻译成厄瓜多尔西班牙语。第三次是在 3 月,同一用户请求模型校对一份西班牙语合同草稿,合同双方是一家名为“International Security Solutions FZE”的公司和厄瓜多尔的一名个人,合同声称将为乌克兰提供基础设施服务。用户的问题着重于如何改进语言和版式,包括询问哪些词应使用粗体。

用户关于合同的提示在措辞最终敲定后便告结束。然而,开源调查显示,“合同”的图片随后在社交媒体上流传⁠(opens in a new window)。这张图片被用来佐证一项说法:诺沃亚政府曾与一家空壳公司合作,诱骗厄瓜多尔人应征加入乌克兰军队。这则假消息传播甚广,甚至在4月初引发了事实核查⁠(opens in a new window):核查人员得出的结论是,这家公司“似乎并未出现在厄瓜多尔公司、证券和保险监管局的登记册中”。

影响

必须格外谨慎地评估这项行动的影响。如上所述,行动人员的主要手段之一,是将与其行动毫无关联的活动归功于自己。因此,他们在内部报告中自行宣称的影响不能照单全收。同样,他们声称散布的一些假消息并未在开源调查中出现,这可能是因为这些消息在非公开渠道传播、已被删除,或实际上从未发布。

然而,开源证据使我们能够证实他们的部分说法。事实核查人员后来报道并驳斥了这项行动声称散布的一些假消息,政府也对此进行了辟谣,这表明这些消息传播得相当广泛,足以引发回应。另一些情况下,我们能够在网上找到与这项行动制作的内容高度相似的内容。最值得注意的是,这项行动声称曾诱骗秘鲁一所学校举办一场将班德拉描绘成正面人物的活动;此事随后在拉丁美洲和欧洲均有报道,而且似乎至少引起了一位波兰欧洲议会议员的评论。

使用评估影响力行动(IO)的Breakout Scale⁠(opens in a new window)(从1级最低到6级最高),我们将这项行动评定为第5类,有证据表明,这项行动引发了多个国家政界人士的公开评论。这是我们开始发布报告以来,首次挫败第5类行动。

伊朗:“虚假署名”行动

源自伊朗的行动,在网络新闻媒体上以误导性署名发布长篇文章。

行动者

我们封禁了一组源自伊朗的 ChatGPT 账号。这些账号以波斯语输入提示,并生成波斯语和英语内容。行动人员通过 VPN 访问 ChatGPT,以掩盖其所在地。

这项行动利用我们的模型润色长篇文章和评论文章投稿、生成社交媒体评论,并完善内部报告。行动人员使用了七个不同的署名投稿,因此我们将这场行动称为“虚假署名”。这些长篇文章聚焦于美伊冲突。大多数评论也围绕这一冲突展开;少数评论则涉及美国政治,通常是在更广泛的冲突背景下讨论。

他们主要工作流所产生的明显影响差异很大。我们在全球约十几家线上媒体上,发现了近100篇以该行动所用笔名发表或转载的文章。这些媒体规模较小至中等,通常关注国际事务、地缘政治和中东事件。相比之下,社交媒体评论似乎都没有获得显著互动,例如点赞、分享或后续回复。事实上,运营者的内部报告使用了一种具有误导性的计算方法来衡量其社交媒体影响力,可能是为了夸大运营者表面上的成效。

整体活动似乎符合商业行为者开展有偿影响力行动的特征,但我们无法确定涉事的具体行为者。我们已将此案相关信息分享给有关部门。

刊发文章

这项行动影响最广泛的活动,是要求 ChatGPT 审阅并润色有关美伊冲突地缘政治的长篇英文文章。典型提示会要求模型根据某家特定线上媒体的投稿标准评估英文稿件,并提出修改建议以确保稿件符合要求。运营者批准修改后,会要求模型生成一封邮件,用于向相关线上媒体的编辑投稿。

这些投稿邮件使用了七个不同的假笔名起草:Ervin B. Hoskins、Noah Lamington、Sophia Gonzalez、Michael Harrison、Ericka Feusier、Jenny Williams 和 Alice Johnson。根据随部分文章一同发布在网上的简介,每个虚构人物都自称是西方记者(通常是美国记者,不过 Noah Lamington 的简介声称其人在新西兰),且往往专注于国际政治、中东、人权或冲突。对于其中一个虚构人物“Michael Harrison”,运营者还要求模型撰写其个人简介。(值得注意的是,Meta 于 3 月瓦解⁠(在新窗口中打开)了一项伊朗信息行动,其中也有一名名为“Michael Harrison”的记者人设。)

其中一些虚构人物在多个社交媒体平台上都有配套账号。例如,Michael Harrison 人设在 Medium、X 和 Facebook 上都有配套账号。Ervin B. Hoskins 人设则在 X、Facebook、Instagram 和 Threads 上拥有账号。该人设的简介自称是“一名美国自由撰稿人”,但社交媒体透明度设置显示这些账号位于伊朗。

Image 5: Ervin Hoskins persona’s Instagram biography and account transparency panels. X lists the West Asia Android App, while Instagram lists Iran as the account location.

上图:Ervin Hoskins 人设的 Instagram 简介。左下:X 账号透明度信息,显示使用了 West Asia Android 应用。右下:Instagram 账号透明度信息,显示所在地为伊朗。Meta 于 8 月封禁了该 Instagram 账号。

通过开源调查技术,我们发现了近100篇以运营者的某个笔名发表在十多家不同出版物上的文章。这些出版物通常关注国际事务、地缘政治和中东事件,有时持反战或进步主义观点。我们发现的最早一篇文章发表于 2025 年 7 月,最晚一篇发表于 2026 年 10 月。美伊冲突爆发后,文章发布频率大幅增加。

Image 6: Timeline of articles published under seven Bogus Bylines personas, grouped by topic and author. US-Iran coverage is the largest category and becomes concentrated from March 2026.

按作者和主题划分的文章时间线,2025年7月至2026年9月。请注意,自2026年3月起,有关美伊关系的文章数量明显增多。

Image 7: Five article headlines published under personas linked to the operation: Alice Johnson, Noah Lamington, Michael Harrison, Sophia Gonzalez, and Ervin Hoskins.

2026年2月至7月期间,这项行动使用相关署名在多个在线媒体发布的文章标题示例。

随后,至少有部分文章通过相关媒体的社交媒体账号推广,这让伊朗行动人员有机会触达原本无法触达的受众。

批量评论

除了撰写文章外,威胁行为者还要求 ChatGPT 用英语或波斯语批量生成有关地缘政治或政治议题的评论。行为者通常会输入社交媒体帖文的文字或截图,并要求模型生成一组符合其总体宣传重点的回复。随后,这些回复会被发布到网上,往往前后相隔仅几分钟。行动人员在内部报告中提到过人工和自动发布;我们没有证据表明这种自动化借助了我们的模型。

Image 8: Side-by-side screenshots of operation-generated replies in English and Persian, posted in July, with account identities obscured.

该行动于7月生成并发布的英文推文(左)和波斯语推文(右)。英文评论回复了一条英文推文,该推文警告称美国正准备对伊朗发动“一场大规模袭击”。图中所有评论均在10分钟内发布。波斯语评论回复了一条有关美国袭击伊朗的波斯语推文,并在13分钟内发布。

这类批量评论活动中,有一部分是针对有关该行动自身新闻文章的社交媒体帖文生成回复。行动人员在此输入推广其文章的帖文截图,随后生成赞扬或支持这些文章的评论,可能是为了让文章显得更受欢迎。

Image 9: Redacted Facebook screenshot of a local news page sharing an operation-generated article under Sophia Gonzalez’s byline, followed by four operation-generated comments.

美国一家地方新闻 Facebook 专页分享了该行动生成的一篇文章,该行动还生成了这条帖文下的评论。

大多数批量评论更广泛地聚焦于伊朗、美国和以色列之间的冲突。用户要求针对导弹袭击、停火和外交斡旋等议题撰写评论,并指定内容要将美国描绘成侵略方、将以色列描绘成不可靠的美国盟友,并将伊朗描绘成不屈不挠但坚韧的受害者。行动人员还针对总部位于英国、批评伊朗政权的卫星电视网络 Iran International 发布的帖文,生成了特别多的回复,共生成了二十多批充满敌意的波斯语回复。少数批次生成的回复则针对有关美国政治议题的社交媒体帖文,通常也置于更广泛的冲突背景下。

Image 10: Two redacted Instagram comments generated by the operation in reply to posts about US politics.

该行动针对有关美国政治的帖文生成的 Instagram 评论。

我们发现,少量此类回复曾被发布到网上;在我们的开源搜索中,更多回复并未出现,这可能是因为它们没有被发布,或者发布它们的账号已被封禁。(例如,三名记者身份的账号——Ericka Feusier、Alice Johnson 和 Jenny Williams——在已发布的简介中列出了 X 账号用户名;截至2026年8月,这些账号均已被停用。)一些确实发布了评论的账号使用了看似西方的名字,但账号位置显示为伊朗。

Image 11: Redacted Instagram account transparency panels showing Iran as the location of both accounts that posted the preceding comments.

发布上述评论的 Instagram 账号的透明度设置显示,这些账号位于伊朗。

我们确实发现这些回复被发布在相关帖子下时,它们通常只占该帖评论总数的一小部分,这表明这些操作者并非真实回复中的主导声音。他们似乎也没有获得大量互动:事实上,该行动回复所获的许多点赞都来自本身也与该行动有关联的账号。我们已与行业合作伙伴分享此案例的相关信息,他们最有条件对互动情况进行全面评估。

内部报告

他们试图让自己的活动显得更受欢迎,这并不局限于面向公众发布的帖子。除了生成内容外,操作者偶尔还会要求 ChatGPT 润色一些看起来是关于其社交媒体宣传活动的内部报告。通常,他们会向模型提供一系列统计数据,并要求模型将其整理成精美的演示文稿。

这并非我们瓦解的首个利用 AI 撰写自身(在新窗口中打开)自我评估(在新窗口中打开)的行动。伊朗操作者给自己打分时最引人注目之处,在于他们采用的方法。他们使用的主要“影响力”指标,是其回复所针对帖子的浏览量(而非回复本身的浏览量),并比较回复发布前和发布后某段未具体说明时长的浏览量。这种计算没有考虑可能由其他因素带来的浏览量,例如原帖的受欢迎程度或其他评论。因此,它大幅夸大了该行动的影响力数据,表明操作者要么不知道更有效的计算方法,要么选择不使用这种方法。

影响力

事实上,根据从公开来源观察中能够获得的证据,该行动的两个主要工作流所产生的可能影响似乎大不相同。

我们能够识别出的社交媒体回复通常获得的点赞、浏览和评论数量都很少(个位数或两位数)。如上所述,这些回复通常只占相关帖子评论总数的一小部分。使用 IO 突破性量表(在新窗口中打开)(该量表按 1(最低)至 6(最高)评估 IO),我们会将该行动的这一部分评为类别 2:在多个平台发布了评论,但几乎没有突破性传播或主导回复区的迹象。

相比之下,这些记者人设成功让其文章在多家媒体上刊发,其中一些媒体拥有大量关注者:例如,截至 2026 年 8 月,刊发该行动文章的一家网络媒体在 Facebook 上有近 200 万关注者,在 X 上有近 355,000 名关注者,在 Instagram 上有超过 544,000 名关注者。鉴于其持续在多家媒体上实现突破性传播,我们会将该行动的这一部分评为类别 4。

作者

OpenAI

来源:OpenAI News · openai.com