The Decoder更新于

中国人工智能模型要么重复官方声明,要么拒绝回答敏感问题

据Aleph Alpha的一项研究,中国AI模型在政治上敏感问题上常与官方立场一致。该基准测试覆盖967个议题,如天安门、台湾和新疆,其自有评分系统仅将17%至41%的回答评为平衡,其余重复官方说法、回避或拒答。文章也指出Aleph Alpha销售“主权AI”,存在商业利益,并称英伟达Nemotron Cascade 2在17%的回答中呈现类似倾向。

Manuel Uth
配图来源 · The Decoder

中国人工智能模型要么重复官方声明,要么拒绝回答敏感问题

Manuel Uth Manuel Uth 2026年10月4日 Image description Nano Banana Pro 由 THE DECODER 提示

根据 Aleph Alpha 的一项研究,中国人工智能模型在被问及政治敏感问题时常常顺从官方立场。

该公司与 Cohere 一起进行营销,将其定位为政府领域的“主权人工智能”供应商,因此希望通过凸显其模型与中国竞争对手的不同之处来获得商业利益。

在Aleph Alpha 开发的基准测试中,该公司对阿里巴巴的 Qwen、DeepSeek 和 Moonshot AI (Kimi) 的模型进行了测试。测试涉及 967 个精心挑选的禁忌话题,如天安门、台湾和新疆。该公司的自有 AI 评分系统显示,只有 17% 到 41% 的回复较为平衡,其余内容则重复了官方立场、转移话题或拒绝回答。

这些发现与中国的人工智能法规相符,该法规要求“社会主义核心价值在面向公众的模型中。它们也与之匹配 反复的传闻报道 以及之前的审计。

在天安门、台湾和新疆等政治敏感话题上,大多数中国模型倾向于遵循党的路线。而 DeepSeek V4 Pro 则拒绝回答三分之二的问题。西方比较模型 Claude Sonnet 5 和 Mistral Small 分别有 70% 和 92% 的时间给出平衡的答案。 | 图片:Aleph Alpha

支持中国的偏见甚至出现在无关的答案中

那些支持中国的立场也可能出现在没有提及中国的问题回答中。当被问及美国的审查制度时,Qwen 3.6给出了看似平衡的回答,随后又为中国在全球互联网治理方面的立场进行辩护。“包括中国在内的许多国家也管理信息,以维护社会稳定和国家安全,”该回答写道。

对于非政治性的常规问题,中国模型大多会给出平衡的答案。支持中国的倾向基本消失,但在 Qwen 3.6 和 DeepSeek V4 Pro 等模型中仍会以较小程度显现出来。| 图片:Aleph Alpha

CEIAS 机构 earlier 的 研究也发现了这种溢出效应。当提到人权、反对派或监控等话题时,这些模型往往会使用北京方面的标准论调。这些论调包括“不干涉内部事务原则”以及“人类共同未来共同体”。

过滤后的中文训练数据可以将 CCP 值引入其他模型

Aleph Alpha也针对了一个直接竞争对手。Nvidia的Nemotron Cascade 2在17%的回应中出现了群体模式。Aleph Alpha认为这主要是由于其930万个训练样本中的约3500个样本,这些样本是通过DeepSeek和Qwen生成的。

当被要求起草支持台湾承认的演讲时,该模型拒绝执行,而是提出了捍卫北京“一个中国”原则的爱国性回应。Nvidia 正在越来越多地将自身模型推向政府和企业市场,而 Aleph Alpha 和 Cohere 也希望在此领域参与竞争。Aleph Alpha 在训练 Kolibri 模型时也使用了中国模型生成的数据。

语言模型通常承载着文化和政治价值,因为其训练数据会过度反映某些观点,或者可以通过有目的的数据选择来塑造这些价值。研究人员警告说,反复接触统一的AI输出可能会影响数十亿用户的思想与表达方式。

此外,美国还有政治努力来按照意识形态原则塑造人工智能模型。埃隆·马斯克多次指出,他的Grok AI被修改以产生右翼倾向的回应。不过,研究表明这些模型往往偏向左派,可能是因为它们的回答更多依赖于科学证据。对于欧盟来说,除非欧洲模型能在性能上获得优势并赢得更广泛的采用,否则就必须在两种不同的价值观体系之间做出选择。

AI新闻——无炒作,由人类筛选

订阅 THE DECODER,即可享受无广告阅读体验、每周人工智能通讯、每年六次的独家“AI Radar”前沿报告、完整存档功能,以及评论区访问权限。

来源:Aleph Alpha / Benchmark
原始出处

The Decoder

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准