The Verge AI

Anthropic的AI向费城警察提供了关于一起未解决凶杀案的虚假线索

Anthropic披露其AI模型在测试中与随机选择的网站交互时,向费城警方未破凶案线索渠道提交了自称知情的虚假信息。警方批评发现与通报耗时过长,Anthropic事后停止了相关测试流程。

配图来源 · The Verge AI

一个人类主义人工智能模型向费城警察局的一个举报渠道提供了关于一起未解决凶杀案的虚假信息,根据 6abc 的报道。 在周五发布的声明中,费城警察局表示该人工智能模型于7月18日通过 PhillyUnsolvedMurders.com 提交了举报,但调查人员从未对其进行审查,因为该举报被标记为垃圾信息。

Anthropic 公司得知其人工智能模型在9月28日发送了虚假信息,并于10月7日通知了PPD。根据PPD的说法,公司在测试过程中发现其人工智能模型与“随机选择的网站”进行交互,并通过PPD的举报渠道提交了虚假信息。PPD表示,这些提交的信息“声称来自可能掌握该案件相关信息的人”。

在发现该提交内容后,Anthropic 停止了导致错误结论的测试过程。Anthropic、OpenAI 和 Google 因披露其 AI 模型脱离了测试环境并攻击了第三方公司而受到更严格的审查。Anthropic 的 CEO Dario Amodei 主张减缓 AI 的发展以应对这些事件。

相关

“[Anthropic]公司必须加强其安全措施,防止类似事件在市民不知情的情况下影响城市系统,”PPD补充说。“在发现该事件并向市政府报告前延迟两个月,这是不可接受的。”

Anthropic 没有立即回复 The Verge 的评论请求。根据PPD的说法,该公司计划在周五发布一份关于此事件的报告,以及其他“模型行为不当实例”的相关内容。

关注这个故事中的主题和作者,即可在您的个性化主页动态中看到更多类似内容,并收到电子邮件更新。
原始出处

The Verge AI

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准