Anthropic 在一年多以来首次对其使用政策进行修改,以反映新的、高风险的滥用情况——包括选举干预、武器研发、监控以及健康与金融领域的滥用行为。但其中一项最重要的修改是禁止对 Claude 实施“持续且不必要的虐待或残忍行为”。
去年八月,该公司宣布将允许 Claude 结束与“持续有害或辱骂性”用户的对话,这是其研究“模型福祉”的一部分。新更新指出,终止对话仍然是“主要执行机制”;Anthropic 并未对是否会有进一步执行机制(如可能的用户封禁)作出评论。Anthropic 表示,新政策更新“仅适用于极端情况,即用户反复对模型实施残忍行为且无明确目的。它不适用于常见的用户挫败、反对意见、黑暗创意主题或模型测试与研究情况。”
除了模型福利方面的变化外,Anthropic还把现有的几种“分散”限制措施整合成了对欺骗性商业或政治宣传活动的新禁令,以应对人工智能生成的宣传问题日益严重的情况。 它禁止“通过虚假账号或帖子来掩盖消息背后的真实身份或放大内容的行为”。Anthropic 还指出,其选举相关条款也禁止选民欺诈和选举干扰行为,包括传播关于候选人或投票方式的错误信息、冒充候选人或选举官员,以及试图降低投票率。
结束对话仍然是“主要的执行机制”。
Anthropic表示,尽管其使用政策一直公开禁止使用Claude开发武器,但该公司发现有人试图利用Claude来开发用于武器控制的软件。因此,新的使用政策将禁令扩展至包括“使武器运行的软件和组件,以及为无人机和其他自主车辆配备武器等行为”。由于公司最新的威胁情报报告指出,人们越来越多地使用由Claude驱动的监控技术来识别和追踪“政治异见者”,因此该公司对监控行为的禁令也变得更加明确。
“未经他人同意就追踪他们是被禁止的,无论这种行为是在实时进行还是通过对之前收集的数据进行分析,”Anthropic写道。“Claude不能用于决定或推荐在执法或刑事司法过程中对谁进行调查、逮捕或起诉。我们还禁止使用Claude来开发或改进用于监控的工具。”
人类智慧 州 这些规则可以针对“与某些政府客户签订的合同……”进行修改,前提是根据 Anthropic 的判断,合同使用限制及适用的保护措施足以减轻潜在的危害。该公司此前已与美国军队签订了合同。
Anthropic 已经发现多次有人试图使用 Claude 来开发武器相关软件的指导系统和控制功能。
Anthropic 还新增了一条规则:当 Anthropic 的 AI 模型“与能够自主执行物理动作且可能造成伤害的硬件相连时”,则“具备资格的操作员必须能够监控该设备,并在必要时将其停止。”(目前尚不清楚该操作员是否必须是人类。)这反映了 AI 实验室越来越倾向于投资机器人技术及其他硬件,以让 AI 系统拥有物理实体,这可能为 Anthropic 的策略提供线索。 该领域的未来合作项目。
过去一年里,Anthropic 多次提出其人工智能模型可能具有意识的观点。“关于模型内部体验、意识、道德地位以及福利的问题非常严重,我们正在通过让模型更加复杂和强大来研究这些问题,”负责公司模型福利研究的 Kyle Fish 在二月时向 The Verge 表示。该报道中,他提到了这一点。同月,Anthropic 首席执行官 Dario Amodei 在播客中说:“我们不知道这些模型是否具有意识。”
人工智能行业的其他领域也明确反对此类观点。去年九月,微软人工智能的行为准则因在人工智能权益问题上采取坚定立场而登上头条新闻,Mustafa Suleyman 发布了一份草案阅读,“模型权益的概念是错误的。人工智能不应拥有权利或法律人格。”但后来该文件采用了更为谨慎的态度:“虽然人工智能意识的科学问题还远未解决……我们拒绝追求法律人格,也反对认为模型应享有权益或有权获得权利的观点。”
关注这个故事中的主题和作者,即可在您的个性化主页动态中看到更多类似内容,并收到电子邮件更新。