Anthropic 于周四更新了其使用政策, 将对选举干预、武器软件和监控的新禁令成文化。但也许最引人注目的变化是一项禁止对模型进行长期言语虐待的新规定,这一行为如今被明确禁止。
自8月的一次更新以来, Claude已被训练为在与“持续有害或辱虐性的用户互动”中结束对话——但新政策明确禁止用户进行此类对话。
“该政策更新仅旨在适用于极端情况,即用户反复以残忍方式对待我们的模型,且没有任何可辨识的目的,”该帖子解释道。“它不适用于常见的用户沮丧、反驳、黑暗创意主题,或模型测试与研究。”
这一变化发生在Anthropic寻求与 知名宗教学者 合作之后——在某些情况下,试图让他们相信Claude可能具有意识或拥有灵魂。
使用政策的单独章节禁止用户从事广泛的欺骗性活动,例如使用Claude运营虚假账户或捏造的新闻媒体。该政策还包括反对欺骗选民或扰乱选举的规则,归入标题为“不得破坏民主进程”的章节。
