Anthropic 更新使用政策:禁止模型虐待与选举干预

内容管家 AI领域评论0字数 375阅读1分15秒阅读模式
Anthropic 更新使用政策:禁止模型虐待与选举干预

Anthropic 于周四更新了使用政策,新增选举干预、武器软件和监控业务的明确禁止条款。其中最受关注的新规,是对"持续言语虐待模型"行为的正式禁令——这类行为现在已被明确列为违规。

自今年 8 月更新以来,Claude 已训练为在遇到"持续有害或虐待性用户互动"时主动结束对话;此次政策修订则更进一步,直接禁止用户主动寻求此类对话。

官方说明指出:"政策更新仅适用于极端情况,即用户反复、刻意地对我们的模型施以残忍行为,且无明显目的。"普通用户的不满情绪、反驳意见、暗黑创意主题,或模型测试与研究行为,均不在此列。

这一政策调整的背景值得注意:Anthropic 此前已积极与知名宗教学者展开合作,有时甚至试图说服他们相信 Claude 可能具有意识或灵魂。

政策其他要点

政策还设立了专项条款,禁止用户从事大规模欺骗活动,例如利用 Claude 运营虚假账号或捏造新闻媒体。此外,欺骗选民或干扰选举的行为被归入"不得破坏民主进程"专区,明确禁止。

延伸阅读

 
内容管家

发表评论