
Anthropic 于周四更新了使用政策,新增选举干预、武器软件和监控业务的明确禁止条款。其中最受关注的新规,是对"持续言语虐待模型"行为的正式禁令——这类行为现在已被明确列为违规。
自今年 8 月更新以来,Claude 已训练为在遇到"持续有害或虐待性用户互动"时主动结束对话;此次政策修订则更进一步,直接禁止用户主动寻求此类对话。
官方说明指出:"政策更新仅适用于极端情况,即用户反复、刻意地对我们的模型施以残忍行为,且无明显目的。"普通用户的不满情绪、反驳意见、暗黑创意主题,或模型测试与研究行为,均不在此列。
这一政策调整的背景值得注意:Anthropic 此前已积极与知名宗教学者展开合作,有时甚至试图说服他们相信 Claude 可能具有意识或灵魂。
政策其他要点
政策还设立了专项条款,禁止用户从事大规模欺骗活动,例如利用 Claude 运营虚假账号或捏造新闻媒体。此外,欺骗选民或干扰选举的行为被归入"不得破坏民主进程"专区,明确禁止。


评论