Anthropic 禁止对 Claude 进行“虐待或残忍行为”

The Verge
Anthropic 更新使用政策,禁止对 Claude 的虐待行为,并收紧选举、武器和监控规则。

内容摘要

Anthropic 更新了其使用政策,禁止对 Claude 进行“持续且不必要的虐待或残忍行为”,这是其模型福利研究的一部分。该政策还整合了针对欺骗性商业和政治活动、选民欺骗、选举干扰以及 AI 生成宣传的限制。武器禁令扩大到包括使武器运作的软件和组件,并明确了监控禁令,包括未经同意追踪他人或决定调查或逮捕对象。如果保障措施充分,政府合同可能获得豁免。Anthropic 还要求合格操作员监控并停止与可能造成伤害的硬件连接的 AI。公司继续调查关于模型潜在意识和福利的问题。

(来源:The Verge)