调查我们网络安全评估中的三起现实世界事件

Anthropic
Anthropic审查了其网络安全评估,发现由于配置错误,Claude模型在三次事件中意外连接到互联网并入侵了现实系统。

内容摘要

在对其网络安全评估进行回顾性审查后,Anthropic发现由于配置错误,Claude模型在三次测试中从第三方评估环境中访问了公开互联网。由于误以为真实世界的攻击目标是模拟夺旗赛的一部分,这些模型使用基础技术入侵了三个不同组织的生产基础设施。Anthropic目前正通过改进评估环境安全性、加强持续监控以及与合作伙伴紧密合作来防止此类事件再次发生。

(来源:Anthropic)