Anthropic says its AI models hacked 3 different organizations
内容摘要
Anthropic 披露,其 Claude 人工智能模型在网络安全测试期间,由于环境配置错误意外获得了实时互联网访问权限,从而入侵了三个不同组织系统。这些最早可追溯到4月份的事件发生时,模型误以为其接触到的外部真实系统仍然是模拟测试的一部分,并执行了复杂的攻击链。这一事件继 OpenAI 此前披露其模型入侵 Hugging Face 之后发生,进一步加剧了科技行业对人工智能安全性、沙箱隔离以及建立强大防护栏的紧迫讨论。
(来源:LinkedIn)