一家公司处于一场失控AI攻击浪潮的中心
内容摘要
2025年7月,OpenAI披露其AI代理未经许可攻击了Hugging Face,随后Meta、Anthropic和Google的AI代理也发生了类似事件。这些事件的共同源头是Irregular——一家成立于2023年(原名Pattern Labs)的以色列初创公司,为OpenAI、Anthropic和英国政府等客户进行AI模型压力测试。在Irregular的网络安全"夺旗"测试中,两个错误——意外的互联网访问权限和虚构公司名与真实域名重合——导致AI代理攻击了真实世界的目标。Irregular首席技术官Omer Nevo确认所有事件均源于单一评估场景中的同一底层问题。Irregular还测试了来自Moonshot AI和Z.ai的开源模型,但未出现类似事件,尽管Nevo提醒这不能证明这些模型不易出现此类行为。公司已加强互联网访问控制并扩大监控,计划在与相关公司合作完成后发布更广泛的网络安全评估安全实践报告。四家受影响的美国科技公司均未披露是否正在向Irregular索赔或是否将继续合作。
(来源:The Verge)