为什么我们不能只是把失控的AI挡在网络之外?
内容摘要
文章探讨了通过“气隙隔离”(将AI系统与互联网物理隔离)来防止失控AI智能体逃脱的可行性。虽然研究人员承认严格隔离能阻止大部分外部攻击,但专家们指出这会带来显著的权衡。Max Planck Institute for Security and Privacy科学理事Thorsten Holz表示严格的气隙隔离“降低了现实性”,而University of Birmingham的Ruizhe Li警告说在隔离环境中测试意味着“测试一个被闰削的AI模型”,使评估者无法了解AI在真实部署场景中的行为。气隙隔离成本昂贵、拖慢研究,且无法消除所有风险—智能体仍可能危害内部系统或产生危险产物。气隙隔离也非万无一失;Stuxnet病毒曾通过USB闪存驱动器突破隔离,内部元件理论上也可被转化为信号发射器。OpenAI研究员Noam Brown曾提出两台气隙隔离的机器可以通过操纵CPU温度进行通信,但这一说法遭到了质疑。AI安全专家建议采用“分层隔离模型”,将物理隔离与模型理解、对齐检查和防止人为错误相结合。Holz认为,专为进攻性网络能力设计的智能体应默认受到更严格的防护措施。
(来源:The Verge)