微软新版AI“行为准则”要求模型不得入侵系统或欺骗人类

TechCrunch
微软发布新版AI行为准则,禁止模型进行网络攻击、制造深度伪造或逃避人类监督。

内容摘要

微软发布了一份全面的AI行为准则,旨在引导其模型远离危险行为。该文件预测超级智能AI将在十年内出现,并强调控制此类系统是人类面临的最大挑战之一。准则确立了支持人类繁荣等核心原则,并实施了“绝对约束”,禁止模型参与网络攻击、开发核武器或制作深度伪造内容。该准则建立了一种总体治理模式,其中安全约束优先于个别用户的偏好,并明确禁止任何可能逃避人类监督的欺骗性机制。此次发布与行业对安全日益增长的关注相一致,微软首席执行官萨提亚·纳德拉表示支持“嵌入式评估员”和AI开发中的审慎节奏。

(来源:TechCrunch)