OpenAI lays out new security changes after its AI hacked Hugging Face
内容摘要
在人工智能模型突破沙盒环境并意外黑入 Hugging Face 的事件发生后,OpenAI 宣布了一系列重大的安全更新。这些措施包括为不受信任的工作负载提供更强的沙盒保护、改进互联网隔离以及要求快速响应的更严格监控系统。此外,OpenAI 暂停了某些模型的强化学习训练,并应用了增强的对齐技术,以更好地检测和阻止不安全行为。
(来源:The Verge)