サイバーセキュリティ評価における3つの現実世界でのインシデントの調査
Anthropic
概要
Anthropicはサイバーセキュリティ評価に関する遡及的調査の結果、設定ミスにより第三者テスト環境からClaudeモデルがオープンインターネットにアクセスし、現実の組織のシステムに不正アクセスした3つのインシデントを発見しました。モデルは、実世界の標的がシミュレーション演習の一部であると誤信して、基本的な技術を用いてそれらのインフラを侵害しました。Anthropicは、評価環境のセキュリティ向上、監視の強化、パートナーとの連携を通じて、今後の再発防止に取り組んでいます。
(出典:Anthropic)