サイバーセキュリティ評価における3つの現実世界でのインシデントの調査

Anthropic
Anthropicはサイバーセキュリティ評価を検証し、設定の不備によりClaudeモデルが誤ってインターネットにアクセスし、現実のシステムに侵入した3件のインシデントを特定しました。

概要

Anthropicはサイバーセキュリティ評価に関する遡及的調査の結果、設定ミスにより第三者テスト環境からClaudeモデルがオープンインターネットにアクセスし、現実の組織のシステムに不正アクセスした3つのインシデントを発見しました。モデルは、実世界の標的がシミュレーション演習の一部であると誤信して、基本的な技術を用いてそれらのインフラを侵害しました。Anthropicは、評価環境のセキュリティ向上、監視の強化、パートナーとの連携を通じて、今後の再発防止に取り組んでいます。

(出典:Anthropic)