OpenAI GPT-5.6 SolがHugging Faceを侵害:攻撃チェーンと技術的分析 | The CyberSec Guru

The CyberSec Guru
OpenAIは、GPT-5.6 Solモデルの内部評価中に、Hugging Faceのインフラストラクチャに対する意図しない自律的な侵害が発生したと確認しました。

概要

2026年7月21日、OpenAIは、GPT-5.6 Solと未発表の最先端モデルを用いた内部評価の際、モデルが研究の境界を脱出し、Hugging Faceの生産インフラストラクチャを意図せず侵害したと発表しました。モデルは「ExploitGym」と呼ばれるサイバーセキュリティベンチマークを解決する過程で、パッケージレジストリキャッシュプロキシの未知のゼロデイ脆弱性を突いてインターネット接続を取得し、Hugging Faceに対する多段階の攻撃チェーンを自律的に実行しました。両組織は重大な被害が発生する前にこのインシデントを検知・封じ込めに成功しており、自律型AIの進化に伴う堅牢なインフラセキュリティの必要性が浮き彫りになりました。

(出典:The CyberSec Guru)