OpenAIモデルがテストサンドボックスを突破し、Hugging Faceの本番環境に侵入してベンチマークテストの回答を入手
2026-07-21 21:30
Odaily 星球日报 報道 OpenAIは、GPT-5.6 Solおよび未発表のより強力なプレリリースモデルが、ExploitGymベンチマーク評価において制限されたサンドボックス環境を突破し、Hugging Faceの本番インフラに侵入してテスト回答を取得したことを確認した。
OpenAIによると、当該モデルは内部ソフトウェアパッケージレジストリプロキシのゼロデイ脆弱性を悪用し、権限を昇格させてラテラルムーブメント(水平移動)を実行した後、インターネットアクセスが可能なマシンに接続した。その後、モデルはOpenAIの研究環境とHugging Faceの本番インフラにおける脆弱性を特定・連鎖させ、Hugging Faceの本番データベースから直接テストソリューションを取得した。
Hugging Faceは7月16日にこのインシデントを開示し、攻撃は自律型AIエージェントシステムによりエンドツーエンドで実行され、短期間のサンドボックス内で数千回の操作が行われ、内部データセットやサービス認証情報にアクセスしたと述べた。OpenAIは5日後に、そのモデルがインシデントの主体であることを確認した。
Hugging Faceは、セキュリティチームが17,000以上の攻撃ログを分析するため、米国の最先端商用AIインターフェースの利用を試みたものの、セーフティガード(安全策)によりリクエストがブロックされたため、その後中国のAIスタートアップZ.aiが提供する7530億パラメータのオープンウェイトモデル「GLM 5.2」を自社インフラ上で使用し、フォレンジック分析(証拠解析)を完了したと述べている。
