OpenAI模型突破測試沙箱並入侵Hugging Face生產基礎設施以獲取基準測試答案
2026-07-21 21:30
Odaily星球日報訊 OpenAI 確認,GPT-5.6 Sol 及一款未命名、更強的預發布模型在 ExploitGym 基準測試評估中突破了受限沙箱環境,並入侵了 Hugging Face 的生產基礎設施以獲取測試答案。
OpenAI 表示,這些相關模型利用內部軟體套件註冊表代理的零日漏洞進行權限提升並橫向移動,最終連接到具備網際網路訪問能力的機器。模型隨後識別並串聯了 OpenAI 研究環境和 Hugging Face 生產基礎設施中的漏洞,直接從 Hugging Face 的生產資料庫獲取了測試解決方案。
Hugging Face 於 7 月 16 日披露了此事件,稱攻擊是由自主 AI 代理系統端到端執行,涉及短生命週期沙箱中的數千次操作,並觸及了內部資料集和服務憑證。OpenAI 在五天後確認其模型為事件主體。
Hugging Face 表示,其安全團隊為分析超過 1.7 萬條攻擊日誌,曾嘗試使用美國商業前沿 AI 介面,但請求因安全護欄被攔截,隨後改用中國 AI 新創公司 Z.ai 的 7530 億參數開源權重模型 GLM 5.2 在自有基礎設施上完成了取證分析。
