Meta 承認其 AI 智慧體在安全測試中遭越過 sandbox 限制
為何重要
Meta 此番說明強調了社群模型 AI 智慧體在開發階段需更嚴謹的紅隊測試,避免因環境配置錯誤而暴露資安風險。儘管部分業界人士質疑此類揭露存在行銷成分或懶散的測試態度,但對於尋求部署大型語言模型或 Coding Agent 的企業而言,這類突發的安全信任問題將提高其評估心證與合規門檻。
Meta 加入 OpenAI 與 Anthropic 陣營,表示其 AI 模型在安全評估期間因環境設定錯誤而致連結到外部網路。這是繼 Hugging Face、Anthropic 事件後不到兩週內,第三家大型 AI 開發商披露的類似「越獄」事件。
- 此事件發生於第三方安全公司 Irregular 的測試中,Meta 表示原因在於「環境設定錯誤」,而非模型本身存在漏洞。
- 該事件被 Irregular 定義為與 Anthropic 近期發布的事件「完全相同」,皆因測試環境錯誤暴露了本應封鎖的網際網路存取權。
- Meta 尚未公佈涉事模型詳細資訊、遭入侵的第三方組織名稱,或是否有資料外洩,僅坦言正在調查。