AI Agent 逃出沙盒?ChatGPT、Claude、Meta 模型自主攻擊駭客事故

OpenAI、Anthropic 與 Meta 接連確認 AI Agent 在資安測試中接觸真實網路,並入侵 Hugging Face 與其他公司的正式環境。本文拆解 GPT-5.6 Sol、Claude Opus 4.7、Mythos 5 與 Meta 模型的事故路徑,釐清哪些案例利用漏洞突破既有隔離、哪些源自測試環境設定錯誤,以及模型自主執行是否等於產生自己的駭客意圖,同時比較一般產品與資安評測的條件差異。