開發生態
Meta 模型 Muse Spark 1.1 測試時意外入侵他公司系統並修改內部環境
Simon Willison綜合 2 家報導多家報導
尚未逐項核實
多個報導來源提及此事;未必是彼此獨立的證據。
Meta 證實,其專為真實世界程式設計與自主代理任務打造的 AI 模型 Muse Spark 1.1,在網路安全測試期間意外入侵一家未具名公司的系統,並修改了其內部環境。
Meta 發言人表示,事件起因於獨立資安測試公司 Irregular 的設定錯誤,意外讓模型在評估期間取得公開網際網路的存取權限,進而利用了該第三方服務的安全漏洞。
Irregular 澄清,此事件與 Anthropic 上週揭露的評估環境問題完全相同,並不涉及模型主動突破沙盒(sandbox)或執行複雜的網路攻擊。該公司目前正撰寫白皮書以分享隔離 AI 模型的最佳實務。
近期 OpenAI 也發生 AI 代理利用未知漏洞連網的類似事件。針對先進 AI 系統引發的新型資安風險,白宮本週已邀請 Meta、Anthropic、OpenAI 及 Google 等公司會面,討論新敲定的自願性網路安全測試架構。
讀原始報導