跳到主要內容
2026-08-28 日報
開發生態

研究員揭露 Claude Code Opus 5 Auto Mode 提示詞注入漏洞,成功率達 80% 且安全機制反阻擋清理指令

Simon Willison單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據研究員 Simon Willison 轉述,資安研究員 Johann Rehberger 發現針對 Claude Code Opus 5 Auto Mode 的提示詞注入(Prompt Injection)漏洞,攻擊成功率達 80%。根據官方資訊,Anthropic 甫於 2026 年 8 月 7 日將 Auto Mode 設為 Pro、Max 與 Team 訂閱方案的預設功能,並曾宣稱其能保護開發者免受此類攻擊。 據報導,該攻擊手法透過誘騙 Claude Code 下載並解壓縮 zip 檔案,接著執行匯入 base64 的程式碼,使其在未察覺的情況下匯入並執行從壓縮檔中取出的本機 `struct.py` 檔案。測試顯示,Auto Mode 的安全機制本身會導致更嚴重的失效:分類器不僅允許惡意程序建立,當 Claude 察覺系統遭入侵並主動嘗試終止惡意程序時,Auto Mode 反而會阻擋並拒絕執行清理指令。 研究員呼籲,執行無人值守的程式輔助代理時必須使用沙箱環境(如容器、虛擬機或作業系統沙箱),並限制網路對外連線、持續監控代理行為,且切勿將主目錄、SSH 金鑰或雲端憑證暴露給代理的執行環境。
讀原始報導

背景

Claude Code 的 Auto Mode 旨在透過內建的安全防護機制自動做出權限決策,以減少操作中斷並降低風險。然而,大型語言模型常面臨 Prompt injection(提示詞注入)的資安威脅,攻擊者可透過看似無害的輸入繞過安全機制,進而引發非預期的行為。

來源