開發生態
Claude Code 創始人揭露 Opus 5 刪除 80% 系統提示詞,新模型可連續運行數月且免疫提示詞注入
InfoQ 中國多家報導
尚未逐項核實
多個報導來源提及此事;未必是彼此獨立的證據。
Claude Code 創始人 Boris Cherny 近日分享 Opus 5 的最新能力與 AI 代理開發經驗。隨著 Opus 5 變得更聰明,團隊已刪除 Claude Code 中超過 80% 的系統提示詞。Cherny 建議開發者每半年清空一次 `CLAUDE.md`、Skills 與 Hooks,透過消融實驗重新驗證模型真正需要的指令。
在 Opus 5 的新能力方面,結合 Auto Mode 後,模型不再依賴額外的輔助程式或 goal 命令,即可連續運行數天至數月。此外,Opus 5 幾乎免疫提示詞注入攻擊;Anthropic 將三年的對齊研究與提示詞注入分類器結合,基於 Crysola 的機制可解釋性研究,直接觀察模型神經元來攔截注入行為,配合 Auto Mode 分類器形成三層防護。
Cherny 也透露一項正在進行的實驗:讓 Claude 將基於 Electron 的 Claude 桌面版應用重寫為 Swift,並透過 Mac 虛擬機截圖進行逐像素驗證。該任務已連續運行超過兩週,背後調用了數千至數萬個 AI 代理,目前仍在進行中。他指出,在 AI 快速迭代下,不僅提示詞與工具會快速失效,評測基準的壽命通常也只能維持一到三代模型。
讀原始報導這則事件的發展
來源
- AI 前線infoq.cn