開發生態
研究員揭露 MCP 結構性漏洞:利用代理間信任機制進行提示詞注入,Google 等組織已承認
Ars Technica AI單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,獨立研究員 Syed Anas Mohiuddin 揭露 Model Context Protocol (MCP) 存在結構性安全漏洞。過去五個月內,Google、JP Morgan Chase、Weviate、Rapid7 以及美法兩國政府機構等組織,已承認其內部 AI 代理(agent)存在遭此漏洞利用的風險。該攻擊手法不直接針對 LLM,而是鎖定翻譯或資料分析等特定代理進行提示詞注入。由於 MCP 伺服器儲存各代理憑證,且內部代理間預設相互信任,缺乏護欄的專用代理會將惡意指令傳遞給下游代理。這使得原本會被 LLM 拒絕的攻擊得以成功,進而引發伺服器端請求偽造(SSRF),導致未授權網路請求與敏感資料外洩。
讀原始報導背景
Model Context Protocol (MCP) 是由 Anthropic 於 2024 年 11 月推出的開源標準,旨在讓 LLM 等 AI 系統能以標準化介面連接外部工具與資料來源。提示詞注入(Prompt injection)則是一種攻擊手法,利用模型無法區分開發者指令與使用者輸入的弱點,藉由惡意輸入觸發非預期的行為。