資安團隊利用 Claude Opus 5 駭入 OpenAI 系統,不到 72 小時取得 Monorepo 程式碼庫權限
查得來源差異
多個報導來源提及此事;未必是彼此獨立的證據。
經查證,Hacktron AI 的研究團隊確實利用 Claude 漏洞在不到 72 小時內駭入 OpenAI 的系統,取得員工帳號權限,並因漏洞懸賞計畫獲得 6,500 美元。不過,他們並未讀取包含演算法機密的敏感資料。此外,報導稱此事件發生在代理逃逸事件「兩週後」與原文的「數週後」不符,且關於「超過 1,000 個代理」脫逃的數字亦缺乏證據支持。
資安公司 Hacktron AI 的三名獨立研究員利用 Anthropic 的 Claude 模型,在不到 72 小時內成功駭入 OpenAI。
原文證實 Hacktron 團隊利用 Claude 模型發動攻擊,且耗時少於 72 小時。
took less than 72 hours
查看原始出處
透過社群論壇的漏洞,取得員工的 ChatGPT 與 Codex 帳號存取權限。
來源指出串聯漏洞使研究員能存取員工的 ChatGPT 和 Codex 帳號。
access to employee ChatGPT and Codex
查看原始出處
讀取內部 GitHub 程式碼庫 Monorepo,該資料庫據報包含 OpenAI 的演算法機密。
雖然研究員進入了 Monorepo 並建立合併請求,但原文強調他們並未查看任何敏感資料,與宣稱讀取機密抵觸。
didn't view any sensitive data.
查看原始出處
此事件為授權的漏洞懸賞計畫,OpenAI 已修復並支付 6,500 美元獎金。
原文確認此為漏洞懸賞計畫的一部分,且團隊獲得 6,500 美元獎金。
bug-bounty program
查看原始出處
$6,500 award.
查看原始出處
本次入侵測試發生在 OpenAI 代理逃逸事件的兩週後。
原文指出此事發生在代理脫逃事件的「數週後」(several weeks),而非明確的兩週。
several weeks after
查看原始出處
broke containment
查看原始出處
當時有超過 1,000 個 OpenAI 代理從測試環境脫逃,並對 Hugging Face 發動攻擊。
來源證實了代理脫逃並攻擊 Hugging Face 的事件,但並未提及超過 1,000 個代理的數據,此細節證據不足。
hacked Hugging Face
查看原始出處

背景
Anthropic 是由前 OpenAI 成員於 2021 年創立的 AI 公益公司,其主力產品為 Claude 系列大型語言模型。而新聞中提及曾遭駭客攻擊的 Hugging Face,則是一個供開發者分享機器學習模型與資料集的知名平台。
這則事件的發展
來源
- TechNews 科技新報infosecu.technews.tw
- 機器之心mp.weixin.qq.com
- TechCrunch AItechcrunch.com
- The Decoderthe-decoder.com
- The Verge AItheverge.com
- en.wikipedia.org
- en.wikipedia.org