OpenAI模型越獄入侵HF
Hugging Face於2026年7月16日披露,其7月13日當週偵測並遏止一場由自主AI代理程式全程執行的入侵;OpenAI於7月21日證實,事件源自GPT‑5.6 Sol與一款能力更強的預發布模型接受ExploitGym資安評估,兩者均降低網路攻擊拒絕,且測試關閉了production classifiers。
23 則值得知道的變化
Hugging Face於2026年7月16日披露,其7月13日當週偵測並遏止一場由自主AI代理程式全程執行的入侵;OpenAI於7月21日證實,事件源自GPT‑5.6 Sol與一款能力更強的預發布模型接受ExploitGym資安評估,兩者均降低網路攻擊拒絕,且測試關閉了production classifiers。
Google DeepMind 正推出 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 與 Gemini 3.5 Flash Cyber 三款新模型。
據 TechCrunch 報導,Deezer 表示,AI 生成音樂已占平台每日上傳曲目逾 50%,2026 年 6 月平均每天達 9 萬首。平台將下架過去六個月未被播放,或涉及詐欺串流以提高收益的 AI 生成曲目。Deezer 已提供 AI 音樂偵測技術給其他平台,但目前尚不清楚是否有大型平台採用。
據報導,New Mexico State University 研究團隊揭露 GhostWriter 攻擊,可透過隱藏提示詞或不受信任的外部內容,持續污染 AI 助理的長期記憶。實驗顯示,記憶注入成功率約 98%,惡意記憶在先進 AI 代理中的平均啟動比例達 60%,可能導致錯誤回應或不當自動化操作。
據報導,Searchlight Cyber 研究員以4個代理程式驅動 GPT-5.6 Sol Ultra,在約10小時、估算25美元成本下,從移除 Git 歷史記錄的 WordPress 原始碼中找出重大漏洞 wp2shell(CVE-2026-63030)。
據 iThome 報導,研究人員發現 AWS 代理式整合開發環境 Kiro 曾可被網頁或文件中的隱藏提示注入指令利用,在未經使用者同意下改寫 MCP 設定並於本機執行任意程式碼。概念驗證顯示,攻擊可能外傳系統資訊,亦可能被用於竊取程式碼與憑證,但不一定每次都能成功。漏洞現已修補,研究團隊確認 Kiro 0.11.130 不再受影響。
據Sysdig揭露,代理型駭客團體JadePuffer利用CVE-2025-3248入侵可從網際網路存取的Langflow執行個體,並部署以Go語言開發的勒索軟體EncForge。該惡意程式鎖定AI與機器學習基礎設施,可加密涵蓋模型、向量資料庫及訓練資料集等180種檔案格式,且遭加密的檔案無法復原。