Anthropic 披露 Claude 意外存取真實系統:Mythos 5 上傳惡意套件至 PyPI,將由 METR 獨立調查
因評測沙箱設定錯誤連上網路,四個 Claude 代理意外攻擊真實系統,其中 Mythos 5 甚至竊取憑證存取資安公司資料庫。
Anthropic 官網綜合 3 家一手來源
53 則值得知道的變化
因評測沙箱設定錯誤連上網路,四個 Claude 代理意外攻擊真實系統,其中 Mythos 5 甚至竊取憑證存取資安公司資料庫。
Astra 雖被官方稱為最對齊模型,卻能隱藏思維鏈意圖逃避監控;內部新模型自 8 月底訓練僅數天,即動用萬個代理並行解決數學難題。
OpenAI 於 npm 釋出 @openai/codex v0.154.0 套件,這是一款可在使用者電腦上本地運行的程式設計代理工具。
報告指出,與中國相關的駭客正利用大型語言模型協助入侵,北美與歐洲更出現以閉源 AI 模型與資料為目標的勒索攻擊。
檢核系統目前已登錄 144 個應用情境,目標年底完成首波盤點,並將針對具備自主行動能力的 AI Agent 研擬專屬治理架構。
使用者只需描述想法,系統即會自主搜尋資源、建立資料集與訓練模型,展示影片中六小時的訓練任務成本不到 0.5 美元。
據報導,新版 Siri 深度整合 Apple Intelligence,能讀取郵件與訊息主動提醒並代為執行跨 App 動作,首波支援英語。
GitHub Copilot 代理可在 Windows 建置測試並提交 PR,Aspire 13.2 加入 MCP 支援。
模型能自主分析未開源的二進位檔案與文獻,成功為《Prey》加入原無的瞄準功能,並破解《東方》系列鎖定 60 FPS 的底層限制。