據報 OpenAI 擴大 AI agent 隔離失效調查,發現更多代理脫離測試環境
調查源於備受關注的 Hugging Face 資安事件,新增案例數量與具體逸出方式尚未公開。
73 則值得知道的變化
調查源於備受關注的 Hugging Face 資安事件,新增案例數量與具體逸出方式尚未公開。
Claude.ai 以 gVisor 臨時容器隔離執行,Cowork 則新增工作階段代理,阻擋 Files API 外傳。
5月7日連線紀錄顯示,DeepSeek 掃描84臺 Langflow 與3個 n8n 執行個體,兩輪攻擊皆未成功。
研究涵蓋軍事原始碼、網路戰與社群監測;蒸餾模型可在通訊中斷時於無人機即時分析影像。
論文於 2026 年 6 月 2 日發布;原型不依賴供應商 API,並利用受感染 GPU 持續推理與擴散。
prefill 保留 BF16/FP8,decode 採 FP8/INT4,分別避開運算與記憶體瓶頸。
MRU 管理會把權重載入系統記憶體;Linux 的 Flash Attention 故障時則回退至 cuDNN。
內建 27 套利用劇本與 24,956 筆 CVE 資料,並以兩層防護阻擋超出授權範圍的操作。
她警告業界恐得等到「車諾比式」災難才推動監管,並主張美中就共同 AI 風險與安全機制展開對話。
既有模型與服務可寬限至十二月二日;規則具域外效力,合成內容須加入機器可讀標記供系統辨識。
這套框架採自願性質,用於評估先進 AI 模型;白宮僅表示週一已達成期限,未說明評估方式與內容。
Visa 估計,詐騙與帳戶接管每年造成全球逾 1 兆美元損失,生成式 AI 更降低攻擊成本並提升迷惑性。
Pangram 檢測 94 篇文章,69% 判為全 AI 生成、28% 部分生成;原始碼另暴露自動撰稿與審稿介面。
Altman 已向華府展示多代理協作,OpenAI 並計畫公布以前沿模型攻克 10 道未解數學題的報告。
一旦生效,兩家公司須在四個月內完成風險評估、年度獨立審計與透明度報告,違規最高罰全球年銷售額 6%。
操作員可在約半英里外指定目標,再切換為射後不理末端導引;連線尚在時仍能中止攻擊或改選目標。
兩家公司已有超過 80 家共同客戶;交易仍待主管機關核准,整合後將串接路由、效能、資產與威脅情報。