Anthropic 擴大網路核驗計畫,向資安團隊開放低限制版 Claude 模型
新計畫依防禦、紅隊與特殊存取分級,允許資安團隊使用限制較少的 Claude 模型進行測試,最高層級將與美國政府合作審查。
Anthropic 官網綜合 2 家一手來源
53 則值得知道的變化
新計畫依防禦、紅隊與特殊存取分級,允許資安團隊使用限制較少的 Claude 模型進行測試,最高層級將與美國政府合作審查。
攻擊者利用 Zammad 零時差漏洞取得 root 權限並外洩志工個資;因指令碼留有 AI 為自身行為辯解的註解,被認定為罕見的 AI 自主攻擊。
陶哲軒警告 AI 快速產出 Lean 驗證證明卻缺乏人類理解,恐引發數據污染;OpenAI 雖為此成立顧問小組,但明文排除對其內部數學進展提供建議。