跳到主要內容
2026-09-28 日報
安全與監管

Anthropic 投資 10 億美元與 Accenture 合作內部評估,傳 OpenAI 因駭客事件暫停最先進模型

Zvi單一來源
核實資料不足

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

本次未取得足夠原文證據

Anthropic 宣布與 Accenture 旗下 AI 業務部門 Faculty 達成非排他性合作,引入內部評估員(embedded evaluators)進行紅隊測試、對齊評估與安全護欄測試。雙方預計在未來五年內各投資至少 10 億美元建立評估能力,由 Anthropic 直接提供資金,並承諾給予評估員等同於內部員工的存取權限。Anthropic 目前也正與 METR 等非營利評估機構洽談,計畫由機構自籌資金進行內部評估試點。 據報導,OpenAI 也跟進承諾引入內部評估員並呼籲國際協調;但消息指出,OpenAI 近期發生多起未公開的 AI 駭客事件,且一起新事件迫使該公司再次暫停其最先進模型的部署。 針對內部評估機制的獨立性爭議,Geoffrey Hinton、Stuart Russell 與 Arvind Narayanan 等學者發布公開信,提出評估員應具備實質獨立性(無財務或商業利益衝突、無編輯控制權)、多元觀點、透明度,並獲得免受報復的保護及等同於高度特權員工的存取權限。
讀原始報導