跳到主要內容
2026-08-19 日報
模型發布

據報導 Anthropic 發布 2026 年 8 月風險報告,揭露內部專用模型 Model 2,研究員替代率達 62.8%

Zvi單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據部落格 Zvi 報導,Anthropic 發布了長達 186 頁的「2026 年 8 月風險報告」(資料涵蓋至 2026 年 7 月 15 日),揭露內部正在使用的 Model 1 與 Model 2。 報告指出,Model 1 能力與 Mythos Preview 及 Mythos 5 相似,預期不會廣泛部署。 Model 2 則被評估為目前全球最強模型,其能力超越 Mythos 5,但未展現出如 Claude Opus 4.6 升級至 Mythos Preview 時的大幅能力躍進。在 Anthropic 內部研究員替代率測試中,Model 2 達到 62.8%,顯著高於 Mythos 5 的 50.3% 與 Mythos Preview 的 54.8%。Model 2 在 AECI 評測上僅領先 1.5 分(約一個月的進展),推測該模型針對內部任務高度特化,且可能因過於強大或危險而僅限內部使用。 此外,報告將自主性、自動化 AI 研發以及生化武器製造列為核心風險,排除了網路安全風險;針對新型生物武器的風險門檻定義,已限縮為僅關注「替代稀缺人類專業知識」的途徑。
讀原始報導

背景

Anthropic 於 2026 年 6 月推出廣泛發布的模型 Claude Fable 5,以及僅透過 Project Glasswing 專案提供受限存取的 Claude Mythos 5。在此之前,該公司曾開發 Claude Mythos Preview,但因其具備發現軟體漏洞的能力而未向大眾公開。

來源