研究與評測
Anthropic 發布 AI 研發追蹤指標,Claude 已主導其 26% 內部研發工作
Techmeme綜合 2 家報導多家報導
尚未逐項核實
多個報導來源提及此事;未必是彼此獨立的證據。
Anthropic 發布一套用於衡量前沿 AI 實驗室研發進度的方法,並公布內部階段性數據,以追蹤 AI 系統自動化構建自身的程度。該體系主要關注三項指標:AI 參與 AI 研發的程度、AI 代理(agents)的監督情況,以及運算資源在 AI 研發與安全研究之間的分配。
在 AI 參與研發方面,Anthropic 採用 Epoch AI 提出的自動化等級體系(AL0 至 AL5,對應無 AI 參與至完全自主運行),提出「Anthropic 研發自動化指數」。數據顯示,截至 2026 年 8 月,Claude 尚未在任何受測研發工作中實現「完全自主運行」(AL5),但已「主導」Anthropic 約 26% 的 AI 研發工作,且處於「AI 協作」及更高等級的工作占比超過 90%;而此比例在 2026 年 2 月時還不到 1%。
為建立此指標,Anthropic 抽樣了 2026 年 7 月約 1.5 萬份內部工作紀錄與 Slack 訊息。該公司希望藉此讓公眾、第三方機構與政府直觀了解前沿 AI 研發速度,並觀察距離 AI 完全自主開發下一代 AI 的「遞迴自我改進」還有多遠。此外,Anthropic 執行長 Dario Amodei 曾呼籲協調放緩前沿 AI 發展,若未來出現相關協調行動,這些指標數據預計將反映出變化。
讀原始報導