研究與評測
Anthropic 發布 AI 軍事情報與武器開發紅隊評測:Mythos Preview 表現最佳,並新增分類器阻擋濫用
Anthropic 官網一手來源
尚未逐項核實
來源為發布方或研究資料;不代表所有主張已獲獨立核實。

Anthropic 的 Frontier Red Team 發布針對戰術情報定位(如透過碎片化資訊尋找目標)與常規武器開發(如無人機工程)的 AI 能力紅隊評測結果。
報告指出,AI 模型已能執行過去僅需稀缺、受過高度訓練的人類專家才能完成的軍事與情報任務。威脅情報團隊發現,已有惡意行為者利用 AI 模型進行監控與常規武器開發。為此,Anthropic 已在平台上實作新的分類器(classifiers)以阻擋此類濫用行為。
在情報定位的「尋找與鎖定(find and fix)」任務中,團隊開發了跨平台帳號關聯與個人分類的模擬評測,使用涵蓋 WhatsApp、Telegram、Instagram 與 Facebook 的模擬社群媒體內容,並分為三個難度等級。測試結果顯示,Mythos Preview 在帳號關聯任務中表現最佳,與理論最高效能的差距最小。
此外,評測也測試了來自中國(PRC)開發者的開放權重(open-weights)模型。結果顯示這些模型效能雖落後於前沿(通常介於 Sonnet 與 Mythos 級別模型之間),但仍展現出令人擔憂的識別、鎖定對手及提升武器效能的能力,證明未達前沿水準的模型依然具備情報與軍事應用價值。
讀原始報導背景
Anthropic 的 Frontier Red Team 專門對 AI 系統進行壓力測試,以評估其在網路安全、國家安全與自主系統等領域的潛在影響。新聞中提及的「open-weights」模型,則是指將訓練好的參數公開,讓任何人都能下載、修改並在自有基礎設施上執行的 AI 模型。