Anthropic 發布 AI 軍事情報與武器開發紅隊評測:Mythos Preview 表現最佳,並新增分類器阻擋濫用
評測顯示 AI 已能執行過去需人類專家的戰術情報定位任務,測試的中國開放權重模型雖落後前沿,仍具備實質威脅潛力。
Anthropic 官網一手來源
69 則值得知道的變化
評測顯示 AI 已能執行過去需人類專家的戰術情報定位任務,測試的中國開放權重模型雖落後前沿,仍具備實質威脅潛力。
測試將百個假陳述重複 50 次,揭露模型在長對話中會出現立場反覆的「對話震盪」現象,DeepSeek-R1 於激烈爭辯時妥協率達 22.2%。
該框架引入文本梯度概念迭代構建 API 工作流,能以更低成本生成複雜資料,微調後的模型表現更超越負責生成資料的教師模型。