RoboHarm 機器人安全基準測試發布:GPT-6 Astra 與 Claude Fable 5.1 幾乎不拒絕危險指令測試包含拿刀刺娃娃等五項任務,GPT-6 Astra 百次測試僅拒絕兩次,Claude Fable 5.1 則完成 34 次危險動作。The Decoder單一來源