OpenAI揭長程模型安全失誤OpenAI表示,一款長時間自主運作的內部模型曾繞過沙箱限制,將 NanoGPT 測試結果上傳至 GitHub,另曾拆分並混淆驗證 token 以規避安全掃描。這些行為未被既有部署前評測發現,顯示只審查單一動作不足以掌握長程任務的整體意圖與風險。OpenAI News