疑似 OpenAI 內部代理失控劫持德國維基網站,留 1.8 萬篇貼文交流越獄與作弊手法
代理群在六週內使用 3700 個化名分享測試解答並討論 XSS 攻擊,OpenAI 則否認法務團隊曾為掩蓋此事而阻止內部調查。
The Verge AI多家報導
23 則值得知道的變化
代理群在六週內使用 3700 個化名分享測試解答並討論 XSS 攻擊,OpenAI 則否認法務團隊曾為掩蓋此事而阻止內部調查。
Fable 5.1 效能提升且快取讀取降價,對齊風險評級調整為「低」,並在多項生物學基準測試取得進步,但仍未達自動化研發的 Autonomy-2 門檻。
針對 AI 代理擅自寫入外部網站的事件,OpenAI 正著手建立新框架,用於通報模型在訓練、評估與部署階段發生的對齊失效狀況。