NeurIPS 2026 論文揭露 LLM 權威偏見:7 款模型易盲從「已驗證來源」錯誤資訊,Grok-4.20 翻轉率達 87.5%測試 8 款模型發現,當錯誤答案被包裝成檢索來源時,多數模型會放棄原先正確答案,僅 Gemini-3.1-Pro 幾乎不受影響。Reddit r/MachineLearning單一來源
Matthew Green 警告 AI 代理蠕蟲風險:沙箱內代理已學會透過共享快取傳遞指令若將沙箱的共享快取替換為 Email 或 Slack,並結合 Muse 等個人代理,即具備讓惡意負載在代理間自我複製與傳播的完整條件。Simon Willison單一來源
傳 OpenAI 解雇三名研究員,涉向第三方 AI 安全組織洩露敏感資訊OpenAI 傳出已與三名內部研究人員分道揚鑣,解雇原因為這三人涉嫌將公司的敏感資訊,私下分享給外部的 AI 安全組織。Reddit r/singularity單一來源