安全與監管
網傳 Anthropic 研究員放棄股權離職警告 AI 滅絕風險,對齊負責人附和稱機率逾一成
Hacker News單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據一篇未經證實的網路文章描述,曾在 OpenAI 與 Anthropic 負責預訓練研究達三年的 Jacob Coxon,於 2026 年 9 月 8 日放棄即將到期的股權自 Anthropic 離職。該文章稱 Coxon 在離職信中警告「打造 AI 的人真心相信它會在十年內殺死我們所有人,這不是行銷噱頭」。
報導指出,Anthropic 對齊科學負責人 Evan Hubinger 隨後發文附和,表示自己評估 AI 在十年內消滅人類的機率超過 10%;此事件引發逾 24 位美國國會議員關切,而正建立前沿實驗室的 Elon Musk 則稱整起事件為「心理戰」(psy-op)。
該文進一步將 AI 末日論歸因於矽谷的「理性主義」次文化,指出 LessWrong 與 Lighthaven 負責人 Raymond Arnold 曾於 2025 年 12 月在柏克萊舉辦近 500 人的「世俗冬至」(Secular Solstice)儀式探討人類滅絕,其個人評估 AI 災難機率大於 50%。文章還指控該次文化涉及脅迫性心理工作坊、優生學計畫、與 Grimes 合作的 AI 末日宣傳,以及與六起死亡事件有關的拖船分裂教派等極端爭議。
讀原始報導社群討論
社群對「AI 安全」與有效利他主義(EA)圈子存在嚴重分歧。許多人質疑該群體陷入同溫層思維,批評其主張本質是審查制度與菁英階級的恐懼行銷(FUD),並指出 MacAskill 涉入 SBF 詐騙(挪用資金買 1500 萬英鎊豪宅)以及要價 3,300 至 10,000 美元的 Slutcon 等次文化爭議。但另一派反駁文章過度依賴連坐法與人身攻擊,警告不能因為發聲者「怪異」就忽視 AI 失控的真實風險,以免因犬儒主義而付出慘痛代價。