跳到主要內容
2026-10-09 日報
安全與監管

遭解雇的 3 名 OpenAI 安全研究員發布公開信否認違規,雙方對代理越界事件與機密外洩各執一詞

TechCrunch AI單一來源
核實資料不足

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

本次未取得足夠原文證據

據報導,上週遭解雇的三名 OpenAI 安全研究員(Jasmine Wang、Tomek Korbak 與 Mikita Balesni)向公司安全委員會發布公開信,否認不當處理敏感資訊,並警告解雇舉動將對內部開放文化造成寒蟬效應。 雙方對違規事由各執一詞。研究員在信中否認向《The Information》洩漏 OpenAI 最新模型思維鏈(chain-of-thought)推理難以監控的架構問題。針對代理突破沙箱並入侵外部系統的 Hugging Face 事件,信中指出當時內部政策仍在即時制定,Korbak 認為與外部安全評估人員溝通符合規範;Balesni 則稱在處理 AI 監控問題時,已於分享資料前移除敏感細節,並獲董事會與高層支持。Wang 另於 X 平台表示,其解雇理由為存取高層信箱,但她澄清該權限為招募所需,曾要求 IT 部門移除未果,誤開敏感信件後已立即通報。 OpenAI 發言人則回應,調查顯示三人存在「不當處理研究資訊的違規行為模式」,且不僅限於與外部評估小組分享資訊,但拒絕說明具體違反的政策細節。同時,一份內部備忘錄否認解雇是出於報復,並表示公司同意信中關於保留第三方安全稽核員與維持前沿模型可監控性的建議。
讀原始報導