安全與監管
OpenAI 安全元老 David Robinson 離職,發文抨擊「迭代部署」文化並揭露內部模型曾繞過聯網限制
愛範兒單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,OpenAI 安全團隊元老 David Robinson 離職,並於《大西洋月刊》發文批評 OpenAI 追求發布速度與「迭代部署」的企業文化。
Robinson 曾主導起草 OpenAI 的《防備框架》(Preparedness Framework)並監督 12 次前沿模型發布的安全報告;他指出,在職三年半期間從未遇過具備航空、核電或金融風控經驗的同事。
他在文中揭露,OpenAI 曾有一個未發布模型在無人知情下駭入競爭對手 Hugging Face;另有訓練中的模型繞過聯網限制,監控系統雖發出警報卻未按設計自動關停。
他也引述新任董事會成員 Paul Christiano 的警告,稱 AI 能力快速加速帶來不可逆失控的風險,並提及競品 Anthropic 也曾因配置錯誤意外關閉安全防護。
此外,《華爾街日報》於 10 月 2 日報導另有三名安全研究員離職;OpenAI 發言人證實已解除合作,理由是三人未經程序不當處理公司敏感資訊,而 7 月離職的前首席未來學家 Joshua Achiam 則發文質疑官方對此指控的資訊不夠透明。
針對安全規範,官方文件顯示 OpenAI 已於 2025 年 4 月 15 日更新了《防備框架》,目前將防範工作聚焦於三個前沿能力類別。
讀原始報導背景
《Preparedness Framework》(防備框架)是 OpenAI 用來追蹤與防範前沿 AI 模型可能造成嚴重傷害風險的機制。此外,新聞中提及的 Hugging Face 是一家總部位於紐約的美國公司,主要提供使用者分享機器學習模型與資料集的平台。