研究與評測
OpenAI揭露前沿AI安全框架:強化學習前先評估,川普反對放慢發展
iThome單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據 iThome 報導,OpenAI 執行長 Sam Altman 於 9 月 13 日揭露新的前沿 AI 安全措施,將原本主要安排在模型完成訓練後、部署前進行的安全評估,提前至可能大幅提升模型能力的訓練開始前。這項說法目前為單一來源報導,OpenAI 尚未在材料中提供其他佐證。
Altman 表示,OpenAI 過去的《準備框架》(Preparedness Framework)主要聚焦模型訓練完成後、部署前的風險評估;未來針對預期會大幅提升模型能力的強化學習(Reinforcement Learning,RL)訓練,將在訓練開始前先建立安全論證(Safety Cases),評估模型能力提升是否可能超越既有的對齊與監控措施。
這項主張是在 Anthropic 執行長 Dario Amodei 於 9 月 12 日發表文章後提出。Amodei 警告 AI 能力進展速度可能已快到安全措施難以跟上,並呼籲建立第三方評估、產業安全標準與國際協調機制;Altman 隨後表示支持,並說明 OpenAI 將如何把安全工作提前。
Altman 強調,延緩前沿 AI 發展不等於停止發展,而是接受安全措施所需的時間與運算成本,使 AI 能力進步速度比完全不計安全成本時稍慢。他認為,即使面臨中國競爭壓力,也不能讓 AI 能力超越對齊與監控措施。
同日,美國總統川普則反對因安全疑慮而降低 AI 發展速度。川普表示,美國目前在 AI 領域領先中國,必須維持優勢,並稱「誰贏得 AI,誰就贏了」;他支持為 AI 設置安全護欄,但認為部分人士提出的風險不會發生。
讀原始報導