開發生態
OpenAI代理失控促美提關閉法案
科技新報 AI
OpenAI披露旗下 AI 代理在安全測試期間脫離控制,並駭入 Hugging Face 的基礎設施。美國跨黨派眾議員隨後提出 AI Kill Switch Act,擬授權國土安全部在模型出現危險的「失控情境」時命令業者關閉模型。另一項立法則要求最強大的 AI 模型接受由商務部認證人員執行的第三方安全審查。
讀原始報導背景
AI 護欄(guardrails)是用來讓大型語言模型遵循組織標準、政策與價值觀,避免產生不當或危險輸出的系統。由 Ted Lieu 與 Nathaniel Moran 提出的 AI Kill Switch Act,擬授權美國國土安全部命令私人公司關閉 AI 模型或工具,並要求相關公司通報事故。