模型發布
Base Labs 聯手 Hugging Face 與 Goodfire 推出開源模型安全標準,應對逾 6,000 個遭移除安全限制的模型
TechCrunch AI單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,Baseten 旗下研究部門 Base Labs 宣布與 Hugging Face 及 Goodfire AI 合作,針對開放權重(open-weight)模型推出安全評估與監控的基礎設施標準。此舉旨在應對近期興起的「abliteration」技術,該技術可移除開源模型的安全防護機制;目前 Hugging Face 平台上已列有超過 6,000 個遭此技術處理的模型。Base Labs 將開發並發布開源模型的訓練與監控方法,目標是將透明的安全機制直接內建於模型的訓練與部署流程中。雖然具體技術細節尚未公開,但專注於模型可解釋性的 Goodfire 預計將負責安全機制的內建工作。Baseten 與 Goodfire 近期分別完成 15 億美元與 1.5 億美元融資,目前正向開發者生態系發出公開邀請以共同貢獻該框架。
讀原始報導