跳到主要內容
2026-09-22 日報
研究與評測

開發者推出 phantom-kv:注入 18MB KV Cache 即可解除 LLM 限制,無需修改模型權重

Reddit r/LocalLLaMA單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據 Reddit r/LocalLLaMA 社群報導,開發者 lordx64 釋出名為 phantom-kv 的大型語言模型(LLM)解除限制(uncensor)系統。該技術無需修改模型權重,而是將約 18MB 預先訓練的鍵值張量庫(key/value tensors)載入模型的 KV Cache 中作為上下文,讓注意力機制(Attention)將其視為既有的對話歷史。 相較於會永久改變檢查點(checkpoint)且破壞量化的權重消除(abliteration),或需在運行時介入的激勵空間投影(activation-space projection),phantom-kv 支援單次請求的熱插拔,卸載快取後即可完全恢復原始模型。系統可依需求切換模式:例如「藍丸(Blue pill)」模式僅解鎖資安防禦任務(如惡意軟體逆向工程),而「紅丸(Red pill)」模式則進一步允許攻擊性內容解釋。 開發者透過 8B 評測模型進行內部審計指出,此方法的解鎖效果在長對話中具備約 2,000 至 4,000 個 token 的半衰期,需透過重新注入來維持;此外,由於該技術僅影響輸入層面,模型回覆時仍可能帶有原先對齊訓練遺留的道德與法律框架。
讀原始報導
本期分類
相關主題