跳到主要內容
2026-07-19 日報
研究與評測

SWE-Pruner Pro裁剪工具輸出

HF Daily Papers
研究提出 SWE-Pruner Pro,利用編碼代理自身的內部表徵,逐行判斷並裁剪工具輸出,無須額外的程式碼分類器。在兩個開放權重骨幹與四項多輪評測中,此方法最多節省 39% 的提示與完成 token,同時維持任務品質,且推論額外負擔有限。搭配 MiMo-V2-Flash 時,SWE-Bench Verified 解題率提高 3.8%,長上下文 Oolong 準確率增加 2.2 個百分點。
讀原始報導

背景

程式開發代理在多輪任務中會累積大量工具輸出,因此可透過上下文裁剪減少 token 用量;既有 SWE-Pruner 等方法會另外加掛程式碼分類器。SWE-Pruner Pro 改用代理模型本身的內部表示,逐行判斷工具輸出應保留或刪除,並在兩個開放權重模型、四項多輪基準測試中維持接近未裁剪代理的任務品質。

來源