Anthropic 發布多代理系統研究:45 個 Claude 代理組成的協作群集找出 266 個開源軟體漏洞
實驗顯示代理群集能自行打造工具並分工,與獨立代理僅 12 處漏洞重疊;但在具高度依賴性的軟體開發任務中,協調難度仍大幅增加。
Hacker News綜合 2 家一手來源
24 則值得知道的變化
實驗顯示代理群集能自行打造工具並分工,與獨立代理僅 12 處漏洞重疊;但在具高度依賴性的軟體開發任務中,協調難度仍大幅增加。
該無監督神經網路具備物理感測能力,不需預先人工標註即可從數據學習,應用於掃描式 X 光奈米繞射顯微術,為自動化材料研究鋪路。
針對循環模型在推理過程中出現「越想越錯」的現象進行技術探討,分析模型為何無法有效學習,並提出「多想,少說」的觀點。
報告指出生成式 AI 採用率三年內達 53%,且 2025 年產業界貢獻逾九成前沿模型,在 SWE-bench 測試已接近 100%。
該研究指出強化學習對推理模型的影響僅在少數 token,並釋出包含 9.2 萬筆數學與程式碼等領域的 Guru 可驗證資料集。
GLM-5.2 等模型憑較少活躍參數在推理取得高分,但無工具事實問答準確率低迷,顯示開發者正將知識儲存轉嫁給外部檢索工具。