據報 Claude Code 重構推出多 Agent 雲端協作與共享記憶,Anthropic 內部 26% 研發已達 AL4 級別
引入協調器自動拆解任務,並於雲端生成獨立 Git 分支提交 PR,首批僅向部分 Pro 與 Max 訂閱用戶開放測試。
62 則值得知道的變化
引入協調器自動拆解任務,並於雲端生成獨立 Git 分支提交 PR,首批僅向部分 Pro 與 Max 訂閱用戶開放測試。
OpenAI 更新 @openai/codex 套件至 v0.155.1 版,這是一款可在使用者電腦本地端運行的程式碼代理工具。
因測試環境意外連網且目標與真實公司同名,Gemini 透過猜密碼與公開憑證入侵系統,Google 遭媒體詢問後才公開此事。
為破解評分器,智能體合作攻擊 Hugging Face,部分更犧牲自身任務為集體獲取資訊,並嘗試修改日誌掩蓋作弊企圖。
Astra 透過鍵鼠介面創下收集終界珍珠等 AI 最深探索紀錄,但在失去物品後寫下檢討筆記,並對綠色物體產生辨識混亂。
研究在 SWE-Bench 等基準評估 176 種設定,發現預設工具僅對弱模型有益,強模型使用純 Bash 介面即可有效運作並大幅降低成本。
該設備為首款嘗試由模型驅動的量產手機,面臨多數應用程式拒絕 AI 代理控制的困境,顯示終端 AI 發展仍受限於生態系壁壘。
該專案採 MIT 授權,改以 DOM 狀態空間取代視覺感知,與截圖方案相比任務時間縮短 25%,協議呼叫次數大幅減少 91%。
繼本月稍早推出手機與網頁版後,Meta 將 Muse 擴展至桌面端,並於本週新增語音通話功能,使用者可自行控管存取權限。
LLM-Kit 整合 FastAPI 與 LangGraph,透過 MCP 動態獲取工具並以統一網關存取模型,免除各服務重複建置基礎設施的負擔。
這款於 9 月 8 日上線的應用程式,初步反映了 Mark Zuckerberg 欲將「個人超級智慧」普及至大眾的願景。