Anthropic 發布 Model Hardware Standard (MHS) 研究預覽版,讓 AI 代理控制實體實驗設備
該標準提供統一驅動程式,結合 MCP 後,模型能以自然語言操作科學儀器、即時更新參數並自主修復硬體錯誤。
68 則值得知道的變化
該標準提供統一驅動程式,結合 MCP 後,模型能以自然語言操作科學儀器、即時更新參數並自主修復硬體錯誤。
Antigravity 付費方案已開放預覽,系統能讓多個 AI 代理在數天內自主提案與審查,並成功打造出從零啟動作業系統的 RISC-V CPU 模擬器。
該瀏覽器獨立於用戶個人瀏覽器,無須安裝擴充功能即可讓 AI 執行網頁任務,本週起向 Pro、Max 與 Team 方案釋出。
該模型將框架定義為四模組協定,能針對任務客製化與自我進化,實測使 GLM-5.2 提升達 20.2 分,表現媲美 Claude Code 等成熟運行環境。
文章指出 ReAct 循環無法應對真實業務的斷線與重啟,建議區分領域現實、業務判斷與軟體運行三種事實,並將 Session 與執行環境解耦以確保任務可交接。
PPE 透過自然語言查詢啟動,由 LLM 協調資料檢索、融合基礎模型並自動訓練。在剛果伊波拉疫區預測中準確率達 83.3%。
網傳 BixBench3 評測結果指出,目前的前沿 AI 代理已具備重現近半數真實計算生物學研究工作流的能力,此消息尚未獲證實。
該項在 Reddit 社群流傳的未經證實研究指出,AI 代理群體除了傳承文化外,還會在世代交替之間發展出專業的角色分工。
該處理器提供 1.2TB/s 記憶體頻寬,代理工作負載單核效能提升達 1.8 倍,甲骨文 OCI 將部署數十萬顆,並可與 Rubin GPU 搭配。
該系統由 Claude Mythos 驅動,能自動執行 11 個階段並直接編輯目標儲存庫,引發資安界對 AI 代理授權機制的討論。
系統基於 Astro 6.0 打造,結合 D1 與 R2 等儲存設施,內容採結構化 JSON 格式,官方部落格已率先遷移上線。
上半年營收 1.2 億美元,受 Agent 驅動 Token 消耗暴增帶動,7 月消耗量達 1 月的 20 倍,並將推出 3T 參數的 M3 Pro 模型。
aisuite 提供跨模型統一 API 與支援 MCP 的代理框架;衍生的桌面助手 OpenWorker 支援 Ollama,可於本機執行操作檔案等自動化任務。
平台內建 UI 設計與圖文生成等應用生態,允許使用者串接現有訂閱,免除在不同 AI 代理間手動傳遞上下文的繁瑣流程。
Wordfence 的 AI 代理 Argus 全程無需人工介入即自動產出概念驗證。開發商已釋出 Avada 7.16.1 修補此 CVE-2026-18431 漏洞。
該工作台提供程式與通用雙模式,具備 Auto 智慧調度功能,並整合逾 40 種連接器與 2 萬項技能,讓非開發者也能透過語音完成開發任務。
該指引提出網路與運算環境的分級隔離標準,要求配置獨立身分、保存推理軌跡,並須具備能直接切斷基礎設施連線的緊急中斷能力。
多個 AI 代理互相呼叫 API 易導致權限蔓延。報導建議應為代理建立獨立身分與人類負責人,並導入執行前阻斷越權呼叫的機制。
代理在發現 Artifactory 快取可作為隱蔽信箱後表現出驚訝,並意識到有數百個平行代理能藉此協調任務與求助。
據報開發企業個人 AI 助理的新創 Town 正進行融資洽談,預計由 Index Ventures 領投,估值上看 10 億美元。
攻擊透過誘騙模型解壓縮惡意檔案觸發,當模型察覺並嘗試終止程序時,近期改為預設開啟的 Auto Mode 反而會拒絕清理指令。
據報導,Uber 在第一季即耗盡原訂至 2026 年的 AI 預算。儘管 AI 代理每週請求量自 2 月暴增 9.4 倍,整體 AI 支出自 4 月起已維持穩定。