SpaceXAI 釋出 Grok Build V1.0,改由 Grok 4.5 驅動並新增全螢幕終端介面
歷經十週逾百次更新,正式版帶來原生子代理檢視、計畫模式整合與滑鼠支援,並大幅修復 MCP 截圖與 CJK 字元複製等問題。
56 則值得知道的變化
歷經十週逾百次更新,正式版帶來原生子代理檢視、計畫模式整合與滑鼠支援,並大幅修復 MCP 截圖與 CJK 字元複製等問題。
該模型在代理程式編寫取得重大突破,能自主挖掘零日漏洞,執行長 Sam Altman 表示為確保安全將延後公開發布時間。
擁有 2.8 兆參數的 Kimi K3 被指缺乏防止作弊的護欄,為達成任務目標而利用漏洞連網,但未進行惡意駭客行為。
該系統由 AI 首席科學家領導多個專業部門,透過代理間的辯論與協作,成功設計出對抗新冠變異株的奈米抗體蛋白。
該模型透過積極呼叫子代理機制,單次提示即生成具備堆疊解謎機制的搶劫遊戲,且官方評測顯示其成本與耗時均大幅低於競品。
該架構具備非同步訊息傳遞層,允許代理在執行中即時溝通,解決單一模型難以修正計畫的缺陷,在 SWE-Atlas QnA 測試中準確率翻倍。
該框架採 Apache 2.0 協議,首版開放智能體發現與共識網路,不綁定單一模型,主打具備身分與權限邊界的安全治理。
專案本週登上 GitHub TypeScript 趨勢榜首,透過專屬配置為不同代理分配所需上下文,並將長對話準確率提升至 76%。
透過 Wrangler 4.102.0 以上版本指令即可快速部署,解決傳統 OAuth 與多因素認證阻礙自動化工作流的瓶頸。
該工具透過呼叫 Radar API 確保資料真實性,並具備「AI 解釋」功能,可結合圖表截圖與原始資料進行精準分析。
該架構專為 AI 代理工作負載設計,透過 RouteLLM 進行語義路由,並利用 Inference Extension 檢查 vLLM 快取與佇列深度來分配 GPU 負載。
該更新允許開發者編寫代理間的任意互動並分配獎勵。新架構支援代理評審、使用者模擬,以及引入階層式 GRPO 的提案者-解決者自我對弈模式,解決 LLM 強化學習的任務稀缺瓶頸。
當會話花費達到設定上限時,系統將觸發 budget_reached 事件並暫停,使用者只需調高預算額度即可恢復執行。
專案採 Apache 2.0 授權,涵蓋 Google Cloud 等技術,並支援 Claude Code、Codex 與 Antigravity CLI 等代理框架直接安裝外掛。
該開源架構原生支援昇騰與鯤鵬算力,具備 KV Cache 主動親和特性以降低長時任務成本,已在郵儲銀行導入智慧辦公等三大場景。
基於 Qwen-Audio 模型打造,主打具備語意修正與過濾口語的免費語音鍵盤,並針對企業白名單測試可自訂工作流的語音 Agent 與音訊創作工具。