研究與評測
Intel 發布 Agent 基礎設施白皮書:指出 60% 任務時間耗於 CPU,透過 Xeon 最佳化可提升 28% 併發量
AI 前線單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
據報導,Intel 發布白皮書指出,現有資料中心基礎設施未針對 Agent 的高頻與工具呼叫負載進行最佳化。
白皮書將 Agent 任務時間拆解,指出模型調用僅佔總任務時間 40%(主要在 GPU),剩餘 60% 皆在主機端 CPU 執行,其中工具執行(如沙箱)佔 35%、資料服務佔 10%、狀態搬運佔 8%、編排調度佔 7%。測量顯示,當併發達 32 個會話時,主機端 CPU 耗時佔比從單一請求的 0.6% 跳升至 11%~15%,其中 94% 的增長來自調度與排隊,導致 GPU 僅有 50% 到 60% 的時間在實際運算。
Intel 提出「每機櫃可交付智能體數」公式,強調透過調度有效性、資源平衡度與計算卸載效益來評估實際工作量。在資源平衡上,Intel Xeon 採用 Flat Memory 模式結合 CXL 擴展記憶體與原生 DDR5,在與 SAP 的聯合測試中達到全 DDR5 效能的 96%,並降低 25% 記憶體成本。在計算卸載上,透過 Xeon 內建的 IAA 加速引擎處理沙箱快照壓縮,可使快照恢復延遲降低 38% 至 42%。
綜合上述最佳化,系統在維持 p99 延遲目標下的併發臨界點,從 235 個 Agent 提升至 300 個,增幅達 28%。
讀原始報導