華為揭露盤古模型在昇騰 950 平台的通訊最佳化實踐:MoE AllToAll 與超長上下文 TTFT 效能提升逾 10%
華為透過適配 CCU 加速器與 Omni Cache 卸載 KV Cache 解決通訊瓶頸,但坦言此硬體親和策略在其他平台可能失效。
InfoQ 中國多家報導
57 則值得知道的變化
Google 擬借重 AMD 的 CPU IP 與先進封裝經驗,這將是 AMD 首度實質參與客製化 AI ASIC 專案。
加拿大新創 Taalas 由前 AMD 與 NVIDIA 架構師 Ljubisa Bajic 創立,於 2026 年 2 月震撼 AI 運算領域。
單晶片功耗突破 1kW 帶動散熱架構升級,Google 逾八成 AI 伺服器已採用液冷,AMD 與 NVIDIA 整櫃方案將於 2026 年放量。
隨著 SpaceX 加速軌道運算基礎設施,NVIDIA 也將 GPU 應用於月球任務,太空 AI 正從概念驗證邁向實際部署階段。
隨著市占率飆升,聯發科近年據傳已拿下 Google TPU 產品的重大訂單,正逐步威脅博通在客製化晶片領域的地位。