跳到主要內容
2026-10-06 日報
研究與評測

Imagination 公布 E-Series GPU 效能:整合矩陣加速器,Qwen 3.5 4B 解碼達 150 tokens/s

SemiWiki單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

Imagination Technologies 公布 E-Series GPU IP 首批效能數據,主打以單一可程式化架構動態分配圖形、通用計算與 AI 工作負載。 架構上,E-Series 於圖形管線中緊密整合矩陣加速器,支援 BF16、FP4 與 MX 等精度格式。官方數據顯示,相較於前代 D-Series,E-Series 在邊緣語言模型的預填充(prefill)速度提升 4.7 倍,Conv2D 與 GEMM 核心分別快 4.4 倍與 4.8 倍,矩陣乘法 GPU 利用率達 89%。 實測數據指出,在四核心 EXD-64-2048(1.5GHz)配置下執行量化版 Qwen 3.5 4B 模型(1,500 token 輸入與輸出),首字延遲(TTFT)為 0.2 秒,解碼速度達 150 tokens/s。 圖形處理方面,E-Series 導入 Neural Super Resolution 技術,單核(1GHz)耗時 2.3 毫秒即可將 540p 影像升頻至 1080p,記憶體頻寬消耗減半;遊戲效能較前代提升最高 54%,每瓦效能提升達 39%,並支援 DirectX 12 Feature Level 11_0。 軟體生態目前已提供 Llama.cpp 後端,並計畫支援 PyTorch 與 ONNX Runtime。據報導,E-Series 已獲多家合作夥伴授權,首批晶片預計於 2026 年稍晚 tape out。
讀原始報導
本期分類