跳到主要內容
2026-08-30 日報
前瞻與傳聞

據報輝達 Rubin Ultra 記憶體測試降規至 192GB,改以 NVLink 串聯 576 顆晶片應對 HBM4E 缺貨

TechNews 科技新報單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據產業消息報導,輝達(NVIDIA)下一代旗艦晶片 Rubin Ultra 正進行記憶體降規測試,原預期配備 1 TB HBM4E,測試版已降至 192 GB,低於現行 Vera Rubin 的 288 GB。報導指出,若未來記憶體產能提升,高容量版本仍有機會回歸。 此舉主要為因應 HBM4E 至 2027 年仍將面臨的產能緊缺。將單卡記憶體降至 192 GB,可用相同記憶體總量產出約五倍數量的晶片,優先滿足微軟、Meta 等客戶對整體算力的需求。此外,記憶體成本已占 Vera Rubin 伺服器機櫃 25% 至 30%(部分 AI 晶片組甚至高達 60%),降低高頻寬記憶體用量有助輝達守住毛利率,避免利潤過度流向 SK 海力士、三星與美光等供應商。輝達先前亦曾因缺貨,將 Vera CPU 總記憶體從 54 TB 降至 28 TB。 為彌補單卡容量縮水,輝達轉向機櫃級網路架構,透過 NVLink 將 576 顆晶片串聯,共享逾 100 TB 記憶體池,同時降低發熱與耗電。在任務分配上,輝達推出改用一般記憶體的 Rubin CPX 處理高算力需求的「理解問題」階段,並將「生成回答」階段的龐大暫存資料移至快閃記憶體。 輝達將競爭層級從單卡規格提升至系統級效率,加上 CUDA 軟體生態系的記憶體管理最佳化,迫使競爭對手超微(AMD)改變策略,近期亦全力推進整合 72 顆晶片的整機櫃方案,以避免受困於單卡競爭框架。
讀原始報導

背景

高頻寬記憶體(HBM)是一種用於 3D 堆疊記憶體的介面技術,最初由三星、AMD 與 SK 海力士開發,常與高效能圖形加速器搭配使用。為解決單一晶片容量受限的問題,輝達採用其於 2014 年發布的 NVLink 專屬高速互連通訊協定,讓多個裝置能透過網狀網路直接溝通,取代傳統的中央集線器架構。

這則事件的發展

  1. 2026-08-28據報 Nvidia 將以 129 億美元收購 Hugging Face,掌握開源 AI 平台
  2. 2026-08-27輝達 FY2027 Q2 營收達 962.2 億美元年增 106%,資料中心佔 890 億美元
  3. 2026-08-27輝達財報前夕市場聚焦融資風險:為客戶安排 5,000 億美元融資,並因 DRAM 短缺調漲伺服器價格逾 15%
  4. 2026-08-24Nvidia 斥資 60 億美元授權 Poolside 技術並吸收逾百名員工,將開發 Nemotron 開放權重模型對抗 DeepSeek 與 Kimi
  5. 2026-08-21阿里與字節跳動等中國企業繞道東南亞雲端,遠端取用輝達 GB300 等受限晶片算力

來源