NVIDIA Vera Rubin量產
NVIDIA 宣布 Vera Rubin NVL72 正加速量產,CoreWeave、Google Cloud、Microsoft Azure 與 Oracle Cloud Infrastructure 已有機架運行。
25 則值得知道的變化
NVIDIA 宣布 Vera Rubin NVL72 正加速量產,CoreWeave、Google Cloud、Microsoft Azure 與 Oracle Cloud Infrastructure 已有機架運行。
OpenCode 發布 2.0 測試版,全面重做 API,並將執行環境由 Bun 遷移至 Node、桌面端由 Tauri 轉向 Electron。新版預設以常駐服務執行,支援跨裝置連線、熱重載,以及在多個分頁並行執行獨立 AI 程式開發任務。
NVIDIA 推出為 Vera Rubin 平台打造的 Spectrum-6 Ethernet 交換系統,頻寬達 102.4 Tbps,容量為前一代系統的兩倍。CoreWeave、Microsoft、Nebius、SpaceXAI 與 Tesla 將成為首批導入業者,支援超大規模模型訓練與推論部署。
據愛範兒報導,字節跳動發布 Seed Audio 1.0,至簡動力與北京大學聯合實驗室提出 HarmoWAM,無問芯穹則公布 Agentic Infra 策略。這些進展涵蓋音訊生成、機器人長程移動與精細操作,以及 AI 代理的訓練、推論與部署。相關效能數據主要由發布方提供,目前缺乏獨立佐證。
據報導,Moonshot 發布新一代模型 Kimi K3,短短兩天便因需求爆量暫停新用戶訂閱。Kimi K3 總參數達 2.8 兆、活躍參數約 500 億,但運行時仍須在主記憶體載入完整參數,一般企業難以自行部署。分析人士認為,其低價策略可能帶動 AI 工作負載成長,進一步推升 HBM、AI 晶片與網通設備需求。
Mistral 宣布擴大與 Microsoft 的全球策略合作,讓企業與受監管產業能採用並掌控前沿 AI。隨著 Mistral 擴充歐洲 AI 算力,Microsoft 將運用部分新增容量,並把 Mistral 模型導入旗下 AI 平台。客戶可彈性選擇雲端部署,或在完全離線的環境中運作。
平頭哥宣布開源 T-Head SAIL,完整開放真武 AI 晶片從核心驅動、Runtime、編譯器、六大數學函式庫,到千卡叢集維運工具與技術文件的底層軟體堆疊。這套系統已在阿里雲生產環境接受大規模驗證,並適配 PyTorch、TensorFlow、vLLM、SGLang 等 260 餘個主流框架。
Wistron在德州沃斯堡啟用首座美國製造廠,目前量產NVIDIA GB300 Grace Blackwell Ultra Superchip,並將生產NVIDIA Vera Rubin Superchip。這座占地32.4萬平方英尺的D1廠投資7億美元,預計年內擴大至每月生產數萬片電路板。
據報導,中科曙光的曙光8000(登峰)在 WAIC 亮相,被稱為中國首套全國產十萬卡級 AI 超級叢集,上線首週即達應用滿載。報導指出,系統採用自研 400G 網路卡、880G 交換晶片與國產 RDMA 互連,已投入大型模型推論、科學運算及 AI4S。值得注意的是,目前尚無大型模型能擴展至十萬卡運行,現階段主要以共享算力支援多種工作負載。