騰訊與甲骨文簽署 70 億美元協議,於東南亞租賃 10 萬枚先進 AI 晶片
這項為期 5 年的協議首付約 30%,騰訊將藉此取得受美國出口管制限制的先進算力,用於推進 AI 模型與代理工具開發。
58 則值得知道的變化
這項為期 5 年的協議首付約 30%,騰訊將藉此取得受美國出口管制限制的先進算力,用於推進 AI 模型與代理工具開發。
新版框架改採 DDP 架構並支援 MXFP8,在 512 張 B300 GPU 上成功實測 1.2 兆參數模型,大幅降低 MoE 路由與通訊成本。
Arm 提出由 CPU 負責運算,並透過 NVIDIA BlueField-4 等 DPU 進行獨立安全隔離的代理式 AI 基礎設施架構。
該架構將上下文視為檔案供模型自主更新,結合線上強化學習讓 Qwen3.5-9B 效能提升 47.6%,並降低 35% 伺服器運算成本。
透過 SSD 非同步預取技術減少延遲,實測在 13 萬 tokens 長上下文中,仍可維持 33 至 44 tok/s 的穩定解碼速度。
HPE 宣布獲全球最大私有雲端公司 Vultr 採購合約,顯示非 NVIDIA 陣營的 AI 基礎設施取得重大商業進展。
受 AI 應用快速擴張帶動,中國正掀起新一波資料中心建設熱潮,推動其基礎設施規模躍升至全球第二。
Supermicro 結合其 DCBBS 與專屬 DLC-2 液冷技術,提供從 5 MW 至 GW 級的完整部署藍圖,單機櫃配備 20.7 TB HBM4 記憶體與 216 TB/s 互連頻寬。
據統計,台積電加碼美國廠使累計投資達 2650 億美元;字節跳動與 MGX 分居二三名,AI 算力需求成擴產核心。
此計畫為美韓戰略投資合作的一部分,首批發電設施最快預計於 2029 年上線,除滿足園區需求外,多餘電力將回送德州電網。
該案由 14 家台資銀行參與,超額認購 2.5 倍,資金將用於建置台灣首座 AI 工廠與 NVIDIA GB300 NVL72 算力集群。
原架構雖能支撐千億級向量與 200ms 延遲,但在多向量表示下會導致嚴重的儲存與寫入放大,新版將全面提升文字搜尋速度。