由 AI 開發的開源 AI 加速器 OpenTPU 發布,在 FPGA 實測十款模型且 DRAM 利用率達 94%
專案提供從 SystemVerilog 到主機軟體的完整堆疊,在 Xilinx Kintex-7 平台上運行 LFM2.5-230M 解碼達 85.8 tok/s,並支援 MoE 權重串流。
53 則值得知道的變化
專案提供從 SystemVerilog 到主機軟體的完整堆疊,在 Xilinx Kintex-7 平台上運行 LFM2.5-230M 解碼達 85.8 tok/s,並支援 MoE 權重串流。
該叢集配備 NVIDIA Spectrum-X 網路技術,Together AI 作為首位客戶,將結合其推論平台與 IBM 雲端設施,應對每月數百兆 token 的開源模型運算需求。
提供快照、配方、套件與驗證功能,能將配置渲染至 Helm 或 Argo CD,並附帶簽章證據以解決 GPU 叢集組件版本衝突。
透過 GDA-KI 技術讓 CUDA 核心直接驅動網路操作,新推的開源版專注於 RDMA-Verbs,並可在執行時動態呼叫完整 DOCA SDK 功能。
AM Intelligence 擴大亞洲 AI 算力佈局,計畫於印度與馬來西亞的基礎設施中新增兩萬張 Nvidia Rubin GPU。
該模組採用矽穿孔垂直堆疊技術,使雙路伺服器最高可配置 12TB 容量,目前正由 AMD 與 Intel 進行平台驗證以應對 AI 需求。
影響 Unsloth 2026.5.10 及更早版本,官方已於 2026.6.9 版修復,目前尚無 CVE 識別碼且未發現實際攻擊案例。
開發者提交的 PR #26610 透過 RPC 新增參數,讓使用者能在多台獨立電腦間執行張量平行運算,擴展分散式推論能力。
據 Reddit 未經證實的消息,微軟疑似意外曝光 GPT-6.1 Sol 僅將推論次數由三次降為兩次,完全沿用 GPT-6 Sol 的基礎權重。
由阿波羅牽頭,包含 100 億美元貸款與 300 億美元投資級債券,預計 2027 年完成。馬斯克曾指名採用 Vera Rubin 架構。
由 Coatue 與 Blackstone 領投,預計為 2027 年 IPO 前最後一輪。其積壓訂單因 Anthropic 的巨額合約已激增至 500 億美元。