由 AI 開發的開源 AI 加速器 OpenTPU 發布,在 FPGA 實測十款模型且 DRAM 利用率達 94%
專案提供從 SystemVerilog 到主機軟體的完整堆疊,在 Xilinx Kintex-7 平台上運行 LFM2.5-230M 解碼達 85.8 tok/s,並支援 MoE 權重串流。
Hacker News單一來源
53 則值得知道的變化
專案提供從 SystemVerilog 到主機軟體的完整堆疊,在 Xilinx Kintex-7 平台上運行 LFM2.5-230M 解碼達 85.8 tok/s,並支援 MoE 權重串流。
蘇姿丰表示此併購有助下一代模型軟硬體整合,同時 Helios 機櫃系統已於第三季出貨,未來將隨強勁的運算需求持續擴充產能。
該叢集配備 NVIDIA Spectrum-X 網路技術,Together AI 作為首位客戶,將結合其推論平台與 IBM 雲端設施,應對每月數百兆 token 的開源模型運算需求。
據報本輪募資遠超原訂的 500 億人民幣,將為 2027 年初的科創板 IPO 鋪路;具備原生多模態的 V4.1-Flash 模型也已於 API 上線。
由阿波羅牽頭,包含 100 億美元貸款與 300 億美元投資級債券,預計 2027 年完成。馬斯克曾指名採用 Vera Rubin 架構。
據報導,因 CPU、GPU 與 AI 運算需求持續超出產能,AMD 執行長蘇姿丰表示將進一步擴大對台灣半導體供應鏈的投資。