NVIDIA 發布 DGX Station for Windows,具備 748GB 記憶體並支援本地運行兆級參數模型
該設備預計 2026 年第四季上市,搭載 GB300 晶片,提供最高 20 PFLOPS 算力與 1,600W 功耗,讓開發者能在 Windows 環境中微調與測試大型 AI 模型。
iThome 中國單一來源
58 則值得知道的變化
該設備預計 2026 年第四季上市,搭載 GB300 晶片,提供最高 20 PFLOPS 算力與 1,600W 功耗,讓開發者能在 Windows 環境中微調與測試大型 AI 模型。
旨在解決代理工具與決策管理過於複雜的痛點,開發者無須重新建構,即可將現有 AI 代理直接連接至強化學習環境進行訓練與升級。
新規範移除握手流程與會話 ID,允許請求獨立路由至任意伺服器;雖簡化水平擴展,但開發者需自行處理應用狀態與中斷重試機制。
該工具旨在讓 AI 代理能在本地安全執行程式碼與呼叫工具,避免接觸用戶敏感資料,但微軟尚未公布技術細節與上線時間。
該 849.5 億美元年化支出僅涵蓋建築本體,未計入伺服器等硬體成本;其龐大能耗亦帶動美國 8 月電力建設支出年增 9.7%。
該設施位於孟買新城 Taloja 園區,首期預計 2028 年中期啟用,未來可能再擴增 240MW 容量,並計畫在當地設立辦事處。
據報導,新框架將代理迴圈與執行環境分離,避免將記憶體存為本機 JSONL 檔案,旨在協助企業集中管理 AI 代理並減少對前沿實驗室的依賴。
該 PR 針對無法完全載入 VRAM 的 MoE 模型,為保留在主機記憶體的專家建立 GPU 快取,有望大幅提升推論速度。