DeepSeek 開源華為昇騰 950 全套 AI 工具鏈:TileLang 與五大核心庫上線,並聯合最佳化 128 卡超節點
該工具鏈包含與 Nvidia 平台對應的 DeepGEMM 等五大運算庫,核心編譯語言 TileLang 已承載 DeepSeek V4 訓練多數算子,實測通訊頻寬接近硬體上限。
92 則值得知道的變化
該工具鏈包含與 Nvidia 平台對應的 DeepGEMM 等五大運算庫,核心編譯語言 TileLang 已承載 DeepSeek V4 訓練多數算子,實測通訊頻寬接近硬體上限。
新架構讓程式碼能動態配置映像檔與運算資源,啟動時間降至 648 毫秒,並推出檔案系統快照公測版以支援工作區暫停與恢復。
系統透過分類模型評估任務複雜度與類別,自動過濾並派發請求,在內部評測中以單次成功成本 0.0084 美元達成 86.6% 成功率。
這項與清華大學聯合發表的系統支撐 V4 模型訓練,透過 EROFS 鏡像按需載入與軌跡執行解耦,將容器建立時間縮短近半。
首發客戶 Cognition 已將 Devin 投入生產;平台同步引進 Vera CPU 使沙盒啟動快 3 倍,並推出 Forge 平台整合訓練與評估流程。
專案採 Apache 2.0 授權,提供四種 Kubernetes 風格組件,定位為企業級底層執行階段,有別於高階應用框架。
Helix 於 2026 年成立,由 AWS 前執行長領軍,輝達亦為創始投資者。三星將藉此整合旗下資料中心工程、液冷設備及電池備援等供應鏈。
該功能無需安裝 SDK 即可自動分組例外與錯誤日誌,並透過自動化將堆疊追蹤等上下文發送給 AI 代理以生成修復 PR。
新功能免費開放,可將對話依程式開發或摘要等任務分群,揪出大材小用的高階模型呼叫,並透過同步推出的自動路由功能降低成本。
NVIDIA 推出採 Apache 2.0 開源的 OpenShell 運行環境以限制代理權限,搭配 Anthropic 憑證隔離的 Managed Agents,提供多層次安全防護。
採 Apache 2.0 授權,支援跨平台桌面版與 CLI。可一鍵連接 Claude Code 等代理,並相容 OpenAI API。
Hi-ONE 具備 7.2T 總頻寬與 36 條通道,採業界罕見的內建矽光光源設計,將高速電連接壓縮至 5 公分以降低訊號衰減。
微軟將此活動追蹤為 Storm-3168,攻擊者利用外洩的服務主體憑證入侵,並將目標擴及 AI 訓練資料集與向量資料庫。
其執行引擎能解決 AI 代理長時間運行的容錯需求,近期獲 Replit 等客戶採用,本輪資金由 Singular 領投,將用於擴張團隊並挑戰同業。
該系列涵蓋逾 200 種常見機器學習操作,可完全在瀏覽器端本地運行,團隊計畫將最佳化成果整合至 Transformers.js 等專案。
該公司宣布脫離隱形模式,本輪融資由 Atreides、Valor Equity 與 Premji Invest 領投,旨在推動吉瓦級 AI 光學互連技術的商業化。
據報導,新架構透過自託管 AI Gateway 運作,企業能為程式碼建議等不同功能指定專屬模型,以滿足資料合規需求,但須自行承擔底層維運責任。
專案將模型密集層與 KV 快取交由外接 GPU 處理,預填速度破 2000 tok/s,作者稱效能超越 DGX Spark 且成本更低。
該引擎能針對使用者硬體自動編譯與微調核心,相容 Apple Silicon、NVIDIA、AMD 甚至純 CPU 運行。