Meta 擴大部署自研 AI 晶片 MTIA 450/500,台積電已交貨並運行 DeepSeek 等模型
Meta 將於 2027 年部署新一代 MTIA 處理器,承諾一年內建置逾 1 GW 算力,祖克柏亦表態反對業界協調放緩 AI 發展。
57 則值得知道的變化
Meta 將於 2027 年部署新一代 MTIA 處理器,承諾一年內建置逾 1 GW 算力,祖克柏亦表態反對業界協調放緩 AI 發展。
新系統採用 NVFP4 精度與第六代 NVLink,在 AgentX 代理基準預覽測試中,效能高達 GB300 的 30 倍。
該平台採推理與工具執行解耦架構,目前已獲百家企業採用,月調用量達千萬級,並於阿里雲資安與淘寶客服場景實測提升十倍人效。
系統以 NVFP4 量化、KV 快取重複使用與樹狀多詞元預測技術,將 1,007 輪測試縮短至 24 分 36 秒完成,輸出吞吐量達每秒 52.33 詞元,BFCL 準確率為 87.94%。
研究發現三元模型零權重佔比高達 51.5%,藉此設計結合位元圖與符號向量的 BITCOS 佈局,取代傳統 5-trit 封裝,有效降低儲存成本。
實驗結合自訂 GRPO 變體與 500 條 GPT-6 Astra 代理軌跡進行蒸餾,使原本無法處理多數查詢的模型,成功超越資料庫預設效能。
小米 Mimo 2.6 的訓練後儀表板已對外公開,網址路徑暗示可能涉及強化學習進展,官方尚未發布該模型或工具的具體細節。
該聯盟旨在制定技術中立的效能標準,透過轉移運算負載或釋放儲能等方式,讓 AI 基礎設施能彈性配合電網,加速設施併網時程。
NVIDIA示範由Codex協調NemoClaw子代理,透過Omniverse Libraries完成場景標註、物理設定與SimReady驗證,再交付Isaac Sim或Isaac Lab。
起因為 3 月遭攻擊,破壞程度超越 AWS 容錯設計,促使阿聯酋重新檢視 AI 資料中心的防爆與地下化規劃。
新模組採用矽穿孔垂直堆疊技術,較四條 128GB 配置降低逾 60% 功耗,目前正由 AMD 與 Intel 驗證,預計 2027 年下半年量產。
受 AI 伺服器建置帶動,預估 2026 年其用電佔比將達 33.4%,並促使業者採用高壓直流供電,美國至 2030 年供電缺口恐逾 170GW。
Intel 透過 Core Ultra 3 處理器整合異質運算,推出涵蓋六大產業的 Edge AI Suites,主張以傳統控制搭配 AI 輔助降低機器人部署門檻。
該聯盟旨在解決美國 AI 算力擴張的電力瓶頸,將制定統一標準與快速審批通道,讓資料中心能依電網狀況動態調整功耗。
火山引擎指出大模型落地面臨能力、工程與確定性三大鴻溝,其 LAS 體系透過封裝 150 多個算子,在電商素材與具身智慧等場景大幅提升生產效率與成功率。
投資方包含 Matrix、Playground 與 Socratic Partners,專注解決 AI 資料中心內部晶片互連的網路傳輸需求。
伺服器最快 2029 年上市,將提供配備兩顆或四顆 M8 Ultra 晶片版本,為蘋果自 2011 年停售 Xserve 後首度重返企業伺服器市場。
消息人士透露,由 10 家銀行組成的銀團將提供這筆鉅額融資,旨在協助該公司為人工智慧實驗室提供算力基礎設施。
該智能維運助手揚棄對話驅動,改以告警等事件觸發確定性 Pipeline 預取上下文,並將結構化維運經驗作為自進化對象,已於快手核心業務線落地。