Meta 明年上半年將部署 1GW 規模自研 AI 推理晶片,並取消 Olympus 訓練晶片專案
第三代 MTIA 450 已成功運行 DeepSeek 等模型。為控制成本,Meta 取消兼顧訓練的 Olympus 專案,全面專注於通用推理晶片。
64 則值得知道的變化
第三代 MTIA 450 已成功運行 DeepSeek 等模型。為控制成本,Meta 取消兼顧訓練的 Olympus 專案,全面專注於通用推理晶片。
引擎採用 Rust 構建並提供 Python 介面,首發支援 PI 0.5 與 WALL-OSS 模型,在 Jetson Thor 上推理頻率達 38.46Hz。
初期鎖定出版業與電子書平台,徵集授權出版品、試閱內容及公共財等四大類資料,並設有明確授權與可退出的下架機制。
該 ICML 2026 論文透過離線強化學習合成資料,訓練輕量擴散模型一次性映射查詢與目標嵌入,完全繞過 CoT 思考 token,達成亞秒級搜尋響應。
該開源架構協助研究人員設計並測試容錯量子運算應用,美國費米實驗室實測將開發時間從 5 個月縮短至 3 週。
ContextBox 搭載四張 BlueField-3 DPU 提供 120GB/s 頻寬,解決 KV Cache 跨機共用瓶頸;其 F9000X 叢集亦獲 MLPerf 讀寫第一。
新設定將直接封鎖 OpenAI 等純訓練爬蟲,解決混合爬蟲造成的兩難;官方預計明年初將推出針對 AI 摘要的精細控制功能。
今年 AI 巨頭支出高達 7500 億美元,但營收最高僅 2000 億,龐大的資本支出與 GPU 快速折舊恐引發史上最大資本錯置風險。
AI 推論轉向持續運作的代理模型,導致 KV cache 耗盡加速器的 HBM 容量。Astera Labs 為此新增三款 Leo 記憶體控制器以解決此痛點。
此數據為九個月前預估的兩倍,併網設施為消耗主力。額外需求預計每日增加百萬噸溫室氣體排放,佔全美現有排放量 12%。
該平台每秒處理逾 7000 萬次請求,目前 Rust 版本已承載 95% 生產流量並顯著降低延遲,預計數週內將徹底下線舊有 Python 版本。
Google 於 SEMICON Taiwan 2026 說明 AI 基礎設施方向,討論涵蓋次世代 TPU 以外技術,強調電力限制是未來擴展系統的主要挑戰。
隨著推理模型與代理 AI 普及,據報 2026 年推理算力需求激增,促使 Nvidia 推出 Groq 3 語言處理單元,Anthropic 更每月砸 10 億美元向 SpaceXAI 租用算力。