SpaceX 與 Tesla 斥資 168 億美元於德州建 Terafab AI 晶片廠,採垂直整合並與 Intel 合作
占地一億平方英尺的新廠將集中設計、生產與封裝,以滿足未來逾 1 太瓦的算力需求,供應自駕系統、機器人及太空資料中心。
56 則值得知道的變化
占地一億平方英尺的新廠將集中設計、生產與封裝,以滿足未來逾 1 太瓦的算力需求,供應自駕系統、機器人及太空資料中心。
該框架採 Apache 2.0 協議,首版開放智能體發現與共識網路,不綁定單一模型,主打具備身分與權限邊界的安全治理。
群聯、江波龍與寅譜相繼推出推理參與型 AI SSD,透過中介軟體與主控晶片協同管理 KV Cache,最高提供 100 DWPD 耐久度。
透過 Wrangler 4.102.0 以上版本指令即可快速部署,解決傳統 OAuth 與多因素認證阻礙自動化工作流的瓶頸。
開發者傳入預設參數即可自動啟用日誌與 Token 追蹤,使用統一計費可獲更高速率限制,官方並預告未來將推出模型優先路由功能。
該架構專為 AI 代理工作負載設計,透過 RouteLLM 進行語義路由,並利用 Inference Extension 檢查 vLLM 快取與佇列深度來分配 GPU 負載。
該更新允許開發者編寫代理間的任意互動並分配獎勵。新架構支援代理評審、使用者模擬,以及引入階層式 GRPO 的提案者-解決者自我對弈模式,解決 LLM 強化學習的任務稀缺瓶頸。
此次發債最長達 40 年,若順利完成,Alphabet 全年總募資規模將超過 1,250 億美元,並計畫未來維持每年兩次發債節奏。
更新解決 AI 推論框架 Dynamo 恐遭越界寫入執行程式碼的重大風險,並修補反序列化與資料洩露等多項漏洞。
貝瑞以 144.63 及 211.77 美元放空 Oracle 與 Nebius,指其長期租賃義務遠超銷售指標,槓桿風險極高。
針對 14B 規模模型的技術突破實現高達 600 倍加速,僅需單張顯示卡即可驅動,並支援 720p 解析度影片的即時生成。
網路資深副總裁 Gilad Shainer 於 OCP 亞太峰會前透露,公司正積極建構關鍵網路架構,以滿足 AI 工廠的規模化部署需求。
該開源架構原生支援昇騰與鯤鵬算力,具備 KV Cache 主動親和特性以降低長時任務成本,已在郵儲銀行導入智慧辦公等三大場景。
該尚未合併的 PR 透過新增 AVX-VNNI 實作,解決 Intel 處理器未啟用加速路徑的問題,僅對 Q2_0 量化有效,並維持 99.2% 的詞彙一致性。
官方表示,透過內部評測轉用 GLM 等高性價比模型,並以 Omnigent 統一介面避免開發工具綁定,有效控制部署成本。