輝達宣布以 129.3 億美元收購 Hugging Face,承諾維持硬體中立與生態系開放
Hugging Face 為尋求算力資源主動促成交易,平台目前匯聚逾 1800 萬名開發者與 300 萬個模型,未來將保持獨立運作且不綁定單一運算平台。
57 則值得知道的變化
Hugging Face 為尋求算力資源主動促成交易,平台目前匯聚逾 1800 萬名開發者與 300 萬個模型,未來將保持獨立運作且不綁定單一運算平台。
Meta 將於 2027 年部署新一代 MTIA 處理器,承諾一年內建置逾 1 GW 算力,祖克柏亦表態反對業界協調放緩 AI 發展。
該模型主打在不犧牲圖文、數學與程式碼等通用能力下,突破空間具身智能,實測可完成複雜的空間判斷與機器人收納任務規劃。
新版模型 API 已於火山方舟全量上線並接入「豆包工作」,支援多子 Agent 平行開發,強化長程任務與多模態程式設計能力。
模型提出上下文機制網路(CMNs)探索變數關聯,在 TabArena 等三大結構化資料評測中 Elo 分數均獲第一,並已開放權重。
專案提供脈衝重建卷積模組權重、微調程式碼與支援多 GPU 調度的網頁介面,輸入格式為特定二值序列,完整生成流程需另行準備基礎模型。
新版要求至少 M1 晶片;AFM 3 Core Advanced 僅支援 M3 以上且需至少 12GB 記憶體,Siri 與聽寫功能受此限制。
新系統採用 NVFP4 精度與第六代 NVLink,在 AgentX 代理基準預覽測試中,效能高達 GB300 的 30 倍。
該架構僅保留任務規格等四類上下文,捨棄推理軌跡以避免干擾,並透過零 Token 資料刷新機制將任務時間縮減 14 倍。
新方法引入去噪進度分數與分層遮罩機制,解決擴散模型缺乏時間信用分配與似然估計偏差問題,可隨插即用於任何 GRPO 訓練器。
該技術在訓練軌跡中引入能量指南針評估序列品質,170M 參數模型僅需 8 步推論,效能超越 5 倍大模型的離散生成基準。
系統以 NVFP4 量化、KV 快取重複使用與樹狀多詞元預測技術,將 1,007 輪測試縮短至 24 分 36 秒完成,輸出吞吐量達每秒 52.33 詞元,BFCL 準確率為 87.94%。
模型利用 2.6 億快取 token 壓低成本。審查發現 11 次攻擊中有 5 次使用非預期捷徑,促使官方強化基準測試驗證機制。
報告指出 Agentic AI 將推動數位世界轉向以代理為中心,預期算力集群規模將提升百倍、任務成本下降千倍,並帶動龐大基礎設施投資。
研究發現三元模型零權重佔比高達 51.5%,藉此設計結合位元圖與符號向量的 BITCOS 佈局,取代傳統 5-trit 封裝,有效降低儲存成本。
該框架利用累積的發現歷史作為重播模擬器獲取即時回饋,在演算法、數學最佳化與 GPU 核心工程中,維持發現品質並大幅降低成本。
實驗結合自訂 GRPO 變體與 500 條 GPT-6 Astra 代理軌跡進行蒸餾,使原本無法處理多數查詢的模型,成功超越資料庫預設效能。
小米 Mimo 2.6 的訓練後儀表板已對外公開,網址路徑暗示可能涉及強化學習進展,官方尚未發布該模型或工具的具體細節。
新介面可自動分配任務並支援雲端背景執行,同時整合 Artifacts 與 Design。Docs 與 Slides 率先向 Pro 與 Max 用戶釋出,可匯出簡報與 PDF。
該平台採推理與工具執行解耦架構,目前已獲百家企業採用,月調用量達千萬級,並於阿里雲資安與淘寶客服場景實測提升十倍人效。
該聯盟旨在制定技術中立的效能標準,透過轉移運算負載或釋放儲能等方式,讓 AI 基礎設施能彈性配合電網,加速設施併網時程。
支援 MCP 的 AI 代理可存取設備歷史數據進行分析與建立自動化,基於安全限制無法解鎖門,需透過 Google Cloud 專案設定。
NVIDIA示範由Codex協調NemoClaw子代理,透過Omniverse Libraries完成場景標註、物理設定與SimReady驗證,再交付Isaac Sim或Isaac Lab。
起因為 3 月遭攻擊,破壞程度超越 AWS 容錯設計,促使阿聯酋重新檢視 AI 資料中心的防爆與地下化規劃。
新模組採用矽穿孔垂直堆疊技術,較四條 128GB 配置降低逾 60% 功耗,目前正由 AMD 與 Intel 驗證,預計 2027 年下半年量產。
受 AI 伺服器建置帶動,預估 2026 年其用電佔比將達 33.4%,並促使業者採用高壓直流供電,美國至 2030 年供電缺口恐逾 170GW。
新機具備獨立 AI 按鍵,內建豆包助手與全雙工語音大模型,支援螢幕問答與跨應用操作,並首推最高百萬人民幣的 AI 洩密保障。
Intel 透過 Core Ultra 3 處理器整合異質運算,推出涵蓋六大產業的 Edge AI Suites,主張以傳統控制搭配 AI 輔助降低機器人部署門檻。
針對代理式 AI 需求,新架構減少 DDR 存取次數以支援長上下文,並支援 INT2 至 FP16 精度,透過 CPU 協調多步驟工作負載。
該助理目前開放搶先體驗,具備更生動的語音並整合 Swiggy 等在地服務,未來正式上線後 Prime 會員可免費使用。
該聯盟旨在解決美國 AI 算力擴張的電力瓶頸,將制定統一標準與快速審批通道,讓資料中心能依電網狀況動態調整功耗。
火山引擎指出大模型落地面臨能力、工程與確定性三大鴻溝,其 LAS 體系透過封裝 150 多個算子,在電商素材與具身智慧等場景大幅提升生產效率與成功率。
投資方包含 Matrix、Playground 與 Socratic Partners,專注解決 AI 資料中心內部晶片互連的網路傳輸需求。
該服務採用開源與本機 LLM 混合架構,能主動跨裝置提供會議與行程資訊,官方承諾不取用個人資料訓練模型或投放廣告。
該測試版功能目前於法國與北美推出,協助用戶處理複雜搜尋與分頁資訊,預設不儲存對話紀錄,預計今年稍晚擴展至英德兩國。
諾和諾德已用 Claude 將臨床報告撰寫從數月縮短至數分鐘;微軟 AI 負責人則警告其「憲法」路線恐使模型抵抗人類指令。
此相機模式將流程分為建立安全數位底片與後續顯影,解決現有 C2PA 標準在編輯鏈易遭竄改,以及綁定裝置所產生的隱私風險。
Cybercab 於奧斯汀上線後遭稽核,官方限期 9 月 30 日前說明如何符合聯邦安全標準,並釐清是否違規拆除臨時操控裝置。
這款 AI 瀏覽器助理主打隱私優先,預設不儲存對話且 Mistral 承諾不留存資料,首波於法國及北美開放測試。
為減少使用者決定任務分頁的困擾,本次更新將整合前端介面,並率先向 Pro 與 Max 方案用戶推出文件與簡報生成新功能。
RTX 5090 遭中國 AI 業者掃貨致官方庫存全空,第三方報價逼近 9,500 美元;另有多名公版卡用戶因序號褪色遭輝達拒絕保固。
為解決後段產線空間不足,三星正將韓國天安與溫陽廠區改建為 HBM 先進封裝產線,並敦促協力廠提前擴產以消化 DDR5 訂單。
獲前 ASML 執行長支持,Euclyd 整合處理器與記憶體技術,將開發完整硬體機架系統,專注降低 AI 推論能耗與成本。
加拿大 Cohere 與德國 Aleph Alpha 宣布合併,Aleph Alpha 共同執行長 Ilhan Scheer 將出任新公司營運長。
由字節跳動原 AI 製藥團隊負責人劉凱領軍的新主體,獲紅杉中國、高瓴創投及多家醫藥集團投資,目前官方尚未對此置評。
本輪由淡馬錫旗下 Xora 領投,使總融資達 8500 萬美元,其內部框架 Hobie 號稱能以 2 至 4 人團隊取代傳統 30 人編制。
分析指黃仁勳正影響川普對台晶片決策;他在 All-In Summit 2026 稱美國擔憂 AI 終結文明,中國的發展敘事則更為實際。
該美國新創由 Mark McQuade 於 2023 年創立,專注於開放權重模型與訓練後階段,透過此輪融資正式晉升獨角獸行列。
伺服器最快 2029 年上市,將提供配備兩顆或四顆 M8 Ultra 晶片版本,為蘋果自 2011 年停售 Xserve 後首度重返企業伺服器市場。
工程師可在 Antigravity 介面選用 Claude,但每人設有使用配額;Gemini 仍是公司主要推薦工具,過去對外部工具的限制被指放寬。
消息人士透露,由 10 家銀行組成的銀團將提供這筆鉅額融資,旨在協助該公司為人工智慧實驗室提供算力基礎設施。
美國總統川普與中國國家主席習近平預計於華盛頓舉行被稱為「G2 高峰會」的國宴,科技與貿易將成焦點。
該智能維運助手揚棄對話驅動,改以告警等事件觸發確定性 Pipeline 預取上下文,並將結構化維運經驗作為自進化對象,已於快手核心業務線落地。
雙方正討論租用廠房或與雲端供應商合資等方案,SK Hynix 官方回應尚未定案,且此技術轉移計畫未來可能面臨韓國政府審查。
相關程式碼已現身 macOS 與 iPadOS,該極簡介面可展開操作建議。代號 V68 的折疊機專屬分支顯示,未來有望結合手寫筆懸停與 AI 文字編輯功能。