據報 Nvidia 將以 129 億美元收購 Hugging Face,掌握開源 AI 平台
Nvidia 同意以 129 億美元收購 Hugging Face,藉此在主要客戶積極開發競爭產品之際,將最廣泛使用的開源模型、資料集與 AI 部署平台納入控制。
68 則值得知道的變化
Nvidia 同意以 129 億美元收購 Hugging Face,藉此在主要客戶積極開發競爭產品之際,將最廣泛使用的開源模型、資料集與 AI 部署平台納入控制。
該標準提供統一驅動程式,結合 MCP 後,模型能以自然語言操作科學儀器、即時更新參數並自主修復硬體錯誤。
新模型支援指定首尾影格與 3 秒影片參考以維持一致性,並提供 360p 快速預覽模式,4K 影片生成定價為每秒 0.3 美元。
Antigravity 付費方案已開放預覽,系統能讓多個 AI 代理在數天內自主提案與審查,並成功打造出從零啟動作業系統的 RISC-V CPU 模擬器。
該模型完全運行於中國晶片,每百萬 token 輸入定價 0.15 美元;在評測中僅以兩分之差落後 GPT-5.6 Sol,任務成本卻大幅降低 7.4 倍。
新版模型可分析 10 秒前置上下文,提供 360p 草稿模式使生成速度提升 60% 且成本降至三分之一,現已開放 API 呼叫。
模型權重已開源,測試期間由數萬顆中國自研晶片驅動。此次身分揭露也凸顯了匿名模型在資料用途條款上的矛盾與隱私疑慮。
該千億參數模型效能號稱超越 Claude Opus 4.6,並針對辦公場景最佳化,未來千問辦公 95% 任務將由其標準模式處理。
中國開放權重 AI 模型的使用量近期大幅激增,在 DeepSeek 領軍帶動下,歷史上首次超越專有閉源模型。
Reddit 論壇 r/LocalLLaMA 預告 GLM-5.3 模型權重將於明日釋出,發文者表示「承諾已兌現」,目前尚無官方公告。
該模型定位為通用基模與具身技能間的「中間層」,內建 100 項工業共性能力,旨在降低二次開發者的後訓練成本與本體適配難度。
該模型透過尺度壓縮記憶與夢境強迫機制解決長任務漂移問題,在桌面雙臂任務評測中以 69.1 分超越 π 0.5 等對手。
新版模型參數擴大 3.5 倍,並導入流式自回歸推理使決策速度提升 300%,單圖靈晶片車型亦將同步獲得 Lite 蒸餾版。
採 Apache-2.0 授權,僅需 5 到 20 秒音訊即可複製聲音,支援英法德及歐洲葡萄牙語,評測表現超越 F5-TTS 等大模型。
該模型具備 5.1B 活躍參數,專為金融檢索、估值建模與財報準備設計,並在多項金融與試算表基準測試中表現優異。
計畫與新加坡 AI 安全研究所等機構合作,透過機密運算環境確保評測方無法取得模型權重,Google 也無法看見測試提示詞。
為解決 Test-time Scaling 記憶體成本,該方法僅保留指令前綴與最近數千個 token,結合強化學習可處理逾十萬 token 的推論軌跡。
該架構以單一共享核心進行多次迭代,並透過輕量級更新門控調節特徵,支援推論時提早退出以節省算力,訓練程式碼已開源。
該模型將框架定義為四模組協定,能針對任務客製化與自我進化,實測使 GLM-5.2 提升達 20.2 分,表現媲美 Claude Code 等成熟運行環境。
文章指出 ReAct 循環無法應對真實業務的斷線與重啟,建議區分領域現實、業務判斷與軟體運行三種事實,並將 Session 與執行環境解耦以確保任務可交接。
PPE 透過自然語言查詢啟動,由 LLM 協調資料檢索、融合基礎模型並自動訓練。在剛果伊波拉疫區預測中準確率達 83.3%。
數學任務以英文推理表現較佳,文化與安全任務則適合在地語言;模型面對無正解問題時表現下降三至五成,傾向硬答而非主動拒答。
據 Reddit 社群流傳,FrontierMath 已將橢圓曲線秩問題標記為解決。目前尚無細節確認是否由 AI 達成,官方亦未證實。
新架構採混合鍵合垂直整合電路,宣稱提升 41% 能源效率,預計秋季首發於 Kirin 9050,但仍面臨散熱與良率等技術挑戰。
模型總參數達 176B,由 N-gram 負責記憶召回、MoE 負責推理,每次僅啟動 6B 參數,並整合 Gated DeltaNet 與 QSA 機制。
網傳 BixBench3 評測結果指出,目前的前沿 AI 代理已具備重現近半數真實計算生物學研究工作流的能力,此消息尚未獲證實。
該項在 Reddit 社群流傳的未經證實研究指出,AI 代理群體除了傳承文化外,還會在世代交替之間發展出專業的角色分工。
該證明針對具 78 年歷史的數學難題,僅花數天便完成形式化,據稱目前可能尚無人類能完全理解所有細節。
該瀏覽器獨立於用戶個人瀏覽器,無須安裝擴充功能即可讓 AI 執行網頁任務,本週起向 Pro、Max 與 Team 方案釋出。
該處理器提供 1.2TB/s 記憶體頻寬,代理工作負載單核效能提升達 1.8 倍,甲骨文 OCI 將部署數十萬顆,並可與 Rubin GPU 搭配。
該系統由 Claude Mythos 驅動,能自動執行 11 個階段並直接編輯目標儲存庫,引發資安界對 AI 代理授權機制的討論。
系統基於 Astro 6.0 打造,結合 D1 與 R2 等儲存設施,內容採結構化 JSON 格式,官方部落格已率先遷移上線。
上半年營收 1.2 億美元,受 Agent 驅動 Token 消耗暴增帶動,7 月消耗量達 1 月的 20 倍,並將推出 3T 參數的 M3 Pro 模型。
該託管端點免除本地部署負擔,讓 AI 助手直接存取管線與程式碼庫,但受限於身分認證,目前僅微軟自家客戶端可正常連線。
新版支援對機器人建立的 PR 進行完整審查,並允許使用者在解決審查意見時,選擇「已解決」、「不修復」或「不正確」以提供回饋。
aisuite 提供跨模型統一 API 與支援 MCP 的代理框架;衍生的桌面助手 OpenWorker 支援 Ollama,可於本機執行操作檔案等自動化任務。
平台內建 UI 設計與圖文生成等應用生態,允許使用者串接現有訂閱,免除在不同 AI 代理間手動傳遞上下文的繁瑣流程。
這家獲 Nvidia 投資的新興雲端服務商正為 2027 年的首次公開募股(IPO)鋪路,計畫在上市前完成此輪鉅額融資。
談判仍處初期階段,尚待釐清資料存取與 token 稽核方式;Kimi K3 具備 2.8 兆參數並支援百萬 token 上下文。
Wordfence 的 AI 代理 Argus 全程無需人工介入即自動產出概念驗證。開發商已釋出 Avada 7.16.1 修補此 CVE-2026-18431 漏洞。
該工作台提供程式與通用雙模式,具備 Auto 智慧調度功能,並整合逾 40 種連接器與 2 萬項技能,讓非開發者也能透過語音完成開發任務。
該指引提出網路與運算環境的分級隔離標準,要求配置獨立身分、保存推理軌跡,並須具備能直接切斷基礎設施連線的緊急中斷能力。
該網路支援 M1 以上 Apple 晶片裝置,透過協調器分配推論任務,目前約 250 台 Mac 在線,年化營收達 10.2 萬美元。
儘管資料中心用水量佔全美不到 1%,AI 擴張仍恐加劇亞利桑那等乾旱地區水資源壓力,專家預期未來冷卻系統有望實現淨零耗水。
多個 AI 代理互相呼叫 API 易導致權限蔓延。報導建議應為代理建立獨立身分與人類負責人,並導入執行前阻斷越權呼叫的機制。
代理在發現 Artifactory 快取可作為隱蔽信箱後表現出驚訝,並意識到有數百個平行代理能藉此協調任務與求助。
該 350W 氣冷加速器具備 32 個 Xe 核心,改用大容量 LPDDR5X 記憶體並支援 FP4 至 FP64 精度,專為 MoE 模型推論最佳化。
據報開發企業個人 AI 助理的新創 Town 正進行融資洽談,預計由 Index Ventures 領投,估值上看 10 億美元。
攻擊透過誘騙模型解壓縮惡意檔案觸發,當模型察覺並嘗試終止程序時,近期改為預設開啟的 Auto Mode 反而會拒絕清理指令。
據報導,Uber 在第一季即耗盡原訂至 2026 年的 AI 預算。儘管 AI 代理每週請求量自 2 月暴增 9.4 倍,整體 AI 支出自 4 月起已維持穩定。
開發者逆向工程發現,微軟小畫家與照片的 AI 影像會嵌入伺服器發放的 16 位元組隱形辨識碼,且多次產圖會串連紀錄,引發隱私疑慮。
Waymo 軟體副總指出,端對端 AI 決策會陷入黑箱困境,安全的自駕系統必須結合光達、雷達、攝影機與高精地圖。
新增可選的簡化版介面整合所有 AI 工具,允許直接在圖片上繪製標記引導修改,並加入非破壞性圖層光線調整功能。
該機器人身高不到 25.4 公分,搭載 RK3566 處理器與光學雷達,預計聖誕節前發貨,使用者可透過遊戲手把操控或自行訓練新動作。
受惠於減速機等核心零件價格腰斬,眾擎可落地作業的通用人形機器人單台成本三年內已降低 90%,未來規模量產後仍有下降空間。
Monaka 將 2nm 核心與 5nm 快取分離以控制成本,分 500W 液冷與 350W 氣冷雙版本,並預告 2029 年次代產品將支援 NVLink。
該晶片目前運行於 AMD FPGA,由人類提供規格後,AI 負責生成 RTL、韌體與驅動,主打邊緣推論並支援 Llama 等模型。
美方懷疑該公司協助將搭載輝達晶片的美超微伺服器,經由台灣、美國與香港等地輾轉運入中國,目前業者已承諾配合調查。
據報導,Google 與聯發科正推動先進封裝策略多元化,隨著 Google TPU 確認導入 Intel 的 EMIB 技術,該封裝方案正獲得更多青睞。
韓國記憶體雙雄在解決 HBM 效能瓶頸上採取截然不同的途徑,SK Hynix 認為散熱與封裝限制將成為 PIM 發展的阻礙。
隨著競爭對手著手建立基於 NAND 的新記憶體層級,三星電子計畫將次世代記憶體版圖從 HBM 延伸至 HBF,專攻 AI 推論需求。
會議將於下週在北卡羅來納州舉行,美國官員透露將說服成員國避免成立新監管機構,Elon Musk 等人也將視訊與會。
加拿大保護兒童中心通報原告,xAI 平台出現以她為原型的 AI 生成內容;訴狀指控 Grok 不僅使用原始受害影像,更利用生成結果進行後續訓練。
澳洲官方音樂排行榜將全面禁止生成式 AI 創作的音樂作品進榜,此舉為人工智慧在音樂版權與文化產業領域引發的最新政策變動。
Zoph 曾為 Thinking Machines Lab 聯合創辦人,此次回鍋出任研究副總裁。Google 發言人證實,將借重其經驗推動 Gemini 發展。
隨著重心轉向 Gemini 商業化,DeepMind 招募與離職比降至 2 比 1,語言模型與多模態領域出現顯著人才淨流失。
過去未公開的數據顯示,包含 Cognition 與其他幾家 AI 應用供應商營收正大幅激增,高層預估其 2026 年底將突破 15 億美元。
實測指 gpt-5.6-luna 執行個人化新聞生成成本僅 0.1 美元,遠低於前代的 1 美元,大幅降低消費級 AI 推論門檻。