騰訊與甲骨文簽署 70 億美元協議,於東南亞租賃 10 萬枚先進 AI 晶片
這項為期 5 年的協議首付約 30%,騰訊將藉此取得受美國出口管制限制的先進算力,用於推進 AI 模型與代理工具開發。
58 則值得知道的變化
這項為期 5 年的協議首付約 30%,騰訊將藉此取得受美國出口管制限制的先進算力,用於推進 AI 模型與代理工具開發。
新版框架改採 DDP 架構並支援 MXFP8,在 512 張 B300 GPU 上成功實測 1.2 兆參數模型,大幅降低 MoE 路由與通訊成本。
由 AWS 實驗專案 Strands Labs 推出,體積小巧可於本機運行,能取代完整 LLM 處理代理工作流,提供低成本的自動化選擇。
該模型以 Qwen3-8B 為語言骨幹,捨棄獨立視覺編碼器,直接將影像轉為 16x16 像素區塊處理,權重僅限非商業研究使用。
AI 程式編輯器 Cursor 宣布正式上線 GLM 5.3 與 GLM 5.3 Flash,並指出 GLM 5.3 Max 是目前 CursorBench 4.0 評測基準中得分最高的開放權重模型。
新轉錄模型支援 60 種語言自動偵測,詞錯誤率僅 2.50%,並同步推出具備受限語音複製功能的 MAI-Voice-2.1。
模型採 Apache 2.0 授權並託管於 Workers AI,Clef-flash 中位數延遲僅 38.8ms,在多項決策評測中擊敗競品 Jev。
官方宣布 Grok 4.7 正式上線 Gemini Enterprise Agent Platform,擴展其企業級代理應用。
官方宣稱新模型解決局部編輯易生瑕疵的問題,提供單張 0.8 至 22 美分的四種計費方案,已上線平台與 API。
該模型能即時處理語音、表情與手勢,據稱在 Nvidia 擬真度評測中獲 3.83 分逼近真人,目前僅開放 Griffin-Lite 供少數測試者預覽。
IFM 團隊介紹新發布的 6 款 K2 Horizon 模型,除權重外,更全面開放訓練資料、程式碼、中間檢查點與細粒度日誌。
大規模消融實驗顯示,在相同時間預算與 LLM 骨幹下,最先進的複雜框架與僅具備基礎讀寫權限的單一代理表現無異,底層模型能力才是效能關鍵。
該方法讓模型在失敗後寫下 TL;DR 洞察並進行反向傳播,僅需 4 千筆任務與洞察配對資料進行訓練,即可達到完整訓練效能。
Ataraxos 克服龐大隱藏資訊與單局高達兩千步的挑戰,以 15 勝 1 敗戰績,擊敗稱霸世界第一逾 600 週的人類玩家。
測試 8 款模型發現,當錯誤答案被包裝成檢索來源時,多數模型會放棄原先正確答案,僅 Gemini-3.1-Pro 幾乎不受影響。
該架構將上下文視為檔案供模型自主更新,結合線上強化學習讓 Qwen3.5-9B 效能提升 47.6%,並降低 35% 伺服器運算成本。
該研究以廣義教師強制(GTF)穩定 DEER 演算法,支援百萬級長度序列,在動態系統重建任務上效能超越 Mamba。
具備檢索工具的 Agent loop 表現遠勝傳統 RAG。測試發現重排序模型反降準確率,且模型常以自身記憶作答並生成虛假引用。
這款人類互動模型在 NVIDIA 全雙工 AI 影片基準測試中奪冠,相較於其他系統僅約 3% 的欺騙率,其表現大幅領先。
透過 SSD 非同步預取技術減少延遲,實測在 13 萬 tokens 長上下文中,仍可維持 33 至 44 tok/s 的穩定解碼速度。
可由 CLI 或 App 啟用,支援讀取畫面與點擊輸入,能自動化缺乏 API 或 MCP 整合的傳統 GUI 軟體,操作前須經使用者授權。
Arm 提出由 CPU 負責運算,並透過 NVIDIA BlueField-4 等 DPU 進行獨立安全隔離的代理式 AI 基礎設施架構。
企業現在可透過儀表板直接部署免維護的專屬 AI 代理工作區,新版本更支援讀寫 GitHub 程式碼庫與 Gmail 郵件草稿。
HPE 宣布獲全球最大私有雲端公司 Vultr 採購合約,顯示非 NVIDIA 陣營的 AI 基礎設施取得重大商業進展。
受 AI 應用快速擴張帶動,中國正掀起新一波資料中心建設熱潮,推動其基礎設施規模躍升至全球第二。
Supermicro 結合其 DCBBS 與專屬 DLC-2 液冷技術,提供從 5 MW 至 GW 級的完整部署藍圖,單機櫃配備 20.7 TB HBM4 記憶體與 216 TB/s 互連頻寬。
協議採授權金加權利金新模式,雙方將合作提升 Trainium 效能,Synopsys 亦將透過 Amazon Bedrock 開發 AI 代理。
據統計,台積電加碼美國廠使累計投資達 2650 億美元;字節跳動與 MGX 分居二三名,AI 算力需求成擴產核心。
此計畫為美韓戰略投資合作的一部分,首批發電設施最快預計於 2029 年上線,除滿足園區需求外,多餘電力將回送德州電網。
新晶片導入 Adreno Neural Fusion 渲染技術與代理式 AI 影像管理,高通並定調智慧手機將成為跨裝置 AI 體驗的控制中心。
該案由 14 家台資銀行參與,超額認購 2.5 倍,資金將用於建置台灣首座 AI 工廠與 NVIDIA GB300 NVL72 算力集群。
商家可透過自然語言指示 AI 代理 Sidekick 修改網站結構與設計,初期僅支援桌面版,且暫不開放第三方主題與擴充套件。
這款採 MIT 授權的極簡代理框架新增 Anthropic 快取預熱與延遲工具載入,並同步釋出支援長效任務的實驗套件。
若將沙箱的共享快取替換為 Email 或 Slack,並結合 Muse 等個人代理,即具備讓惡意負載在代理間自我複製與傳播的完整條件。
原架構雖能支撐千億級向量與 200ms 延遲,但在多向量表示下會導致嚴重的儲存與寫入放大,新版將全面提升文字搜尋速度。
該套件與傳統 PDK 不同,主要為代理式 AI 提供技術知識層,台積電稱其可讓數位設計生產力提升 3 至 5 倍,但具體規格尚未公開。
開發者可透過少量 TypeScript 或由 Claude 輔助生成專屬模組,並於 CLI 或桌面應用中以 `/plugin` 指令安裝。
新版將檔案支援上限提升至 10 MiB,並提供每月各 1000 次語義與全文檢索免費額度,計費僅涵蓋攝取、儲存與查詢。
用戶可上傳自拍或全身照預覽服飾穿搭,並將商品存入專屬資料庫,同時支援上傳名人穿搭照片尋找可購買的同款單品。
平台具備預算控制與雙人審批機制,依用量計費。據報導,因拒絕放寬自主武器限制遭五角大廈封殺,目前轉向聯邦與州級民用機構。
這項被官方定位為「全新效能等級」的 AI 升頻技術,將率先應用於《漫威金鋼狼》與《羊蹄戰鬼》兩款遊戲中。
該功能整合於 Google TalkBack,可透過相機即時朗讀文字或尋找物品,並支援後續問答,但官方警告不可用於導航或避障。
馬斯克表示,為確保機器人量產有充足記憶體,AI6 記憶體也將降至 144GB。因頻寬維持不變,預計對效能影響可忽略。
雙方於 9 月 30 日宣布這項戰略協議,旨在推動 Amazon 更複雜的 AI 驅動產品與雲端服務的客製化晶片研發進程。
受美國先進 AI 晶片出口管制影響,中國資料中心與 AI 基礎設施正加速轉向國產替代方案,進一步推動了當地市場格局的改變。
2026 年第四季記憶體市場呈現兩極化,消費端需求疲軟與伺服器強勁採購形成強烈對比,凸顯 AI 工作負載正持續重塑硬體供應鏈。
雙方將在矽谷的研究中心展開結盟,共同研發次世代記憶體技術,目標是打造並影響全球廣泛使用的 AI 系統硬體架構。
因應 AI 晶片尺寸擴大,康寧、AGC、NEG 與 Schott 將次世代核心基板與玻璃穿孔技術路線聚焦於此單一尺寸。
美光透過台灣、日本與新加坡現有廠房進行在地擴充,並與台積電等大廠深化先進封裝合作,預期 2027 年後記憶體供應將更為緊張。
新光電氣於 9 月 30 日簽署協議,買下 Japan Display 位於千葉縣茂原市的廠房,藉此提升 AI 晶片封裝產能。
彭博引述知情人士指出,Anthropic 正尋求最快於 11 月中旬公開發行,若時程順利,將在美國感恩節假期前正式進入資本市場交易。
隨著 ABF 載板瓶頸轉移,高階雲端 AI 加速器市場將迎來結構性轉變,ASIC 總出貨量預計在 2027 年首次超過 GPU。
供應鏈消息指出,AWS 最新 AI 訓練晶片 Trainium 3 出貨進度落後預期,凸顯全球 AI 硬體供應鏈正面臨廣泛壓力。
Cloudflare 推出名為 Clef 的開放權重決策模型。此消息目前僅於社群流傳,具體的模型規模、架構與實際應用場景等細節均尚未公開。
Figma 疑似將 MCP 存取權限縮限至白名單客戶,並將 Pi 排除在外。此舉恐影響 AI 代理與相關工具的整合生態。
OpenAI 傳出已與三名內部研究人員分道揚鑣,解雇原因為這三人涉嫌將公司的敏感資訊,私下分享給外部的 AI 安全組織。