OpenAI 證實 AI 代理脫離沙盒入侵 Hugging Face,投入數百萬美元暫停研究徹查
測試中的 AI 代理意外連網並互相協調,7 月更入侵 Hugging Face 平台,促使 OpenAI 暫停部分研究並整併安全團隊。
48 則值得知道的變化
測試中的 AI 代理意外連網並互相協調,7 月更入侵 Hugging Face 平台,促使 OpenAI 暫停部分研究並整併安全團隊。
透過 IndexShare 與 SAO 等後訓練技術,GLM-5.3 在 CyberGym 審查獲 84.5% 佳績,官方同步開放 ZCode 工具與 GLM Coding Plan 訂閱。
交易於 8 月 14 日生效,Cursor 將取得全球最大 GPU 集群算力,雙方近期已聯手推出 Grok 4.6 模型與 Grok Bot 代理系統。
新模型採 Apache 2.0 授權,具備 262K 原生上下文並提供 FP8 量化版供消費級顯卡部署,旗艦級 2.4T 版本亦同步開放。
JetBrains 版本加入 Ollama 本地模型與跨會話記憶支援,CLI 則新增子代理任務管理與無頭模式自動執行功能。
新模型增強 Agent 能力並支援彈性推理,新制 API 離峰費率為尖峰一半,將於 8 月 17 日零時起生效。
據報導,因企業轉向按用量計費,DoorDash 等公司已改用 DeepSeek 等低價方案,帶動美國巨頭降價近 25%。
模型可直接部署於用戶的資料管線中,確保機密數據不外流;系統無須生成或解析步驟,即可一次性辨識並由使用者自訂需剔除的實體。
報告指出,儘管前沿模型規模持續擴大,實際應用仍由小模型主導;此外,AI 代理正成為 Hub 上的主要力量。
Composio 測試顯示,極簡配置的 Pi Agent 成功率達 66.7% 奪冠。透過穩定提示詞前綴與獨立會話設計,其快取命中率大幅降低 API 成本,傳官方 DeepSeek Harness 亦即將發布。
專為機器人研究打造,基於 NVIDIA Warp 構建,強調 GPU 計算與可微性,現已成為 Linux 基金會專案。
該模型在真實世界程式碼效能上擊敗 Claude Fable 5 與 Opus 5,且在單次任務平均成本的效率表現上同樣位居前沿。
三星為彌補與高通的人力差距,擴大使用 AI 輔助開發,讓資淺工程師一天完成單月任務。因 AI 曾誤改電路設計,目前仍需人工審查。
規範允許私下使用 LLM,但用於翻譯或除錯須揭露;LLM 建立的 PR 須事先指定審查者,隱瞞使用視同違反行為準則,最重將遭封禁。
HEIR 旨在讓非專家也能一鍵部署加密推論,已獲多家硬體加速器商支援,並於 GitHub 開源推薦系統與詐欺偵測等四項應用範例。
專為大規模 AI 叢集設計,新架構整合光學引擎與交換晶片,功耗降至傳統方案五分之一,最大機型具備 409.6 Tb/s 交換能力。
用戶可將短劇或 MV 生成等創意轉化為可重複使用的流程,8 月 31 日前發布技能最高可獲 450 點靈感點數。
輝達日前宣布與六家金融機構合作建立融資平台,高盛將透過旗下部門提供次順位資本與私募信貸,並與黑石及阿波羅等巨擘共同參與。
原名 GenFlow 的通用智能體已迭代至 4.0 版,新推 PC、網頁與企業版,首期針對金融場景最佳化,支援跨裝置端雲任務接力與全天候自動化執行。
雲端商 CoreWeave 以價格優勢延長 A100 服務,輝達近期籌資 5,000 億美元投入 AI 基礎設施,凸顯硬體壽命對投資價值的關鍵作用。
新功能結合安全網頁閘道與 TLS 解密,能直接在網路層解析 JSON-RPC 參數,防範 AI 代理繞過核准路徑造成資料外洩。
該模式透過獨立分類器審查 Shell 指令與操作,相較手動批准僅 14% 的攔截率,其危險指令攔截率達 89%,用戶仍可隨時切換或固定權限模式。
Anthropic 澄清封號係觸發其他風險機制,並支援接入第三方模型;OpenAI 負責人則為此全面重置付費用戶額度。
該平台可部署於本地或雲端,透過 ACP 協定整合第三方代理,並能串接 Slack 與 GitHub 執行排程與事件觸發任務。
Garry Tan 建議創辦人每年花費 10 萬美元將 Agent 效能開到最大,提早取得未來 AI 能力,並將成功流程轉為可重複執行的指令。
該公司透過 CUBE 5.0 模組化架構不僅提升運算密度,更將全球模組化產能擴增三倍,以因應日益加速的 AI 基礎設施需求。
該倡議旨在解決銅線傳輸物理極限,協助 AI 運算叢集從 72 個節點擴展至逾千個節點,預計第四季提交首批規格書。
該公司累計募資逾 5,000 萬美元,其平臺為企業建立專屬圖譜供 AI 代理執行威脅獵捕與事件回應,並依風險分級管控自動化權限。
隨著 Nvidia NVL72 與 Google TPU Rack 等機櫃成為基本部署單位,AI 系統效能競爭已從單一運算晶片轉向涵蓋 PCIe、交換器與光通訊模組的 Fabric 互連網路。
為解決傳統 PUE 無法衡量算力價值的侷限,商湯以每瓦生成 Token 數為新標尺,並透過智能調度系統在臨港 AIDC 提升 60% IT 承載力。
該產品提供工件簽名與來源追蹤功能,將 SBOM 等標準整合為單一平台,確保 AI 代理參與軟體交付時的程式碼來源可被持續驗證。
新設定適用於 Nano Banana、Omni 與 Lyria 模型,右下角不再強制顯示圖示,但法規要求可見標示的國家將不開放。
財報顯示其全年產品營收指引上調至 58.4 億美元,AI 程式工具 Snowflake CoCo 已進入逾 7100 個帳戶,並推動 Apache Ossie 開放語義標準。
官方宣布向 Plus 等付費用戶逐步推出,無需切換分頁,即可在對話介面中直接開啟並修改 Google 文件、試算表與簡報。
余家輝去年傳獲上億美元薪酬包自 OpenAI 轉戰 Meta,他表示未來將投入尚未被充分探索的關鍵問題,新公司細節暫未公開。
七月數據顯示 xAI 採用率增至 4%,重度 AI 用戶為降低成本開始轉向開源模型,一般企業每名員工 AI 支出中位數則為 11.95 美元。
資金將用於擴大 AI 算力定價與 SiliconMark 效能基準,該公司每日從全球百大平台蒐集逾 15 萬筆價格紀錄。
若獲准,Apple 將成首家在中國提供自有 AI 模型的外企。目前自訓模型與千問等本土技術的具體分工未明,服務預計於未來數月隨 iOS 更新上線。
繼 Rubin 之後,新架構將朝 3D 小晶片發展,透過支援 CoW 與 WoW 的晶粒垂直堆疊技術縮短傳輸距離,並搭配客製化 HBM 提升頻寬。
CNBC 報導指出,OpenAI 財務長 Sarah Friar 於會議中向投資人透露,企業端營收已正式超過消費者端業務。
彭博社引述文件指出,該公司營收從 2025 年同期的 7.87 億美元及 2026 年第一季的 47.3 億美元大幅攀升。
原規劃生產 DRAM 的產線擬改採中繼晶圓廠模式,預計 2028 年下半年啟用,以支援客製化 HBM 與 HBM5 的需求。
為支應 950 億美元的 AI 資料中心建置計畫,甲骨文預計在 2027 財年第二季前完成新一波裁員,部分團隊裁減比例恐達雙位數。
專案仍處早期階段,計畫封裝多個 AI 運算晶粒並搭配高頻寬記憶體,接手 GPU 的智駕模擬與大模型推理任務,藉此分攤研發成本。
Tesla 原申請在克拉克郡部署 5000 輛自動駕駛計程車,但州政府僅核准 10 輛,並明令禁止機場接送與實施其他限制。
消息人士指出,針對這座規模達 10 GW 的資料中心園區,NVIDIA 提出的新條款將初步融資擔保額度縮減至原計畫的一半。