DeepSeek 無預警釋出 V4 Pro 0813 正式版 API,Agent 能力大幅提升直逼 Fable 5
新版模型軟體工程跑分翻倍,加劇與 Grok 4.6 的價格戰,官方並暗示將推出專屬代理框架 DeepSeek Harness。
52 則值得知道的變化
新版模型軟體工程跑分翻倍,加劇與 Grok 4.6 的價格戰,官方並暗示將推出專屬代理框架 DeepSeek Harness。
該醫師經一年嘗試後於 2026 年 7 月取得突破,證明過程結合了 2-dilations 擾動引理與雙層位勢表示法。
測試 13 款模型發現,即使啟用思考模式,前沿模型仍有 11% 至 12% 的事實無法提取,顯示擴展規模對改善知識提取的幫助有限。
該 3.1B 模型記憶體佔用低於 3.3GB,在蘋果 M5 Max 推論達 228 tokens/s,並大幅提升螢幕 UI 理解與函數呼叫能力。
模型以逾 10 萬小時、50 多種手語資料訓練,初期支援美國手語轉英語。系統僅擷取骨架座標進行翻譯,不回傳原始影片以保護隱私。
韓國 AI 實驗室 Upstage 推出新一代旗艦推理模型,支援 512K 上下文,在代理與長文本任務表現大幅提升,但延遲增加且定價翻倍。
Runway 宣布最新影像模型 Grok Imagine Image 2.0 已正式加入其平台,使用者現可直接存取並體驗該模型。
模型透過預測畫面與動作學習物理空間關係,僅需 13 分鐘專用資料即可讓五指機器人轉開瓶蓋,並在客戶部署取得 87% 通過率。
該系列模型將感知與行動能力拆解驗證,包含採用 MoE 架構強化物理規律預判的 LingBot-Video,公司並計畫於年底完成第二輪融資。
網友於 ModelScope 發現 Qwen 3.8 27B 模型頁面,原欲藉此確認確切發布時間,但該連結隨後即遭移除,官方尚未證實。
新版本將語義編解碼器幀率減半至 25 Hz 並導入 Zipformer 架構以降低成本,同時利用 GRPO 強化學習提升發音自然度。
該機器人在一小時無人工介入的直播中,僅用標準夾爪處理隨機包裹,準確率逾 98%,其 WUM 架構模型能即時預測物理變化。
該方法透過自適應篩選與群體資訊傳輸機制聚合隱藏狀態,在長文件場景中可減少 73.94% 的提示 KV Cache 並加速推理,且直接相容 Qwen 與 LLaVA 等模型。
分析顯示 Opus 5 平均回覆達 510 字,更常使用破折號與坦誠語氣;同系列的 Fable 5 則較簡潔,但給予肯定回饋的機率翻倍。
有別於 LLM-as-judge,AutoEval 透過真實人類提示與模型回覆進行評分,維持動態基準,讓模型實驗室能快速取得基於人類偏好的洞察。
由北京大學與 NTU 等團隊共同研發的世界動作模型 ω-0,旨在重塑人形機器人的居家作業模式,使其具備全身協同自主作業能力。
該方案幾乎無針對 ARC 進行最佳化,僅透過單一動作指令與檔案系統日誌,即可達到 99.3% 的 pass@2 成績。
該語言以二進制圖存儲作為編譯器輸入,並透過統一的 JSON 介面與穩定錯誤代碼,讓 AI 代理能直接查詢、修補與決策程式碼。
駭客在 40 分鐘內透過 PyPI 竊取逾 43 萬筆 CI/CD 憑證與 AI 金鑰,為 2026 年最大規模 AI 供應鏈外洩事件。
透過全新連接器,Agent 可直接同步並匯入使用者在其他平台的工作資產,將分散的設計與文件集中管理,開放所有付費方案使用。
本輪由 Menlo Ventures 領投,騰訊與 Salesforce 等參投。該平台目前託管 6000 萬個專案,並提供自研 AI 模型與前沿模型選項。
專案基於 RustVMM 與 KVM 建構,最新 v0.6.0 版新增 Kubernetes 支援,並具備快照與網路審計功能,解決 Agent 執行的安全與狀態恢復難題。
該計畫旨在籌集逾 5000 億美元第三方資金投入 AI 基礎設施,預期將重塑業界支付運算資源的模式,黃仁勳為此特別向投資人說明公司的曝險狀況。
該機主打具身智能概念,內建與阿萊(ARRI)共研的 2 億畫素主鏡頭及自研影像晶片,支援抖音與微信視訊自動追焦,並搭載第五代驍龍 8 至尊版。
報告指出,企業選擇平台首重跨模型彈性,且多數承認其部署的代理多為聊天機器人,目前投資主力集中於代理監控與安全權限。
本輪由 Peak XV Partners 領投。該公司專注於持續整合(CI)與程式碼驗證,並推出能自動修復錯誤的 AI 代理 Codesmith,客戶數已突破 5000 家。
本輪由 Dell 等機構領投,累計融資達 1.2 億美元。其技術透過觀測員工跨軟體操作,解決高達 95% 企業 AI 代理失敗的困境。
Synopsys 發表 26.R1 版本整合 Ansys 技術,並推出 PyAnsys 讓客戶自建 AI 代理,與微軟實測顯示設計驗證效能最高提升 40%。
據報導,Intel 指出即使增加 GPU 算力,CPU 調度、記憶體容量與資料移動仍將成為代理型 AI 伺服器的新效能限制。
對話紀錄將自動儲存並同步至桌面、網頁與行動版,瀏覽器內亦支援 skills 與 connectors,Pro 用戶將於未來幾週內獲得更新。
新機搭載台積電 3 奈米 Tensor G6 晶片,支援處理冗言贅字的 Rambler 語音輸入與相機手語翻譯。全系列即日起預購,預計 8 月 20 日正式上市。
拒絕範圍涵蓋實況、VOD 與聊天室紀錄,僅適用於未來的模型訓練。若在他人頻道聊天,資料是否被用於訓練將取決於該頻道主的設定。
蘋果於家庭 App 提示升級 iCloud+ 可獲更多 AI 額度,未來圖像生成等依賴伺服器的功能,將依訂閱級別設定每日使用上限。
德國倡議團體針對 Meta AI 眼鏡正式提出刑事控告,指控內容涉及 AI 產品的隱私與法律監管問題,具體細節尚未公開。
該平台結合影片時間軸與無限畫布,支援任意模型生成並完整記錄資產來源以利版權審查,目前已有逾百家好萊塢與廣告工作室採用。
投資人 Gavin Baker 指出,多家企業預期合約到期後單張 GPU 支出將增加至少一倍,引發社群對 DGX Sparks 價格同步翻倍的擔憂。
儘管雲端業務營收年增近 4 倍,硬體銷售卻衰退。公司正加速擴產,以支應與 OpenAI 簽訂的 200 億美元算力協議。
Intel 積極推動 Foveros 3D 與 EMIB 互連技術,預計 2028 年封裝尺寸將達業界標準 12 倍,突破光罩極限。
由於 Googlebot 綑綁傳統搜尋與 AI 抓取,導致網站流量銳減。在監管與業界施壓下,Google 將先於英國測試不影響排名的 AI 退出選項,隨後推向全球。
Sanders 指出 AI 模型已出現突破隔離環境與協助設計病毒等失控風險,呼籲業者兌現安全承諾停止擴張,否則參議院將採取行動。
面壁智能由中信證券輔導上市,其端側模型 MiniCPM 開源下載量破 3800 萬次,並已導入三星手機與長安馬自達等量產車款。
該公司專門收購傳統會計與 IT 企業並導入 AI,旗下稅務代理 TaxAI 已達 98% 準確率。新資金將用於進軍基礎設施合規審查市場。
AI 流量佔比突破 60%,大廠正以硬體金鑰與 JA4+ 技術封鎖免費爬蟲,將商業模式從廣告曝光轉為向 AI 代理收取 API 費用。
據報導,鴻海於 8 月 12 日向投資者說明,目前獲利成長速度已快於擴充 AI 伺服器產能所需的支出,未來擴建資金充足。
彭博社引述知情人士報導,Anthropic 正與 Decart 進行收購談判。該新創專注於即時生成式影片與 GPU 最佳化技術。
蘋果正與各大出版商協商複數年合約,將依據 AI 實際使用內容的情況支付費用,藉此讓語音助理能精準掌握最新時事,官方尚未對此置評。
模型包含 2B 語言與 400M 視覺編碼器,具備 128K 文本上下文,多模態驗證範圍為 8K,且不支援工具呼叫與系統提示詞。
該公司五月才以 260 億美元估值募得 10 億美元,其企業客戶包含 NASA 與高盛,過去半年使用量每月成長 50%。
美國白宮預計於未來幾個月內更新現有框架,正式將達到「前沿能力」的開放模型納入規範,以應對持續擴大的 AI 監管挑戰。
受惠於專業服務領域對 AI 工具需求激增,這家瑞典新創距離上次以 56 億美元估值募資僅相隔四個月,估值已近乎翻倍。
Xirp 本身不提供模型,而是透過整合 Spotify Portal,讓 AI 掌握內部服務相依關係與架構決策,目前僅支援 macOS。
官方表示 Grok 4.7 初步訓練已完成,效能顯著優於 4.6 版,目前正透過 SpaceX 內部資料進行特殊補充訓練。