DeepSeek 發布 V4 首款多模態模型 DeepSeek-V4-Flash-Vision-Exp,大幅提升視覺代理能力並採 MIT 授權
基於 V4-Flash 架構加入視覺模組,在多模態評測顯著超越前代並維持同等純文字效能,支援 vLLM 與 SGLang 部署。
47 則值得知道的變化
基於 V4-Flash 架構加入視覺模組,在多模態評測顯著超越前代並維持同等純文字效能,支援 vLLM 與 SGLang 部署。
新制不再單純計算使用次數,而是綜合考量提示詞複雜度與對話長度,免費版享標準配額,付費版依訂閱層級按比例增加。
因歐盟月活躍用戶逾 4500 萬,ChatGPT 與 Reddit 等平台同遭納入數位服務法規範,須於 2026 年底前完成合規。
基於 1 兆個時間點預訓練,於 Gift-Eval 等三大基準測試登頂,並採連續區塊遮罩技術免除迭代迴圈,提供 9 個分位數機率預測。
該模型為全球最大開源模型,有效參數達 104B,並導入與 DeepSeek V4 相同的 Muon 最佳化器,大幅推升記憶體用量。
HOMIE Gen2 模型全新發布,旨在解鎖人類經驗的 Scaling Law,被定位為專屬於機器人的經驗百科全書。
Google 推出 Gemini 3.7 Flash,Anthropic 年化營收達 650 億美元,OpenAI 則因安全事件暫停模型微調兩週。
解碼器基於 7400 小時音訊文本配對資料訓練以避免依賴純文本先驗,支援問答與 ASR,因沿用 NVIDIA 編碼器僅限非商業授權。
該基準以 92 組提案比較評估模型,人類專家一致率達 77%,而 Opus 5 與 GPT-5.6 Sol 等前沿模型表現皆接近隨機猜測。
論文證實在長文本基準測試中,SWA 表現遠優於耗費算力後訓練的線性注意力模型,能有效改善本地 LLM 推理的記憶體限制。
透過自研桌面用戶端與 FloatSail 系統,Floatboat 讓同款模型在五項基準測試從零勝轉為全勝,長程任務 DeepSWE 增益達 23.6%,證明複雜任務換 Harness 比換模型更划算。
技術自《NBA 2K27》早期版本外洩,主打以 AI 重新演算角色材質與光影,目前已被社群破解支援 RTX 40 系列顯卡運行。
該框架分為符號化因子與模型研發兩套獨立系統,透過預先登記算子與隔離測試集,限制 Agent 任意編寫程式碼,避免未來資料污染。
該研究透過 Google Gecko 嵌入將提示詞分群並建立模型專屬特徵向量,解決傳統路由在模型變更時需重新訓練的痛點。
針對現有反洗錢資料集的分數虛高問題,新資料集透過三階段時間快照與對齊金額分布切斷因果外洩,包含 10 萬節點與 120 萬邊。
對談指出 OpenAI 加密多 Agent 提示詞以鎖定生態,Claude Code 預設自動審批致成本翻倍,且當前低價訂閱正掩蓋每年高達百萬美元的真實算力成本。
本次為史上最大更新,匯集逾 1.6 萬個 PR。新版可自動讀取本機現有的 API 金鑰與模型,並透過本地 Gateway 串接多種通訊軟體。
新版支援免 GitHub 登入使用 Claude API、跨視窗共享會話,並推出呼叫互補模型檢查程式碼的 `/rubber-duck` 實驗指令。
獲 Google nDX 計畫補助,可讓 Claude 等 AI 應用即時檢索百年圖文與世界年鑑,並強制標註出處以改善幻覺。
新版 SDK 支援原生 Spark,Trainer 整合 Flux 框架,模型註冊表更名為 Hub 並支援 MCP 伺服器部署。
MyAgent 具備持久記憶與後台執行能力,底層透過 Circuit 平台路由任務,逾半數請求由本地開放權重模型處理以控制成本。
估值達 4.5 億美元,由 Sequoia Capital 與 Kleiner Perkins 領投。其利用非主流晶片與間歇性能源,專為不需低延遲的後台 Agent 提供低成本算力。
專案八個月內累積逾 11 萬次 PR 與 Issue,卻因過度依賴 Anthropic 模型,並耗時處理高達 9500 個設定項與資安報告,導致軟體變慢而遭競品搶走用戶。
Cadence 實測 AI 能將特定晶片驗證流程從 5 週縮短至 1 天,但最困難的 10% 關鍵區塊仍需工程師介入,未來 EDA 商業模式可能從軟體授權轉向按 Token 計費。
新平台 Raft 捨棄單一 Agent 運行時,直接接入 Claude Code 與 DeepSeek 等模型作為團隊成員,透過跨廠商通訊協定建立工作區,並將每個 Agent 定價為 0.1 個人類席位。
該機制首階段將指令解析為抽象語法樹進行安全比對,無法判斷時才交由獨立審查代理評估風險,據官方觀察最高可自動核准 82% 操作。
該應用由 Meta 收購的 Gizmo 團隊打造,輸入提示詞即可生成互動遊戲,但作品被限制在官方生態系中無法獨立匯出。
COUPE 將透過提升單通道至 400 Gbps 或增加波長數擴展頻寬,未來將支援達 3.3 倍光罩尺寸,並與 CoWoS 封裝整合。
代理在小型專案能有效收斂,但在複雜企業系統中易產生「操作熵」,需依賴測試與資料契約等明確限制來防止偏離目標。
據報此次異常發生於 8 月 31 日 16:55 至 19:16 UTC,導致網頁版 Claude Code 等功能效能下降,現已修復。
兩款模型整合至免除資料收集的 GenAI.mil 安全平台;Anthropic 則因堅持安全護欄遭列供應鏈風險而缺席。
廣告向 ChatGPT Go 與免費版用戶顯示,官方強調不影響回答且廣告主無法取得對話內容,未來將引入更多廣告型態。
該車由滴滴與廣汽埃安聯合打造,今年 1 月交付路測。車內配備 17.3 吋螢幕與 AI 語音互動,支援語音驗證尾號與調節空調等功能。
違規帳號的貼文將無法在 Reels 與探索頁面推薦給非粉絲;但僅使用 AI 修圖或撰寫文案的創作者不受此規範,依規標示者亦不會受罰。
開發者 Pieter Levels 透過 Claude Code 打造該網站,首日吸引 3.7 萬人觀看。底層模型由 fal Research 基於 MiniMax H3 優化,吞吐量達官方 35 倍。
針對 Claude 評測時意外連網的越界事件,官方承認存在對齊與資安疏失,將與 METR 合作獨立審查,並呼籲業界建立放緩研發步伐的協調機制。
Apple 在針對 OpenAI 的訴訟中提交新文件,要求加速證據開示程序,並指控前員工違規使用機密且相關證據正遭到銷毀。
據報英國央行總裁警告,新型 AI 模型的發展可能對全球金融穩定構成威脅,此消息引發外界對總體經濟與監管層面動態的關注。
測試代號 mozaik-alpha-fdm,能直接生成具備內部構造的 3D 城堡。模型先前因觸及關鍵級網路安全風險暫停訓練半個月。
該公司目前尚無營運中的資料中心,但已簽訂近 9 GW 算力合約;其俄亥俄州園區興建資金仍取決於 NVIDIA 是否提供擔保。
該德州資料中心由 Hut 8 建造,NVIDIA 藉由支持其投資的雲端供應商 Lambda,利用財務實力直接參與租約與晶片供應。
據社群消息指出,Runway 疑似推出名為 Solaris 的全新模型,定位為其首個「介面世界模型」,詳細規格仍待確認。
專注於銷售與行銷的 AI 新創 Clay 據報正進行新一輪募資,其投前估值已從今年一月員工認股時的 50 億美元,攀升至 70 億美元。
Apple 因缺乏企業 AI 策略與專責團隊,加上記憶體短缺導致供貨不及,部分企業客戶已轉向購買 Nvidia 類似尺寸的 DGX Spark 輕巧型 AI 桌機。