跳到主要內容
2026-09-13 日報
模型發布

DeepSeek 據報以 V4.1 Flash 替換 V4 Pro:僅提前約一天通知、未設遷移期

AI 前線單一來源
已查原文 · 4 項主張

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

經查證,報導中關於 DeepSeek 宣佈以 V4.1 Flash 替換 V4 Pro 且缺乏並行遷移期引發復現隱患、同期招募 150 個不參與模型訓練的底層系統工程師,以及 DSec 系統運用全域有序軌跡日誌等主張,皆與原文內容完全相符,所有重要主張均獲得支持。

DeepSeek 宣佈發往 V4 Pro 的請求改由 V4.1 Flash 處理並按其計費,且未設立新舊模型並行的遷移期。

原文確認官方進行模型路由切換,且未提供新舊模型並存的緩衝過渡期。

没有新旧模型并行的迁移期

查看原始出處

舊模型突發退役引發反彈,科研團隊擔憂舊版本撤下會導致過去的實驗條件與結果難以復現。

原文記載了研究團隊對 V4-Pro 舊版撤除後,先前實驗結果無法重現的擔憂。

以前得到的结果也可能很难复现

查看原始出處

爭議發生前,DeepSeek 宣佈開放約 150 個底層系統與後端職缺,這批工程師都不會參與模型訓練。

原文證實了招募約 150 名專注於作業系統與後端等工程師,且未參與模型訓練。

都不会参与模型训练

查看原始出處

DSec 基礎設施能並行數十萬個 Agent 環境,並透過全域有序的軌跡日誌記錄任務命令以支援中斷恢復。

原文明確提到 DSec 使用全域有序的軌跡日誌,以支援 Agent 任務中斷後的恢復。

全局有序的轨迹日志

查看原始出處
據 AI 前線報導,DeepSeek 團隊成員崔添翼 9 月 9 日在 X 發文稱,V4.1 Flash 在效能、費用、速度與總耗時等方面都超過 V4 Pro;V4.1 Flash 上線後、V4.1 Pro 上線前,所有原本發往 V4 Pro 的請求都會改由 V4.1 Flash 處理,並按 Flash 價格計費。報導稱,DeepSeek 當天在開放平台發布公告,部分客戶也收到電子郵件,但距離切換約只有一天,沒有安排新舊模型並行的遷移期;不少開發者直到看到瀏覽量超過 70 萬的 X 貼文,才得知 V4 Pro 即將被替換。 內部與外部測試據稱顯示,V4.1 Flash 採用新的模型結構並原生支援多模態,能力更強、速度更快且成本更低。反對聲音主要來自已將 V4 Pro 接入生產環境的開發者,他們認為平台應為新舊模型使用不同的 model ID,並在舊模型退役前至少提供兩週緩衝,讓使用者重新調整 Prompt、品質控制與參數。報導指出,模型替換可能改變輸出長度、格式、拒答範圍及工具呼叫順序,進而使既有程式出錯;使用 V4-Pro-0813 進行研究的團隊則擔心舊模型撤下後,實驗條件難以維持或重現。 這場爭議發生前兩天,崔添翼另稱 DeepSeek 開放約 150 個資深後端與服務端工程師職缺,工作涵蓋作業系統、虛擬化、網路、儲存、調度、容器、控制平面與 Agent 彈性計算,而非模型訓練。報導並提到,DeepSeek 的 DSec(DeepSeek Elastic Compute)可在單一集群並行執行數十萬個 Agent 沙箱,透過 Python SDK 提供預熱容器、相容 Docker 的容器、Firecracker 微型虛擬機與 QEMU 虛擬機等環境,並接入分散式檔案系統 3FS 按需載入資料;系統也以全域有序軌跡日誌記錄命令與結果,支援中斷後恢復並避免重複執行。報導認為,DeepSeek 雖持續補強模型下方的系統工程,但這次版本切換仍暴露出版本隔離、退役公告、過渡窗口與通知機制不足的問題。
讀原始報導

這則事件的發展

  1. 2026-09-11DeepSeek 發布 552B 多模態模型 V4.1-Flash:輸入僅啟動 8B 參數,KV Cache 縮減至前代四分之一並下調 API 定價
  2. 2026-09-10傳 DeepSeek 將推 v4.1 flash 模型,定價更低且能力超越 v4 pro