模型發布
DeepSeek 據報以 V4.1 Flash 替換 V4 Pro:僅提前約一天通知、未設遷移期
AI 前線單一來源
已查原文 · 4 項主張
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
經查證,報導中關於 DeepSeek 宣佈以 V4.1 Flash 替換 V4 Pro 且缺乏並行遷移期引發復現隱患、同期招募 150 個不參與模型訓練的底層系統工程師,以及 DSec 系統運用全域有序軌跡日誌等主張,皆與原文內容完全相符,所有重要主張均獲得支持。
DeepSeek 宣佈發往 V4 Pro 的請求改由 V4.1 Flash 處理並按其計費,且未設立新舊模型並行的遷移期。
原文確認官方進行模型路由切換,且未提供新舊模型並存的緩衝過渡期。
没有新旧模型并行的迁移期
查看原始出處
爭議發生前,DeepSeek 宣佈開放約 150 個底層系統與後端職缺,這批工程師都不會參與模型訓練。
原文證實了招募約 150 名專注於作業系統與後端等工程師,且未參與模型訓練。
都不会参与模型训练
查看原始出處
DSec 基礎設施能並行數十萬個 Agent 環境,並透過全域有序的軌跡日誌記錄任務命令以支援中斷恢復。
原文明確提到 DSec 使用全域有序的軌跡日誌,以支援 Agent 任務中斷後的恢復。
全局有序的轨迹日志
查看原始出處
據 AI 前線報導,DeepSeek 團隊成員崔添翼 9 月 9 日在 X 發文稱,V4.1 Flash 在效能、費用、速度與總耗時等方面都超過 V4 Pro;V4.1 Flash 上線後、V4.1 Pro 上線前,所有原本發往 V4 Pro 的請求都會改由 V4.1 Flash 處理,並按 Flash 價格計費。報導稱,DeepSeek 當天在開放平台發布公告,部分客戶也收到電子郵件,但距離切換約只有一天,沒有安排新舊模型並行的遷移期;不少開發者直到看到瀏覽量超過 70 萬的 X 貼文,才得知 V4 Pro 即將被替換。
內部與外部測試據稱顯示,V4.1 Flash 採用新的模型結構並原生支援多模態,能力更強、速度更快且成本更低。反對聲音主要來自已將 V4 Pro 接入生產環境的開發者,他們認為平台應為新舊模型使用不同的 model ID,並在舊模型退役前至少提供兩週緩衝,讓使用者重新調整 Prompt、品質控制與參數。報導指出,模型替換可能改變輸出長度、格式、拒答範圍及工具呼叫順序,進而使既有程式出錯;使用 V4-Pro-0813 進行研究的團隊則擔心舊模型撤下後,實驗條件難以維持或重現。
這場爭議發生前兩天,崔添翼另稱 DeepSeek 開放約 150 個資深後端與服務端工程師職缺,工作涵蓋作業系統、虛擬化、網路、儲存、調度、容器、控制平面與 Agent 彈性計算,而非模型訓練。報導並提到,DeepSeek 的 DSec(DeepSeek Elastic Compute)可在單一集群並行執行數十萬個 Agent 沙箱,透過 Python SDK 提供預熱容器、相容 Docker 的容器、Firecracker 微型虛擬機與 QEMU 虛擬機等環境,並接入分散式檔案系統 3FS 按需載入資料;系統也以全域有序軌跡日誌記錄命令與結果,支援中斷後恢復並避免重複執行。報導認為,DeepSeek 雖持續補強模型下方的系統工程,但這次版本切換仍暴露出版本隔離、退役公告、過渡窗口與通知機制不足的問題。
讀原始報導