跳到主要內容
2026-09-02 日報
前瞻與傳聞

據報 DeepSeek V4 Pro 藉後訓練提升代理能力,1M 上下文採 YaRN 外推,快取命中費率 8 月 17 日起調漲最高 12 倍

AI 科技評論單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,DeepSeek V4 Pro(0813 版本)在預訓練架構與 Flash 版本相同的情況下,疑似透過重新進行後訓練大幅提升代理能力,其 Terminal Bench 2.1 分數從預覽版的 72.1 提升至 87.9,DeepSWE 從 12.8 升至 62.7。官方自測數據顯示,Kimi K3 在多數代理測試項目(如 Terminal Bench 2.1 的 88.3 分)仍領先 V4 Pro 0813 版;同時,智譜發布的 GLM-5.3 亦採用不換架構、僅延長後訓練的策略,且智譜官方模型卡明文致謝 GLM-5.2 整合了 DeepSeek 的稀疏注意力機制(DSA)。 設定檔顯示,V4 Pro 的 1M 上下文是基於 64K 基礎,透過 YaRN 方法外推 16 倍而來(rope_scaling),與 Kimi K3 更改注意力機制或 GLM-5.2 調整 rope_theta 的作法不同;實測在 90.2 萬 token 處的事實檢索命中率達 100%,但官方建議接入 Claude Code 時將自動壓縮視窗設為 768K。評測機構 Artificial Analysis 數據指出,V4 Pro 輸入單價達每百萬 token 1.32 美元,但單次任務成本僅 0.25 美元(同批 106 個開源模型中第二低);實測 92 萬 token 上下文首次提問約花費 9 元人民幣,後續四次提問因快取命中總計僅花費 0.28 元人民幣。 其開源框架 Harness 透過嚴格的工程設定保護快取前綴穩定,例如在 plan 模式下不移除工具列表以維持請求形狀、限制工具結果超過 8,192 字元即裁切,以及限制會話標題上限為 64 token。官方定價於北京時間 8 月 17 日零時起調漲,快取命中費率調漲 6 至 12 倍,未命中調漲 1.5 至 3.0 倍,輸出調漲 2.25 至 4.5 倍,並設定 UTC 01:00–04:00 與 06:00–10:00 為高峰時段。
讀原始報導

背景

DeepSeek Harness 是一款由 DeepSeek AI 開發的開源代理(agent)框架,目前正處於開發者預覽階段並持續快速迭代。該框架基於 Cordis 的外掛系統建構,並已釋出原始碼供全球開發者使用。

來源