跳到主要內容
2026-09-23 日報
前瞻與傳聞

DeepSeek 擬轉用華為晶片訓練模型,預計 2026 年交付並計畫募資 500 億人民幣

DigiTimes綜合 2 家報導多家報導
核實資料不足

多個報導來源提及此事;未必是彼此獨立的證據。

查證回合用盡,未形成有依據結論

據報導,DeepSeek 創辦人梁文鋒在閉門投資者會議中表示,公司未來將轉向依賴華為等中國國產晶片來訓練 AI 模型,預計華為最快於 2026 年第四季交付訓練晶片。梁文鋒將此硬體轉換策略形容為 DeepSeek「最大的賭注之一」,並強調這項工作必須成功。 在模型進度方面,梁文鋒透露 DeepSeek 目前正在訓練擁有 2 兆參數的模型,未來更計畫推出達 8 兆參數的版本。為支撐龐大算力需求,DeepSeek 正敲定第二輪融資,目標募資 500 億人民幣、對應估值達 5,000 億人民幣,其中約 300 億人民幣將直接投入算力擴建。 目前 DeepSeek 仍依賴 Nvidia 晶片進行訓練。華為上週公布的昇騰(Ascend)AI 晶片三年路線圖顯示,可用於訓練的昇騰 950DT 將於今年第四季推出,但受限於先進記憶體等零組件短缺,華為晶片的實際供應量仍面臨制約。
讀原始報導

背景

DeepSeek 是一家總部位於中國杭州的 AI 公司,由 High-Flyer 擁有並提供資金。該公司專注於開發並開源大型語言模型(LLM),旗下知名模型包含 DeepSeek-V4、DeepSeek-R1 與 DeepSeek-Coder 等。

這則事件的發展

  1. 2026-09-22據傳 DeepSeek 正訓練 2T 參數模型,並計畫未來打造 8T 參數規模
  2. 2026-09-20DeepSeek 調整 API 計費規則:中國法定節假日與調休週末全天按空閒時段計費
  3. 2026-09-19網路傳聞 DeepSeek 具備全新模型架構,官方尚未證實
  4. 2026-09-16傳 DeepSeek 聘請高瓴創投合夥人嚴文韜任首任 CFO,為 2027 年科創板 IPO 鋪路
  5. 2026-09-10據報 DeepSeek 籌備科創板 IPO,並預告 9 月 10 日發布 V4.1 Flash 模型

來源