前瞻與傳聞
DeepSeek 擬轉用華為晶片訓練模型,預計 2026 年交付並計畫募資 500 億人民幣
DigiTimes綜合 2 家報導多家報導
核實資料不足
多個報導來源提及此事;未必是彼此獨立的證據。
查證回合用盡,未形成有依據結論

據報導,DeepSeek 創辦人梁文鋒在閉門投資者會議中表示,公司未來將轉向依賴華為等中國國產晶片來訓練 AI 模型,預計華為最快於 2026 年第四季交付訓練晶片。梁文鋒將此硬體轉換策略形容為 DeepSeek「最大的賭注之一」,並強調這項工作必須成功。
在模型進度方面,梁文鋒透露 DeepSeek 目前正在訓練擁有 2 兆參數的模型,未來更計畫推出達 8 兆參數的版本。為支撐龐大算力需求,DeepSeek 正敲定第二輪融資,目標募資 500 億人民幣、對應估值達 5,000 億人民幣,其中約 300 億人民幣將直接投入算力擴建。
目前 DeepSeek 仍依賴 Nvidia 晶片進行訓練。華為上週公布的昇騰(Ascend)AI 晶片三年路線圖顯示,可用於訓練的昇騰 950DT 將於今年第四季推出,但受限於先進記憶體等零組件短缺,華為晶片的實際供應量仍面臨制約。
讀原始報導背景
DeepSeek 是一家總部位於中國杭州的 AI 公司,由 High-Flyer 擁有並提供資金。該公司專注於開發並開源大型語言模型(LLM),旗下知名模型包含 DeepSeek-V4、DeepSeek-R1 與 DeepSeek-Coder 等。
這則事件的發展
來源
- 科技新報 AItechnews.tw
- iThome 中國ithome.com
- en.wikipedia.org
- deepseek.com