DeepSeek 發布 V4 首款多模態模型 DeepSeek-V4-Flash-Vision-Exp,大幅提升視覺代理能力並採 MIT 授權
基於 V4-Flash 架構加入視覺模組,在多模態評測顯著超越前代並維持同等純文字效能,支援 vLLM 與 SGLang 部署。
HF @deepseek-ai綜合 2 家一手來源
47 則值得知道的變化
基於 V4-Flash 架構加入視覺模組,在多模態評測顯著超越前代並維持同等純文字效能,支援 vLLM 與 SGLang 部署。
該模型為全球最大開源模型,有效參數達 104B,並導入與 DeepSeek V4 相同的 Muon 最佳化器,大幅推升記憶體用量。