跳到主要內容
2026-08-01 日報
模型發布

據報 DeepSeek V4 Flash 新權重悄然上傳至 Hugging Face 舊資料夾

Reddit r/LocalLLaMA未證實
Reddit r/LocalLLaMA 有貼文稱,Antirez 已將 DeepSeek V4 Flash 新權重悄然上傳至 Hugging Face 的既有資料夾:`antirez/deepseek-v4-gguf`。貼文標題列出的檔名為 `DeepSeek-V4-Flash-Q4KExperts-F16HC-F16Compressor-F16Indexer-Q8Attn-Q8Shared-Q8Out-chat-v2-imatrix-0731.gguf`。目前僅有單一 Reddit 來源,消息尚未獲其他來源佐證。
讀原始報導

背景

GGUF 是一種將模型資料儲存在單一檔案中的二進位格式,著重快速載入與儲存,並設計給 GGML 等執行器使用。搜尋結果也指出,在模型量化時使用 Importance Matrix(imatrix),可改善 llama.cpp 的效能。

這則事件的發展

  1. 2026-07-31DeepSeek V4上架HF
  2. 2026-07-31V4 Flash 0731評測得分50

來源