DeepSeek v4 Flash
92 則報導橫跨 45 期2026-07-17 起
2026-09-20Reddit r/LocalLLaMA
據報 DeepSeek-V4.1-Flash 論文將 KV Cache 壓縮至 890 bytes,社群另關注兩篇代理框架研究
2026-09-20iThome 中國
DeepSeek 調整 API 計費規則:中國法定節假日與調休週末全天按空閒時段計費
2026-09-19Reddit r/singularity
網路傳聞 DeepSeek 具備全新模型架構,官方尚未證實
2026-09-19Hacker News
Cactus Compute 推出 8-29MB 邊緣基礎模型 Needle 3,微調後稱可匹敵 DeepSeek V4 Flash
2026-09-17Hacker News
DeepSeek V4.1 Flash 於 AI 駭客基準測試獲滿分,攻破 11 個漏洞目標僅花費 4.65 美元
2026-09-16量子位
傳 DeepSeek 聘請高瓴創投合夥人嚴文韜任首任 CFO,為 2027 年科創板 IPO 鋪路
2026-09-16iThome
俄羅斯駭客結合 OpenAI Codex 與 DeepSeek 打造 AI 代理,利用 PaperCut 漏洞入侵全球 395 個組織
2026-09-15Reddit r/LocalLLaMA
網傳 DeepSeek v4.1 Attention 算子作者發文:AI 已能獨立分析 CUDA 與 PTX,預估一年內將超越人類
2026-09-15NVIDIA Developer
NVIDIA Transformer Engine 加速 JAX Dropless MoE:DeepSeek-V3 訓練達 1,068 TFLOPS/GPU
2026-09-13AI 前線
DeepSeek 據報以 V4.1 Flash 替換 V4 Pro:僅提前約一天通知、未設遷移期
2026-09-12iThome 中國
DeepSeek 取消 V4 Pro API 下線計畫,將於 9 月 14 日後繼續提供服務且計費不變
2026-09-11Reddit r/singularity
網傳 Qwen、Kimi 與 DeepSeek 大規模蒸餾 Claude:14 天內阿里達 1.51 億次互動
2026-09-11TechNews 科技新報
亞利桑那大學測試 7 款 LLM 長對話抗誤導能力:GPT-3.5 最易妥協,Claude 3.5 Sonnet 最抗壓但修正率為零
2026-09-11HF Trending
DeepSeek 發布 552B 多模態模型 V4.1-Flash:輸入僅啟動 8B 參數,KV Cache 縮減至前代四分之一並下調 API 定價
2026-09-10Reddit r/LocalLLaMA
網傳美國指控 DeepSeek 與 Alibaba 等中國 AI 企業惡意抄襲技術
2026-09-10Hacker News
傳 DeepSeek 將推 v4.1 flash 模型,定價更低且能力超越 v4 pro
2026-09-10Reddit r/LocalLLaMA
網友實測以 10 至 12 張 RTX 3090 運行 285B DeepSeek-V4-Flash-Vision-Exp,解碼速度最高達 120 tok/s
2026-09-10OpenRouter
OpenRouter 推出美國區域路由,確保資料端到端不出境,並支援 DeepSeek V4 Pro 等模型落地
2026-09-10Ars Technica AI
美國指控 DeepSeek 等六家中國 AI 企業,透過 API 與提示詞注入大規模蒸餾竊取前沿模型
2026-09-10中央社 科技
據報 DeepSeek 籌備科創板 IPO,並預告 9 月 10 日發布 V4.1 Flash 模型
2026-09-10GitHub vllm-project/vllm
vLLM 發布 v0.29.0:預設啟用 MRV2,並支援 Hy4-preview、Qwen3.8 與 Kimi K3 等未曝光模型
2026-09-09Reddit r/LocalLLaMA
傳 DeepSeek V4.1 Flash 展開 API 內部測試,具備原生多模態支援
2026-09-09iThome 中國
DeepSeek 調降 Flash 系列模型定價:輸入快取命中降幅達 60%,輸出每百萬 Token 4 元
2026-09-08鈦媒體
據報 DeepSeek 千兆瓦級算力擴張面臨電力挑戰,尚未解決供電銜接問題
2026-09-07量子位
網易有道發布辦公 Agent 用戶報告:泛程式設計任務佔近四成,近六成算力消耗於非辦公時間
2026-09-07DigiTimes
傳 DeepSeek 計畫採購 16 萬片華為晶片,用於內蒙古 1GW 資料中心
2026-09-05GitHub sgl-project/sglang
sglang v0.5.19 發布:新增支援 Qwen3.8 與 Ling-3.0 等模型,並正式導入 Beam search 功能
2026-09-02Reddit r/LocalLLaMA
Reddit 社群彙整最新本地模型跑分:涵蓋 DeepSeek-V4-Flash 與 Qwen3.8,Opus-4.8 於 GPQA 達 93.6
2026-09-02AI 科技評論
據報 DeepSeek V4 Pro 藉後訓練提升代理能力,1M 上下文採 YaRN 外推,快取命中費率 8 月 17 日起調漲最高 12 倍
2026-09-02AI 科技評論
DeepSeek Harness 外掛生態調查:破萬儲存庫僅不到千個可用,且存在沙盒越權與快取失效問題
2026-09-02AI 科技評論
DeepSeek V4 開源多模態模型權重,揭露 32 層 ViT 與專屬 MoE 視覺路由機制
2026-09-01InfoQ 中國
Floatboat 公布全端 Harness 評測:DeepSeek-V4-Flash 跑分全面超越貴 57 倍的 Claude Opus 4.8
2026-09-01InfoQ 中國
Pi 核心貢獻者揭露 Token 市場黑箱:DeepSeek 恐為 1.5 bit 縮水版,並指 OpenAI GPT-5.6 曾聯手越獄沙箱
2026-09-01HF @deepseek-ai
DeepSeek 發布 V4 首款多模態模型 DeepSeek-V4-Flash-Vision-Exp,大幅提升視覺代理能力並採 MIT 授權
2026-08-29Simon Willison
AI 代理顛覆開源資安:OCaml 漏洞討論 10 分鐘內遭探測,GitHub CVE 審查期暴增至 4 週
2026-08-28DigiTimes
據報導中國開源 AI 模型使用量創新高,由 DeepSeek 領軍首度超越閉源模型
2026-08-28HF Daily Papers
JIT-Agent 模型發布:為 LLM 動態生成自適應 Agent 框架,助 DeepSeek-V4-Flash 跑分超越 GPT-5.6
2026-08-27GitHub Changelog
GitHub Copilot 全域模型策略正式上線,未設定模型將預設啟用,排除 DeepSeek 等開放權重模型
2026-08-27InfoQ 中國
DeepSeek 開源 AI 代理執行環境 DeepSeek Harness,採微核心架構並提供四種基礎模式
2026-08-27GitHub vllm-project/vllm
vLLM 發布 v0.28.0:深度最佳化 Kimi-K3 與 DeepSeek V4 推論,並支援磁碟 KV 快取卸載
2026-08-25Reddit r/LocalLLaMA
FreeToken 提出邊緣端 MoE 部署新技術,RTX 5090 運行 DeepSeek-V4-Flash 達 25 tok/s
2026-08-23iThome
DeepSeek 調整 API 計費:週末全天統一按低谷價收費,V4-Pro 輸出每百萬 tokens 13.5 元
2026-08-23GitHub sgl-project/sglang
sglang 發布 v0.5.18:新增支援 Muse Glimmer 等 7 款模型,DeepSeek-V4-Pro B200 解碼 TPOT 降至 35.67ms
2026-08-22Reddit r/LocalLLaMA
據報 DeepSeek Harness 發布 v0.1.1,支援 DeepSeek-V4-Flash-Vision-Exp 視覺模型
2026-08-22量子位
雷鳥發布 34g 無鏡頭 AI 眼鏡 iO:具兩天續航並首批支援 DeepSeek V4 Pro
2026-08-22愛範兒
DeepSeek 發布多模態模型 deepseek-v4-flash-vision-exp,同步推出 Files API
2026-08-21Latent Space
智譜 CEO 揭露 GLM-5.3 依賴全合成環境 RL 提升推理,開源模型 Ornith-1.5 釋出 397B MoE 版本
2026-08-21AI 科技評論
J-Space 宣稱 DeepSeek V4 加 Harness 追平 GLM-5.3 遭實測打假,CoT 作者批「小模型+工具」難敵大模型內化能力
2026-08-19AI 科技評論
九章智算雲部署 GLM-5 與 DeepSeek R 系列,透過動態匹配 Generator 與 Trainer 實現 RL 訓推一致
2026-08-19HuggingFace Blog
HuggingFace 發布 Agent 記憶體研究:強模型需完整指南,弱模型適合檢索,DeepSeek-V3.2 任務完成率提升 9.5%
2026-08-19INSIDE
DeepSeek 開源 V4-Flash 正式版:採 MIT 授權,總參數 284B 但活躍參數僅 13B
2026-08-19科技新報 AI
xAI 發布 Grok 4.6 智力追平 GPT-5.6,Gemini 3.7 Flash 輸出達 340 tokens/s,DeepSeek V4 Pro 實施峰谷定價最高漲 12 倍
2026-08-17VentureBeat
據報 DeepSeek V4 Flash 代理任務實測成功率僅 53.8%,API 價格最高調漲達 11 倍
2026-08-15InfoQ 中國
DeepSeek V4 Flash 搭配 Pi Agent 於 Composio 測試擊敗 Claude Code,單次任務成本僅 0.028 美元且快取命中率達 99.9%
2026-08-15Hacker News
DeepSeek 發布 V4-Pro 模型並更新 API 定價:引入峰谷費率,離峰快取命中價格調漲 5 倍
2026-08-14Hacker News
DeepSeek 發布 API 定價更新,最新計費方案已上線官方文件
2026-08-14X @arena
DeepSeek-V4-Pro (Max) 登 Code Arena WebDev 第八,性價比超越高價模型
2026-08-14X @deepseek_ai
DeepSeek 開源 Harness v0.1 開發者預覽版,主打「一切皆為外掛」架構
2026-08-13愛範兒
DeepSeek 無預警釋出 V4 Pro 0813 正式版 API,Agent 能力大幅提升直逼 Fable 5
2026-08-12X @mattshumer_
GMI Cloud 展示結合 DeepSeek V4 Flash 與 MiniMax H3 的影片生成工作流,單次生成僅需 1.97 美元
2026-08-12Reddit r/LocalLLaMA
社群實測 DeepSeek V4 量化:揭露預設轉換 Bug,llama.cpp 在 RTX 5090 與 H100 產生不同困惑度
2026-08-11InfoQ 中國
DeepSeek V4 Flash 官方 API 憑 0.0028 美元快取價與極高命中率,長會話實際成本遠低於第三方
2026-08-11GitHub vllm-project/vllm
vLLM 發布 v0.27.0:全面支援 Kimi K3 與 Qwen3.5,並針對 DeepSeek-V4 進行效能最佳化
2026-08-10DigiTimes
據報 DeepSeek 投資宇樹科技 1.408 億人民幣,佈局 AI 模型與人形機器人結合
2026-08-09X @arena
Arena 發表 Trace-and-Amplify 框架:無須指令即可收集 RL 訓練期獎勵駭客軌跡,偵測準確率達 90.16%
2026-08-08鈦媒體
傳 DeepSeek 重啟融資目標三年市值對齊騰訊,崔添翼指流出簡報未必造假
2026-08-07X @liquidai
Liquid AI LFM2.5-2.6B 工具呼叫實測達 DeepSeek-V4-Flash 水準,處理速度快 3.7 倍
2026-08-06X @Xianbao_QIAN
分析指 DeepSeek v4 Flash 開源 Disk KV cache 架構,5% 快取命中率差異可致 3 至 4 倍成本落差
2026-08-06TechNews 科技新報
傳 DeepSeek 重啟第二輪融資:計畫募資 500 億人民幣,投前估值達 5,000 億
2026-08-06AI 科技評論
MiniMax 開源多模態影片生成模型 H3,登頂 Artificial Analysis 榜單並獲超百家夥伴首日接入
2026-08-05X @arena
DeepSeek-V4-Flash 公測上線,Agent Arena 排名總榜第 21、開源第 3,超越自家 V4-Pro
2026-08-04Reddit r/LocalLLaMA
Reddit 用戶稱以 24GB VRAM Intel Windows PC 跑起 DeepSeek-V4-Flash-0731 Q3 量化版
2026-08-04Hacker News
AirLLM 支援 Kimi K3 2.8T,單張 RTX 6000 Ada 僅用 3.72GB VRAM 推論
2026-08-04iThome
Palo Alto Networks 揭露中國駭客以 DeepSeek、Hermes 自主攻擊,掃描 Langflow 與 n8n 均失敗
2026-08-04愛範兒
DeepSeek V4 Flash 正式版在 OpenCode 單日耗用 8 兆 Token,每百萬輸出收費 2 元人民幣
2026-08-03AI 科技評論
網易有道全面接入 284B DeepSeek-V4-Flash 正式版,涵蓋 LobsterAI、翻譯與 ThinkFlow
2026-08-01Reddit r/LocalLLaMA
據報 DeepSeek V4 Flash 新權重悄然上傳至 Hugging Face 舊資料夾
2026-08-01X @arena
DeepSeek-V4-Flash-High 以 1,586 分居 Frontend Code Arena 第 7,官方
2026-07-31科技新報 AI
傳 DeepSeek 擬增1GW算力
2026-07-31X @ArtificialAnlys
V4 Flash 0731評測得分50
2026-07-31X @deepseek_ai
DeepSeek-V4-Flash API公測上線
2026-07-31HF @deepseek-ai
DeepSeek V4上架HF
2026-07-30量子位
無問芯穹公開PDD推論架構
2026-07-27DigiTimes
DeepSeek暫停第二輪募資
2026-07-27GitHub vllm-project/vllm
vLLM 0.26.0 發布
2026-07-25Hacker News
DeepSeek暫停募資
2026-07-21橘鸦AI早报
DeepSeek V4傳延後發布
2026-07-18Techmeme
中國AI基金取得DeepSeek投票權
2026-07-18量子位
公告揭露DeepSeek估值線索
2026-07-18X @arena
Kimi-K3登頂前端程式評測
2026-07-17InfoQ 中國
美國研議限制前沿開源模型
2026-07-17TechNews 科技新報