Qwen3.8-Flash-Next
108 則報導橫跨 49 期2026-07-17 起
2026-09-17NVIDIA Developer
NVIDIA TensorRT Edge-LLM 於 Jetson AGX Thor 執行 MLPerf 邊緣代理測試,跑 Qwen3.6-27B 較 llama.cpp 快 6.4 倍
2026-09-15Reddit r/LocalLLaMA
UkisAI 宣稱 Swift-Qwen3.8-27B:思考 Token 減少 58%、速度提升 1.95 倍
2026-09-15AI 前線
Arm 發布 AI Portal 開發者入口:整合 Qwen 與 Gemma 預先最佳化模型,並支援 MCP 供 AI 代理存取
2026-09-13The Decoder
KAIST 與 Naver AI Lab 研究發現 AI 推理步驟對應獨立內部表示,中間層訊號最強
2026-09-12AI 科技評論
螞蟻密算開源智能體框架 HOP 3.0,採「探索—核驗—提交」機制並使 27B 模型達千億參數表現
2026-09-11Reddit r/LocalLLaMA
社群開發者推出 Apple Silicon 推論引擎 Cherenkov,執行 Qwen3.8-Flash-Next 僅需 21GB 記憶體
2026-09-11Reddit r/singularity
網傳 Qwen、Kimi 與 DeepSeek 大規模蒸餾 Claude:14 天內阿里達 1.51 億次互動
2026-09-10Hacker News
推理引導實驗:Qwen3.8 注入 GPT-5.5 Pro 推理後答案重疊度大增 18.18%,暗示潛在訓練關聯
2026-09-09Reddit r/LocalLLaMA
網友實測 Qwen3.8-Flash-Next 推論引擎:262K 滿載 SGLang 首字延遲 35 秒,較 llama.cpp 快 7.3 倍
2026-09-09Reddit r/LocalLLaMA
Qwen 發布自動駕駛視覺語言模型 Qwen-Drive-1.0-4B,整合 3D 感知與運動規劃
2026-09-09Interconnects
據報中國開源模型授權趨嚴:GLM-5.3 設百億美元營收審查門檻,小紅書 dots3 獲 IMO 2026 滿分
2026-09-09AI 科技評論
基元律動發布 Agent-Native 模型 NeoHorse-1,基於執行軌跡後訓練,4B 版本五項基準超越 Qwen3.5-9B
2026-09-09AI 科技評論
據報 Perplexity 推出本地 Agent 產品 Portable Computer,採用阿里 Qwen3.8-27B 模型
2026-09-09HuggingFace Blog
Hugging Face 發表 LLM 安全拒絕邊界研究,指出傳統微調恐致 Qwen3-8B 過度拒絕率飆升至 74%
2026-09-07Reddit r/MachineLearning
Yandex 研究團隊探討將 KV-cache 作為代理執行階段,藉修改推論狀態提升 LLM 互動性
2026-09-05HF Daily Papers
Minima 釋出全 NVFP4 W4A4 量化版 Qwen3.8-27B,打破混合架構限制,體積縮至 17.5 GiB 且效能持平 BF16
2026-09-05GitHub sgl-project/sglang
sglang v0.5.19 發布:新增支援 Qwen3.8 與 Ling-3.0 等模型,並正式導入 Beam search 功能
2026-09-03Hacker News
Cerebras 上線 Qwen 3.8 27B 模型,據報推論速度達 1500 tokens/s
2026-09-03HF @BAAI
智源研究院開源 Recon2Reason-Reasoning-4B 視覺語言模型,專注室內場景空間推理
2026-09-02Reddit r/MachineLearning
研究提出 EvoUndo 框架解決 LLM Agent 自我進化恢復問題,將修復成功率從 0 提升至 99.3%
2026-09-02Reddit r/LocalLLaMA
Reddit 社群彙整最新本地模型跑分:涵蓋 DeepSeek-V4-Flash 與 Qwen3.8,Opus-4.8 於 GPQA 達 93.6
2026-09-02Hacker News
推論工具 slotstream 發布:48GB Mac 可跑 104GB Qwen3.8-Flash-Next,速度達 12 tok/s
2026-09-02HF Daily Papers
PaperGym 將論文轉為強化學習環境,訓練 Qwen3-8B 研究規劃能力超越 Kimi K2.6
2026-09-02HF Daily Papers
Qwen 發表 Qwen3.8-Flash-Next 125B MoE 架構:訓練 FLOPs 降至 1/9,結合 Gated DeltaNet 與稀疏注意力
2026-09-01Last Week in AI
SpaceXAI 發布 500K 上下文 Grok 4.6,OpenAI 揭露 Jalapeño 推論晶片,Qwen 3.8 以 27B 規模媲美 GPT-5.6
2026-08-31Reddit r/LocalLLaMA
社群開發者釋出 Mac 最佳化版 Qwen3.8-Flash-Next,M1 Max 實測 Prefill 達 190 tps
2026-08-31機器之心
據報端側模型專用 Harness 推出,以 Qwen3.8-27B 實現「零成本推理」
2026-08-30量子位
實測揭露本地部署 LLM 效能衰退元兇:推理軟體堆疊差異導致長文本 Token 翻轉,NVIDIA NVFP4 錯誤率近半
2026-08-29Reddit r/LocalLLaMA
IST-DASLab 發布 Qwen3.8-27B 的 GSQ+RCO 量化 GGUF 模型,3.00 bpw 效能逼近 BF16 基準
2026-08-29HF Daily Papers
論文提出 TTPO 測試時策略最佳化,實現無標籤數學推理訓練,Qwen3-1.7B 準確率升至 45.2%
2026-08-28Reddit r/LocalLLaMA
Qwen 3.8 Flash Next 架構解析:結合 N-gram 與 512 專家 MoE,將 51B 參數卸載至 SSD
2026-08-28AI 科技評論
據報導阿里發布全新 Qoder AI 代理工作台:內建 Qwen3.8-Max,支援自然語言與即時語音開發
2026-08-28AI 科技評論
千問辦公首發上線 Qwen3.8-Flash,生成速度提升 100% 且支援 1M 上下文
2026-08-27GitHub huggingface/transformers
Transformers 發布 v5.16 雙版本:支援 Qwen4-Exp、GLM-5.3-Flash 與 Step-3.7-Flash
2026-08-27NVIDIA Developer
阿里發布 Qwen3.8-Flash-Next 176B 模型權重,NVIDIA 宣布 GB300 NVL72 提供 Day-0 支援
2026-08-27X @Alibaba_Qwen
阿里開源 Qwen3.8-Flash 多模態 MoE 模型:125B 參數僅激活 6B,API 定價為 DeepSeek-V4-Flash 三分之一
2026-08-26Reddit r/MachineLearning
Hugging Face 員工解析 Papers with Code 混合搜尋架構:結合 pgvector 與 Qwen3-Embedding-0.6B
2026-08-26Reddit r/LocalLLaMA
網友開發 Llama.cpp 自適應推測分支,稱 Qwen3.8 推論速度最高提升 50%
2026-08-26Reddit r/LocalLLaMA
騰訊開源多模態嵌入模型 WeMM-Embedding,基於 Qwen3.5 並提供 9B/4B/2B 版本
2026-08-26X @arena
阿里 Qwen3.8-27B 登頂 Image-to-WebDev Arena 開源榜首,輸入每百萬 token 僅 0.4 美元
2026-08-26Hacker News
Qwen 3.8-Flash-Next 模型即將發布,採 125B a6B 規格
2026-08-26HF Daily Papers
研究團隊開源 Industrial-Instruction 框架與資料集,以 Panasonic 技術文件生成工業 QA,實測 Claude 生成品質較佳但成本高百倍
2026-08-25Hacker News
研究指 LLM 可透過推論引擎漏洞控制主機,vLLM 曾爆出 CVE-2025-9141 任意程式碼執行漏洞
2026-08-25Reddit r/LocalLLaMA
ICML 2026 論文提出 ToMoE 動態剪枝法:將稠密 LLM 轉為 MoE 架構,無須微調即超越過往技術
2026-08-25Import AI
METR 報告指 AI 大幅加速 2026 資安漏洞發現,多校聯合推出 SPADE 自對弈訓練框架
2026-08-25iThome
湯森路透耗資 4,000 萬美元推出自研模型 Thomson,基於 Qwen3.5-397B 打造
2026-08-24Reddit r/LocalLLaMA
Qwen 3.8 27B 密集模型發布,社群實測 OCR 表現超越 Gemini 3.5 Flash Lite
2026-08-23TechCrunch AI
Inherent 發布科學代理 Faraday,以 27B 參數模型在論文重現任務擊敗 GPT-5.5 與 Claude Opus 4.8
2026-08-23GitHub sgl-project/sglang
sglang 發布 v0.5.18:新增支援 Muse Glimmer 等 7 款模型,DeepSeek-V4-Pro B200 解碼 TPOT 降至 35.67ms
2026-08-22Hacker News
開源 Qwen3-TTS 1.7B 實作:單張 H100 達成 10 RPS 下首音訊延遲低於 50ms,每百萬字元成本約 2 美元
2026-08-22VentureBeat
Nvidia 提出跨模型 KV Cache 轉移技術,以線性映射免除重新計算,速度最高提升 25 倍
2026-08-21AI 科技評論
阿里雲財報:AI 收入連 12 季三位數成長,並開源 2.4 兆參數旗艦模型 Qwen3.8-Max
2026-08-20Reddit r/LocalLLaMA
據傳 Qwen 下週將發布全新中等規模開源模型,因時程緊湊不提供搶先體驗
2026-08-20Reddit r/LocalLLaMA
開發者透過自研核心讓四張 V100 原生執行 Qwen 3.8 NVFP4,解碼速度匹敵 RTX 5090
2026-08-20Hacker News
Unsloth 發布 Dynamic 3.0 GGUF 量化技術,Qwen3.8-27B 同體積準確率提升逾 10%
2026-08-20Reddit r/LocalLLaMA
llama.cpp 引入 DFlash2 投機解碼,Qwen 3.8 27B 本地推論速度最高提升 3 倍達 140 tok/s
2026-08-19Reddit r/LocalLLaMA
據報 DFlash 2 發布,支援 Qwen 3.8 27B 與 Muse Glimmer
2026-08-19Reddit r/LocalLLaMA
據報騰訊開源 27B GUI 代理模型 UI-Mate,基於 Qwen3.6 支援跨應用操作
2026-08-19Reddit r/LocalLLaMA
據報 Qwen 釋出 2.4T 參數 Qwen3.8 Max 開放權重,網友以單一提示詞生成 COD 遊戲
2026-08-18GitHub Trending (typescript)
Qwen 開源終端機 AI 程式碼代理 Qwen Code,支援多模型切換並全面對標 Claude Code
2026-08-17Hacker News
分析指 AI 模型正刻意犧牲事實記憶換取推理能力:Qwen3.5 9B 幻覺率達 80% 但數學跑分飆升
2026-08-17Simon Willison
阿里開源視覺模型 Qwen 3.8 27B,實測指預設 xhigh 推理等級會導致嚴重過度思考
2026-08-16Reddit r/LocalLLaMA
據 Reddit 實測 Apple Silicon 推論生態:框架碎片化嚴重,mlx-lm 轉換 Qwen 會遺失 MTP head
2026-08-16GitHub Trending (python)
SGLang 推出多模態與語音推論框架 SGLang-Omni,首日支援 MiniMax Music 3 與 Qwen3-Omni
2026-08-16量子位
至知研究院等提出大模型可解釋性方法 SWD:直接拆解權重抽取迴路,資料成本不到訓練型基線 1%
2026-08-16Techmeme
阿里 Qwen 過去半年全球下載量破 30 億次,Hugging Face 報告指其遠超 Google 與 Meta
2026-08-15X @huggingface
Hugging Face 發布 2026 夏季開源模型報告:小模型主導實際應用,Qwen 與 Gemma 領跑本地推論
2026-08-15X @Alibaba_Qwen
阿里開源 Qwen3.8 系列權重,27B 多模態模型支援百萬上下文與單卡部署
2026-08-14X @MiniMax_AI
MiniMax 釋出開源音樂模型 MiniMax-Music3,支援生成 5 分鐘完整歌曲
2026-08-14AI 科技評論
阿里開源 2.4T 參數 MoE 模型 Qwen3.8-2.4T-A95B,Flag OS 首日完成 9 款 AI 晶片適配
2026-08-13Reddit r/LocalLLaMA
據報 Qwen 3.8 27B 模型頁面短暫現身 ModelScope,隨後即遭下架
2026-08-13量子位
紫東太初團隊推出免訓練視覺 Token 剪枝方法 GMC,減少 80% Token 仍保留近 98% 效能
2026-08-12Reddit r/LocalLLaMA
社群消息稱 Qwen 官方已證實,Qwen 3.8-27b 模型將於本週發布
2026-08-12Reddit r/LocalLLaMA
開發者發布法語小型語言模型 Luth-2-0.8B 與 2B,基於 Qwen3.5 打造並在法語評測超越 Gemma-4
2026-08-12TechNews 科技新報
蘋果發布指引:中國 Mac 用戶可將阿里千問接入 Siri 與寫作工具
2026-08-11Reddit r/LocalLLaMA
韓國 Motif-Technologies 釋出 Motif-3 模型,據傳 AAII 跑分微幅超越 Qwen 3.7 Max
2026-08-11X @Alibaba_Qwen
Qwen 發布多模態代理外掛 Qwen-MM-Plugins,支援 MCP 協議並整合 3D、CAD 與長影片處理
2026-08-10Reddit r/LocalLLaMA
社群釋出 llama.cpp 修補程式修正 MTP 記憶體高估,AMD 雙卡執行 Qwen 27B 上下文從 64K 提升至 149K
2026-08-10量子位
中國無盡前沿團隊開源 35B 模型 BigBang-V1:基於 Qwen3.6 採 RSI 訓練,科研跑分超越 1T 級 DeepSeek V4 Pro Preview
2026-08-09X @arena
Arena 發表 Trace-and-Amplify 框架:無須指令即可收集 RL 訓練期獎勵駭客軌跡,偵測準確率達 90.16%
2026-08-08量子位
阿里推出 AI 語音平台 CosyVoice Studio,整合 Qwen-Audio 支援語意修正與 6 小時錄音轉寫
2026-08-08科技新報 AI
傳阿里擬對 Qwen3.8-Max 開源模型大型商用用戶收費,跟進 Kimi K3 抽取營收分成
2026-08-06Reddit r/LocalLLaMA
Qwen 開發者 AMA 預告即將推出 27B 模型,確認 3.8 版本達 2.4T 參數與 95B 活躍參數
2026-08-06Reddit r/LocalLLaMA
據報小米開源機器人基礎模型 Xiaomi-Robotics-1,經 10 萬小時軌跡訓練並結合 Qwen3-VL 與 DiT
2026-08-06Hacker News
Qwen-Image-3.0-Pro 圖像生成模型上線:支援 4.5k token 輸入、12 種語言渲染與複雜排版
2026-08-06Reddit r/LocalLLaMA
Qwen3-TTS 語音複製功能合併至 llama.cpp 主線,支援 1.7B Base 模型與 10 種語言
2026-08-05AI 科技評論
阿里發布 2.4 兆參數 Qwen3.8,OpenRouter、Vercel 等海外平台發布當日即接入,Max 版預計下週開源
2026-08-05X @arena
阿里發布 2.4T 參數 Qwen3.8-Max,Image-to-WebDev Arena 排名第二僅落後 Claude Opus 5 三十九分,下週開源權重
2026-08-04量子位
阿里千問辦公8月3日公測,主攻企業級Agent協作
2026-08-04X @arena
Qwen3.8-Max前端榜居第4,改寫成本效能前緣
2026-08-04X @Alibaba_Qwen
阿里發布Qwen3.8-Max,2.4兆參數且下週開放權重
2026-08-02鈦媒體
Qwen 據報看好開源,手機 Agent 獨家報價權出現鬆動
2026-08-01Reddit r/LocalLLaMA
據報 Meituan 推出 LongCat-Flash-Lite-Sparse:MoE 僅 3B active para
2026-08-01AI 科技評論
據報導 Boogu-Image-0.1 以 10B 參數在 Qwen-Image-Bench 得分 53.58,超越 8
2026-07-29X @ArtificialAnlys
Qwen Audio 3.0評測登頂
2026-07-25GitHub ollama/ollama
Ollama v0.32.4 支援 Laguna
2026-07-23InfoQ 中國
阿里發布 Qwen-Image-3.0
2026-07-23X @Alibaba_Qwen
Qwen新TTS雙版本登場
2026-07-23AI 科技評論
真武M890部署Qwen3.8
2026-07-22The Verge AI
Kimi K3、Qwen3.8挑戰美系模型
2026-07-21X @Alibaba_Qwen
Qwen Cloud推每月6美元方案
2026-07-21Hacker News
Qwen-Image-3.0 發布
2026-07-21X @Alibaba_Qwen
Qwen3.8-Max登上Qoder
2026-07-20Simon Willison
Qwen 3.8 Max開放權重
2026-07-20愛範兒
Qwen3.8 預覽版開放使用
2026-07-20愛範兒
Kimi暫停個人新訂閱
2026-07-19X @Alibaba_Qwen
Qwen3.8即將開放權重
2026-07-17INSIDE