跳到主要內容
2026-08-24 日報
模型發布

Qwen 3.8 27B 密集模型發布,社群實測 OCR 表現超越 Gemini 3.5 Flash Lite

Reddit r/LocalLLaMA單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

根據 Hugging Face 與官方 GitHub 資訊,Qwen 3.8 27B 於 2026 年 8 月 12 日發布,架構為密集模型(dense model)。據 Reddit r/LocalLLaMA 社群開發者實測指出,將該模型接入 Codex 與主打高性價比的 GPT Luna 進行比較後,發現兩者程式碼能力相當;而在 OCR 任務的處理品質上,表現甚至優於 Gemini 3.5 Flash Lite。 開發者表示,這是首款能力達到一年前頂尖模型水準的本機模型。由於其優異表現,部分企業內部已開始評估採購硬體自行部署,並預估硬體投資可在不到兩個月內回本。該評論也指出,受制裁影響,小型本機模型的品質正快速提升,未來結合更佳的量化(quants)與推論最佳化技術,可能進一步打破雲端大廠的算力護城河。
讀原始報導

背景

Qwen(通義千問)是由阿里雲(Alibaba Cloud)開發的大型語言模型系列。本次引發討論的 Qwen 3.8 27B 是一款原生多模態的開源權重模型,專為本地端硬體設計,主打在程式碼編寫、代理工作流程與辦公室自動化任務上提供頂尖效能。

這則事件的發展

  1. 2026-08-20開發者透過自研核心讓四張 V100 原生執行 Qwen 3.8 NVFP4,解碼速度匹敵 RTX 5090
  2. 2026-08-17阿里開源視覺模型 Qwen 3.8 27B,實測指預設 xhigh 推理等級會導致嚴重過度思考
  3. 2026-08-14阿里開源 2.4T 參數 MoE 模型 Qwen3.8-2.4T-A95B,Flag OS 首日完成 9 款 AI 晶片適配
  4. 2026-08-13據報 Qwen 3.8 27B 模型頁面短暫現身 ModelScope,隨後即遭下架

來源