跳到主要內容
2026-08-15 日報
模型發布

阿里開源 Qwen3.8 系列權重,27B 多模態模型支援百萬上下文與單卡部署

X @Alibaba_Qwen綜合 2 家報導多家報導
尚未逐項核實

多個報導來源提及此事;未必是彼此獨立的證據。

阿里巴巴正式開源 Qwen3.8 系列模型權重,包含 Qwen3.8-27B 與旗艦級的 Qwen3.8-2.4T-A95B (Max-level),採 Apache 2.0 授權,已上架 Hugging Face 與 ModelScope。 Qwen3.8-27B 為具備 270 億參數的原生多模態密集(dense)模型,官方表示其整體效能超越 Qwen3.7-Plus,在程式碼與辦公室工作流程表現突出。架構上,該模型採用與 2.4T MoE 旗艦版相同的混合注意力(hybrid-attention)骨幹,總計 64 層中有 16 層執行全注意力機制,其餘 48 層採線性注意力機制,並內建視覺塔(vision tower)與 MTP draft head。 該模型具備 262K 原生上下文長度,可透過 YaRN 擴展至 1M tokens。在硬體部署方面,Qwen3.8-27B 支援 vLLM 零日(Day-0)整合,在 NVFP4 精度下僅需 24.6 GiB 記憶體,可於單張 Blackwell GPU 運行 1M 上下文(6.6M KV tokens)。
讀原始報導

背景

Qwen(通義千問)是由阿里雲(Alibaba Cloud)所開發的大型語言模型系列。該系列持續釋出開源權重,讓開發者能將模型部署於本地端,或用於建立各類 AI 應用程式與代理(Agent)。

這則事件的發展

  1. 2026-08-14阿里開源 2.4T 參數 MoE 模型 Qwen3.8-2.4T-A95B,Flag OS 首日完成 9 款 AI 晶片適配
  2. 2026-08-13據報 Qwen 3.8 27B 模型頁面短暫現身 ModelScope,隨後即遭下架
  3. 2026-08-05阿里發布 2.4 兆參數 Qwen3.8,OpenRouter、Vercel 等海外平台發布當日即接入,Max 版預計下週開源

來源