模型發布
阿里開源 Qwen3.8 系列權重,27B 多模態模型支援百萬上下文與單卡部署
X @Alibaba_Qwen綜合 2 家報導多家報導
尚未逐項核實
多個報導來源提及此事;未必是彼此獨立的證據。
阿里巴巴正式開源 Qwen3.8 系列模型權重,包含 Qwen3.8-27B 與旗艦級的 Qwen3.8-2.4T-A95B (Max-level),採 Apache 2.0 授權,已上架 Hugging Face 與 ModelScope。
Qwen3.8-27B 為具備 270 億參數的原生多模態密集(dense)模型,官方表示其整體效能超越 Qwen3.7-Plus,在程式碼與辦公室工作流程表現突出。架構上,該模型採用與 2.4T MoE 旗艦版相同的混合注意力(hybrid-attention)骨幹,總計 64 層中有 16 層執行全注意力機制,其餘 48 層採線性注意力機制,並內建視覺塔(vision tower)與 MTP draft head。
該模型具備 262K 原生上下文長度,可透過 YaRN 擴展至 1M tokens。在硬體部署方面,Qwen3.8-27B 支援 vLLM 零日(Day-0)整合,在 NVFP4 精度下僅需 24.6 GiB 記憶體,可於單張 Blackwell GPU 運行 1M 上下文(6.6M KV tokens)。
讀原始報導背景
Qwen(通義千問)是由阿里雲(Alibaba Cloud)所開發的大型語言模型系列。該系列持續釋出開源權重,讓開發者能將模型部署於本地端,或用於建立各類 AI 應用程式與代理(Agent)。
這則事件的發展
來源
- Hacker Newshuggingface.co
- X @Alibaba_Qwennitter.net
- Hacker Newstwitter.com
- iThomeithome.com
- AI 科技評論leiphone.com
- 量子位qbitai.com
- Reddit r/LocalLLaMAreddit.com
- Reddit r/LocalLLaMAreddit.com
- Techmemetechmeme.com
- en.wikipedia.org