模型發布
Qwen 開發者 AMA 預告即將推出 27B 模型,確認 3.8 版本達 2.4T 參數與 95B 活躍參數
Reddit r/LocalLLaMA單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
據社群整理的 Qwen 開發者 X(原 Twitter)AMA 紀錄,官方預告為回應社群訴求,即將推出全新的 27B 模型。針對 Qwen 3.8,官方確認其總參數達 2.4T,活躍參數為 95B,架構與 3.5 相似但規模大幅提升,且在後訓練(post-training)的強化學習階段投入了極龐大的算力。
在 100 小時影片理解技術上,開發者澄清其並非傳統的代理群(agent swarm),而是採用階層式影片記憶體系統。該系統會將影片片段編碼為包含場景、實體、事件及其時間關係的結構化文本圖譜,藉此實現跨片段的檢索與推論。
官方表示,為維持近乎每月的發布節奏,本次更新暫不提供技術報告。此外,團隊預告 Qoder 與 QwenWork 即將釋出更新,並提及 Qoder AI IDE 可作為 CLI 程式開發介面;而先前展示的 SAE 引導微調技術(qwen-scope)目前仍以研究用途為主。
讀原始報導背景
Qwen(通義千問)是由阿里雲開發的大型語言模型系列。該系列提供多種採用開源授權或專有授權的模型,並透過 Qwen Studio 平台為開發者與一般用戶提供 AI 助理服務。