跳到主要內容
2026-08-04 日報
模型發布

阿里發布Qwen3.8-Max,2.4兆參數且下週開放權重

X @Alibaba_Qwen綜合 8 家報導多家報導
尚未逐項核實

多個報導來源提及此事;未必是彼此獨立的證據。

阿里巴巴於8月3日發布旗艦模型Qwen3.8-Max,定位為目前Qwen系列規模最大、能力最強的模型,主打程式設計、專業辦公、長週期任務與原生多模態能力。模型採稀疏MoE架構與混合注意力機制,總參數量2.4兆、啟用參數95B,支援視覺理解及最長1M tokens上下文。 阿里稱,Qwen3.8-Max可自主規劃、執行並依回饋修正工作;其自主程式開發展示可從空資料夾一路完成正式環境專案,持續超過10天,發布資料進一步稱該實驗歷時16天。官方另展示模型進行逾500輪晶片設計最佳化,以及處理長達365天的電商策略任務。阿里並稱其多項程式設計智慧體與通用智慧體指標接近Anthropic Fable 5,部分程式設計指標超越Fable 5及Claude Opus 5的High版本。 Qwen3.8-Max已可透過Qwen Studio及千問AI平台API使用,企業級Agent產品「千問辦公」(QwenWork)也同步開放網頁版及PC客戶端公測。國際API價格為每百萬tokens輸入2美元、輸出6美元,Implicit Caching每百萬tokens為0.25美元;中國市場價格分別為人民幣12元、36元及1.5元。 Qwen3.8-Max的開放權重預定於發布後一週在Hugging Face與ModelScope釋出,這也將是Qwen-Max等級模型首次開放權重;較小型的Qwen3.8-27B亦將同步開放權重。
讀原始報導

背景

Qwen 在 2025 年 4 月推出 Qwen3 系列,包含 Qwen3-30B-A3B 等後訓練模型與對應的預訓練版本,並在 Hugging Face 等平台提供。此後 Qwen3 系列持續更新,推出 Qwen3-2507 的 Instruct 與 Thinking 兩種版本。

來源