跳到主要內容
2026-07-20 日報
模型發布

Qwen 3.8 Max開放權重

Simon Willison
Alibaba 發布 2.4T 參數的 Qwen 3.8 Max,並開放模型權重,改變先前未開放 Qwen 3.7 Max 的做法。Ben Thompson 主張美國應明定模型訓練蒐集資料屬合理使用,並禁止美國企業以服務條款限制模型蒸餾,以提升美國開放模型的競爭力。他推測 Alibaba 的決定可能受到習近平近期鼓勵開源、開放、協作與分享的談話影響,但兩者關聯尚未獲證實。
讀原始報導

背景

模型蒸餾是大型語言模型常見的訓練技術,研究人員可反覆輸入提示詞的不同變化,觀察特定模型的回應方式,但這種方法也可能被用於逆向工程。Anthropic 指控多家中國公司透過大規模蒸餾使用其模型,中國官員則主張蒸餾在適當使用下屬於合法工程技術。開放權重則是公開預訓練模型的權重參數檔案,但通常不包含完整訓練資料集、原始程式碼、模型架構或訓練方法。

來源