傳騰訊將 Hy4-preview 模型從 1.5TB 壓縮至 200GB GGUF,據稱維持 98% 效能官方資料顯示,該模型總參數達 770B、骨幹包含 78 層架構,每個 token 會啟動 49B 參數。此次大幅度壓縮將有利於本地端部署。Reddit r/LocalLLaMA單一來源