跳到主要內容
2026-08-30 日報
前瞻與傳聞

傳騰訊將 Hy4-preview 模型從 1.5TB 壓縮至 200GB GGUF,據稱維持 98% 效能

Reddit r/LocalLLaMA單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據 Reddit 社群消息指出,騰訊將旗下 Hy4-preview 模型從原先的 1.5TB 大幅壓縮至約 200GB 的 GGUF 格式,且據稱維持了約 98% 的原始效能。 根據官方資料補充,Hy4-preview 模型總參數高達 770B,骨幹包含 78 層架構,推論時每個 token 會啟動 49B 參數。目前該壓縮版本的具體技術細節與釋出狀態尚未獲得騰訊官方證實。
讀原始報導

背景

Hy4-preview 是由騰訊開發的新一代混合專家(MoE)旗艦模型。GGUF 則是由 llama.cpp 專案推出的二進位檔案格式,能將張量與詮釋資料整合於單一檔案中,專為快速儲存與載入模型資料而設計。

來源