模型發布
Google 釋出 DiffusionGemma 技術報告,模型包含 26B A4B MoE 架構版本
Reddit r/LocalLLaMA單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
Google 釋出 DiffusionGemma 技術報告,相關論文已上線 arXiv。根據官方 Hugging Face 資訊,該系列包含基於 26B A4B 混合專家(MoE)架構的版本。據社群消息指出,目前 llama.cpp 針對該模型的支援(PR 24423 與 24427)暫處於草稿(Draft)狀態,使用者預期未來能在 8GB 記憶體(VRAM)的設備上獲得更快的推論速度。
讀原始報導背景
DiffusionGemma 是由 Google DeepMind 開發的生成式模型,基於 Gemma 4 與 Gemini Diffusion 的研究,放棄了傳統大型語言模型逐字生成的自迴歸架構。llama.cpp 則是廣泛用於本機端執行模型推論的開源 C/C++ 函式庫。