模型發布
據報 Meituan 推出 LongCat-Flash-Lite-Sparse:MoE 僅 3B active para
Reddit r/LocalLLaMA未證實
Reddit r/LocalLLaMA 一則未經證實的貼文稱,Meituan 推出了 LongCat-Flash-Lite-Sparse。該模型採用 MoE 架構,約有 3B active parameters,另配備約 30B 的 n-gram 查找表,並將查找表卸載至 RAM,以在 24GB GPU 上支援 256K context。發文者表示,這項設計讓人聯想到 Gemma 4 的 PLE 技術;其初步分析則認為,LongCat-Flash-Lite-Sparse 尚不足以取代 Qwen 3.6 27b。
讀原始報導背景
LongCat-Flash-Lite-Sparse 是 Meituan 的模型,已在 Hugging Face 提供模型頁面。該頁面包含搭配程式庫、推論服務、Notebook 與本機應用程式的使用說明。