跳到主要內容
2026-09-02 日報
模型發布

獨立架構新模型 Spark-X2.5 4B/1.7B 現身,號稱支援 1M 上下文

Reddit r/LocalLLaMA單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據 Reddit 社群 r/LocalLLaMA 發現,Hugging Face 上出現由 XHToken 發布的新模型 Spark-X2.5,提供 4B 與 1.7B 兩種參數版本。該模型並非基於現有模型微調,而是採用獨立新架構,頁面標榜兩款模型皆原生支援高達 1M 的上下文長度。效能方面,據稱 4B 版本的跑分與 Qwen 3.5 9B 旗鼓相當。目前標準版 llama.cpp 尚未支援該架構(PR #27868 待合併),使用者需下載 GGUF 檔案並透過客製化的 llama.cpp 分支才能執行。
讀原始報導

背景

llama.cpp 是一個開源的 C/C++ 高效能推論引擎,被廣泛視為在本地端執行大型語言模型的實質標準。為了提升模型資料的讀寫速度與向下相容性,該專案於 2023 年推出了 GGUF 二進位檔案格式,將張量與詮釋資料(metadata)整合儲存於單一檔案中。

來源