前瞻與傳聞
Qwen 3.8-Flash-Next 模型即將發布,採 125B a6B 規格
Hacker News綜合 2 家報導多家報導
尚未逐項核實
多個報導來源提及此事;未必是彼此獨立的證據。
官方宣布 Qwen 3.8-Flash-Next 模型即將發布。根據 ModelScope 平台資訊,該模型規格標註為 125B a6B。
讀原始報導社群討論
社群對新模型高度期待,認為這讓擁有 128GB 記憶體(如 Strix Halo 或 Mac)的設備發揮價值,網友預估 4-bit MLX 量化版在 128GB M5 Max 上可達 50-70 tok/s。然而,許多 64GB 記憶體的用戶感到失落,表示更希望能推出 27B 或 35B 級別的模型。此外,部分開發者抱怨 Qwen 模型在 OpenRouter 上的連線極不穩定,且官方命名方式令人困惑。
來源
- Reddit r/LocalLLaMAreddit.com
- Reddit r/LocalLLaMAreddit.com
- Reddit r/LocalLLaMAreddit.com
- Reddit r/LocalLLaMAreddit.com
本期分類