qwen38flashnext
4 則報導橫跨 4 期2026-08-27 起
2026-09-09Reddit r/LocalLLaMA
網友實測 Qwen3.8-Flash-Next 推論引擎:262K 滿載 SGLang 首字延遲 35 秒,較 llama.cpp 快 7.3 倍
2026-08-31Reddit r/LocalLLaMA
社群開發者釋出 Mac 最佳化版 Qwen3.8-Flash-Next,M1 Max 實測 Prefill 達 190 tps
2026-08-28Reddit r/LocalLLaMA
Qwen 3.8 Flash Next 架構解析:結合 N-gram 與 512 專家 MoE,將 51B 參數卸載至 SSD
2026-08-27NVIDIA Developer