模型發布
開發者發布法語小型語言模型 Luth-2-0.8B 與 2B,基於 Qwen3.5 打造並在法語評測超越 Gemma-4
Reddit r/LocalLLaMA單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
據 Reddit 社群消息,開發者發布了兩款專為法語最佳化的小型語言模型 Luth-2-0.8B 與 Luth-2-2B。該系列為非推理模型,改用 Qwen3.5 作為基礎模型,開發團隊指出其對後訓練的接受度顯著較高。
在訓練方法上,Luth-2 引入涵蓋數學、程式碼、工具呼叫與多輪對話等領域的 3B token SFT 混合資料集,並透過專家特化與多領域同策略蒸餾(MOPD)進行強化學習。評測數據顯示,Luth-2-2B 在 Multi-IF 取得 69.67 分(對比 Gemma-4-E2B-it 的 65.17),在 Math-500 取得 81.52 分;Luth-2-0.8B 則在 MGSM-Rev2 取得 72.92 分,大幅領先 granite-4.0-h-micro 的 55.60 分。
目前模型權重(含 GGUF 格式)、SFT 與 RL 訓練資料及程式碼均已在 Hugging Face 與 GitHub 開放,可供裝置端本地部署運行。
讀原始報導背景
Luth-2 是一款專為法文打造的小型語言模型(SLM),其底層架構採用了由阿里雲(Alibaba Cloud)開發的 Qwen 系列模型 Qwen3.5。該模型透過 30 億 token 的監督式微調(SFT)與強化學習技術,旨在提升非英語系語言在各類任務中的表現,並保持能在本地端運行的輕量化優勢。