跳到主要內容
2026-09-24 日報
開發生態

Ollama v0.34.4 更新:支援思考模型單次處理結構化輸出,並加速 Qwen 3.8

GitHub ollama/ollama一手來源
核實資料不足

來源為發布方或研究資料;不代表所有主張已獲獨立核實。

查證回合用盡,未形成有依據結論

Ollama 發布 v0.34.4(目前為 rc0 版本)更新。伺服器端修復了偶發的「model not found」錯誤,並針對思考模型(thinking models)實作單次處理(single pass)的結構化輸出。底層依賴方面,同步更新 llama.cpp 與 MLX 版本;其中 MLX 的更新帶來 Gemma 4 影像解析度的動態選擇功能,並提升 Qwen 3.8 的提示詞處理速度。此外,應用程式端調整為避免使用 System Events 來偵測 ChatGPT/Codex。
讀原始報導

背景

llama.cpp 是一個開源的軟體函式庫,旨在以最少的設定在各種硬體上執行大型語言模型(LLM)推論,目前已被視為本機端推論的實質標準。而 MLX 則是專為 Apple 晶片所設計的陣列框架。

來源

本期分類