Ollama v0.34.4 更新:支援思考模型單次處理結構化輸出,並加速 Qwen 3.8
新版修復偶發的模型遺失錯誤,並升級 MLX 框架,支援 Gemma 4 影像解析度動態選擇,同時加速 Qwen 3.8 提示詞處理。
GitHub ollama/ollama一手來源
71 則值得知道的變化
新版修復偶發的模型遺失錯誤,並升級 MLX 框架,支援 Gemma 4 影像解析度動態選擇,同時加速 Qwen 3.8 提示詞處理。
新架構打破過去雲端隔離環境僅能無狀態運算的限制,資料於雲端安全隔離區短暫解密處理後即重新加密,並已通過獨立資安機構審計。
該基準與 SGLang 合作,將 83 個 PR 轉為 53 個推論任務於 H100 運行,發現跨領域任務通過率較單一領域低 21.3%。
NVCRE 解決叢集通過健康檢查卻在實際訓練失敗的問題,支援以 CEL 自訂效能標準,並提供單節點至全規模的分散式測試。
雙方將針對 AI 資料中心基礎設施與實體 AI(Physical AI)等一系列人工智慧倡議展開合作,推動前沿應用發展。
商湯 Token 產能半年增長近十倍,未來將把 Encoder 與 Attention 等模組拆分為獨立資源池,以應對多模態與 MoE 模型的算力需求。
據報導,Pinterest 導入量化技術與基於 SSD 的 SPANN 架構取代 HNSW,使吞吐量達 DiskANN 三倍,並降低近三成生產成本。
Riviera 支援逾 300 種檔案格式,每秒執行數十萬次轉換。其 API 可提取結構化元資料,協助開發者處理 RAG 流程與模型輸入。