GLM-5.2登上HF熱門榜
zai-org 發布旗艦模型 GLM-5.2,並登上 Hugging Face 熱門榜,採 MIT 授權且支援 1M-token 長上下文。官方評測顯示,其多項程式開發與代理能力較 GLM-5.1 提升。
24 則值得知道的變化
zai-org 發布旗艦模型 GLM-5.2,並登上 Hugging Face 熱門榜,採 MIT 授權且支援 1M-token 長上下文。官方評測顯示,其多項程式開發與代理能力較 GLM-5.1 提升。
據報導,Upstage 發布面向 Agent 場景的開放權重模型 Solar Open 2,採用 Hybrid-Attention MoE 架構,總參數達 250B、每個 token 啟用 15B 參數,並支援 100 萬 token 上下文。
Qwen 發布 Qwen-Audio-3.0-TTS,分為主打即時互動的 Flash 與高品質生成的 Plus 版本。新模型支援 16 種語言,可透過行內標籤與自然語言控制耳語、憤怒、呼吸及笑聲等表現,並能從含雜訊的參考音訊產生乾淨輸出。
Thinking Machines 發布 Inkling,這款 975B 參數、41B active 的 MoE 開放權重模型,可接收文字、影像與音訊並輸出文字。模型支援 BF16 與 NVFP4,並可透過 Transformers、vLLM、SGLang 等框架在本地部署。
poolside 推出 Laguna S 2.1,並登上 Hugging Face 熱門榜;這款 MoE 模型共有 118B 參數、每個 token 啟用約 8B 參數,支援 1,048,576-token context 與原生推理。
Prism ML 的 Ternary Bonsai 27B GGUF 開放權重模型登上 Hugging Face 熱門,採端到端三元 Transformer 權重,部署占用約 7.2 GB。
Upstage 的開放權重模型 Solar Open 2 登上 Hugging Face 熱門榜,採用 250B-A15B Hybrid-Attention MoE 架構,每個 token 僅啟用 15B 參數。模型支援 1M token 上下文,鎖定工具呼叫、多步推理、文件工作與程式開發等代理型任務。
Moonshot AI 發布的 Kimi K2.7 Code 已登上 Hugging Face 熱門,這款以 Kimi K2.6 為基礎的開放權重 agentic coding 模型,總參數達 1T、啟用參數為 32B,並支援 256K context 與視覺輸入。
Google DeepMind 的開放權重指令模型 google/gemma-4-31B-it 登上 Hugging Face 熱門榜。模型支援文字與圖像輸入、最高 256K context,並具備推理、程式開發及原生函式呼叫能力。
NVIDIA 在 Hugging Face 發布 4B 參數的 Cosmos3-Edge,並登上熱門模型榜。該模型採用 Mixture-of-Transformers(MoT)架構,可處理文字、圖像、影片與動作軌跡等多模態輸入,支援世界模擬、未來預測、動作推理及 Physical AI 應用。
阿里於 7 月 21 日發布第三代圖像生成與編輯基礎模型 Qwen-Image-3.0,最高支援 4.5K Token 文字輸入,長度為前代的 4.5 倍。新模型強化複雜指令、空間版面與多層資訊理解,並支援 12 種語言及 20 多種字型的原生算繪。
Cactus 發布 Gemma 4 E2B Hybrid,在模型 checkpoint 內建信心探針,為每次回答輸出 0 至 1 的信心分數,低於門檻時可自動轉交較大型模型。FP16 版本在多數基準僅需將 15–35% 的查詢轉交 Gemini 3.1 Flash-Lite,即可達到相近表現。
xAI 推出由新模型 Grok 4.5 驅動的 coding agent 與 CLI「Grok Build」,目前可免費試用。它支援平行執行的子代理、技能、hooks、MCP servers、AGENTS.md,以及從規劃、開發、測試到部署的終端工作流程。其計畫模式會在使用者核准前阻擋程式碼編輯,並以清楚的 diff 呈現核准後的變更。