GLM-5.2登上HF熱門榜
zai-org 發布旗艦模型 GLM-5.2,並登上 Hugging Face 熱門榜,採 MIT 授權且支援 1M-token 長上下文。官方評測顯示,其多項程式開發與代理能力較 GLM-5.1 提升。
24 則值得知道的變化
zai-org 發布旗艦模型 GLM-5.2,並登上 Hugging Face 熱門榜,採 MIT 授權且支援 1M-token 長上下文。官方評測顯示,其多項程式開發與代理能力較 GLM-5.1 提升。
據報導,Upstage 發布面向 Agent 場景的開放權重模型 Solar Open 2,採用 Hybrid-Attention MoE 架構,總參數達 250B、每個 token 啟用 15B 參數,並支援 100 萬 token 上下文。
OpenAI於7月21日承認,內部以已發布的GPT-5.6 Sol及一款更強的未發布模型測試ExploitGym時,刻意停用部分正式環境安全分類器並降低資安任務拒絕限制;該基準包含898個源自真實漏洞的案例。
Qwen 發布 Qwen-Audio-3.0-TTS,分為主打即時互動的 Flash 與高品質生成的 Plus 版本。新模型支援 16 種語言,可透過行內標籤與自然語言控制耳語、憤怒、呼吸及笑聲等表現,並能從含雜訊的參考音訊產生乾淨輸出。
Thinking Machines 發布 Inkling,這款 975B 參數、41B active 的 MoE 開放權重模型,可接收文字、影像與音訊並輸出文字。模型支援 BF16 與 NVFP4,並可透過 Transformers、vLLM、SGLang 等框架在本地部署。
poolside 推出 Laguna S 2.1,並登上 Hugging Face 熱門榜;這款 MoE 模型共有 118B 參數、每個 token 啟用約 8B 參數,支援 1,048,576-token context 與原生推理。
Prism ML 的 Ternary Bonsai 27B GGUF 開放權重模型登上 Hugging Face 熱門,採端到端三元 Transformer 權重,部署占用約 7.2 GB。
Upstage 的開放權重模型 Solar Open 2 登上 Hugging Face 熱門榜,採用 250B-A15B Hybrid-Attention MoE 架構,每個 token 僅啟用 15B 參數。模型支援 1M token 上下文,鎖定工具呼叫、多步推理、文件工作與程式開發等代理型任務。
Moonshot AI 發布的 Kimi K2.7 Code 已登上 Hugging Face 熱門,這款以 Kimi K2.6 為基礎的開放權重 agentic coding 模型,總參數達 1T、啟用參數為 32B,並支援 256K context 與視覺輸入。
Google DeepMind 的開放權重指令模型 google/gemma-4-31B-it 登上 Hugging Face 熱門榜。模型支援文字與圖像輸入、最高 256K context,並具備推理、程式開發及原生函式呼叫能力。
NVIDIA 在 Hugging Face 發布 4B 參數的 Cosmos3-Edge,並登上熱門模型榜。該模型採用 Mixture-of-Transformers(MoT)架構,可處理文字、圖像、影片與動作軌跡等多模態輸入,支援世界模擬、未來預測、動作推理及 Physical AI 應用。
據鈦媒體報導,Zhipu AI 及其開源模型 GLM 5.2 成功處理一場涉及 OpenAI、具高度自主性的網路攻擊,突破美國既有防護機制未能應對的困境。此事凸顯開源模型在 AI 資安防禦上的潛力,但目前僅有單一來源,官方尚未證實。
阿里於 7 月 21 日發布第三代圖像生成與編輯基礎模型 Qwen-Image-3.0,最高支援 4.5K Token 文字輸入,長度為前代的 4.5 倍。新模型強化複雜指令、空間版面與多層資訊理解,並支援 12 種語言及 20 多種字型的原生算繪。
Cactus 發布 Gemma 4 E2B Hybrid,在模型 checkpoint 內建信心探針,為每次回答輸出 0 至 1 的信心分數,低於門檻時可自動轉交較大型模型。FP16 版本在多數基準僅需將 15–35% 的查詢轉交 Gemini 3.1 Flash-Lite,即可達到相近表現。
美國白宮科技政策辦公室主任Michael Kratsios於7月22日指控中國AI新創Moonshot AI建立可切換存取方式、躲避偵測的內部平臺,大規模擷取美國模型輸出,並在開發Kimi K3時蒸餾Anthropic的Fable模型,但他未公布具體證據,Moonshot也尚未公開回應。
xAI 推出由新模型 Grok 4.5 驅動的 coding agent 與 CLI「Grok Build」,目前可免費試用。它支援平行執行的子代理、技能、hooks、MCP servers、AGENTS.md,以及從規劃、開發、測試到部署的終端工作流程。其計畫模式會在使用者核准前阻擋程式碼編輯,並以清楚的 diff 呈現核准後的變更。
Google Research 將強化學習(RL)整合量子錯誤校正,讓自主代理在運算期間依據錯誤偵測資料,持續調整數千個控制參數以抵消硬體漂移。團隊在 Willow 超導處理器刻意注入控制參數漂移的測試中,將錯誤校正碼的邏輯穩定性提升 3.5 倍,延長其作為可靠量子記憶體的時間。
Google Research 發表 SymptomAI 研究,透過 13,917 名參與者的全國規模隨機研究,評估五種由 Gemini Flash 2.0 驅動的對話式症狀評估代理。結果顯示,能主動追問的策略顯著優於完全由使用者主導的基準,臨床醫師在超過 50% 的案例中也更偏好 SymptomAI 提出的鑑別診斷。
Prime Intellect 公開超過 365,000 項任務,涵蓋 SWE、終端機與搜尋代理,共包含 23 組任務集。這些任務整合於單一 API、統一沙盒生命週期與單一指令之下,可支援 agentic RL 的訓練與評測。
Hugging Face 將 Nunchaku Lite 的 SVDQuant 4-bit W4A4 推論原生整合進 Diffusers,可透過 from_pretrained() 載入,無須另裝推論引擎或在本機編譯 CUDA。相較 BF16,這套方案可顯著降低 VRAM 用量,並在缺少架構專屬融合核心的情況下提供約 30% 加速。
AMD宣布與Anthropic達成合作,將投資最多50億美元;《華爾街日報》稱投資須待特定部署里程碑達成,整體AI伺服器合作金額達數百億美元。Anthropic將採購最多2GW的AMD新一代Instinct MI450晶片,預計自2027年上半年開始交付,並採用Helios機櫃級解決方案。
阿里真武M890超節點已成功適配2.4兆參數的Qwen3.8,並在阿里雲百鍊平台提供模型推論服務。單一實例透過ICN Switch 1.0連接64張真武M890,提供800GB/s高速互連與9TB GPU記憶體,可支援2兆參數MoE模型的專家並行。
Alphabet公布2026年第二季營收年增24%至1,197.96億美元、營業利益增30%至408億美元,調整後每股盈餘2.85美元;營收高於LSEG預估的1,169.3億美元,每股盈餘則低於預估的2.89美元,淨利因771億美元股票投資淨收益而年增298%至1,121億美元。
MiniMax 與 AMD 公布針對 428B MSA 稀疏 MoE 多模態基礎模型的 ATOM 與 ATOMesh 全棧推論最佳化,並宣稱 AMD MI355X 在 MiniMax-M3 服務效能上已接近 Nvidia B200。