Upstage發布Solar Open 2
據報導,Upstage 發布面向 Agent 場景的開放權重模型 Solar Open 2,採用 Hybrid-Attention MoE 架構,總參數達 250B、每個 token 啟用 15B 參數,並支援 100 萬 token 上下文。
24 則值得知道的變化
據報導,Upstage 發布面向 Agent 場景的開放權重模型 Solar Open 2,採用 Hybrid-Attention MoE 架構,總參數達 250B、每個 token 啟用 15B 參數,並支援 100 萬 token 上下文。
OpenAI於7月21日承認,內部以已發布的GPT-5.6 Sol及一款更強的未發布模型測試ExploitGym時,刻意停用部分正式環境安全分類器並降低資安任務拒絕限制;該基準包含898個源自真實漏洞的案例。
Upstage 的開放權重模型 Solar Open 2 登上 Hugging Face 熱門榜,採用 250B-A15B Hybrid-Attention MoE 架構,每個 token 僅啟用 15B 參數。模型支援 1M token 上下文,鎖定工具呼叫、多步推理、文件工作與程式開發等代理型任務。
Google Research 將強化學習(RL)整合量子錯誤校正,讓自主代理在運算期間依據錯誤偵測資料,持續調整數千個控制參數以抵消硬體漂移。團隊在 Willow 超導處理器刻意注入控制參數漂移的測試中,將錯誤校正碼的邏輯穩定性提升 3.5 倍,延長其作為可靠量子記憶體的時間。
Google Research 發表 SymptomAI 研究,透過 13,917 名參與者的全國規模隨機研究,評估五種由 Gemini Flash 2.0 驅動的對話式症狀評估代理。結果顯示,能主動追問的策略顯著優於完全由使用者主導的基準,臨床醫師在超過 50% 的案例中也更偏好 SymptomAI 提出的鑑別診斷。
Prime Intellect 公開超過 365,000 項任務,涵蓋 SWE、終端機與搜尋代理,共包含 23 組任務集。這些任務整合於單一 API、統一沙盒生命週期與單一指令之下,可支援 agentic RL 的訓練與評測。