上海AI實驗室發布 744B 參數 Agentic 模型 Atria Dawn Preview,基於 GLM-5.2 MoE 架構並上架 Hugging Face
查得來源差異
來源為發布方或研究資料;不代表所有主張已獲獨立核實。
新聞報導稱上海人工智慧實驗室發布了 Atria Dawn Preview 模型權重,基於 744B 參數的 GLM-5.2 架構,並支援 256K 上下文純文字輸入等功能。經查證,大部分主張皆與官方 Hugging Face 頁面說明相符。然而,關於基準測試成績全面優於其他模型的說法與原文不符,因為官方數據表中對照模型(如 DeepSeek 與 Claude Opus 5)在部分測試項目(如 DeepSearchQA)的數據標示為「不可用」(unavailable),故無法證實 Atria 在所有項目中皆擊敗了它們。
上海人工智慧實驗室在 Hugging Face 上架新一代 Agentic 模型 Atria Dawn Preview 的 Ascend w8a8 權重。
官方頁面明確說明該模型是由上海人工智慧實驗室所開發。
Shanghai Artificial Intelligence Laboratory.
查看原始出處
該模型基於 744B 參數的 MoE GLM-5.2 基礎模型開發。
官方文件證實此模型建構於 744B 參數的 MoE GLM-5.2 基礎模型之上。
744B-parameter MoE GLM-5.2
查看原始出處
專注於連續環境理解與多步任務完成,涵蓋發現、創造、交付與網路安全四個維度。
原文表格明確列出這四個具體的代理任務維度。
Discovery
查看原始出處
Creation
查看原始出處
Delivery
查看原始出處
Cybersecurity
查看原始出處
在 DeepSearchQA、AutomationBench 與 CyberGym 等測試中,成績優於 DeepSeek V4 Pro 0813、Claude Opus 5 等模型。
官方數據表顯示,DeepSeek 等模型在部分項目(如 DeepSearchQA)的成績為「不可用」,無法比較,這抵觸了報導宣稱在該項目勝過它們的說法。
result is unavailable.
查看原始出處
模型支援本地部署與線上 API(含國際與中國節點),具備 256K 上下文視窗。
原文說明模型具備本地及線上選項,且設定檔中顯示上下文視窗限制為 256000。
"context_window": 256000
查看原始出處
為純文字模型,不支援多模態輸入,在 Codex CLI 等工具需手動設定為純文字以避免圖片報錯。
官方特別提醒模型僅接受文字輸入,必須手動設定以覆寫 Codex 預設的多模態行為。
text input only.
查看原始出處
背景
混合專家模型(MoE)是一種機器學習技術,透過多個專家網路將問題空間劃分處理。本次新聞提及的底層模型 GLM-5.2,隸屬於中國軟體公司 Z.ai 所開發的開源權重通用語言模型(General Language Model)系列。