跳到主要內容
2026-09-16 日報
模型發布

上海AI實驗室發布 744B 參數 Agentic 模型 Atria Dawn Preview,基於 GLM-5.2 MoE 架構並上架 Hugging Face

HF @internlm一手來源
查得來源差異

來源為發布方或研究資料;不代表所有主張已獲獨立核實。

新聞報導稱上海人工智慧實驗室發布了 Atria Dawn Preview 模型權重,基於 744B 參數的 GLM-5.2 架構,並支援 256K 上下文純文字輸入等功能。經查證,大部分主張皆與官方 Hugging Face 頁面說明相符。然而,關於基準測試成績全面優於其他模型的說法與原文不符,因為官方數據表中對照模型(如 DeepSeek 與 Claude Opus 5)在部分測試項目(如 DeepSearchQA)的數據標示為「不可用」(unavailable),故無法證實 Atria 在所有項目中皆擊敗了它們。

上海人工智慧實驗室在 Hugging Face 上架新一代 Agentic 模型 Atria Dawn Preview 的 Ascend w8a8 權重。

官方頁面明確說明該模型是由上海人工智慧實驗室所開發。

Shanghai Artificial Intelligence Laboratory.

查看原始出處

該模型基於 744B 參數的 MoE GLM-5.2 基礎模型開發。

官方文件證實此模型建構於 744B 參數的 MoE GLM-5.2 基礎模型之上。

744B-parameter MoE GLM-5.2

查看原始出處

專注於連續環境理解與多步任務完成,涵蓋發現、創造、交付與網路安全四個維度。

原文表格明確列出這四個具體的代理任務維度。

Discovery

查看原始出處

Creation

查看原始出處

Delivery

查看原始出處

Cybersecurity

查看原始出處

在 DeepSearchQA、AutomationBench 與 CyberGym 等測試中,成績優於 DeepSeek V4 Pro 0813、Claude Opus 5 等模型。

官方數據表顯示,DeepSeek 等模型在部分項目(如 DeepSearchQA)的成績為「不可用」,無法比較,這抵觸了報導宣稱在該項目勝過它們的說法。

result is unavailable.

查看原始出處

模型支援本地部署與線上 API(含國際與中國節點),具備 256K 上下文視窗。

原文說明模型具備本地及線上選項,且設定檔中顯示上下文視窗限制為 256000。

"context_window": 256000

查看原始出處

為純文字模型,不支援多模態輸入,在 Codex CLI 等工具需手動設定為純文字以避免圖片報錯。

官方特別提醒模型僅接受文字輸入,必須手動設定以覆寫 Codex 預設的多模態行為。

text input only.

查看原始出處
上海人工智慧實驗室(internlm)在 Hugging Face 上架新一代 Agentic 模型 Atria Dawn Preview 的 Ascend w8a8 權重。該模型基於 744B 參數的 MoE GLM-5.2 基礎模型開發,專注於需要連續環境理解、工具使用與多步任務完成的研究及工程場景,涵蓋發現、創造、交付與網路安全四個維度。 根據官方評測,Atria Dawn Preview 在 DeepSearchQA(96.0)、AutomationBench(53.8)與 CyberGym(86.5)等基準測試中,成績優於 DeepSeek V4 Pro 0813、KIMI K3、GPT 5.6 sol 及 Claude Opus 5 等模型。 模型支援本地部署與線上 API(含國際與中國節點),具備 256K 上下文視窗。官方特別註明此為純文字模型,不支援多模態輸入,若在 Codex CLI 等工具中使用,需手動設定輸入模態為純文字以避免傳入圖片導致報錯。
讀原始報導

背景

混合專家模型(MoE)是一種機器學習技術,透過多個專家網路將問題空間劃分處理。本次新聞提及的底層模型 GLM-5.2,隸屬於中國軟體公司 Z.ai 所開發的開源權重通用語言模型(General Language Model)系列。

來源