跳到主要內容
2026-08-13 日報
模型發布

韓國 Upstage 推出 Solar Pro 4 推理模型,大幅提升智能體任務與長文本處理能力

X @ArtificialAnlys綜合 2 家報導多家報導
尚未逐項核實

多個報導來源提及此事;未必是彼此獨立的證據。

韓國 AI 實驗室 Upstage 於 8 月 13 日推出全新旗艦推理模型 Solar Pro 4,定位為處理複雜 AI 智能體任務的商用大模型,預計於 2026 年 4 月取代 Solar Pro 3。該模型僅支援純文字輸入與輸出,具備 512K token 上下文窗口與最高 128K token 輸出長度,支援在單次會話中載入多份合約與數據文件,官方目前未披露參數量。 定價方面,透過 Upstage 第一方 API 每百萬 token 輸入為 0.3 美元、輸出 1.2 美元、快取命中(Cache hit)為 0.06 美元。首批支援的推論供應商包含 Upstage 第一方 API、OpenRouter 與 TimelyRouter。 在 Artificial Analysis Intelligence Index 評測中,Solar Pro 4 獲得 42 分(前代為 14 分)。其在智能體與長文本任務進步顯著:Terminal-Bench v2.1 達 57%、AA-LCR 達 71%、τ³-Banking 達 23%;在 GDPval-AA v2 真實世界智能體任務中,Elo 積分達 1276,超越 1000 的人類基準線。官方展示中,該模型能透過 3 條提示詞分析政策與市場數據,完成選址篩選並依序生成 Excel 活頁簿、審查報告與簡報。 在幻覺與延遲方面,Solar Pro 4 的幻覺率從前代的 88% 降至 24%,主因是模型傾向放棄作答(作答率降至 41%),但 AA-Omniscience 準確率維持在 19%。此外,儘管模型在 token 使用上更具效率(每任務平均輸出 43k token),但運算延遲增加,平均完成單一測試任務需 9.5 分鐘(前代為 6.9 分鐘)。
讀原始報導

來源