Claude Opus 5 (Max) 以 1,699 分登頂 Fullstack Code Arena,定價僅 Fable 5 一半
該模型在前端與開啟事實查核的文本評測中同樣奪冠,預設推理版本則緊追 Kimi K3 排名第三,展現強大的端到端應用生成能力。
X @arena單一來源
61 則值得知道的變化
該模型在前端與開啟事實查核的文本評測中同樣奪冠,預設推理版本則緊追 Kimi K3 排名第三,展現強大的端到端應用生成能力。
該模型在多圖生影片、圖生影片與影片編輯類別奪冠,效能超越 Seedance 2.0 與 Grok 等模型,為開源陣營再下一城。
該代理會為每次請求啟動專屬虛擬電腦執行任務,但報導指其跑分僅與上一代模型比較,缺乏與 GPT-5.6 等最新競品的對比。
該模型具備 60 億活躍參數,透過獨立模態路由解決表徵衝突,並在 ContextASR-Bench 端到端語音基準測試的 12 項指標中全數取得 SOTA 成績。
實測長輸入預填充達 2,500 至 3,500 tok/s,可支援 3 至 4 人同時進行程式開發與 AI 代理等本機推論任務。