據報 GPT-6 Astra 解出 FrontierMath Tier 4 最後未破題,AI 累計攻破全部 43 題報導稱,Astra公開成績為97.6%,但「全部解出」是累計不同模型與時間的成功紀錄;Tier 4 v2現有43題。量子位單一來源
三項實測揭露 AI 程式設計 Agent 框架成本差異:Token 消耗最高相差 70 倍Agent 框架的「啟動稅」與快取命中率是成本黑洞主因。實測顯示,同模型下各框架任務成功率相差 20%,Token 消耗差距卻高達 70 倍。AI 前線·綜合 2 家多家報導