跳到主要內容
2026-10-03 日報
前瞻與傳聞

據傳 GPT-6.1 sol (max) 於 FrontierMath Tier 4 v2 數學基準測試達 100% 滿分

Reddit r/singularity單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據 Reddit 社群 r/singularity 流傳的消息,一個名為 GPT-6.1 sol (max) 的未公開模型,在 Epoch AI 的 FrontierMath Tier 4 v2 基準測試中達到了 100% 的滿分。該消息僅附帶 Epoch AI 排行榜的網址連結,目前尚未有官方出面證實此模型的存在與測試數據的真實性。
讀原始報導

背景

GPT-6.1 Sol 是由 OpenAI 於 2026 年 9 月推出的大型語言模型。FrontierMath 則是一項專門用於評估 AI 進階數學推理能力的基準測試。

這則事件的發展

  1. 2026-10-01OpenAI 發表 GPT-6.1 Sol 與 $500 訂閱方案,快取成本僅 Claude Sonnet 5.5 一半但任務完成率較低
  2. 2026-10-01網傳 GPT-6.1 Sol 於高難度基準測試 Humanity's Last Exam 取得第三名

來源

本期分類