研究與評測
馬斯克稱 Grok 4.6 於 CursorBench 3.2 程式碼評測登頂,超越 GPT-5.6 Sol 與 Claude 5
X @elonmusk單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
根據馬斯克轉發社群帳號 X Freeze 的消息,Grok 4.6 在 CursorBench 3.2 的真實世界程式碼評測中排名第一。消息稱其表現超越了 Claude Fable 5、Opus 5 以及 GPT-5.6 Sol 等前沿模型。此外,根據效能與單次任務平均成本的對比圖表,Grok 4.6 在維持頂尖程式碼能力的同時,展現了極高的成本效率。此消息目前僅為社群與馬斯克轉發,尚未有官方詳細技術報告證實。
讀原始報導背景
Grok 是由伊隆·馬斯克(Elon Musk)於 2023 年 11 月推出的大型語言模型系列,目前已整合至社群網路 X 與特斯拉的 Optimus 機器人中。該計畫最初的構想是打造一個追求真相的 AI,以作為 ChatGPT 之外的另一種選擇。
這則事件的發展
來源
本期分類