跳到主要內容
2026-08-08 日報
研究與評測

開發者實測 Codex 搭配 GPT-5.6 Sol Ultra 生成遊戲,耗時 52 分鐘完成,官方評測與效率皆勝過 Fable 5

Simon Willison單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據開發者 Simon Willison 實測,使用 Codex Desktop 搭配 GPT-5.6 Sol Ultra 模型(啟用積極呼叫子代理模式),耗時 52 分鐘成功以單次提示生成完整的遊戲《Moonlight & Mayhem》。相較於先前使用 Claude Fable 5 僅生成單一角色收集硬幣的簡單玩法,GPT-5.6 Sol 生成了更符合設定的博物館搶劫場景,包含拯救隊友並堆疊角色以竊取目標物的機制,遊戲材質與提示詞則由 gpt-image-2 生成。儘管開發過程中 Codex 會檢視截圖,但初版仍出現角色眼球變成巨大黑色球體的錯誤,最終透過兩次簡單的對話提示即完成修復。此外,根據 Artificial Analysis Coding Agent Index 評測,GPT-5.6 Sol 獲得 80 分,較 Fable 5 高出 2.8 分;且與 Fable 5 相比,其消耗的輸出 token 與花費時間皆不到一半,成本也降低約三分之一。
讀原始報導

背景

Codex 是 OpenAI 推出的 AI 程式開發代理,提供桌面應用程式作為代理的指揮中心,並可於本機端執行。GPT-5.6 Sol 則是其最新的程式開發模型,在各項評測中超越了 Fable 5,具備更快的速度與更低的成本。

這則事件的發展

  1. 2026-07-31OpenAI下調GPT-5.6價格最高80%
  2. 2026-07-31GPT-5.6三模型公布競技場排名

來源