開發生態
開發者 Simon Willison 回顧 2026 年 LLM 發展:Claude Opus 4.5 與 GPT-5.1 帶動 coding agent 達日常實用水準
Simon Willison單一來源
核實資料不足
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
本次未取得足夠原文證據

據知名開發者 Simon Willison 於 WeAreDevelopers 大會發表的未經驗證演講指出,2025 年 11 月發布的 Claude Opus 4.5 與 GPT-5.1 讓 coding agent 跨越了實用門檻。他表示,搭配 Claude Code 與 Codex 等代理工具後,模型表現已從「經常犯錯」提升至「足以應付日常開發」的可靠程度。
在其慣用的「生成鵜鶘騎腳踏車 SVG」測試中,兩款模型在 11 月時仍無法準確繪製腳踏車結構。針對代理安全(agent security)與沙盒機制,大會 277 場議程中有約 40 場涉及此議題,但他先前預測「代理遭劫持導致重大經濟損失」的災難尚未發生。
Willison 透過 AI 代理輔助,成功以 Python 實作 JavaScript 直譯器(移植自 MicroQuickJS)與 WebAssembly 執行環境,並透過 Pyodide 將其編譯為 WebAssembly 在瀏覽器中運行。演講中也引用 Adam Leventhal 提出的「Deep Blue」一詞,形容軟體工程師因 AI 能力大幅提升而產生的倦怠感。
讀原始報導