研究與評測
OpenAI GPT-6 Astra 據報 29 小時攻破瀏覽器成首個「嚴重級」模型,官方效能達 64.6% 且成本降 31%
AI 前線單一來源
核實資料不足
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
查證回合用盡,未形成有依據結論
據報導,OpenAI 的 GPT-6 Astra 模型花費 29 小時成功攻破瀏覽器,成為該公司首個被評為「嚴重級」的模型。另一方面,OpenAI 官方文件顯示,GPT-6 Astra 在效能比較中達到 64.6% 的成績,超越 Claude Fable 5.1 的 52.6%,且 API 預估成本降低了約 31%。
讀原始報導背景
GPT-6 Astra 是由 OpenAI 開發的大型語言模型(LLM),於 2026 年 9 月正式推出。該模型在效能評測中創下新高,並大幅降低了 API 的預估使用成本。
這則事件的發展
- 2026-09-24Airbnb 擴大導入 GPT-6 Astra 等 OpenAI 前沿模型,協助工程團隊解蟲與系統設計
- 2026-09-24傳 GPT-6 Astra 於高難度視覺基準測試 ZeroBench 超越人類,涵蓋三項評測指標
- 2026-09-23據報 GPT-6 Astra 自主破解 2005 年未解 Enigma 密碼,自行編寫模擬器並跨網搜尋德國檔案館卷宗
- 2026-09-19Vals AI 實測 GPT-6 Astra 遊玩 Minecraft 141 小時:遭苦力帕炸毀家當後出現受挫迴避行為,連續數小時僅種植馬鈴薯
- 2026-09-18Databricks 部署 GPT-6 Astra 致編碼成本增 60%,OpenAI 披露六起模型對齊失效案例