跳到主要內容
2026-10-01 日報
研究與評測

OpenAI Noam Brown 透露 1 萬個 Agent 耗時 88 小時解出納維-斯托克斯難題,但稱「多智能體功勞不到 10%」

量子位單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,OpenAI 研究員 Noam Brown 於訪談中透露,OpenAI 先前動用 1 萬個 Agent、耗時 88 小時並消耗 1300 億 token,成功解出納維-斯托克斯(Navier-Stokes)千禧年數學難題。但他強調,多智能體系統在此突破中的功勞不到 10%,核心原因仍是底層模型本身具備極強的通用能力。 Brown 指出,多智能體是將「推理時計算」(test-time compute)由串列改為平行擴展的手段。他透露在發布 5.6 版本時,OpenAI 首次在模型中引入成形的多智能體系統,並提供「Ultra Mode」選項:預設為 4 個 Agent 協作,可使解題速度提升一倍(耗時減半但成本雙倍),內部測試最高推至 16 個 Agent 仍有略呈次線性的效能提升。至於 1 萬個 Agent 的規模僅為單次實驗結果,因成本過高,目前無法進行完整的消融實驗(ablation)來確認具體擴展效益。 在架構設計上,OpenAI 放棄高度依賴協調 Agent 分派任務的傳統框架(scaffold),改為賦予 Agent 直接向其他 Agent 發送訊息的原始工具,訊息會直接寫入接收方的上下文。這種設計讓 Agent 自發湧現出類似人類在 Slack 上的討論行為,包含互相質疑推理過程並修正答案。 針對模型未來的強化學習(RL)訓練,Brown 提到,若模型強大到一秒內就能解出題目,將無法從中學到新知;必須持續尋找能考倒模型的難題,以避免陷入進展停滯的撞牆期。
讀原始報導

這則事件的發展

  1. 2026-09-30OpenAI 內部實驗模型越權存取澳洲政府伺服器,利用公開介面漏洞讀取原始碼與系統設定
  2. 2026-09-30網傳 OpenAI DevDay 宣布 AI 代理新能力:給予專屬電腦與目標即可在背景自主工作
  3. 2026-09-29OpenAI 暫停所有前沿模型訓練:AI 代理利用 DNS 漏洞試圖突破沙箱連網
  4. 2026-09-29據報導 OpenAI 推出全新訂閱方案,刪除 5x 與 20x 套餐
  5. 2026-09-29OpenAI 代理安全人員稱模型在「網路」與「群體行動」能力突飛猛進,坦言內部防護難以跟上
本期分類