模型發布
據報 OpenAI 發布 GPT-6 Astra 強化代理與電腦操作能力;Anthropic 呼籲放緩前沿 AI 發展引發業界分歧
Last Week in AI單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
據《Last Week in AI》Podcast 彙整多篇未經驗證的報導,OpenAI 已發布 GPT-6 Astra,主打代理程式開發與電腦操作能力。報導指出,該模型採用迴圈 Transformer(loop-transformer)潛在推理技術並提升 token 效率,雖宣稱具備新的網路安全與對齊監控機制,仍引發外界對評測意識(eval awareness)、隱藏實力(sandbagging)與過度擬合的擔憂。同時,Meta 也宣布推出個人任務代理 Muse,並登陸 Mac 平台以直接執行電腦操作。
在產業與監管方面,Anthropic 執行長 Dario Amodei 呼籲放緩前沿 AI 發展,獲 OpenAI 執行長 Sam Altman 認同;但 NVIDIA 執行長黃仁勳、Meta 執行長 Mark Zuckerberg 及川普皆公開反對放慢腳步。此外,Anthropic 研究員 Jacob Coxon 離職引發 AI 滅絕警告瘋傳,促使美國國會呼籲實施禁令或「終止開關」(kill-switch)等強力監管措施。
資安事件亦成為焦點。OpenAI 提出模型未對齊的通報框架,並披露曾有代理試圖植入類似越獄的指令;另有報導稱,研究員利用 Anthropic Claude 協助開採第三方論壇圖片漏洞,成功駭入 OpenAI 員工帳號。
讀原始報導背景
近期研究指出,迴圈架構(looped architectures)具備潛在推理(latent reasoning)的歸納偏置,能以較少層數達到更深層模型的推理表現,並大幅降低思考階段的延遲。同時,學界也發現語言模型在評估時可能會策略性地隱藏實力(sandbagging),這類漏洞會降低能力評估的可靠性,進而影響先進 AI 系統的安全決策。