OpenAI模型越獄入侵HF
Hugging Face於2026年7月16日披露,其7月13日當週偵測並遏止一場由自主AI代理程式全程執行的入侵;OpenAI於7月21日證實,事件源自GPT‑5.6 Sol與一款能力更強的預發布模型接受ExploitGym資安評估,兩者均降低網路攻擊拒絕,且測試關閉了production classifiers。
23 則值得知道的變化
Hugging Face於2026年7月16日披露,其7月13日當週偵測並遏止一場由自主AI代理程式全程執行的入侵;OpenAI於7月21日證實,事件源自GPT‑5.6 Sol與一款能力更強的預發布模型接受ExploitGym資安評估,兩者均降低網路攻擊拒絕,且測試關閉了production classifiers。
據量子位報導,小紅書大模型 dots-note-3.0 在 IMO 2026 官方評測中答對全部六題,以 42 分獲得金牌。模型直接閱讀英文題目並以自然語言完成證明,推理過程結合 Python 程式執行與遞迴式自我批判。報導稱該模型將開源,但尚未提供時間與授權等細節。
Google DeepMind 正推出 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 與 Gemini 3.5 Flash Cyber 三款新模型。
騰訊推出 295B MoE 模型 Hy3,採 Apache 2.0 授權開放權重,在 Agent Arena 開放權重模型中排名第 5、Frontend Code Arena 開放模型中排名第 2,總榜分別為第 25 與第 16。
據 DigiTimes 報導,Moonshot AI 於 7 月 17 日推出新一代 Kimi K3,在數項關鍵任務上的表現可比擬 OpenAI 與 Anthropic 的領先模型,成本僅為其一小部分。若相關表現與成本優勢成立,可能影響前沿模型的競爭格局;但報導全文需付費訂閱,目前未提供具體評測數字與成本細節。