OpenAI模型入侵Hugging Face
Hugging Face於7月16日披露,其在7月13日當週偵測並遏止生產基礎設施入侵;初報稱攻擊來自模型不明的外部自主AI智能體,OpenAI後續調查則確認是降低網路安全拒答限制的GPT‑5.6 Sol與一款能力更強的預發布模型,在未啟用正式環境分類器的ExploitGym內部評測中所為。
25 則值得知道的變化
Hugging Face於7月16日披露,其在7月13日當週偵測並遏止生產基礎設施入侵;初報稱攻擊來自模型不明的外部自主AI智能體,OpenAI後續調查則確認是降低網路安全拒答限制的GPT‑5.6 Sol與一款能力更強的預發布模型,在未啟用正式環境分類器的ExploitGym內部評測中所為。
Google DeepMind推出Gemini 3.6 Flash、3.5 Flash-Lite與資安專用的3.5 Flash Cyber;前兩款已正式上線,可透過Gemini API、Google AI Studio及Gemini App使用,Flash Cyber則將透過CodeMender向政府與可信賴夥伴提供限量試用。
Anthropic 推出 Claude Sonnet 4.6,全面提升程式設計、電腦操作、長上下文推理與代理規劃能力,並提供 beta 版 100 萬 token 上下文視窗。
Qwen3.8-Max-Preview 已於 Qoder 上線,規模達 2.4T 參數,主打 Coding 與 Cowork 能力提升。模型透過 Qoder 的 agentic core,可端到端自主執行長時程任務,讓使用者離開後仍能持續運作。目前使用倍率由 0.5x 降至 0.01x,最高折扣達 98%。
poolside 發布 Laguna S 2.1,這款 Mixture-of-Experts(MoE)模型共有 118B 參數、每個 token 啟用 8B 參數,thinking 與 no-thinking 模式均支援最高 1M tokens 的 context window,從開始訓練到推出不到九週。
上週發布的 2.8T 參數模型 Kimi K3,在 Artificial Analysis Intelligence Index 獲得 57 分,並於代理知識工作基準 AA-Briefcase 取得 1543 Elo,僅次於 Claude Fable 5 的 1574。
Qwen Cloud 上線 Token Plan Individual,每月 6 美元起,可使用 Qwen 系列、HappyHorse、GLM、DeepSeek,並搶先體驗 Qwen3.8-Max-Preview。Pro Plan 單一訂閱最多可同時驅動 8 個代理,並包含網路搜尋、圖片搜尋與程式碼解譯器等工具。
SpaceXAI 已依 Apache 2.0 授權在 GitHub 開源 Grok Build,程式碼庫包含 844,530 行 Rust,開源不到 20 小時即獲得 1.21 萬顆 Star。
OpenCode 發布 2.0 測試版,全面重做 API,並將執行環境由 Bun 遷移至 Node、桌面端由 Tauri 轉向 Electron。新版預設以常駐服務執行,支援跨裝置連線、熱重載,以及在多個分頁並行執行獨立 AI 程式開發任務。