Google推出三款Gemini新模型
Google DeepMind推出Gemini 3.6 Flash、3.5 Flash-Lite與資安專用的3.5 Flash Cyber;前兩款已正式上線,可透過Gemini API、Google AI Studio及Gemini App使用,Flash Cyber則將透過CodeMender向政府與可信賴夥伴提供限量試用。
25 則值得知道的變化
Google DeepMind推出Gemini 3.6 Flash、3.5 Flash-Lite與資安專用的3.5 Flash Cyber;前兩款已正式上線,可透過Gemini API、Google AI Studio及Gemini App使用,Flash Cyber則將透過CodeMender向政府與可信賴夥伴提供限量試用。
Anthropic 推出 Claude Sonnet 4.6,全面提升程式設計、電腦操作、長上下文推理與代理規劃能力,並提供 beta 版 100 萬 token 上下文視窗。
Qwen3.8-Max-Preview 已於 Qoder 上線,規模達 2.4T 參數,主打 Coding 與 Cowork 能力提升。模型透過 Qoder 的 agentic core,可端到端自主執行長時程任務,讓使用者離開後仍能持續運作。目前使用倍率由 0.5x 降至 0.01x,最高折扣達 98%。
poolside 發布 Laguna S 2.1,這款 Mixture-of-Experts(MoE)模型共有 118B 參數、每個 token 啟用 8B 參數,thinking 與 no-thinking 模式均支援最高 1M tokens 的 context window,從開始訓練到推出不到九週。
據橘鴉AI早報報導,DeepSeek V4 正式版未依原訂計畫於 7 月中旬上線,截至 7 月 21 日仍未發布。社群流傳的截圖疑似顯示,正式版可能與官方 Harness 產品同步推出,但此說法尚未獲官方證實。官方先前郵件指出,正式版發布後將採用尖峰、離峰計價機制,並於調價前 24 小時通知使用者。
Qwen 發布新一代圖像模型 Qwen-Image-3.0,主打豐富內容、真實細節與深度知識。目前尚無能力、規模及可用性等具體資訊,實際表現仍待進一步資料確認。
上週發布的 2.8T 參數模型 Kimi K3,在 Artificial Analysis Intelligence Index 獲得 57 分,並於代理知識工作基準 AA-Briefcase 取得 1543 Elo,僅次於 Claude Fable 5 的 1574。
據愛範兒報導,字節跳動發布 Seed Audio 1.0,至簡動力與北京大學聯合實驗室提出 HarmoWAM,無問芯穹則公布 Agentic Infra 策略。這些進展涵蓋音訊生成、機器人長程移動與精細操作,以及 AI 代理的訓練、推論與部署。相關效能數據主要由發布方提供,目前缺乏獨立佐證。
據報導,Moonshot 發布新一代模型 Kimi K3,短短兩天便因需求爆量暫停新用戶訂閱。Kimi K3 總參數達 2.8 兆、活躍參數約 500 億,但運行時仍須在主記憶體載入完整參數,一般企業難以自行部署。分析人士認為,其低價策略可能帶動 AI 工作負載成長,進一步推升 HBM、AI 晶片與網通設備需求。