跳到主要內容
2026-07-21 日報
模型發布

Google推出三款Gemini新模型

Google DeepMind綜合 10 家報導
Google DeepMind推出Gemini 3.6 Flash、3.5 Flash-Lite與資安專用的3.5 Flash Cyber;前兩款已正式上線,可透過Gemini API、Google AI Studio及Gemini App使用,Flash Cyber則將透過CodeMender向政府與可信賴夥伴提供限量試用。3.6 Flash定價為每百萬輸入/輸出token 1.50/7.50美元,輸出token用量較3.5 Flash少17%,特定DeepSWE測試最多少65%;DeepSWE成績由37%升至49%,OSWorld由78.4%升至83%。Artificial Analysis實測3.6 Flash平均每項任務耗時由2.7分鐘降至1.3分鐘、輸出速度304 token/s、單項成本由0.59美元降至0.50美元,但Intelligence Index仍為50分、與3.5 Flash相同,和Google所稱整體品質提升存在評估分歧;3.5 Flash-Lite則達350 token/s、平均任務時間由1.0分鐘降至0.6分鐘,指數由25升至36分,API定價為每百萬輸入/輸出token 0.30/2.50美元,高於3.1 Flash-Lite的0.25/1.50美元。3.5 Flash Cyber整合CodeMender,可高速多次掃描與修補漏洞;Google稱其最多呼叫五次時在CyberGym具競爭力,並在V8 JavaScript Engine找出55個已確認問題,高於3.5 Flash的47個及Opus 4.6的36個,其中10個未被其他模型發現。Gemini 3.5 Pro仍在與合作夥伴測試、尚無廣泛推出日期,Google也已啟動其迄今最具企圖的Gemini 4預訓練。 ⚠️ 來源分歧:Google稱Gemini 3.6 Flash在程式設計、知識工作與多模態品質上提升,但Artificial Analysis測得其整體Intelligence Index仍為50分,與3.5 Flash相同。
讀原始報導

背景

Artificial Analysis Intelligence Index 是綜合評估語言模型推理、程式設計、知識、指令遵循、科學推理及多步驟任務能力的基準,Artificial Analysis 也獨立比較模型的品質、價格、輸出速度與延遲。DeepSWE 則聚焦長時間跨度的軟體工程任務,包含來自活躍開放原始碼儲存庫的 113 項原創題目,涵蓋 TypeScript、Go、Python、JavaScript 與 Rust。

來源