跳到主要內容
2026-10-01 日報
模型發布

Google 發表 Gemini 4 Argon:輸出上限達 100 萬 tokens,首批僅限資安專家

Google DeepMind綜合 6 家報導一手來源
核實資料不足

來源為發布方或研究資料;不代表所有主張已獲獨立核實。

查證回合用盡,未形成有依據結論

Google DeepMind 發表新一代前沿模型 Gemini 4 Argon。據 Ars Technica 報導,Google 原承諾於 6 月推出 Gemini 3.5 Pro,但最終直接發表 Gemini 4 Argon。目前該模型正參與美國政府的發布前自願審查程序,僅透過 Fairwind 計畫向受信任的資安防禦者開放。Google DeepMind SVP Koray Kavukcuoglu 表示,初期限制存取是為了確保模型未出現對齊問題。 Gemini 4 Argon 將單次輸出 token 上限從 64K 大幅提升至 100 萬。定價為每百萬輸入 token 2 美元、每百萬輸出 token 10 美元,快取輸入 token 享 95% 折扣。 在各項評測中,Argon 在真實世界軟體工程評測 DeepSWE v1.1 獲得 77.9%,擊敗 Claude Opus 5.5(74.2%)與 GPT-6 Astra(74.1%)。此外,該模型在 Vibe Code Bench 獲得 91.9%,長影片理解 LVBench 獲得 91.7%,並在測量核心業務端到端執行的 AutomationBench 以 51.3% 排名第一。 針對資安領域,Google 向受信任者與內部團隊提供「無資安護欄」版本的 Argon。在評估修復漏洞能力的 CWE-bench v1 中,Argon 以 68% 並列第一。資安公司 Wiz 已透過其 Scan for Good 計畫使用該模型,並發現了先前模型遺漏的全球醫院軟體重大漏洞。 Google 內部已廣泛部署 Argon 代理進行自動化任務: - 記憶體最佳化:代理分析遙測資料後,已為 Google 資料中心釋出 300 TiB 記憶體,預估總節省量可達 500 TiB 至 1 PiB。 - 程式碼遷移:代理正將 Google 內部的 C/C++ 程式碼庫遷移至 Rust,涵蓋超過 80 萬行的 Fuchsia Zircon 核心。在開源影片解碼器 libgav1 專案中,代理替換了 3.2 萬行 SIMD 程式碼,產出的安全 Rust 版本執行速度比原 Rust 移植版快 2.7 倍。 - 量子運算:在數分鐘內將量子演算法子程序的時空資源基準效能提升了 40%。
讀原始報導

背景

Fairwind Program 是 Google DeepMind 專為受信任合作夥伴推出的專屬計畫,旨在透過提供前沿 AI 能力的早期存取權,協助防禦由 AI 驅動的網路威脅。此次發布的 Gemini 4 Argon 即是透過該計畫率先提供給資安防禦人員使用。

來源