Google 發表 Gemini 4 Argon:輸出上限達 100 萬 tokens,首批僅限資安專家
新模型在 DeepSWE 評測以 77.9% 擊敗 GPT-6 Astra,內部已利用其代理將 C/C++ 程式碼遷移至 Rust,並省下 300 TiB 記憶體。
Google DeepMind綜合 6 家一手來源
92 則值得知道的變化
新模型在 DeepSWE 評測以 77.9% 擊敗 GPT-6 Astra,內部已利用其代理將 C/C++ 程式碼遷移至 Rust,並省下 300 TiB 記憶體。
該模型結合選擇性狀態空間遞迴與雙曲空間情節記憶庫,在 1270 萬 token 訓練中困惑度達 53.7,並具備執行時重寫權重的可塑性。
新版整合多種訊息入口與記憶管理,支援長任務與團隊協作。實測顯示其採大步少輪策略,全程未觸發上下文壓縮,但仍具命令列安裝門檻。
GPT-6.1 Sol 標準定價與 Sonnet 5.5 相同,但快取輸入僅 0.1 美元;OpenAI 同步將 200 美元方案用量砍半。
模型採 Apache-2.0 授權釋出六種尺寸,能判斷影像旋轉角度;團隊同時發現競品在 JPEG 壓縮後,準確率會從 98% 暴跌至 30%。
首發客戶 Cognition 已將 Devin 投入生產;平台同步引進 Vera CPU 使沙盒啟動快 3 倍,並推出 Forge 平台整合訓練與評估流程。
據 Reddit 社群流傳消息,前沿模型 GPT-6.1 Sol 在高難度基準測試 Humanity's Last Exam 的 Diamond 級別中取得第三名,官方尚未證實此成績。
Google Gemini 4 在 Artificial Analysis 基準測試中取得與 GPT-6 Astra 相同的成績,且運作成本較對手大幅降低了百分之四十。