跳到主要內容
2026-10-07 日報
前瞻與傳聞

據報 Google 新旗艦模型 Gemini 4 Argon 基準測試成績亮眼,但內部指其程式碼能力不穩

DigiTimes單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據 DigiTimes 報導,Google 新一代旗艦 AI 模型「Gemini 4 Argon」在多項基準測試(benchmark)中取得了優異的成績。然而,部分 Google 內部員工透露,該模型在編寫程式碼(coding)方面的表現仍不夠穩定,並因此引發了內部的疑慮。
讀原始報導

背景

Gemini 4 Argon 是 Google 推出的新一代旗艦級 AI 模型,具備網路安全防禦能力。在基準測試中,該模型主要與 GPT-6 Astra 及 Claude Fable 5.1 等模型進行比較。

這則事件的發展

  1. 2026-10-01Google 發表 Gemini 4 Argon:輸出上限達 100 萬 tokens,首批僅限資安專家
  2. 2026-10-01網傳 Google 未發布模型 Gemini 4 Argon 跑分洩漏:18 項評測有 12 項勝過 GPT-6 Astra 與 Opus 5.5

來源

本期分類