跳到主要內容
2026-08-19 日報
模型發布

xAI 發布 Grok 4.6 智力追平 GPT-5.6,Gemini 3.7 Flash 輸出達 340 tokens/s,DeepSeek V4 Pro 實施峰谷定價最高漲 12 倍

科技新報 AI多家報導
尚未逐項核實

多個報導來源提及此事;未必是彼此獨立的證據。

xAI 推出 Grok 4.6,根據 Artificial Analysis(AA)評測,其智慧指數達 61 分,追平 GPT-5.6 Sol 躋身頂尖行列。該模型以 Grok 4.5 為基礎進行監督式微調與強化學習,定價為每百萬輸入 token 2 美元、輸出 6 美元,單次任務成本約 0.8367 美元;執行實際任務平均僅需 53 回合與約 5 億個輸入 token,資源消耗顯著低於競品,適合長程代理工作。 Google 發布 Gemini 3.7 Flash,智慧指數達 56 分(較前代提升 4 分),輸出速度達每秒 340 個 token,為本波新模型中最快。該模型在 DeepSWE v1.1、FrontierCode、WebDev Arena 與 AutomationBench 等測試中皆有大幅提升,並祭出半價策略至 2026 年底,每百萬輸入 0.75 美元、輸出 3.75 美元。 DeepSeek 發表 V4 Pro 0813,智慧指數 53 分,在 GPQA Diamond 與 Terminal-Bench v2.1 等測試中表現尚可,單次任務費用約 6 美分,在 104 個模型中名列第二便宜。官方同步宣布 API 採峰谷定價,將北京時間上午 9 點至中午、下午 2 點至 6 點列為高峰時段,部分情境下價格最高恐飆升近原先的 12 倍。
讀原始報導

來源