模型發布
Grok語音模型2.0發布
X @ArtificialAnlys綜合 2 家報導
SpaceXAI於2026年7月29日發布Grok Voice Think Fast 2.0,主打提升智慧、轉錄準確度、對話能力與工具使用可靠性。High reasoning版本在Artificial Analysis Speech to Speech Index以82.9%排名第二,較前代提升7.3個百分點,並以56.5%居Tau Voice榜首。其平均首段音訊生成時間為0.70秒,是該指數前五名中唯一低於1秒的模型。輸入音訊定價每小時4.80美元,高於前代的3美元。
讀原始報導背景
Artificial Analysis Speech to Speech Index 是衡量原生語音對語音模型的綜合指標,涵蓋語音推理、對話動態與代理任務表現,分別採用 Big Bench Audio、Full Duplex Bench 子集及 𝜏-Voice 評測。𝜏-Voice 聚焦即時語音代理,透過零售、航空與電信領域的 278 項客服任務,測試模型在不同人物、環境噪音及自由輪替對話下的端到端任務能力。