跳到主要內容
2026-09-09 日報
模型發布

Inception Labs 發布最大擴散語言模型 Mercury 2.5:速度達 1,107 tokens/s,首發輸入價每百萬 $0.04

Hacker News單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,Inception Labs 宣布推出 Mercury 2.5,官方稱其為目前市場上最大且能力最強的擴散語言模型(diffusion LLM)。 在規格與效能方面,Mercury 2.5 支援 260K tokens 上下文,在廣泛可用的 NVIDIA GPU 上生成速度達 1,107 tokens/s。官方表示,其品質較前代提升 40%,能力對標 GPT-5.6 Luna (Low)、Gemini 3.5 Flash-Lite 與 Claude Haiku 4.5 等成本最佳化模型。 新版本具備可調推理(Tunable reasoning)、平行工具呼叫與 schema-aligned JSON 能力。標準定價為每百萬 tokens 輸入 0.20 美元、輸出 0.75 美元;首發期間提供 2 折優惠,降至輸入 0.04 美元、輸出 0.15 美元。 官方指出,該模型已被 OpenCall 用於語音代理(中位數延遲近 170 毫秒),以及 Augment Code 用於程式碼輔助。此外,Inception Labs 同步推出 Mercury Voice(首字延遲低於 170 毫秒)與 Mercury Router 預覽版。模型目前可透過 Inception API、Baseten 與 OpenRouter 存取。
讀原始報導