Kimi K3推出百萬上下文模型
Kimi K3 已正式上線,具備 2.8 兆參數、100 萬 token 上下文與原生多模態能力。Kimi Delta Attention 在百萬 token 上下文中可讓解碼速度最高提升 6.3 倍,Attention Residuals 則以不到 2% 的額外成本,將訓練效率提高約 25%。
X @Kimi_Moonshot
23 則值得知道的變化
Kimi K3 已正式上線,具備 2.8 兆參數、100 萬 token 上下文與原生多模態能力。Kimi Delta Attention 在百萬 token 上下文中可讓解碼速度最高提升 6.3 倍,Attention Residuals 則以不到 2% 的額外成本,將訓練效率提高約 25%。
Arena.ai 公布,Kimi-K3 以 1679 分登上 Frontend Code Arena 第一名,兩兩對戰平均勝率達 76%。其排名較 Kimi-k2.6 從第 18 名躍升至第 1 名,並在七個領域中的六個居首;Claude Fable 5 與 GPT-5.6 Sol 的勝率則分別為 63% 與 58%,基準線為 50%。
德國研究聯盟Soofi-Team公布Soofi S 30B-A3B,採用Mamba–Transformer MoE架構,每個token僅啟動30億參數,主打英德雙語、長文本推理與AI代理能力。團隊表示,其在4K至256K上下文長度下可維持平穩吞吐量,英德文程式撰寫與數學評測亦有領先表現。
OpenAI提出「每美元有效智慧」框架,主張企業應以成功完成工作的完整成本與產出價值衡量AI投資回報,而非只看每Token成本。同步發布的GPT-5.6分為Sol、Terra與Luna三個層級,分別側重旗艦效能、成本平衡及速度與價格。
騰訊在 2026 世界人工智慧大會展示混元 Hy3、Marvis 等 AI Agent 產品,SkillHub 並正式上線 SkillPay 支付體系。SkillPay 將技能分發、Agent 呼叫與付款串接於同一任務流程,商家可透過 Pay Skill 向 Agent 收費。