Kimi K3 智慧指數得分 57
Kimi K3 在 Artificial Analysis Intelligence Index 得分 57,表現與 Opus 4.8、GPT-5.5 相近,但仍落後 Fable 5 與 GPT-5.6 Sol。其 GDPval v2 Elo 達 1668,並以 53% 成績位居 AutomationBench-AA 第一。
23 則值得知道的變化
Kimi K3 在 Artificial Analysis Intelligence Index 得分 57,表現與 Opus 4.8、GPT-5.5 相近,但仍落後 Fable 5 與 GPT-5.6 Sol。其 GDPval v2 Elo 達 1668,並以 53% 成績位居 AutomationBench-AA 第一。
Arena.ai 公布,Kimi-K3 以 1679 分登上 Frontend Code Arena 第一名,兩兩對戰平均勝率達 76%。其排名較 Kimi-k2.6 從第 18 名躍升至第 1 名,並在七個領域中的六個居首;Claude Fable 5 與 GPT-5.6 Sol 的勝率則分別為 63% 與 58%,基準線為 50%。
德國研究聯盟Soofi-Team公布Soofi S 30B-A3B,採用Mamba–Transformer MoE架構,每個token僅啟動30億參數,主打英德雙語、長文本推理與AI代理能力。團隊表示,其在4K至256K上下文長度下可維持平穩吞吐量,英德文程式撰寫與數學評測亦有領先表現。
Rust 向量索引工具 turbovec 登上 GitHub Trending,提供 Python bindings,並採用 Google Research 的 TurboQuant 演算法。
星源智提出城市級長程方向感知視覺語言導航框架 DA-Nav,整合商業導航指令、第一視角空間理解與偏航恢復,讓機器人能在執行路線時主動偵測並修正偏差。其 ReDA 資料集包含約 28.6 萬筆時序樣本,其中約 12.8 萬筆為恢復資料;完整模型在長程閉環評測中達到 98.15% 糾正成功率,移除恢復資料後則降至 15.46%。