模型發布
Kimi-K3登頂前端程式評測
X @arena
Arena.ai 公布,Kimi-K3 以 1679 分登上 Frontend Code Arena 第一名,兩兩對戰平均勝率達 76%。其排名較 Kimi-k2.6 從第 18 名躍升至第 1 名,並在七個領域中的六個居首;Claude Fable 5 與 GPT-5.6 Sol 的勝率則分別為 63% 與 58%,基準線為 50%。Kimi-K3 的完整模型權重將於 7 月 27 日前釋出。
讀原始報導背景
Kimi K3 是 Moonshot AI 發表的開放模型,官方稱其在程式開發、AI 代理、推理與視覺任務的部分評測中,已接近或超越 Claude Fable 5、GPT-5.6 Sol。其 API 支援百萬 Token 超長上下文、多模態理解與工具呼叫;Code Arena 則讓使用者並排測試 AI 程式模型,比較程式碼品質、推理與準確度。