模型發布
GitHub Copilot 月底將支援本機模型推論,微軟同步推出 MAI Code 1.1 Flash 混合專家模型
iThome 中國單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
據報導,微軟宣布 GitHub Copilot 將於本月底前支援本機 AI 模型推論,允許開發者在雲端與裝置端模型之間自動或手動切換。微軟提供自動編排與強制使用裝置端模型兩種模式,用戶可在 GitHub Copilot CLI、Copilot 應用程式與 Visual Studio Code 中設定偏好。本機模型支援指定提供者、模型或端點,開發者可透過 Windows ML 選擇 MAI Code 1.1 Flash,或連接相容於 OpenAI 格式的本機端點。
為配合此更新,微軟推出 MAI Code 1.1 Flash 混合專家(MoE)模型,總參數 1,370 億,活躍參數 68 億,並採用量化與推測解碼技術最佳化回應速度與記憶體占用。該模型在 Surface Laptop Ultra 上的實測顯示,複雜任務中的峰值記憶體使用率與處理速度均顯著提升;在提示長度介於 2K 到 256K Token 時,解碼吞吐量達每秒 40 至 63 個 Token。
讀原始報導