跳到主要內容
2026-07-27 日報
模型發布

微軟推出新圖像與語音模型

iThome據報導
據報導,微軟公布圖像生成模型 MAI-Image-2.5-Pro 與低延遲文字轉語音模型 MAI-Voice-2 Flash,並分別上線 Microsoft Foundry 與 Azure Speech。微軟宣稱,其自研模型相較 OpenAI 模型可顯著降低 GPU 成本,並已將相關技術導入 Bing Image Creator、PowerPoint、OneDrive 與 Dynamics 365。相關效能與成本優勢目前為微軟單方面說法。
讀原始報導

背景

MAI-Image-2.5-Pro 與 MAI-Voice-2-Flash 於 2026 年 7 月 23 日開始公開預覽,兩者皆為微軟自研的生成式 AI 模型。前者可透過 Azure AI Foundry 依文字提示生成寫實或藝術風格圖片;後者則可經由 Azure Speech 與 Azure Voice Live 建置低延遲、支援語音對語音互動的代理人。

來源