跳到主要內容
2026-09-07 日報
開發生態

微軟 Foundry 模型路由擴容至 28 個區域,模型池新增 GPT-5.6 與 Claude Opus 4.8

InfoQ 中國多家報導
尚未逐項核實

多個報導來源提及此事;未必是彼此獨立的證據。

微軟對 Foundry Models 的模型路由器進行擴容,全球標準部署可用區域由 2 個增至 28 個,資料區域部署擴充至 21 個,以滿足資料駐留的合規需求。 模型池同步更新,新增 Anthropic Claude Opus 4.8 與 GPT-5.6 系列,並移除已達生命週期終點的 gpt-5-chat、gpt-5.2-chat、gpt-5.3-chat 及 DeepSeek-V3.1。使用預設配置(Balanced 模式)的團隊無需重新部署即可自動套用變更;若已限制模型子集,則需手動添加新模型才會納入可用範圍。 儘管 API 端點保持穩定,專家指出自動更新可能改變應用程式的回答風格、延遲與 Token 使用量。此外,路由器的有效上下文窗口取決於底層模型中最小的窗口,向模型池添加小窗口模型會動態降低整體的上下文上限。 其他技術限制與細節包括: - **Claude 部署前提**:Claude 模型必須先在同一個 Foundry 帳戶中單獨部署匹配的 SKU,否則路由器選中時會返回 InvalidResourceProperties 錯誤。 - **路由決策限制**:決策僅基於文本,圖片輸入不影響模型選擇,且不支援音訊。 - **計費方式**:路由器會對自身的輸入提示詞計費,疊加在底層模型成本之上。 - **工作模式**:支援 Balanced(平衡品質與成本)、Quality(品質優先,適合複雜推理)與 Cost(成本優先,適合高吞吐量分類)三種模式,修改配置最多五分鐘生效。 - **可追溯性**:每個回應的 `model` 欄位會返回實際選中的模型名稱,供事後審計。 官方公告未提供準確率、成本對比或延遲開銷等實測數據,但釋出了一個開源評估管道,建議團隊在接入生產流量前進行基準測試。
讀原始報導

背景

Microsoft Foundry 是微軟 Azure 雲端運算平台旗下的一項服務,主要提供開發者建立 AI 代理、模型與應用程式。該平台透過微軟的全球基礎設施,支援多種程式語言與開發工具,協助企業與政府進行應用程式的管理與開發。

來源