開發生態
VentureBeat 調查:49% 企業遇過 AI 通過測試卻在實際上線出錯,對自動化評估信任度反升至 13%
VentureBeat單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
據 VentureBeat 發布的 7 月份企業 AI 部署調查顯示,49% 的受訪企業表示其 AI 代理或基於 LLM 的功能在通過內部測試後,仍在實際上線時發生客戶可見的錯誤,其中 24% 表示該情況發生過不只一次。
儘管出錯率與 6 月份的 50% 幾乎持平,企業對自動化評估的信任度卻呈現上升趨勢。調查指出,對自動化評估表示信任的比例從 6 月的 5% 升至 13%;將「測試與現實結果不一致」視為最大擔憂的比例則從 29% 降至 19%。數據更顯示,曾因 AI 代理上線失敗而受害的企業,正加速而非減緩移除部署決策中的人為介入。
在信任度方面出現明顯分歧:遇過 AI 上線出錯的企業中,僅 4% 對自動化檢查完全信任;而未遇過此類事件的企業,完全信任的比例達 24%。
針對此趨勢,自動化代理監控平台 Raindrop.ai 技術長 Ben Hylak 指出,隨著系統導入 MCP 與子代理變得日益複雜,已無法完全列舉所有失敗案例。財星 100 大企業正逐漸減少評估資料集並降低維護優先級,轉而依賴部署前後的異常與問題檢測解決方案。該調查樣本包含 108 位來自百人以上規模企業的受訪者,其中 69% 具備 AI 採購決策權。
讀原始報導