研究與評測
數發部公布首波主權 AI 評測,本土模型價值觀準確率達 92-100%;並與八大部會啟動 AI 風險盤點
iThome單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,數發部 AI 產品與系統評測中心(AIEC)公布首波臺灣主權 AI 評測結果,針對 188 個國內外通用 AI 模型進行測試。評測建立 3 項指標:臺灣繁體中文理解能力、社會文化理解能力及價值觀理解能力;其中語言與社會文化能力分別採用近 5 年高中學測國文科與社會科題目作為基準。
評測結果顯示,國際大型模型在繁體中文理解已有一定水準,但臺灣本土模型在價值觀理解項目的表現較佳,準確率達 92% 至 100%。數發部表示,未來將進一步建立金融、法務、教育及醫療等垂直領域模型的評測機制。
在 AI 風險管理方面,數發部已與衛福部、法務部、經濟部等八個重點部會啟動 AI 風險盤點輔導,目標於今年底完成四步驟風險盤點,並於 2027 年 6 月底前完成第一輪法規調適。目前系統已登錄 144 個 AI 應用情境,因屬試行階段暫不公開個別案例。
數發部次長侯宜秀指出,臺灣採取「分類但不分級」的 AI 治理模式,不比照歐盟 AI Act 採固定風險等級,而是由各主管機關依實際應用情境設計管理措施。此外,隨著 AI Agent 快速發展,未來治理重點將延伸至自主執行任務能力、授權、安全及可問責性等面向,並規畫逐步將 Agent 治理納入政府 AI 治理指引。
讀原始報導