研究與評測
WhatsApp 測試裝置端 AI 防詐功能 Scam Alert,結合機密運算與聯邦分析確保對話不上雲
InfoQ 中國多家報導
尚未逐項核實
多個報導來源提及此事;未必是彼此獨立的證據。
WhatsApp 正在小範圍測試選擇性啟用的裝置端機器學習功能 Scam Alert,可透過對話結構與語言訊號,偵測非聯絡人發送的疑似詐騙訊息並發出警告。
該功能將小型模型下載至裝置本機運行,訊息內容不會上傳雲端;若偵測到異常,使用者可選擇封鎖、檢舉或標記為信任,並可選擇分享最近 5 則訊息協助改進模型。
系統底層採用 Meta 於 USENIX NSDI 2025 發布的 PAPAYA 聯邦分析系統,將警告事件與使用者操作在本地匯總後,透過 Oblivious HTTP 傳輸至機密虛擬機(CVM)處理,並套用差分隱私與最小群組閾值,僅向 WhatsApp 提供整體的近似統計數據。
為防止伺服器針對單一使用者派發特定模型,Meta 將模型與其 SHA-256 雜湊值發布至第三方的僅附加(append-only)透明度帳本,客戶端載入前須驗證帳本條目、簽章與時效性。
Meta 目前正擴大漏洞獎金計畫(Bug Bounty)範圍以涵蓋此機密聯邦分析管線,並將發布 CVM 二進位檔案與隱私相關原始碼供獨立安全審查。
讀原始報導背景
Oblivious HTTP(OHTTP)是一種由 IETF 制定的網路協定(規範於 RFC 9458),旨在實現網際網路上的匿名 HTTP 傳輸。其核心目標是防止單一實體同時獲取請求內容與發送者的 IP 位址,藉此保護使用者隱私。
來源
- AI 前線infoq.cn
- en.wikipedia.org