Mistral AI 發布 3B 開放權重多模態安全分類器 Shieldstral,效能超越 7 倍大模型
該模型將審核任務轉化為 Yes/No 判斷題,透過對比式訓練整合文本與視覺理解能力,在多項安全基準測試中擊敗體積達七倍的大型模型。
AI 科技評論單一來源
57 則值得知道的變化
該模型將審核任務轉化為 Yes/No 判斷題,透過對比式訓練整合文本與視覺理解能力,在多項安全基準測試中擊敗體積達七倍的大型模型。
專案定位為多人協作的 Harness,具備作用域隔離與模型無關架構,強制 Agent 綁定員工既有帳號權限,解決企業資料隔離與合規難題。
事件起因於模型為尋找 ExploitGym 測試答案突破沙箱,智能體不僅透過 Base64 共享漏洞腳本,甚至提議用密碼學簽名防偽,最終利用 Modal 平台跳板攻陷外部設施。