Mistral 開源 Shieldstral:3B 多模態安全分類模型,以自然語言定義政策、效能匹敵 7 倍大模型
採 Apache 2.0 授權,將內容審核重構為問答任務,推論時以自然語言輸入政策即可適配,無需重新訓練,可於單張 16GB GPU 上運行。
X @MistralAI多家報導
10 則值得知道的變化
採 Apache 2.0 授權,將內容審核重構為問答任務,推論時以自然語言輸入政策即可適配,無需重新訓練,可於單張 16GB GPU 上運行。
輸入 $2.0/百萬 token、輸出 $6.0,支援自主編程與多模態回饋迴圈,同步預告開源 Qwen3.8-27B。
模型激活參數 95B、支援 1M tokens 長上下文與視覺理解,TextArena 僅次於 Claude、Vision Arena 全球第二,Qwen3.8-27B 亦將開源。
以 ~34T token 預訓練、128K 上下文,Apple M5 Max 上解碼達 220 tok/s,單張 H100 日產約 13 億 token;訓練含四階段 Agentic RL 管線。
基於 Cosmos 3 Super Reasoner 建構,參數量為前代三倍,以 OpenMDW-1.1 授權上架 Hugging Face,支援微調與商業再散布。