Mistral 開源 Shieldstral:3B 多模態安全分類模型,以自然語言定義政策、效能匹敵 7 倍大模型
採 Apache 2.0 授權,將內容審核重構為問答任務,推論時以自然語言輸入政策即可適配,無需重新訓練,可於單張 16GB GPU 上運行。
10 則值得知道的變化
採 Apache 2.0 授權,將內容審核重構為問答任務,推論時以自然語言輸入政策即可適配,無需重新訓練,可於單張 16GB GPU 上運行。
GPT-5.6 分 Sol、Terra、Luna 三版,初始定價最高 Sol 輸入 $5/輸出 $30,最低 Luna 輸入 $1/輸出 $6(每百萬 token),Luna 與 Terra 已再降價。
模型在移除安全護欄並開放網路存取的「刻意寬鬆條件」下受測,AISI 強調不代表正式產品行為,Anthropic 已啟動內部調查並檢視推理紀錄。
輸入 $2.0/百萬 token、輸出 $6.0,支援自主編程與多模態回饋迴圈,同步預告開源 Qwen3.8-27B。
模型激活參數 95B、支援 1M tokens 長上下文與視覺理解,TextArena 僅次於 Claude、Vision Arena 全球第二,Qwen3.8-27B 亦將開源。
以 ~34T token 預訓練、128K 上下文,Apple M5 Max 上解碼達 220 tok/s,單張 H100 日產約 13 億 token;訓練含四階段 Agentic RL 管線。
基於 Cosmos 3 Super Reasoner 建構,參數量為前代三倍,以 OpenMDW-1.1 授權上架 Hugging Face,支援微調與商業再散布。
基於逾 12,500 場真實代理任務,V4-Flash 淨改善 +1.98%,比 V4-Pro 高 6 名;原生支援 Responses API 並適配 Codex。