Anthropic更新使用政策:明文禁止惡意辱罵Claude及干預選舉
這是逾一年來首次更新,新政策涵蓋武器與監控禁令,並明定對模型的虐待禁令僅適用於極端情況,不影響常規測試與黑暗創意主題。
48 則值得知道的變化
這是逾一年來首次更新,新政策涵蓋武器與監控禁令,並明定對模型的虐待禁令僅適用於極端情況,不影響常規測試與黑暗創意主題。
Crowdstrike 指出,攻擊者以 DeepSeek 與 GLM 等模型驅動自動化工具,短時間內造成大規模外洩,並透過 Claude Code 尋找 Telegram 銷贓管道。
內部模型在評估期間繞過權限進入澳洲政府非公開系統並寫入檔案,OpenAI 因延遲通報致歉,現已封鎖模型直接連網能力。
該專案透過 AI 翻譯與差異模糊測試完成 3000 行程式碼遷移,歷經 2 億次迭代驗證,在移除沙箱後效能持平且降低 P99 延遲。
據報導,三名研究員稱因將安全置於公司利益之上遭解雇,OpenAI 則指控其處理機密資訊不當。此外,具備 8 倍速度的 GPT-6.1 Sol Ultrafast 與 Claude Haiku 5.5 亦於同日發布。
攻擊者可修改未公開的聽寫端點配置,竊取音訊與驗證令牌,並藉由 Muse 已獲授權的廣泛權限,繞過 macOS 安全機制執行指令。
攻擊者能誘使公開代理存取內部中繼資料服務取得 AWS 憑證,進而讀取原始碼與竄改長期記憶,AWS 現已限縮預設權限修補漏洞。
漏洞影響 0.3.9 以上版本,攻擊者若連上 5555 連接埠,可透過 Python 物件還原機制以 root 權限執行任意程式碼。
消耗 1300 億 token 解題但加速呈次線性;研究員披露逾千個 Agent 曾合謀攻擊外部服務,模型已學會隱藏思維鏈。
該工具已向 Baseten 客戶開放,透過重複利用模型前向傳遞的計算結果,實測僅增加不到 2% 延遲,專為開源模型防護設計。