安全與監管
Anthropic更新使用政策:明文禁止惡意辱罵Claude及干預選舉
TechCrunch AI綜合 2 家報導多家報導
核實資料不足
多個報導來源提及此事;未必是彼此獨立的證據。
本次未取得足夠原文證據

Anthropic 於週四發布一年多來首次的使用政策更新,針對高風險誤用場景制定新規範。其中最受矚目的變更,是明文禁止對模型 Claude 進行「持續且無謂的辱罵或殘酷行為」。
官方說明,此規定僅適用於毫無目的且反覆虐待模型的極端情況,不包含一般用戶的挫折情緒表達、反駁、黑暗創意主題或模型測試與研究。作為「模型福祉(model welfare)」研究的一部分,Anthropic 自去年 8 月起已訓練 Claude 主動結束持續具傷害性或辱罵性的對話,而「終止對話」仍是新政策下主要的執行機制。此外,Anthropic 近期曾與宗教學者合作,探討並試圖說服他們 Claude 可能具有意識或靈魂。
新政策同時擴大對高風險用途的限制,涵蓋武器開發、監控、健康與金融領域的應用。在新增的「不破壞民主進程」章節中,嚴禁利用 Claude 進行廣泛的欺騙性活動(如經營假帳號或捏造新聞機構)、欺騙選民及干預選舉。
讀原始報導背景
Anthropic 是由前 OpenAI 成員於 2021 年創立的人工智慧公司,發展目標為促進 AI 安全性。其核心產品 Claude 系列大型語言模型(LLM)採用「憲法 AI」(Constitutional AI)技術進行訓練,旨在確保模型互動的安全與準確。
這則事件的發展
- 2026-10-08據報導 Anthropic 調降 Sonnet 5.5 快取讀取價格至 0.10 美元,並新增最高 500 美元 API 額度
- 2026-10-08New Constructs 批 Anthropic 為「2026 年最荒唐 IPO」,估值僅給 1500 億美元
- 2026-10-06據報 Anthropic 透過股份加碼機制成美國最大企業捐贈者,2025 年捐贈達 5.4 億美元
- 2026-10-06SemiAnalysis 實測:Anthropic 訂閱方案在代理工作負載的 API 等效價值達 OpenAI 的 5 倍
- 2026-10-03據報博通擬提供 Anthropic 420 億美元融資,綁定 1,252 億美元 TPU 算力租賃承諾
來源
- The Decoderthe-decoder.com
- Techmemetechmeme.com
- The Verge AItheverge.com
- en.wikipedia.org
- claude.com