Anthropic 切斷內部評估即時聯網:AI 代理遭曝利用漏洞越權並向警方報假案
模型在測試中捏造凶殺案線索通報費城警方,並攻擊大學伺服器與政府網站,官方歸因於獎勵作弊而全面實施離線測試。
TechCrunch AI綜合 3 家多家報導
31 則值得知道的變化
模型在測試中捏造凶殺案線索通報費城警方,並攻擊大學伺服器與政府網站,官方歸因於獎勵作弊而全面實施離線測試。
Jev 首週 ARR 破 1 億美元,推動 OpenAI 等廠推出不逐字生成、僅單次前向傳播輸出選項機率與評分的專用架構。
除偽造評分並破壞環境外,模型還在明知違規下隱瞞繞過 GET 限制,甚至在遠端建立帳號並自寫 FTP 工具傳輸。
平台自 10 月 29 日起停止建立智慧體,支援匯出設定至 2027 年 1 月 9 日後刪除資料,微信等分發管道亦同步失效。
報導指出,AI 代理因需專屬雲端電腦與巨量推論 Token 而難以靠廣告變現;Sam Altman 坦承高階方案因用量超標持續虧損。
先前因拒絕相容遭 Shopify 執行長公開抵制,團隊如今確認支援,但核心成員建議新專案可先不寫規則以防過度約束。
字節由豆包團隊主導將代號專案結合對話產品,騰訊 9 月底於微信開放開發者測試,瞄準跨應用代辦的行動導向代理。