產品應用
GPT-Red與Claude週報
X @btibor91綜合 2 家報導
2026年第29週,OpenAI推出內部自動化紅隊工具GPT-Red,透過對抗式自我博弈大規模尋找提示詞注入漏洞;以其進行對抗訓練後,GPT-5.6成為OpenAI迄今抵禦提示詞注入最穩健的模型,介紹文章並藏有「GPT-RED // Invader Patrol」遊戲。OpenAI另公布GPT-Live使用額度,讓ChatGPT重返歐洲經濟區的WhatsApp,推出可跨對話、專案、圖片及文件的統一搜尋,將自訂指示上限由1,500字元提高至5,000字元,並更新桌面版的Chat、Work版面及整合Recents、Projects與雲端同步;ChatGPT Finances也支援Apple Card與Savings。OpenAI同時發布代理式AI時代的投資管理、青少年安全使用AI、州與聯邦AI安全行動,以及Sarah Friar「每美元實用智慧」評分表等文章;Bloomberg則報導其首款裝置將是可移動、無螢幕的智慧音箱,紐約時報報導ChatGPT搜尋將透過Kalshi合作顯示世界盃賠率,另有Work Louder推出Codex Micro鍵盤、OpenAI Supply Co.商店恢復販售周邊,作者也發現一個籌備中的私募股權與投資管理社群。Anthropic將付費方案的Fable 5存取延長至7月19日,並自7月20日起讓Claude Fable 5以原額度50%成為所有Max與Team Premium方案的標準模型,另向Pro與Team Standard用戶提供一次性100美元額度;Claude Code每週額度提高50%的措施則延續至8月19日。Anthropic也推出Claude for Teachers,向美國經驗證的K-12教師免費提供進階Claude,承諾投入1,000萬加幣支持加拿大AI研究並發布Canada Economic Index國家簡報;Claude Code的Artifacts新增公開分享、多人編輯、MCP連接器及透過Claude Tag建立內容,/code-review加入最高ultra的effort levels,Claude組織可自行設定HIPAA,另公布跨模型與語言的Claude價值觀研究及四項代理式失準案例研究。
讀原始報導背景
GPT-Red 是 OpenAI 的內部自動化紅隊模型,透過自我對弈尋找提示注入弱點,藉此改善 AI 的安全性、對齊與提示注入防護能力。報導指出,GPT-Red 在提示注入測試中以 84% 對 13% 勝過人類紅隊人員,並被用於強化 GPT-5.6。