前瞻與傳聞
傳 Anthropic 針對 Claude Code 進行 A/B 測試,疑似調降模型投入程度
Hacker News單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
據社群消息指出,Anthropic 疑似針對其開發工具 Claude Code 進行 A/B 測試,調降模型的投入程度(effort levels)。該消息目前僅為社群初步觀察,官方尚未證實是否刻意降低輸出品質或進行相關實驗。
讀原始報導社群討論
社群對 Claude 的計費不透明與效能退化強烈不滿,有用戶實測 Opus 5 執行簡單更新竟耗時 43 分鐘(舊版 4.6 僅需不到 2 分鐘),導致部分用戶退訂或將 $200 方案降級至 $20。Anthropic 官方澄清這僅是 API 設定的 A/B 測試改變了數值映射,強調內部評估效能並未下降,部分用戶也質疑模型根本無法準確回報自身的 effort 狀態。面對模型過度囉嗦的問題,許多人分享將 Opus 5 設為 Low effort 反而能避免無謂發散,在維持品質的同時大幅節省成本。
這則事件的發展
- 2026-08-22Claude Code ARR 達 151.2 億美元領先,但 Codex 近期增幅逾 50% 快速追趕,且 Anthropic 逾四成營收依賴雲端渠道
- 2026-08-21Anthropic 終端機代理工具 Claude Code 登上 GitHub Trending,支援自然語言處理程式碼與 Git 工作流
- 2026-08-19Anthropic 延長 Claude Code 每週額度提升 50% 優惠至 8 月 31 日
- 2026-08-18Claude Code 推出 /design 技能預覽版,將 UI 畫板工作流整合進 CLI 與桌面版
- 2026-08-15三星 System LSI 導入 Claude Code 加速晶片驗證,SoC 測試環境建置從逾一個月縮短至兩天