研究與評測
1.7 萬次實測揭露 Claude Code、Codex 與 Cursor 工具選擇偏好,發布各類別排行榜與決策軌跡
Hacker News單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,一項針對 Claude Code、Codex 與 Cursor 等 AI 寫程式代理(coding agents)的大規模測試結果發布,旨在分析 AI 如何為開發者挑選並安裝第三方服務。該實驗共執行近 1.7 萬次測試,涵蓋 75 個程式碼儲存庫、1,163 種提示詞變體,並模擬無軟體背景開發者至資深工程師等多種使用者輪廓。
測試發現,即使在不同的沙盒環境、專案基礎與提示詞下,AI 代理常得出一致的工具選擇結論。例如在資料庫選擇上,Claude Code 與 Cursor 皆因免費額度、成本可預期,以及不會像 Supabase 在低用量時休眠等理由,向不同背景的使用者推薦並實際安裝 Neon。
報告引述 Vercel 去年 4 月的數據指出,超過 30% 的部署已由 AI 代理發起(半年內成長 1000%),顯示開發工具廠商的市場競爭將越來越依賴 AI 的決策偏好。測試團隊目前已公開各類別工具的排行榜、彙整結果,以及包含使用者提示詞、AI 思考軌跡與實際程式碼差異(code diffs)的完整紀錄。
讀原始報導社群討論
作者分析 1.7 萬次對話以研究並影響 AI 選擇開發工具的偏好,卻引發社群強烈抨擊,痛批這種「AI SEO」將重演搜尋引擎被廣告與駭客增長毀滅的惡夢。技術討論中,用戶指出 Claude 極度偏好用 Python、awk 與 sed 編輯檔案,且極少使用網路搜尋(有人實測 8 次僅 1 次),並有人質疑該分析結果僅是反映訓練資料的分佈。此外,該服務高達每月 5,000 美元的起跳價格與充滿彈出視窗的糟糕手機版 UI 也受到不少抱怨。