研究與評測
據報 NeurIPS 以 Pangram AI 檢測工具直接拒絕 178 篇論文,且主席自身論文也被標記高達 69%
Reddit r/MachineLearning單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
據 Reddit 社群消息指出,NeurIPS 觀點論文賽道(Position Paper Track)近期使用專有 AI 檢測工具 Pangram,在無人工審查與申訴機制的情況下,直接拒絕了 178 篇論文(占總投稿量 18.4%)。
爆料者比對會議聲明與 Pangram 技術文件後指出多項爭議:首先,獨立研究人員將該賽道三位主席近期的論文輸入同一檢測工具,結果顯示 AI 生成比例達 24% 至 69%,若依相同標準,主席自身的論文也面臨被拒絕的風險。
其次,Pangram 預設設定最初將高達 42.7% 的投稿判定為 90-100% AI 生成,主辦方隨後縮小文本檢測範圍,才將標記率降至 12.7%。此外,有 22 篇論文因檢測分數大於 0.5,且作者勾選「未使用 AI」,被系統直接認定作者說謊而遭拒絕。
該事件也引發對非英語母語(ESL)研究者的公平性疑慮。爆料引用史丹佛大學研究指出,61.22% 由人類撰寫的托福作文會因結構嚴謹而被誤判為 AI 生成,而 NeurIPS 並未公布相關的人口統計校正數據。消息補充,被拒絕的作者並未被列入黑名單或記上學術不端紀錄,仍可將論文轉投其他會議。
讀原始報導