跳到主要內容
2026-09-28 日報
安全與監管

Authors Guild 訴訟解密文件稱 OpenAI 與微軟明知使用盜版書訓練,並曾試圖銷毀 LibGen 證據

Hacker News單一來源
核實資料不足

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

本次未取得足夠原文證據

據 Authors Guild 公布的未解密法庭文件顯示,OpenAI 與微軟高層在版權訴訟案中,被指控明知使用盜版書籍訓練 AI 模型,並預期其產品將導致作家失業。文件揭露,微軟早在 2019 年 4 月 Sam Altman 與 Dario Amodei 向 Bill Gates 等人展示 GPT-3 早期版本時,便已知悉 OpenAI 使用盜版圖書網站 LibGen。 內部通訊顯示,OpenAI 前研究總監 Dario Amodei 與研究員 Sam McCandlish 曾擔憂使用「可疑的俄羅斯網站」LibGen 會在 Hacker News 上引發觀感問題(optics),而非擔憂法律責任。為掩蓋痕跡,OpenAI 於 2022 年夏天發起名為「Project Clear」的行動,由研究副總裁 Bob McGrew 等人主導,自系統與儲存空間中刪除 LibGen 相關檔案。 此外,OpenAI 政策總監 Jack Clark 曾於 2020 年表示將忽略藝術家的擔憂並發布產品;2022 年加入的 Tarun Gogineni 則將作家流失工作視為「可接受的經濟破壞」,預言機器將為機器創造粗製濫造的內容(slop),並曾計畫讓 GPT-5 續寫 George R.R. Martin 的《冰與火之歌》未完結篇章。該案預計於 2027 年初舉行聽證會。
讀原始報導

社群討論

社群對 OpenAI 內部文件流出反應兩極,許多人強烈譴責高層在 2020 至 2022 年間明知故犯使用 LibGen 盜版書庫,且內部預估有「>80% 機率」被質疑資料來源,卻只擔心在 Hacker News 或 Twitter 造成公關危機。反對者痛批 OpenAI 企圖用 GPT-5 「自動完成」喬治·R·R·馬丁小說的計畫是剽竊且毫不尊重藝術,甚至呼籲應立法強制這類模型開源權重(weights);但另一派聲音則反駁,科技淘汰舊產業是歷史常態,且目前 AI 真正取代作家的實質證據依然薄弱。