新聞股票微軟員工曾質疑AI抓取是否為「人類史上最大規模的勞動竊取」

微軟員工曾質疑AI抓取是否為「人類史上最大規模的勞動竊取」

作者: Decrypt·

重點速覽

  • 時報2023年著作權訴訟新公開的文件顯示,微軟員工私下將OpenAI使用新聞文章比作史無前例的人類勞動竊取,並警告以AI生成素材訓練可能使模型品質逐步退化。
  • 微軟執行長Satya Nadella作證表示付費牆內容應經授權,並稱若當時知道OpenAI使用付費牆素材,他會行使微軟權利強制其重新訓練模型。
  • OpenAI內部通訊包括一名員工描述打造繞過時報付費牆的變通工具,並獲總裁Greg Brockman正面回覆。
  • OpenAI內部發現,包括一名工程師觀察到使用者極少點擊引用連結,削弱了兩家公司主張聊天機器人能為出版商帶回流量的論點。
  • 在Sidney Stein法官審理即決判決動議之際,兩名被告均堅持以新聞文章訓練屬合理使用;本案由時報於2023年底提起,其後十一家出版商加入。
微軟員工曾質疑AI抓取是否為「人類史上最大規模的勞動竊取」

根據週四公開的法院文件,並由《紐約時報》報導,微軟員工曾辯論OpenAI使用新聞文章是否構成「人類史上最大規模的勞動竊取」,並可能引發使其正在打造的模型品質退化的「末日迴圈」。

這些文件源自時報於2023年底對OpenAI與微軟提起的著作權訴訟,其後另有十一家出版商加入。OpenAI全程駁斥相關指控,而這場訴訟已迫使該公司保存2,000萬筆ChatGPT對話紀錄。紐約南區聯邦法官Sidney Stein正在審理即決判決動議,文件也隨其審理陸續公開。即決判決允許法官在無重大事實爭議時無需開庭即可裁決,因此這些公開的紀錄——包括兩家公司的內部通訊——在此訴訟階段具有相當分量。

微軟2023年的內部文件早已預料到外界反彈。一份備忘錄寫道:「全球數百萬人很快就會認為大型模型『吸走』他們所有成果,是一種前所未有的驚人竊取行為。」同一作者還寫道,大型AI模型「是一種會摧毀自身供應鏈的產品」。這番指的是一種回饋迴圈:大量以AI生成素材訓練的模型,將逐步使其自身輸出品質退化——亦即員工所稱的「末日迴圈」。

微軟表示,這些備忘錄由應用科學總監Brent Hecht撰寫,他同時在西北大學任職,相關內容不代表公司立場。該公司在一份文件中表示,Hecht並非決策者,其職責是「提出不同且不對稱的觀點」。

「在地毯上留下一團爛攤子」

微軟執行長Satya Nadella作證表示,「任何付費牆內的內容,任何想使用的人都應取得授權」,並補充,如果他當時知道OpenAI以付費牆內容進行訓練,他會行使微軟的權利,強制該公司重新訓練其模型。公司發言人表示,Nadella是就人們如何查找與消費資訊表達「廣泛原則」。

在OpenAI內部,有員工向總裁Greg Brockman報告打造了一個繞過時報付費牆的「駭客手法」。Brockman回覆:「啊,不錯。」

曾掌管ChatGPT團隊的Nick Turley於2023年6月寫道,AI對出版商構成「生存威脅」。他在2024年2月寫道,AI產品「會隨著能力提升而越來越具替代性」,並在另一處寫道AI「產品基本上就是具替代性的,就是這樣」。

一名OpenAI工程師於2023年2月觀察到,「無論我們把連結放在多顯眼的位置,使用者都不會點擊」——這項發現不利於聊天機器人能為出版商帶回流量的說法,而流量長期以來是新聞機構讀者與營收的重要來源。

在2020年致Brockman與執行長Sam Altman的備忘錄中,時任政策總監的Jack Clark警告,公司正在「打造取代那些定義社會『文化』者的勞動的系統」,並將「成為矽谷如何輕率踏入生活其他領域、在地毯上留下一團爛攤子的象徵」。Clark其後離職共同創辦Anthropic,後者將時報的置評請求轉由OpenAI回應。

微軟與OpenAI均主張,以新聞文章進行訓練屬於合理使用,是將轉化為新作品,而非取代原作。合理使用允許在未經授權下有限度使用受著作權保護的素材,而對已出版新聞報導的大規模訓練是否符合,正是本案將檢驗的核心法律問題。

「全世界都能看到OpenAI與微軟對自身行為是否公正的一貫想法,」代表《紐約每日新聞》及另外七家報紙的律師Steven Lieberman表示。

時報本身即為本案原告,但拒絕向自家記者置評;記者稱OpenAI未回應置評請求。在即決判決動議仍待審理之際,本案接下來的關鍵節點是Stein法官的裁決,以及公開程序還會揭開哪些內容。