商傳媒|林昭衡/綜合外電報導

由多家大型出版商與知名作家組成的聯盟,已向美國紐約南區聯邦地區法院提起集體訴訟,指控科技巨擘 Google 未經許可,使用受著作權保護的書籍來訓練其人工智慧(AI)模型 Gemini。

此次訴訟是出版業與 AI 開發商之間,因使用受著作權內容訓練生成式 AI 系統而日益升溫的法律戰中,最新的案例。原告包括樺榭圖書集團(Hachette Book Group)、聖智學習出版公司(Cengage Learning)、愛思唯爾(Elsevier)以及暢銷作家史考特·圖羅(Scott Turow)。

訴訟文件指出,Google 涉嫌利用出版商先前提供給 Google 圖書(Google Books)計畫的書籍來訓練 Gemini AI 模型。出版商主張,最初協議僅允許 Google 將書籍數位化並在搜尋結果中顯示部分片段,並未授權 Google 將這些作品挪用為商業 AI 產品的訓練資料。文件中更引述一份 Google 內部文件,據稱估計若此行為受到質疑,Google 可能面臨數千萬至數十億美元的罰款,顯示 Google 對潛在法律後果知情。

原告方認為,Google 據稱未經授權使用版權書籍,將威脅出版業的生存,不僅減少合法書籍和學術期刊的銷售,更助長低成本的 AI 生成內容替代品,同時削弱快速成長的授權內容市場。他們強調,AI 公司應向版權所有者支付費用,而非未經允許就使用受著作權保護的資料。

這起針對 Google 的訴訟,與上月多家出版商,包括愛思唯爾、聖智學習出版公司、樺榭圖書集團、麥美倫出版社(Macmillan)及麥格勞希爾(McGraw Hill)對 Meta 提起的訴訟性質相似。該案指控 Meta 使用數百萬本盜版書籍訓練其 Llama AI 模型。Meta 則否認這些指控,堅稱使用版權材料訓練 AI 模型符合美國法律中的「合理使用」原則。這些平行訴訟顯示,在法院對 AI 著作權爭議做出判決前,出版商正採取協同法律策略。

在此之前,Anthropic 公司去年已同意支付 15 億美元,和解一起關於其 AI 系統涉嫌使用盜版書籍訓練的集體訴訟。同時,《紐約時報》(The New York Times)對 OpenAI 和微軟(Microsoft)的著作權訴訟仍在進行中。

Google 尚未與數位出版商簽署廣泛的 AI 訓練內容授權協議,儘管該公司與美聯社(The Associated Press)維持著授權合作夥伴關係。出版商認為,隨著 AI 系統越來越依賴受著作權保護的材料,更廣泛的協議是必要的。網路安全服務商 Cloudflare 也預計將於 9 月 15 日起,為新客戶和免費層級客戶自動阻擋廣告頁面上所有多用途網路爬蟲(web crawlers),此舉普遍被視為針對 Google 的爬蟲,因出版商認為其同時用於傳統搜尋索引和 AI 資料收集。此外,《今日美國》(USA Today Inc.)執行長麥克·里德(Mike Reed)近日表示,若未達成授權協議,該公司可能會在未來六到十二個月內將內容從 Google 搜尋中移除。這顯示在經過多年的談判、爬蟲限制和產業壓力後,出版商正日益轉向法院,以釐清版權作品在 AI 開發中的使用界線。