多家出版商和一名知名作家已在纽约联邦法院起诉 Google,指控其未经授权使用受版权保护的图书训练 Gemini 模型。原告称,这些作品原本只授权用于 Google Books 的检索片段展示,并不包括 AI 训练用途。
原告指向两类行为
起诉方包括 Hachette、Cengage、Elsevier、作家 Scott Turow,以及作者组织 S.C.R.I.B.E.。他们以集体诉讼方式提起案件,称 Google 将图书内容导入 Gemini 训练流程,超出了原有授权范围。
诉状还称,Google 曾删除或修改部分作品的版权信息,以掩盖相关材料被用于模型训练。若这一指控成立,案件焦点将不只停留在是否构成合理使用,还会延伸到是否存在主动规避版权标识的问题。
既有授权成为争议核心
这起案件的一个关键点,在于原告与 Google 之间并非完全没有合作基础。出版商和作者此前曾向 Google 提供图书内容,用于 Google Books 生成可搜索的片段,方便用户检索书籍。
原告认为,这一授权范围十分明确,只限于搜索展示,不包括将整本书或副本用于训练商业 AI 模型。诉状称,Google 还使用了上传至 Google Play 的图书内容,而这些内容同样未获得单独的 AI 训练许可。
纽约法院可独立判断
美国此前已有两起加州案件对 AI 公司较为有利,法院曾认定使用受版权保护作品训练 AI 可构成合理使用。但这次案件提交至纽约南区联邦地区法院,该法院并不受加州相关判决直接约束。
这意味着,纽约法院可以围绕本案事实单独判断,尤其是原告强调的“有限授权被转作其他商业用途”这一点,可能成为审理重点。
- 起诉法院:纽约南区联邦地区法院
- 原告主体:出版商、作家及作者组织
- 核心争议:图书授权是否扩展至 Gemini 训练
内部文件成关注点
诉状还提到一份据称来自 Google 内部的文件。原告称,该文件曾警告,使用受版权保护图书训练 AI 对 Google 来说“问题很大”,潜在罚款规模可能达到数百亿美元。如果这份文件进入证据程序,案件压力可能进一步上升。
目前,Google 尚未就这起诉讼作出回应。
