西雅图时报和Newsday于9月4日向美国纽约南区联邦法院提起诉讼,指控OpenAI与微软未经许可,抓取其新闻网站(包含付费墙内的文章)内容,用于训练AI产品,如ChatGPT、Copilot和Bing AI等 [1, 2, 3, 4, 5]。
诉讼称,这些AI产品能复制新闻内容,改写文章并回答用户问题,导致新闻机构网站流量和订阅收入下降。西雅图时报和Newsday请求法院命令OpenAI和微软销毁包含其新闻数据的所有数据集和AI模型副本 [1, 2, 3, 5]。
两家媒体指出,OpenAI和微软通过绕过付费墙非法抓取内容,且微软曾资助西雅图时报的新闻项目和奖学金。西雅图时报诉状称,"像ChatGPT和Copilot这样的AI产品被宣传为内容生产者,实则是内容的掠夺者,将人类创作内容吸收后以复制和衍生形式回馈市场,以实现商业目的" [6, 4]。
微软发言人表示,这起诉讼“令人意外”,并强调“我们理解地方新闻的重要性,愿意坐下来讨论解决方案” [1, 3]。OpenAI则强调其模型训练基于公开数据,并主张公平使用原则保护其行为,未对诉讼进一步发表评论 [1, 3]。
早在2023年,《纽约时报》已针对OpenAI与微软提起类似诉讼,控告未经授权使用数百万篇新闻文章训练AI。目前该案仍在审理中。除这几起案件外,美国已有数十起针对OpenAI、Anthropic、Meta等AI企业的版权诉讼,涉及未经许可使用受版权保护内容训练大型语言模型 [1, 2, 3, 5]。
美国司法部虽非诉讼当事方,但支持以大规模网络文本数据训练语言模型属公平使用,以免阻碍AI技术发展。纽约时报则批评政府立场,认为AI企业应为内容创作者支付合理报酬。纽约时报发言人指出,"AI与创作者可以共存,AI公司只需支付合理的内容使用费用" [5]。
西雅图时报和Newsday的诉讼将是未来此类版权争议的关键案例,后续诉讼进展及审理时间尚未确定。