《西雅图时报》与《Newsday》再起诉 OpenAI 与微软:AI 训练数据争议升级

随着生成式 AI 迅速渗透新闻行业,《西雅图时报》和《Newsday》联手起诉 OpenAI 与微软,指控其未经授权使用新闻内容训练 ChatGPT 等模型,称此举可能“毁掉”媒体生态。了解最新诉讼细节及行业影响。

《西雅图时报》与《Newsday》再起诉 OpenAI 与微软:AI 训练数据争议升级

诉讼背景:AI 与新闻内容的冲突

近期,《西雅图时报》与《Newsday》联手向美国联邦法院提交诉状,指控 OpenAI 与其投资方微软在未经授权的情况下,将两家媒体的原创报道用于训练生成式人工智能模型。原告认为,AI 生成的内容往往是对已发布新闻的“复制”或“衍生”,这不仅侵犯了版权,还可能导致新闻行业“被自身生产的内容所吞噬”。

核心指控:AI 不是内容创造者而是“掠夺者”

诉状将 ChatGPT、Copilot 等产品描述为“声称能生产内容,实则是贪婪的消费者”。原告强调,这类模型在训练过程中大量摄取人类记者的稿件,然后以“相似”形式输出,形成对原作的二次利用,却未向原作者支付任何费用或取得许可。

“自食其果”的隐喻

诉状使用了“蛇吃自己的尾巴”的比喻,形容生成式 AI 可能导致新闻机构自毁前路:一方面,它们的内容被 AI 吞噬,削弱了原始流量和广告收入;另一方面,AI 生成的相似内容又进一步冲击了传统媒体的竞争力。

行业连锁反应:从《纽约时报》到地方媒体的集体行动

本案并非孤例。2023 年,《纽约时报》已对 OpenAI 与微软提起版权侵权诉讼,随后多家媒体相继加入维权行列。随着诉讼进程的推进,越来越多的新闻机构担忧其核心资产——原创报道——正被大模型无偿“消费”。

微软的双重角色

值得注意的是,微软不仅是 OpenAI 的主要投资者,还曾资助《西雅图时报》的新闻项目和奖学金计划。对此,微软发言人在接受采访时表示,对诉讼“感到惊讶”,但愿意坐下来“探讨解决方案”。这种立场透露出技术公司与媒体之间日益复杂的合作与冲突关系。

法律与政策层面的挑战

当前美国版权法对机器学习训练数据的使用尚缺乏明确指引。原告方主张,未经授权的抓取行为已构成侵权;而被告则可能依赖“合理使用”条款辩护,声称训练模型属于技术创新的必要步骤。法庭最终如何平衡创新与版权保护,将为全球 AI 监管提供重要参考。

对读者的影响

如果法院判决倾向于严格限制 AI 对新闻内容的抓取,可能会迫使 AI 公司重新审视数据来源,提升对版权的合规力度。这对普通读者而言,意味着未来在搜索引擎或聊天机器人中获取新闻信息时,可能会看到更明确的来源标识,甚至出现付费墙的转移。

展望:媒体与 AI 的共生路径

尽管诉讼带来了不确定性,但也促使媒体与技术公司思考合作的新模式。例如,建立付费数据授权平台,让媒体在保留版权收益的同时,为 AI 提供合法、优质的训练素材。如此,既能保障记者的创作回报,又能让 AI 获得可靠的数据来源,实现双赢。

总体来看,《西雅图时报》与《Newsday》的起诉标志着新闻行业对生成式 AI 影响的警觉升级。随着更多诉讼陆续展开,行业内部必将加速制定数据使用准则,推动监管机构尽快给出明确的法律框架。对读者而言,这场争议的走向将直接影响信息获取的方式与质量。