《西雅图时报》《新闻日报》起诉 OpenAI 与微软:指控新闻内容被用于训练 ChatGPT 和 Copilot
据 IT之家援引路透社消息,美国两家媒体《西雅图时报》与《新闻日报》已于当地时间本周五(9 月 4 日)在美国纽约南区联邦地区法院起诉 OpenAI 和微软。两家媒体指控称,OpenAI 与微软未经授权复制其新闻报道,并将相关内容用于训练和驱动旗下 AI 产品,包括 ChatGPT、微软 Copilot 以及必应的 AI 检索功能。案件再次把生成式 AI 与新闻版权之间的冲突推到台前。
起诉书显示,两家媒体认为,被告方抓取了其网站内容,其中不仅包括公开页面,也包含付费墙背后的专属报道。这些文章随后被纳入训练数据集,用于训练相关模型或支撑 AI 产品生成回答。媒体方称,部分 AI 产品能够输出报道中的原文段落,也能生成与原报道高度相似的改写内容,并在用户提问时直接给出综合答案。
争议焦点:AI 训练是否可以使用新闻内容
这起诉讼的核心并不只是“模型是否读过新闻”,而是新闻机构与 AI 公司围绕内容使用边界的长期分歧。新闻报道通常需要记者采写、编辑审核、版权管理和订阅体系支撑;而生成式 AI 产品在回答问题时,可能将这些信息重新组织后直接呈现给用户。
两家媒体在诉讼中强调,如果 AI 工具能够向用户提供完整或近似完整的新闻信息,读者访问媒体官网、点击原文或支付订阅的动力就会下降。这种模式可能削弱新闻机构的流量、广告和会员收入基础。对于地方媒体而言,付费内容和深度报道往往是其商业模式的重要组成部分,因此付费墙内容是否被纳入训练数据成为本案中格外敏感的一点。
- 原告:美国媒体《西雅图时报》与《新闻日报》。
- 被告:OpenAI 与微软。
- 提交法院:美国纽约南区联邦地区法院。
- 涉及产品:ChatGPT、微软 Copilot、必应 AI 检索等。
- 主要诉求:要求法院命令销毁被指侵权作品副本,以及包含相关内容的训练数据集和 AI 模型。
OpenAI 与微软回应:合理使用与沟通方案
针对相关指控,OpenAI 发言人回应称,其模型基于公开数据训练,并符合合理使用原则,但未就本次诉讼的具体指控作进一步评论。微软方面则在电子邮件中表示,虽然这起诉讼令其感到意外,但公司高度认可地方新闻报道的重要性,并愿意与各方进行坦诚沟通,寻找解决此类纠纷的方案。
从回应看,OpenAI 的重点仍放在“公开数据”和“合理使用”上,这也是目前多起 AI 版权争议中常见的抗辩方向。微软则更强调合作与协商,这与其既是 OpenAI 重要合作方、又在搜索和办公软件中广泛引入 AI 功能的身份有关。对于微软来说,Copilot 和必应 AI 检索若被认定存在系统性版权风险,可能影响其 AI 产品在内容来源、摘要呈现和结果引用上的设计。
影响解读:新闻版权正在重塑 AI 数据供应链
过去几年,大模型公司依赖大规模网页文本训练模型,新闻内容因具备时效性、结构化表达和事实密度,通常被认为是高价值语料。但随着 ChatGPT、Copilot 等产品从“研究工具”走向大众应用,内容方开始更清晰地看到潜在替代效应:用户可能不再进入原始网页,而是直接消费 AI 生成的答案。
本案的一个关键看点在于,原告不仅要求赔偿或停止使用,还寻求法院命令销毁相关侵权副本、训练数据集,甚至包含这些内容的 AI 模型。对于大模型产业而言,这类诉求如果获得支持,将带来远超单一版权纠纷的影响:模型训练数据的来源证明、数据删除机制、版权授权链条和模型可追溯能力,都可能成为 AI 公司必须补课的基础设施。
从产业趋势看,AI 公司与内容机构之间正在形成两条路径:一是通过授权协议购买高质量内容,二是在诉讼压力下重新调整抓取、训练和输出规则。对于中文读者和国内科技行业而言,这起案件提供了一个重要观察窗口:生成式 AI 的竞争不只发生在模型能力层面,也发生在数据合规和内容生态关系层面。谁能在模型效果、版权合规与内容合作之间找到平衡,可能会成为下一阶段 AI 产品能否持续扩张的关键。