海外多家媒体机构联名提请法院处罚OpenAI,新闻内容无授权抓取引发大规模版权诉讼 - 电商Agent与全链路服务数字化解决方案
       

海外多家媒体机构联名提请法院处罚OpenAI,新闻内容无授权抓取引发大规模版权诉讼

2026年7月9日,以《纽约时报》、纽约每日新闻、MediaNews集团为核心的多家美国媒体联合向纽约南区联邦法院提交正式动议,申请对OpenAI及其合作方微软作出司法制裁;叠加此前近400家地方报业联盟集体诉讼、加拿大全国媒体集群起诉,全球媒体阵营针对OpenAI新闻素材侵权的法律维权进入取证攻坚与追责升级阶段,该案将划定生成式AI抓取公开网页内容训练模型的全球版权司法边界。

海外多家媒体机构联名提请法院处罚OpenAI,新闻内容无授权抓取引发大规模版权诉讼

一、本次提请法院处罚的核心事由

1. 核心指控:取证环节蓄意隐匿、销毁关键证据

媒体方52页法律文书明确指出,OpenAI在长达两年庭审取证中刻意向法院虚假陈述

长期对外声称无法检索训练数据集、ChatGPT历史对话输出日志,不能定位模型内收录的受版权保护新闻稿件; 但公司数据安全主管当庭证词推翻前述口径,证实OpenAI内部早已具备检索训练语料库、筛查新闻原文的技术能力,却拒不配合法院证据开示指令,还批量删除数十亿条AI应答日志,导致侵权溯源证据永久灭失,属于典型司法妨碍行为。

2. 基础侵权事实:系统性爬虫抓取+剥离版权标识商用获利

原告梳理完整侵权链路:

  1. OpenAI爬虫程序批量爬取全球媒体官网原创新闻稿件,未经签约授权、未支付内容稿酬,直接灌入GPT系列大模型完成训练;
  2. 抓取过程中主动删除原文内嵌版权管理信息(CMI),规避著作权溯源认定;
  3. ChatGPT、微软Copilot可直接复述、改写、浓缩媒体独家报道,用户不再跳转媒体官网浏览,直接分流订阅流量与广告收入,媒体采编投入完全被AI无偿复用变现。

3. 叠加诉讼体量:多批次媒体集体维权

  1. 头部主流媒体线:《纽约时报》2023年率先发起诉讼,举证超百例AI输出内容与时报报道高度重合,索赔金额超10亿美元;本次联合都市类媒体共同申请惩戒程序。
  2. 美国地方报业联盟:6月底近400家区域报纸统一提交合并诉讼,直指AI无序抓取正在摧毁地方新闻采编业态,或将导致区域性本土媒体大面积停刊。
  3. 加拿大全域媒体方阵:加拿大通讯社、环球邮报、多伦多星报、CBC广播公司等本土核心媒体,于安大略省高等法院单独立案,要求按单篇新闻最高2万加元进行惩罚性赔偿,涉案赔付规模可达数十亿加元。
海外多家媒体机构联名提请法院处罚OpenAI,新闻内容无授权抓取引发大规模版权诉讼

二、媒体方明确向法院提出四项处罚与判决诉求

  1. 司法惩戒处罚 针对证据隐瞒、销毁行为下达程序性处罚,采信原告方证据推定规则,直接认定OpenAI侵权事实成立;并处以法庭罚金、承担全部诉讼与取证费用。
  2. 永久禁令限制 强制判令OpenAI永久禁止在未获得书面授权前提下,抓取、收录原告旗下任何新闻内容用于模型训练、产品生成。
  3. 追溯性经济赔付 核算OpenAI依托侵权新闻语料获得的商业营收,追缴不当得利+法定版权惩罚性赔偿金。
  4. 强制开放溯源权限 必须完整开放训练库检索接口,配合全行业媒体批量筛查自有稿件是否被违规纳入模型语料库。

三、OpenAI官方核心抗辩口径

  1. 坚持合理使用(Fair Use)原则,认为公开网页新闻属于公共信息素材,大模型训练属于信息转化与研究用途,不构成直接著作权侵权;
  2. 反驳原告索要数十亿条用户对话日志属于越界调取用户隐私数据,超出本案诉讼审理范围;
  3. 辩称部分日志删除属于正常业务数据生命周期管理,并非针对性销毁诉讼证据,要求法院驳回制裁申请。

四、行业深层矛盾:新闻产业与生成式AI的生存博弈

  1. 流量与商业模式冲突 媒体依靠独家调查报道、时政资讯吸引付费订阅与网页广告;AI直接整合输出精简答案,用户无需进入原网站,媒体内容生产端失去变现入口,采编团队经费持续萎缩。
  2. 授权机制严重缺位 仅美联社等极少数机构与OpenAI签订付费内容授权协议,绝大多数中小媒体无议价能力,无法约束爬虫抓取行为,形成“头部签约、中小被无偿收割”的失衡格局。
  3. 全球监管连锁反应 欧盟《AI法案》已明确要求高风险AI模型训练数据集必须具备合法版权来源;英国、法国同步推进AI数据溯源立法,未来无授权爬取图文、新闻、文学内容将被纳入硬性合规红线。
海外多家媒体机构联名提请法院处罚OpenAI,新闻内容无授权抓取引发大规模版权诉讼

五、同类版权诉讼横向对比与行业判例参考

  1. 德国首例AI训练侵权判决:慕尼黑地方法院此前裁定OpenAI使用受版权保护歌词训练模型违法,成为全球首个认定模型训练环节即构成侵权的司法先例。
  2. Anthropic高额和解先例:同赛道大模型企业Anthropic因未经许可收录海量图书版权内容,最终达成15亿美元巨额和解,为AI企业版权纠纷设立赔付参考标尺。
  3. 谷歌、Meta均已遭遇多起内容抓取诉讼,行业普遍从无差别全网爬取,转向定向采购授权内容、搭建可溯源合规语料库。

六、后续事件两大发展方向预判

  1. 法院裁决走向 若法官认定OpenAI存在证据妨害,大概率会简化侵权举证流程,大幅降低媒体胜诉门槛;若驳回制裁动议,案件将进入冗长的实质侵权庭审,耗时周期预计超18个月。
  2. 行业商业模式迭代 AI厂商将全面分化两条路径:一是与新闻出版集团批量签订年度内容授权采购合同;二是采用网页爬虫白名单+robots协议严格遵守,主动屏蔽未开放授权的媒体站点,从技术层面规避批量版权风险。

七、对全球AI产业的延伸影响

本次系列诉讼本质是数据生产方与AI技术方的权益边界确权:

过去大模型依赖全网公开数据粗放式训练的野蛮生长模式被法律收紧,后续无论是闭源商用大模型,还是开源基座模型,都必须对训练素材版权来源留档可查; 同时也会倒逼联邦学习、本地私有数据集训练、授权语料采购等合规数据方案加速普及,彻底终结无约束抓取网络原创内容的行业惯例。

                       
(0)
电商增长专家-荣荣电商增长专家-荣荣
上一篇 2026-07-22 13:42
下一篇 2026-07-23 01:31

相关推荐