热点解读

七家财经媒体联合声明拒当AI训练语料:从美杜莎LoRA案二审看"用作品训练AI"的版权边界

据法治周末2026年9月3日报道,《21世纪经济报道》《证券日报》《中国基金报》等7家财经媒体近日联合宣布:未经本单位书面许可,不得将本单位…

📅 2026-09-06✍️ 潘杰峰 律师👁 热点解读

据法治周末2026年9月3日报道,《21世纪经济报道》《证券日报》《中国基金报》等7家财经媒体近日联合宣布:未经本单位书面许可,不得将本单位原创内容用于机器学习、数据挖掘、大模型训练、文字转音视频等人工智能应用场景;同期披露的美杜莎LoRA案中,上海知识产权法院二审确立了关键规则——只有当LoRA模型在用户指令下再次生成与权利作品实质性相似的作品时,才构成对复制权的侵害,使用在先作品训练大模型本身并不必然侵害复制权两件事叠加的信号很清晰:中国法院正在"训练行为"与"生成行为"之间划出精细的责任分界,而内容权利人则试图通过事前声明与联合议价在司法规则定型前锁定谈判筹码——AI企业的语料合规策略,不能再赌"合理使用"一个篮子。

一、美杜莎LoRA案:二审改写了什么

美杜莎案(上海金山法院一审、上海知识产权法院二审)与杭州互联网法院一审、杭州中院二审的奥特曼LoRA案,构成国内AI训练版权裁判的两条路径:

一审逻辑(与杭州奥特曼案相近):以商业使用为目的、以在先角色形象图片训练LoRA模型,再现在先作品独创性表达并将其提供给公众,影响作品正常使用,不构成合理使用。核心是"训练+使用"整体评价。

二审逻辑(上海知产法院):拆分评价。训练过程"记住"的是参数而非作品复制件——经过训练的模型并不必然"再现"用于训练的作品,参数无法直接拼凑出原图。因此只有在用户指令驱动下生成了与权利作品实质性相似的作品时,复制权侵害才成立;既然训练本身不侵害复制权,"合理使用"的抗辩讨论在训练环节甚至无需展开。

对AI企业的直接含义:单纯"用"了他人作品训练,不等于必然侵权;真正的风险敞口在"生成端"是否输出实质性相似内容。但这绝不等于训练环节的全面安全——以盗版方式获取语料(突破付费墙、破坏技术措施)本身仍可能构成侵权,且各地裁判尺度尚未统一,杭州路径与上海路径并存的局面还将持续。

二、七家媒体联合声明的法律意义:一份"反向授权要约"

7家财经媒体的联合声明在法律上至少产生三重效果:

第一,消灭"不知情"抗辩空间。 声明公开发布后,任何将该等媒体内容纳入语料的AI企业都难以主张善意取得或不知情,主观过错认定被简化。

第二,为" opt-out"机制提供中国式样本。 境外采机器可读的弃权声明(如robots.txt、TDM保留声明),境内媒体以联合声明方式实现类似效果——未来司法解释若引入"权利人明确保留"规则,这类声明就是最直接的证据。

第三,议价筹码而非诉讼筹码。 联合声明的商业本质是内容方集体议价:财经资讯具有强时效性与独家性,是大模型金融、投研能力的刚需语料。对媒体而言,与其零散诉讼(判赔有限),不如统一授权定价(类似海外新闻通讯社与OpenAI的授权协议模式)。

三、AI训练语料的合规路径:诉讼与非诉双轨方案

非诉层面(授权架构),建议AI企业按语料风险分级搭建四层数据库:

  • 授权层:与权利人(媒体、图库、出版社)签署书面授权,明确许可范围必须覆盖"模型训练+模型服务商业化输出"两个环节——本案媒体报道特别强调"书面许可",说明口头默许与一般合作合同不足以覆盖训练用途。
  • 公有领域层:著作权保护期届满作品、政府公开数据,自由使用但注意版本与整理者权利。
  • 技术过滤层:对知名IP(奥特曼、美杜莎类高敏形象)建立特征库,训练与生成双端拦截,避免生成端实质性相似输出落入二审规则的责任区。
  • 高风险隔离层:无法确认权属的灰色语料,仅限内部研发测试,不进入对外商用模型,并设置自动清理周期。

诉讼层面(攻防要点):权利人起诉时,应依上海二审规则把火力集中在"生成端实质性相似"的证据固定(生成结果比对、提示词诱导实验),仅证明"训练过"很难胜诉;AI企业抗辩则相反,全力证明生成结果与原作存在可识别差异、无市场替代效果,并留存语料来源合法性审计记录切割"盗版获取"指控。

四、个人创作者与中小媒体怎么办?

大媒体有联合声明议价,个人创作者缺乏集体行动能力,实务建议:对高价值作品做版权登记+时间戳存证(AI生成端侵权的比对基础);在作品发布页设置明确的训练用途禁止条款;发现模型输出与自己的作品高度相似时,通过"同提示词复现实验"固定证据链后再发律师函——单独一次相似输出可能是巧合,可复现的相似输出才是侵权证据。

广东华商律师事务所潘杰峰律师点评

美杜莎案二审与媒体联合声明同周出现,标志着国内AI版权博弈进入"规则竞速期",我的三点判断:第一,司法在刻意避免一审判决的寒蝉效应,"训练不必然侵权、生成相似才担责"的拆分技术,实质是为国产大模型保留语料空间,AI企业应利用这一窗口期完成语料确权与分级,而非继续裸奔;第二,媒体声明的真正杀伤力在授权谈判而非法庭,联合声明抬高了语料采购的集体定价,AI企业与其等待被动议价,不如主动寻求行业级语料授权联盟,把授权成本摊薄;第三,出海企业要按最严标准配置,欧盟AI法要求公开训练数据摘要、日本已采"遵守或解释"准则、美国索尼音乐诉Anthropic案按作品逐项索赔——同样的语料在国内可能安全,出海即触礁,跨境语料合规审查应成为模型出海的前置动作。

FAQ

Q1:用网上公开的媒体报道训练AI模型,在中国违法吗?

不一定构成侵权。依美杜莎案二审规则,仅使用作品训练模型、模型未生成与原作实质性相似内容的,不侵害复制权。但该规则尚未全国统一(杭州奥特曼案采更严格立场),且若以爬虫突破付费墙、破坏技术措施获取内容,获取行为本身可能构成侵权或不正当竞争。

Q2:媒体发布"禁止用于AI训练"声明后,我已抓取的历史数据怎么办?

建议分级处置:已在声明发布前抓取且声明无溯及约定的,法律风险相对可控,但商用输出端仍需过滤与原作实质性相似的内容;声明发布后新抓取的,属于明知禁止仍使用,过错认定明显不利,应从训练集中移除或转授权谈判。留存数据处置日志以备日后举证。

Q3:LoRA微调模型训练用了他人作品,我只在网上分享模型权重不分享原图,有风险吗?

训练与传播权重本身依上海二审规则不直接侵害复制权,但存在两项残余风险:一是他人用你的模型生成实质性相似内容并传播,若你明知模型具备该能力仍公开传播,可能被认定帮助侵权;二是若获取训练素材的手段违法(盗版图库),该责任独立存在。商用前建议做生成端相似度测试并留存记录。


本文系广东华商律师事务所潘杰峰律师团队出品,仅供客户与行业参考,不构成正式法律意见。

潘杰峰 律师
广东华商律师事务所 · 深圳执业律师
AI合规与数字法律 · 复合背景 · 计算机科学 × 工商管理 × 法学
📞 咨询微信:13590105082
法律咨询:1000元/小时

有 AI 合规或数字法律问题需要专业意见?

潘杰峰律师提供 AI 产品合规设计、AI 民事争议、数据出境、
计算机类刑事辩护、知识产权(诉讼+非诉)等专业法律服务
法律咨询:1000元/小时

立即咨询 微信 13590105082

在线咨询预约

填写以下信息,潘律师会在24小时内联系您

公众号 AI合规 二维码

扫码关注公众号「AI合规」

每日 AI 法律资讯、监管动态、案例解读、
实务合规清单,与本网站内容互补更新。