在人工智能与版权法交叉的版图上,一场新的风暴正在酝酿。2025年10月13日,一群知名YouTuber向加利福尼亚中区联邦法院提交了针对Snap Inc.的集体诉讼,指控这家社交媒体巨头在未获许可或补偿的情况下,系统性使用他们的原创视频内容训练人工智能模型。这是创作者与科技公司之间围绕AI训练数据伦理边界不断升级的又一场战役。
诉讼核心:HD-VILA-100M数据集与“Imagine Lens”
原告是三个YouTube频道的运营者,其累计订阅用户超过620万。他们声称Snap在开发其“Imagine Lens”功能时,使用了其视频内容。该功能允许用户通过文本指令编辑图像。根据法庭文件,YouTuber们指控Snap利用了名为HD-VILA-100M的大规模视频-语言数据集——这个数据集原本仅用于学术研究,却包含了数百万个受版权保护的YouTube视频。原告认为,Snap绕开了YouTube的技术保护措施、服务条款和授权限制,将这些内容重新用于商业AI开发,构成了故意规避既定内容使用框架的行为。
法律战场:超70起案件与不确定的先例
这起诉讼只是AI训练数据版权冲突的一个缩影。据版权联盟(Copyright Alliance)统计,截至2025年10月,已有超过70起版权侵权案件针对AI公司提起。这些案件的结果各异:作家诉Meta案裁定Meta胜诉;作家诉Anthropic案以和解告终;YouTuber诉Nvidia案仍在积极诉讼中。法律环境呈现出复杂的图景。值得注意的是,Snap案的原告此前已对Nvidia、Meta和ByteDance(字节跳动)提起了类似诉讼,表明这是一种针对多家科技平台的协同法律战略。
法律专家指出,AI训练中的大规模数据摄取与传统的单个作品复制性质不同,法院如何将现有版权框架应用于这些新技术背景,将构成关键挑战。
行业响应与监管脉络
面对日益增长的法律挑战,科技行业反应分化。部分公司开始与内容提供商建立正式授权协议,另一些则继续主张其数据收集行为属于“合理使用”范畴。与此同时,多个司法管辖区的监管机构正在制定专门针对AI训练数据获取的新规,形成了快速演变的合规环境。观察人士注意到,历史判例正在为当代AI版权纠纷提供原则基础,但AI训练的特殊性——大规模数据摄取——可能使法院在适用传统版权法时做出不同的裁决。
对内容创作生态的深远影响
此案的判决将对数字内容生态中的多重利益相关者产生重大影响。内容创作者可能获得更明确的权益保障,而AI公司则可能面临更高的合规成本和数据获取费用。平台运营商如YouTube可能需要加强技术保护并制定更清晰的使用政策。
潜在的连锁反应包括:
- 内容价值重估:建立新的创作者报酬经济模型。
- 平台政策修订:更新针对AI训练的服务条款。
- 行业合作:创作者与AI开发者之间的潜在合作。
- 监管立法:专门规范AI训练行为的法律出台。
展望:AI版权法的十字路口
YouTuber对Snap的诉讼正处于界定版权法如何适用于人工智能开发的关键节点。随着AI系统越来越依赖海量人类创作内容进行训练,法律框架必须在激励创新与保护创作者权益之间找到平衡。这起案件,连同诸多类似案件,将建立起影响未来多年AI开发实践的先例。最终的解决方案不仅会影响科技公司和内容创作者,还将决定社会如何在人工智能、知识产权和创意表达的复杂交汇点上前行。
FAQ:
问:诉讼中提及Snap的哪项AI功能?
答:Snap的“Imagine Lens”功能,允许用户通过文本指令编辑图像。原告称该功能使用了其未授权的YouTube视频进行训练。
问:原告使用的是什么数据集?
答:HD-VILA-100M数据集,包含数百万个YouTube视频,原本仅供学术研究使用。
问:截至2025年10月,已有多少起针对AI公司的版权诉讼?
答:据版权联盟,已有超过70起。

