科技·via

只要让大模型一字不差地背出一首歌,硅谷价值几百亿美元的法律护城河就会瞬间坍塌

只要让大模型一字不差地背出一首歌,硅谷价值几百亿美元的法律护城河就会瞬间坍塌。 为什么偏偏是歌词? 为什么几万行代码和复杂的学术论文没能做到的事,偏偏流行歌的几句词,能把 Anthropic 的两位联合创始人个人送上被告席? 过去三年,AI 巨头面对所有版权指控,手里都握着同一面技术盾牌。 他们告诉法官和公众:大模型不存书,也不存歌。 它只是像一个不知疲倦的学生,阅读了万亿级别的文本,提取出语言和常识的概率分布。 模型参数里留下的只有统计权重,没有原始文件。 在法律上,这套过程被包装成合理使用,在欧洲则被称为合法的文本与数据挖掘。 这套辩护听起来无懈可击。 但它成立的前提只有一个:模型只学习抽象规律,不储存原始副本。 歌词把这个神话撕得粉碎。 短文本、高韵律、高频出现,让歌词成了最容易触发过拟合的重灾区。 只要用户输入前两句歌词,大模型就能以极高精度,一字不差地把整首歌词完整输出。 在技术上,这叫模型记忆化。 而在法官眼里,这件事的性质彻底变了。 2025 年 11 月,德国慕尼黑第一地方法院在 GEMA 诉 OpenAI 案(案号 42 O 14139/24)中给出了一记判决。 法院裁定:当大模型把歌词完整记忆在权重中,并能在提示下原样输出时,这种记忆本身就构成了著作权法上的复制。 德国著作权法第 44b 条与欧盟指令规定的文本与数据挖掘例外,只保护数据分析,绝不保护把受保护作品永久内嵌在模型中替代原市场。 模型能原样背出歌词的那一刻,它不再是一个抽象学习的算法。 它成了一台绕过版权授权的无盘点唱机。 现在,这颗定时炸弹在加州被彻底引爆。 Sony Music 与 Warner Chappell 在加州北区联邦法院正式起诉 Anthropic。 诉状指控 Anthropic 系统性从 Library Genesis 等盗版库抓取受保护的歌词与乐谱来训练 Claude。 更致命的是,唱片公司直接把 CEO Dario Amodei 和联合创始人 Benjamin Mann 个人列为了被告。 依照美国版权法第 504(c) 条,每侵权一首作品,法定赔偿金最高可达 15 万美元。 为什么一定要击穿公司,把创始人个人拉下水? 因为在知识产权法里,如果公司管理层明知侵权、直接掌控数据管道并从中获利,原告就可以穿透有限责任的屏障,直接追究个人的连带侵权责任。 从 2025 年 Anthropic 与作家达成的 15 亿美元和解,到如今唱片公司对创始人个人的直接索赔,风向已经彻底变了。 AI 巨头无法再躲在技术黑盒后面,把一切推给神秘的概率统计。 当算法开始无损复刻人类的创作,那道用合理使用筑起的高墙,正在从内部被一块块拆除。

相关 / RELATED

JSON

导出 / EXPORT

订阅 · SUBSCRIBE

每周一封信号简报,重大进展可选即时推送。

不追踪邮件打开与邮件链接点击,一键退订。 或用 RSS · 详情