{"id":"mb-20260830-7625c4","account":"mubei","brand":"","title":"只要让大模型一字不差地背出一首歌，硅谷价值几百亿美元的法律护城河就会瞬间坍塌","summary":"只要让大模型一字不差地背出一首歌，硅谷价值几百亿美元的法律护城河就会瞬间坍塌","body":"只要让大模型一字不差地背出一首歌，硅谷价值几百亿美元的法律护城河就会瞬间坍塌。\n为什么偏偏是歌词？\n为什么几万行代码和复杂的学术论文没能做到的事，偏偏流行歌的几句词，能把 Anthropic 的两位联合创始人个人送上被告席？\n过去三年，AI 巨头面对所有版权指控，手里都握着同一面技术盾牌。\n他们告诉法官和公众：大模型不存书，也不存歌。\n它只是像一个不知疲倦的学生，阅读了万亿级别的文本，提取出语言和常识的概率分布。\n模型参数里留下的只有统计权重，没有原始文件。\n在法律上，这套过程被包装成合理使用，在欧洲则被称为合法的文本与数据挖掘。\n这套辩护听起来无懈可击。\n但它成立的前提只有一个：模型只学习抽象规律，不储存原始副本。\n歌词把这个神话撕得粉碎。\n短文本、高韵律、高频出现，让歌词成了最容易触发过拟合的重灾区。\n只要用户输入前两句歌词，大模型就能以极高精度，一字不差地把整首歌词完整输出。\n在技术上，这叫模型记忆化。\n而在法官眼里，这件事的性质彻底变了。\n2025 年 11 月，德国慕尼黑第一地方法院在 GEMA 诉 OpenAI 案（案号 42 O 14139/24）中给出了一记判决。\n法院裁定：当大模型把歌词完整记忆在权重中，并能在提示下原样输出时，这种记忆本身就构成了著作权法上的复制。\n德国著作权法第 44b 条与欧盟指令规定的文本与数据挖掘例外，只保护数据分析，绝不保护把受保护作品永久内嵌在模型中替代原市场。\n模型能原样背出歌词的那一刻，它不再是一个抽象学习的算法。\n它成了一台绕过版权授权的无盘点唱机。\n现在，这颗定时炸弹在加州被彻底引爆。\nSony Music 与 Warner Chappell 在加州北区联邦法院正式起诉 Anthropic。\n诉状指控 Anthropic 系统性从 Library Genesis 等盗版库抓取受保护的歌词与乐谱来训练 Claude。\n更致命的是，唱片公司直接把 CEO Dario Amodei 和联合创始人 Benjamin Mann 个人列为了被告。\n依照美国版权法第 504(c) 条，每侵权一首作品，法定赔偿金最高可达 15 万美元。\n为什么一定要击穿公司，把创始人个人拉下水？\n因为在知识产权法里，如果公司管理层明知侵权、直接掌控数据管道并从中获利，原告就可以穿透有限责任的屏障，直接追究个人的连带侵权责任。\n从 2025 年 Anthropic 与作家达成的 15 亿美元和解，到如今唱片公司对创始人个人的直接索赔，风向已经彻底变了。\nAI 巨头无法再躲在技术黑盒后面，把一切推给神秘的概率统计。\n当算法开始无损复刻人类的创作，那道用合理使用筑起的高墙，正在从内部被一块块拆除。","category":"科技","score":null,"translated_x_url":null,"translated_status_id":null,"published_at":"2026-08-30 21:53:56","created_at":"2026-08-30 21:53:56"}