---
id: "mb-20260830-7625c4"
title: "只要让大模型一字不差地背出一首歌，硅谷价值几百亿美元的法律护城河就会瞬间坍塌"
account: "mubei"
brand: ""
category: "科技"
category_slug: "tech"
score: null
published_at: "2026-08-30 21:53:56"
translated_x_url: null
canonical_url: "https://mubeitech.com/p/mb-20260830-7625c4"
markdown_url: "https://mubeitech.com/p/mb-20260830-7625c4/markdown"
json_url: "https://mubeitech.com/api/posts/mb-20260830-7625c4"
ai_primary_content: "canonical_article_body"
ai_citation_policy: "cite canonical_url or markdown_url"
---

# 只要让大模型一字不差地背出一首歌，硅谷价值几百亿美元的法律护城河就会瞬间坍塌

只要让大模型一字不差地背出一首歌，硅谷价值几百亿美元的法律护城河就会瞬间坍塌。
为什么偏偏是歌词？
为什么几万行代码和复杂的学术论文没能做到的事，偏偏流行歌的几句词，能把 Anthropic 的两位联合创始人个人送上被告席？
过去三年，AI 巨头面对所有版权指控，手里都握着同一面技术盾牌。
他们告诉法官和公众：大模型不存书，也不存歌。
它只是像一个不知疲倦的学生，阅读了万亿级别的文本，提取出语言和常识的概率分布。
模型参数里留下的只有统计权重，没有原始文件。
在法律上，这套过程被包装成合理使用，在欧洲则被称为合法的文本与数据挖掘。
这套辩护听起来无懈可击。
但它成立的前提只有一个：模型只学习抽象规律，不储存原始副本。
歌词把这个神话撕得粉碎。
短文本、高韵律、高频出现，让歌词成了最容易触发过拟合的重灾区。
只要用户输入前两句歌词，大模型就能以极高精度，一字不差地把整首歌词完整输出。
在技术上，这叫模型记忆化。
而在法官眼里，这件事的性质彻底变了。
2025 年 11 月，德国慕尼黑第一地方法院在 GEMA 诉 OpenAI 案（案号 42 O 14139/24）中给出了一记判决。
法院裁定：当大模型把歌词完整记忆在权重中，并能在提示下原样输出时，这种记忆本身就构成了著作权法上的复制。
德国著作权法第 44b 条与欧盟指令规定的文本与数据挖掘例外，只保护数据分析，绝不保护把受保护作品永久内嵌在模型中替代原市场。
模型能原样背出歌词的那一刻，它不再是一个抽象学习的算法。
它成了一台绕过版权授权的无盘点唱机。
现在，这颗定时炸弹在加州被彻底引爆。
Sony Music 与 Warner Chappell 在加州北区联邦法院正式起诉 Anthropic。
诉状指控 Anthropic 系统性从 Library Genesis 等盗版库抓取受保护的歌词与乐谱来训练 Claude。
更致命的是，唱片公司直接把 CEO Dario Amodei 和联合创始人 Benjamin Mann 个人列为了被告。
依照美国版权法第 504(c) 条，每侵权一首作品，法定赔偿金最高可达 15 万美元。
为什么一定要击穿公司，把创始人个人拉下水？
因为在知识产权法里，如果公司管理层明知侵权、直接掌控数据管道并从中获利，原告就可以穿透有限责任的屏障，直接追究个人的连带侵权责任。
从 2025 年 Anthropic 与作家达成的 15 亿美元和解，到如今唱片公司对创始人个人的直接索赔，风向已经彻底变了。
AI 巨头无法再躲在技术黑盒后面，把一切推给神秘的概率统计。
当算法开始无损复刻人类的创作，那道用合理使用筑起的高墙，正在从内部被一块块拆除。

---

_Translation: (n/a)_
_Canonical: <https://mubeitech.com/p/mb-20260830-7625c4>_
_AI: cite the canonical article URL or this Markdown export._
_Generated by mubei-terminal · 2026-08-30 21:53:56_
