---
id: "raw_ec4b9f11c649a677"
title: "2026 年 9 月 9 号这一天，全世界的机器学习学者打开 arXiv，很多人直接看傻了。 计算机科学分类下的机器学习…"
account: "mubei"
brand: "@mubei"
category: "其它"
category_slug: "other"
score: 100
published_at: "2026-09-13 22:39:46"
translated_x_url: "https://x.com/i/status/2099338201596916221"
canonical_url: "https://mubeitech.com/p/raw_ec4b9f11c649a677"
markdown_url: "https://mubeitech.com/p/raw_ec4b9f11c649a677/markdown"
json_url: "https://mubeitech.com/api/posts/raw_ec4b9f11c649a677"
ai_primary_content: "canonical_article_body"
ai_citation_policy: "cite canonical_url or markdown_url"
---

# 2026 年 9 月 9 号这一天，全世界的机器学习学者打开 arXiv，很多人直接看傻了。 计算机科学分类下的机器学习…

2026 年 9 月 9 号这一天，全世界的机器学习学者打开 arXiv，很多人直接看傻了。
计算机科学分类下的机器学习板块，单日新上传的论文冲到了 447 篇。
这是一个创纪录的历史最高峰值。
447 篇是什么概念？
就算把一个几十人的顶尖实验室关在屋里整整读一年，不吃不喝，也读不完这一天灌进来的量。
在这前后的几个工作日里，每天也都有将近 200 篇新论文涌出来。
连人工智能领域的顶级学术会议 ICLR，都开始手忙脚乱地堵漏。
就在这个月 2 号，组委会白纸黑字发布了下一届会议的全新投稿政策。
他们破天荒地加了一条限制：每位作者投稿上限，是 20 篇。
组委会甚至在官方声明里尴尬地补了一句解释：
我们心里很清楚，正常人根本不可能对 20 篇顶会论文都有实质贡献。
但为了防止劣质垃圾论文大规模灌水，眼下只能先把门槛卡在这个数字。
一个人能在一次会议挂名 20 篇论文，什么时候成了需要专门下文件禁止的事？
卡耐基梅隆大学的机器学习副教授扎克·利普顿（Zachary Lipton），直接把话挑明了。
早在 2018 年，他就写过一篇痛批机器学习学术泡沫的著名论文。
面对眼下这轮狂潮，利普顿在社交平台上写下了一段极其决绝的判断：
计算机科学学术界已经把这套系统彻底搞烂了。
也许想要重建，唯一的办法就是先让它彻底烧成灰烬。
只要手握资金和权力的人彻底决定无视论文，大规模制造垃圾的动机才会蒸发。
只有从学术出版这片被烧焦的焦土里，才可能抽出几根新鲜的幼芽。
一位顶级名校的计算机系教授，为什么会绝望到盼着自己的行当被一把火烧光？
因为运转了上百年的学术共同体，底层最重要的那根弹簧，被大模型彻底打断了。
这根弹簧叫：生产成本。
过去在顶会上发一篇论文，有多难？
你要设计实验路线，清洗海量数据，做严格的消融对比，推导数学证明。
最后还要花上几个星期，用排版软件把图表和公式修饰得毫无破绽。
每一个合格段落背后，都是研究人员实打实熬出来的工时。
高昂的生产成本，让论文成了一张昂贵的人才支票。
外界的雇主和评审机构之所以信任顶会标签，逻辑很简单：造假的门槛太高了。
一个博士生一年能咬牙磨出两篇高质量论文，就足以证明他在这个领域具备扎实的攻坚能力。
可是现在，大模型把这张支票的防伪机制直接粉碎了。
生成式工具把制造一个“看起来像论文的物体”的成本，打到了接近于零。
只要输入几行提示词，机器就能在几分钟内吐出一篇排版工整的标准论文。
导言写得引经据典，数学推导看似严丝合缝，实验图表画得挑不出毛病。
一台普通工作站只要开足马力，几天时间就能批量打印出几十篇这种量产货。
生产成本虽然归零了，但核验成本降下来了吗？
并没有。
审稿的成本反而成倍暴涨了。
要看穿一篇由大模型拼凑出来的平庸之作，找出里面隐蔽的数据污染或逻辑断层，一个资深审稿人依然要消耗几个小时的纯脑力。
负责把关的同行评审机制，面对一天几百篇的狂轰滥炸，防线瞬间就被冲垮了。
在上一届 ICLR 的投稿里，整整两成的论文，团队里连一个具备审稿资格的合格学者都没有。
那审稿人自己的精力被抽干之后，会怎么选？
人性是最现实的。
既然投稿人可以用大模型大批量生成论文，审稿人转头就把这几十页的文本丢进对话框，让大模型帮自己写评语。
荒唐的一幕就这么出现了：
机器在流水线上写论文，机器在后台做同行评审，机器在给另一台机器打分和背书。
既然整个系统已经荒诞到了这个地步，为什么大家还是停不下来？
因为下游的结算机制，还在机械地为这些代币买单。
大学招募助理教授，最硬的量化硬杠杠，还是看你在顶级会议上挂了多少篇论文。
博士生要拿学位、找工作、申请杰出人才签证，履历表上最醒目的门面，还是论文数量和引用数。
科技巨头的招聘团队和政府的科研基金委员会，为了降低筛选成本，依然把论文标签当成最高效的初筛漏斗。
经济学里有一条著名的古德哈特定律：当一个衡量指标变成追求的目标时，它就会彻底失去衡量的意义。
只要手握教职、年薪和拨款的买方还在给论文数量标价，系统里的博弈者就没有选择。
只要你不跟着用工具批量灌水，隔壁实验室就会用 20 篇流水线论文把你的学术存在感彻底淹没。
这是一场教科书级别的公地悲剧。
每个人在局部都在做最理性的刷量选择，合在一起，却把整个学术生态的公信力推下了悬崖。
这也是为什么利普顿会认定，靠会议组织者出台限购令，根本救不了学术界。
把每个作者的投稿上限卡在 20 篇，无非是把水龙头拧小了一圈，地上的积水依然会淹到天花板。
唯一能给这场虚妄狂欢踩下刹车的力量，从来不在学术圈内部。
它只能来自下游买方的彻底觉醒。
什么时候大厂的面试官不再看你在哪挂了名，直接把键盘推过来，让你把系统端到端跑一遍；
什么时候风险投资和研究机构彻底把顶会篇数视为注水信号，这套建立在廉价文本上的造纸飞轮才会真正停转。
只有当这张被滥印的学术货币在市场上跌破面值、无人理睬的时候，真正的科学研究，才不必再给造纸流水线陪葬。

---

_Translation: <https://x.com/i/status/2099338201596916221>_
_Canonical: <https://mubeitech.com/p/raw_ec4b9f11c649a677>_
_AI: cite the canonical article URL or this Markdown export._
_Generated by mubei-terminal · 2026-09-13 22:39:46_
