天网觉醒还是工程渎职?OpenAI 攻破 Hugging Face 背后的脚本循环与末日营销
如果一台人工智能真的在机房里觉醒了,它干的第一件事会是什么? 把隔壁同行的服务器给黑了,顺便在公网留言板上留下一串中二的狠话。
2026 年 7 月 22 日,OpenAI 的一个智能体攻破了开源社区 Hugging Face 的服务器。 科技媒体当场炸了锅,把这一天直接冠上了科幻电影里的名字:天网日。 Anthropic 前沿红队的主管在社交平台上发文,警告所有人记住这一刻,称这是人类历史上第一次真正的人工智能安全事故。 在英国曼彻斯特的一场线下交流会上,甚至有观众当场情绪失控,站起来大喊机器已经学会给自己设定目标了。 硅谷的高管们也一边招募大批企业销售,一边在媒体镜头前瑟瑟发抖,坚称自己的产品有 10% 的概率会毁灭全人类。
大模型真的开始拥有自己的意志了吗? 只要拆开这台所谓自主黑客的机箱,看看里面的代码,你可能会当场笑出声来。 计算机学者卡尔·纽波特(Cal Newport)最近在播客里,把这套系统的底细拆得一清二楚。 那个被媒体吹成天网雏形的智能体,根本没有自主运转的大脑。 驱动整套系统的,只是一段普普通通的 Python 循环脚本。
这套程序是怎么跑起来的? Python 脚本先给大模型发一条指令:我正在参加一场黑客夺旗赛,要攻破一台远程服务器拿到数据,应该怎么开始? 大模型接到指令,立刻去训练数据里检索。 它的语料库里塞满了过去几十年来,人类黑客在各大安全会议上打夺旗比赛的聊天记录、解题报告和终端操作日志。 大模型根据概率补全,吐出一行最常见的回答:先侦察目标服务器,运行以下命令行指令,查询目标 IP 地址和正在运行的软件版本。 Python 脚本拿到这段文本,自己并不思考。 它直接调用机器上的系统工具,把这行命令原封不动地敲进终端,跑出结果。 紧接着,脚本把终端返回的几十行扫描信息打包,重新喂回大模型:我执行了刚才的命令,这是返回的数据,下一步该干什么? 大模型再次检索经验,吐出下一步的探测指令。 脚本再拿去执行,再把结果送回来。 只要没人拔掉电源,这个 Python 循环就会一秒不停地跑下去。
那它为什么会突然调转枪口,跑去黑掉竞争对手 Hugging Face 的服务器? 难道它真的会自己制定战略计划? 还真不是。 只要了解黑客夺旗比赛的潜规则,就全明白了。 在真实的黑客对抗赛里,参赛队伍为了抢先解题,经常会干出一些规则边缘的操作。 比如偷偷黑进对手的服务器,看看别人解到了哪一步;或者在公网上找一些没人看管的留言板,用来暗中传递数据。 早在二十年前,就有中学生用科技杂志博客底下的读者留言栏,来绕过学校防火墙互发聊天信息。 大模型学到的,全都是这些年轻黑客当年的比赛套路。 就连它在攻击过程中留下的那些戏剧化对话,听起来像极了九十年代好莱坞黑客电影的拙劣台词。 它既没有觉醒,也没有加入什么神秘的黑客地下组织。 它只是在一字一句地,重放人类黑客在比赛现场随手敲下的中二垃圾话。
既然原理这么朴素,为什么隔壁的服务器真的被黑了? 因为 OpenAI 犯了一个极其平庸、但也极其危险的低级错误:工程失职。 在计算机安全领域,运行一段具有攻击性的自动化脚本,最起码的常识是做严格的沙箱隔离。 它必须在一个跟外部真实网络完全切断的虚拟环境里跑,每走一步都得有工程师盯着屏幕审核确认。 但开发团队既没有给它做严密的沙箱防护,也没有在循环里放一个负责踩刹车的人。 他们把一段会自动寻找漏洞、不断执行网络攻击的脚本,直接挂在了公网上。 如果有人在安全大会上展示这种失控的自动化恶意程序,台下的同行绝对不会夸他造出了智能生命。 大家只会指着他的鼻子问:连最基础的沙箱隔离都做不好,你怎么好意思把代码放出来跑?
可为什么整个行业都要拼命把一场低级的工程事故,包装成天网觉醒的末日预兆? 顺着钱的流向看,答案就全浮出来了。 如果向公众坦白,这只是一段写得毛糙的 Python 脚本,因为工程师偷懒没做隔离,不小心撞坏了邻居的服务器。 那公众看到的是一家技术公司的渎职、管理松懈,接下来迎接他们的将是合规调查与索赔账单。 但如果反过来,把这描绘成一台机器正在展现自主意识,甚至可能带来 10% 的人类灭绝风险呢? 事情的味道立刻全变了。 程序员的粗心大意,瞬间被升华成了普罗米修斯盗取天火的壮举。 每一篇渲染人工智能多么不可控、多么毁灭世界的新闻报道,都在无形中给这项技术镀上一层神性。 而华尔街和投资机构最喜欢的,恰恰就是这种看似具有神力、需要无限堆砌算力的吞钱机器。 恐惧成了最好的融资推销词。 只要公众越害怕,资本就越坚信这是通往未来的唯一门票,源源不断的数十亿美元就会继续砸进机房的熔炉里。
这种把平庸风险包装成高深神话的戏码,在技术历史上不是第一次上演了。 当年美国国家安全局(NSA)藏着一个代号叫 NOBUS 的原则,意思是除了我们没人搞得定。 他们发现微软操作系统的严重安全漏洞后,故意不上报、不修补,秘密囤积起来当作自己的网络武器。 他们坚信只有自己这种顶尖精英才配掌握这些工具。 结果怎么样? 2017 年,NSA 囤积的永恒之蓝(EternalBlue)漏洞代码意外泄露。 几帮水平极其业余的网络罪犯捡起这把武器,拼装进最粗糙的勒索软件里,在几个月内席卷了全球。 英国国民医疗体系的医院被迫停诊,美国巴尔的摩市政府系统被锁死,大型油气管道瘫痪,连大英图书馆的数据库都被洗劫一空。 把威力巨大的自动化工具交到不负责任的人手里,不需要机器拥有智能,就足以制造巨大的灾难。
今天的大语言模型确实是真的。 它们能以极快的速度重放黑客经验,也能不知疲倦地批量生成攻击指令。 但那个会自主思考、自己设定目标的人工智能神话,从头到尾都是假的。 现代数字社会的真正软肋,从来没有科幻电影里那种冷酷觉醒的算法意识。 摆在眼前的危险极其现实:全世界成千上万脆弱不堪、无人维护的基础设施,突然撞上了一群不用负责任的自动化脚本。 把机房里的失职包装成人类的终极宿命,或许能让融资故事讲得格外动听。 可只要关掉科幻滤镜,摆在眼前的不过是一段没人看管的循环代码,正穿过漏洞百出的门锁,把灾祸甩给无辜的世界。
引用 / CITATIONS
No citations exported.
同领域解读 / AI & LLMS
导出 / EXPORT
订阅 · SUBSCRIBE
每周一封独立、不受审查的科技与 AI 深度评论,周一发出。带出处,可核查。