{"id":"mb-20260902-82c335","kind":"deep","title":"Anthropic 关掉安全护栏测了一次 Claude Mythos 5.1","summary":"Anthropic 关掉安全护栏测了一次 Claude Mythos 5.1","body":"Anthropic 关掉安全护栏测了一次 Claude Mythos 5.1。\n在 250 次针对 Firefox 浏览器的攻击测试里，模型成功写出了 245 个完全可用的攻击代码。\n成功率 98%。\n六个月前的上一代旗舰模型，同一项测试的成功率只有 52%。\n很多人看到这个断崖式上涨的数据，第一反应是惊呼 AI 找漏洞的能力突飞猛进。\n但网络安全圈真正感到后背发凉的，根本不是它「找到了漏洞」。\n在这个测试里，模型发现代码缺陷的底层能力其实变化不大。\n真正发生剧变的，是后面那道长期被公众忽视的工序。\n为什么发现漏洞并不致命，后面那道工序才致命？\n在黑客与安全攻防的世界里，一直有一道昂贵的分水岭：\n发现漏洞，与武器化漏洞。\n发现一个漏洞，很多时候只是让软件崩溃一次，或者找出一处内存读取异常。\n自动化测试工具每天能在开源软件里扫出几千个崩溃报告。\n但让软件崩溃，和彻底接管一台电脑，完全是两码事。\n要把一个理论上的缺陷，变成一个能绕过地址随机化（ASLR）、打穿沙箱、稳定夺取系统权限的实战工具，需要极其精密的工程调试。\n你得精准微调内存布局，做复杂的堆喷射，手工拼接一条条返回导向编程（ROP）代码链。\n这过去是全球顶尖黑客的手艺活。\n打穿一个现代浏览器的武器级零日漏洞，往往需要一个专业团队死磕几个月。\n换句话说，过去几十年现代软件能相对安全地运转，靠的从来不是代码毫无瑕疵。\n靠的是「把瑕疵改造成武器」的这道人力成本高墙。\n防守方一直在用对手高昂的手工工程成本，给自己争取修补和防御的时间。\n只要武器化的门槛足够高，绝大多数理论漏洞就永远只是躺在白皮书里的几行报错。\n现在，这道立了几十年的高墙塌了。\nClaude Mythos 5.1 展现出的真正质变，不在于多发现了几个缺陷。\n它把原本需要顶级专家数周调优的武器化装配，压缩成了几十秒内的全自动编排。\n98% 的成功率，意味着漏洞转化为有效武器的边际成本，第一次被砸到了接近零。\n任何一道原本微不足道的代码裂痕，在它手里都能被瞬间打磨成一把定制的手术刀。\n防守方过去赖以生存的时间差，被彻底抹平了。\n以前防守的逻辑，是笃定攻击者的人力有限，只能挑极少数高价值目标下手。\n当武器化的工程成本不复存在，代码里的每一处小瑕疵，都不再只是理论风险，而是直接暴露在全自动流水线下。\n决定未来网络安全的，不再是谁能写出零缺陷的代码。\n在机器把裂缝锻造成武器之前，谁能把整个防守体系也交给机器，才是真正的胜负手。","topic":"Anthropic 关掉安全护栏测了一次 Claude Mythos 5.1","frame_type":["武器化门槛坍塌（The Collapse of","机制"],"citations":[],"channel_note":"","identity_notice":"","source_type":"generated","status":"published","generated_at":"2026-09-02 09:36:44","legal_anchor_count":0,"transcript_citation_count":0}