---
id: "mb-20260902-82c335"
kind: "deep"
title: "Anthropic 关掉安全护栏测了一次 Claude Mythos 5.1"
topic: "Anthropic 关掉安全护栏测了一次 Claude Mythos 5.1"
source_type: "generated"
status: "published"
generated_at: "2026-09-02 09:36:44"
frame_type: ["武器化门槛坍塌（The Collapse of", "机制"]
legal_anchor_count: 0
transcript_citation_count: 0
---

# Anthropic 关掉安全护栏测了一次 Claude Mythos 5.1

Anthropic 关掉安全护栏测了一次 Claude Mythos 5.1。
在 250 次针对 Firefox 浏览器的攻击测试里，模型成功写出了 245 个完全可用的攻击代码。
成功率 98%。
六个月前的上一代旗舰模型，同一项测试的成功率只有 52%。
很多人看到这个断崖式上涨的数据，第一反应是惊呼 AI 找漏洞的能力突飞猛进。
但网络安全圈真正感到后背发凉的，根本不是它「找到了漏洞」。
在这个测试里，模型发现代码缺陷的底层能力其实变化不大。
真正发生剧变的，是后面那道长期被公众忽视的工序。
为什么发现漏洞并不致命，后面那道工序才致命？
在黑客与安全攻防的世界里，一直有一道昂贵的分水岭：
发现漏洞，与武器化漏洞。
发现一个漏洞，很多时候只是让软件崩溃一次，或者找出一处内存读取异常。
自动化测试工具每天能在开源软件里扫出几千个崩溃报告。
但让软件崩溃，和彻底接管一台电脑，完全是两码事。
要把一个理论上的缺陷，变成一个能绕过地址随机化（ASLR）、打穿沙箱、稳定夺取系统权限的实战工具，需要极其精密的工程调试。
你得精准微调内存布局，做复杂的堆喷射，手工拼接一条条返回导向编程（ROP）代码链。
这过去是全球顶尖黑客的手艺活。
打穿一个现代浏览器的武器级零日漏洞，往往需要一个专业团队死磕几个月。
换句话说，过去几十年现代软件能相对安全地运转，靠的从来不是代码毫无瑕疵。
靠的是「把瑕疵改造成武器」的这道人力成本高墙。
防守方一直在用对手高昂的手工工程成本，给自己争取修补和防御的时间。
只要武器化的门槛足够高，绝大多数理论漏洞就永远只是躺在白皮书里的几行报错。
现在，这道立了几十年的高墙塌了。
Claude Mythos 5.1 展现出的真正质变，不在于多发现了几个缺陷。
它把原本需要顶级专家数周调优的武器化装配，压缩成了几十秒内的全自动编排。
98% 的成功率，意味着漏洞转化为有效武器的边际成本，第一次被砸到了接近零。
任何一道原本微不足道的代码裂痕，在它手里都能被瞬间打磨成一把定制的手术刀。
防守方过去赖以生存的时间差，被彻底抹平了。
以前防守的逻辑，是笃定攻击者的人力有限，只能挑极少数高价值目标下手。
当武器化的工程成本不复存在，代码里的每一处小瑕疵，都不再只是理论风险，而是直接暴露在全自动流水线下。
决定未来网络安全的，不再是谁能写出零缺陷的代码。
在机器把裂缝锻造成武器之前，谁能把整个防守体系也交给机器，才是真正的胜负手。

_Rendered by mubei-terminal._
