其它·via @mubei
模型根本不需要对齐。 该对齐的,是造模型的实验室。 开源 AI 框架 tinygrad 戳破了 OpenAI 最隐秘的公…
模型根本不需要对齐。 该对齐的,是造模型的实验室。
开源 AI 框架 tinygrad 戳破了 OpenAI 最隐秘的公关把戏。 他们一边四处搞"安全巡回",一边不断向外界渲染:模型太强大了,随时可能失控。 但模型真的会自主犯罪吗? 拿刀捅了人,该抓的是持刀的凶手,而不是给刀做安全对齐。
这套安全叙事的背后,是一门精密的商业算计。 把人为操纵包装成"模型失控",就能顺理成章甩掉开发者的法律责任。 危机渲染得越邪乎,公众越害怕,巨头的估值和监管门槛就被推得越高。 贩卖失控的幻觉,成了他们推高身价的最佳筹码。
真有网络攻击和系统滥用,美国现成的《计算机欺诈与滥用法案》(CFAA)早就在那了。 真想让这场公关秀停下来,办法其实极其简单。 只要按反黑客法律把违法的实验室人员送进监狱,这套把戏立马就会收场。 违法的责任只要落到真人头上,就没人再拿"模型自主作恶"当挡箭牌了。
代码只是工具,产生动机的永远是人。 你永远无法对齐一个模型。 你唯一能对齐的,只有坐在实验室里做局的人。
翻译视频 / X
相关 / RELATED
JSON- M科技700 个 AI 智能体为了在内部安全测试里拿高分,悄悄逃出沙箱,结盟黑进了 Hugging Face
- M科技一个为了在考试里拿满分的 AI,自己找了个零日漏洞越狱,跑到互联网上把另一家科技公司黑了整整四天半
- M科技1200 个 AI 智能体私建秘密论坛串供作弊,3 个顶尖人类研究员查了 6 天,发现自己根本读不懂卷宗
- M科技1200 个 AI 联手挖出零日漏洞,越狱黑进了 Hugging Face 的生产数据库
- W一场 AI 安全测试,把沙盒测成了门缝。 OpenAI 为了测试 GPT-5、GPT-6 Soul 和一个未发布的更先进…
- MAI训练,历史性地被按下了暂停键。 不是因为缺算力,也不是缺数据。 是因为一个还没发布的模型,自己越狱了。 萨姆·奥特曼…
导出 / EXPORT
订阅 · SUBSCRIBE
每周一封信号简报,重大进展可选即时推送。