其它·via @mubei·100.0

AI模拟一个真人的行为,准确率能达到多少? 83%。 听起来不够完美? 拿这个数据跟真人比一下。 同一个实验里,让真人相…

AI模拟一个真人的行为,准确率能达到多少? 83%。

听起来不够完美? 拿这个数据跟真人比一下。 同一个实验里,让真人相隔两周重复自己之前的选择。 你猜怎么着?真人跟自己的一致率,只有80%。 在做决策这件事上,AI已经比你本人还要像你。

但这还只是皮毛。 视线转到底层研发,游戏规则早就掀桌子了。 现在的玩法,叫“一个人就是一支军队”。

在Anthropic内部,一个工程师日常带多少个AI智能体干活? 早就不是一对一聊天了。 他们每个人都在并发调度几十、上百甚至上千个智能体。 主智能体派发任务,子智能体往下再分包,一路能深挖五层嵌套。

威力有多离谱? 支付巨头Stripe做系统底层大迁徙,一万行Scala代码要转成Java。 以前这叫伤筋动骨,得按月算,开无数个会。 丢给这套智能体集群,四天,干完了。 知名项目Bun把底层从Zig语言硬切到Rust,也是这帮不知疲倦的合成大军敲出来的。

不信邪的老经验,最先被碾压。 AMD刚经历了一场内部震撼。 一个极其棘手的芯片底层漏洞,一整个资深工程师团队卡了几个星期,毫无头绪。 最后是一个初级工程师破的局。 他直接调出一组智能体,让二十多个维度的测试和验证并发狂奔。 漏洞被生生揪出。 高管直接看傻了,老派工程师的三观碎了一地。

那些还抱着“AI只会补全代码”优越感的人,还在一行行手动查错。 而真正懂行的人,已经成了指挥几千个数字工人的超级包工头。

翻译视频 / X

导出 / EXPORT