{"source":{"id":"mb-20260828-7fb065","title":"一个 AI 用了一周时间，把整个底层压缩库 zlib 彻底重写了一遍","url":"https://mubeitech.com/p/mb-20260828-7fb065"},"method":"semantic-similarity","count":6,"items":[{"rank":1,"id":"mb-20260827-7c90bb","account":"mubei","brand":"","title":"硅谷一家公司开出 600 万美元的预算，打算让 4 名工程师花整整 5 年，只做一件事：重写代码库里的老旧测试","summary":"硅谷一家公司开出 600 万美元的预算，打算让 4 名工程师花整整 5 年，只做一件事：重写代码库里的老旧测试","body":"硅谷一家公司开出 600 万美元的预算，打算让 4 名工程师花整整 5 年，只做一件事：重写代码库里的老旧测试。\n两周之后，这个 5 年的项目被彻底清空。\n消耗的算力账单只有 1.2 万美元。\n这笔把成本打掉 99.8% 的账单，发生在 Asana 的真实代码库里。\n原本要耗死 4 个人 5 年青春的技术债务，在 AI 面前只撑了不到两周。\n是当初 600 万美元的工时估算在层层虚报，还是软件工程底层的某条旧规则被击穿了？\n很多人的第一反应，是工程师在故意夸大工作量。\n软件行业确实有一种防御性报价：面对没人想碰的脏活，团队会给出一个高到离谱的工期，逼管理层放弃立项。\n但如果把这次重构的代码摊开来看，那个 5 年的数字，并非凭空捏造。\nAsana 要做的，是把整个前端测试系统从过时的 Enzyme 迁移到现代的 React Testing Library。\n表面看只是换个测试库。\n底层却横跨着一条三十年来传统转换工具跨不过去的鸿沟。\n跨范式语义重构。\n过去几十年，软件工业处理大规模代码迁移，靠的是基于抽象语法树（AST）的自动化转换脚本。\n语法树脚本擅长做结构替换：把旧的变量声明换成新的，把旧的函数调用换成新的接口。\n这种工具生效的前提，是新旧两套代码遵循同一种设计范式。\nEnzyme 和 React Testing Library 的底层哲学完全对立。\nEnzyme 走的是内部状态测试路线。\n它直接刺入组件内部，检查私有状态、内部变量和组件实例。\n2018 年 Kent C. Dodds 推出 React Testing Library，立下一条新准则：测试越贴近用户的真实操作，能给你的信心就越足。\n它把内部状态全部封死，只看渲染出来的真实 DOM，模拟真实用户去点击屏幕、观察文字变化。\n两套测试在代码层面上几乎找不到一行相同的语法结构。\n语法树转换脚本在这一刻彻底失效。\n要把几千个测试文件翻新，过去只能靠人类工程师通读原来的业务逻辑，在脑子里理解测试意图，再用完全不同的哲学重新写一遍。\n枯燥、庞大、极易出错，而且对业务没有任何直接的新功能产出。\n这种跨越抽象层级的语义翻译，过去是人类独占的认知能力。\n大模型恰恰在这个能力断层上，打穿了第一道缺口。\n它不需要逐行匹配语法树规则，它能同时吃下组件源码和旧测试，理解测试的真实意图，直接吐出符合新哲学的代码。\n更关键的秘密，藏在测试重构这门任务独有的物理环境里。\n闭环确定性验证沙盒。\n大模型写全新业务功能时，常常因为幻觉而难以落地。\n但在测试迁移这个场景下，软件工程提供了一个天然的裁判系统。\n代码改得对不对，不需要产品经理去猜。\nTypeScript 编译器、代码规范检查器、自动化测试套件，每秒都在给出毫无歧义的布尔值判决。\nAirbnb 在迁移 3500 个测试文件时，同样摸清了这台机器的运作逻辑。\n他们让大模型在重试闭环里运转：生成代码，跑测试，如果报错就把错误栈直接喂回上下文重新推理，直到通过。\n最终实现了 97% 的自动化通过率，把 1.5 年的工期压缩到了 6 周。\n过去数十年，阻碍企业清理历史遗留代码的，不是重构有多深奥，是跨范式翻译的边际成本高到无法承受。\n当语义重构遇上确定性的运行沙盒，这笔沉睡了多年的技术债务税，第一次被算力直接抹平。\n软件工业里的很多顽疾，从来不是缺乏解决方案。\n当解决一件脏活的成本从几百万美元跌落到几十块电费时，旧系统赖以生存的借口，也就跟着一起瓦解了。","category":"科技","score":null,"translated_x_url":null,"translated_status_id":null,"published_at":"2026-08-27 21:12:40","created_at":"2026-08-27 21:12:40","url":"https://mubeitech.com/p/mb-20260827-7c90bb","markdown_url":"https://mubeitech.com/p/mb-20260827-7c90bb/markdown"},{"rank":2,"id":"2056365603867251075","account":"mubei","brand":"@mubei","title":"OpenAI 联合创始人、现代 AI 架构的奠基人之一 Andrej Karpathy，最近差点突发心脏病。 原因很可笑…","summary":"OpenAI 联合创始人、现代 AI 架构的奠基人之一 Andrej Karpathy，最近差点突发心脏病。 原因很可笑。 他去看了眼 AI 写的底层代码。 听听这位顶级大佬有多矛盾。 他刚在会上满面春风地分享自己的“高效秘诀”。 原话是：“我已经彻底放弃检查 AI 输出的代码了…","body":"OpenAI 联合创始人、现代 AI 架构的奠基人之一 Andrej Karpathy，最近差点突发心脏病。\n原因很可笑。\n他去看了眼 AI 写的底层代码。\n\n听听这位顶级大佬有多矛盾。\n他刚在会上满面春风地分享自己的“高效秘诀”。\n原话是：“我已经彻底放弃检查 AI 输出的代码了。”\n像是在传授终极生产力魔法。\n结果下一秒，他自己掀了底裤。\n\n他承认，偶尔扫一眼这些代码，心跳都会骤停。\n满屏全是极其臃肿的垃圾代码。\n到处是粗暴的复制粘贴，逻辑抽象生硬得像玻璃一样脆。\n它确实能跑，但极其恶心。\n你让 AI 简化一下试试。\n它根本做不到。\n\n最滑稽的画面出现了。\n这套系统能一口气重构十万行代码。\n但你问它“Strawberry”里有几个 R，它直接死机。\nKarpathy 居然摊着手问台下：这到底怎么回事？\n老哥，你是发明这套技术栈的人，你问我们？\n\n这就是当下 AI 编程的真实前沿。\n也是底层工程师拼命向 CEO 隐瞒的秘密。\n代码烂到让人心梗，但大家都在装作一切顺利。\n以后的软件公司，光有咖啡机不够了。\n得在工位旁边配个心脏除颤仪，外加一个待命的心内科医生。\n以后早会的画风就是：昨天做了什么？今天做什么？有人胸痛吗？\n\n这背后的技术硬伤在哪？\nKarpathy  。\nAI 根本没有内在逻辑。\n它本质上是一个极度复杂的自动补全工具。\n如果你的具体任务没出现在它的基础训练数据，或者强化学习的题库里。\n没有任何力量能让它把正确代码吐出来。\n\n既然这样，程序员还要怎么混？\n刷 LeetCode 和解算法题的套路没用了。\n以后的面试只考一样东西：写 Spec 的能力。\n面试官会直接让你用 AI 建一个推特的克隆版。\n如果你没私下练过，AI 马上就会在 Token、Cookie 过期、密码修改机制上全面崩溃。\n未来的核心竞争力，变成了用极度精准的英语，把所有边缘情况一次性定义死。\n争取用一个 Prompt 拿到结果。\n\n连 Karpathy 这种制定规则的大佬，都在对行业的黑盒发懵。\n普通人感到迷茫就对了。\n资本还在用全知全能的幻觉炒作估值。\n工程师则在用这种幻觉糊弄不懂技术的老板。\n所谓的狂飙突进，靠的全是不敢掀开的遮羞布。","category":"其它","score":100,"translated_x_url":null,"translated_status_id":null,"published_at":"2026-05-18 17:02:49","created_at":"2026-05-18T19:00:33.853734","url":"https://mubeitech.com/p/2056365603867251075","markdown_url":"https://mubeitech.com/p/2056365603867251075/markdown"},{"rank":3,"id":"2056850947947827403","account":"mubei","brand":"@mubei","title":"每月花 20 美元订阅 Claude，不叫会用 AI。 Andrej Karpathy 在一次访谈中一针见血地指出：真正…","summary":"每月花 20 美元订阅 Claude，不叫会用 AI。 Andrej Karpathy 在一次访谈中一针见血地指出：真正的技能鸿沟，在于你如何“用 AI 来构建”。 很多人用 AI 辅助编程，越写越臃肿，甚至直接把项目跑崩。 Karpathy 总结了 AI 编程时最致命的 4 个…","body":"每月花 20 美元订阅 Claude，不叫会用 AI。\n\nAndrej Karpathy 在一次访谈中一针见血地指出：真正的技能鸿沟，在于你如何“用 AI 来构建”。\n很多人用 AI 辅助编程，越写越臃肿，甚至直接把项目跑崩。\nKarpathy 总结了 AI 编程时最致命的 4 个认知缺陷。\n有开发者将这些洞察扩展成了 21 条系统规则，直接冲上 GitHub 趋势榜第一，斩获 8.2 万颗星。\n最惊人的是，配置这套规则后，AI 的编程准确率直接从 65% 飙升到了 94%。\n\n为什么强如 Claude 也会写出垃圾代码？\nKarpathy 揭示了 AI 的四个底层硬伤：\n\n第一，互联网平庸记忆的“思想钢印”。\nAI 太依赖训练集里的常见套路。\nKarpathy 在写 GPU 梯度同步时，为了追求极致性能，没有使用标准的 PyTorch DDP 容器，而是写了一套自定义同步例程。\n结果 AI 根本无法内化这个设计，像复读机一样疯狂逼他换回 DDP。\n它无法理解不符合大众惯例的高级架构。\n\n第二，防卫过当，制造代码垃圾。\nAI 极其喜欢自作聪明地添加一堆 try-catch 声明和冗余的异常处理。\n它总是试图按照“生产级模板”来搞，结果把原本精简优雅的代码库塞满无用逻辑，复杂度直接爆炸。\n\n第三，频繁调用已经废弃的旧 API。\n知识库的滞后性，导致它在面对快速迭代的技术栈时，经常写出过时的垃圾。\n\n第四，低宽带的自然语言沟通。\n在精细的代码段里，用英语长篇大论去命令 AI 效率极低。\n最好的方式是高信息带宽的“光标补全”。\n你将光标移到精准位置，敲出前三个字母，让 AI 顺着你的思路完成剩下的部分。\n\n那套席卷 GitHub 的 21 条规则，本质上就是在用物理外挂“驯化”AI。\n比如，它强迫 AI 必须先用一句话陈述对你独特架构的理解，禁止自作聪明地意淫。\n严禁 AI 在没有明确要求时添加防御性代码和复杂的第三方包。\n强制 AI 保持极简风格，像优秀的资深工程师一样思考。\n\nAI 协同编程的范式正在发生分裂。\n如果你只是让 Agent 去写毫无技术含量的样板代码，或者用来辅助翻译你不熟悉的语言，AI 足够好用。\n但如果你要构建真正具有高智力密度、需要精确排列的系统，放任 AI 自由发挥就是灾难。\n\n未来的编程分水岭，不再是你敲代码有多快，而是你有没有能力用严苛的规则把 AI 塞进你的心智模型里。","category":"其它","score":100,"translated_x_url":null,"translated_status_id":null,"published_at":"2026-05-20 08:24:19","created_at":"2026-05-20T10:23:00.695196","url":"https://mubeitech.com/p/2056850947947827403","markdown_url":"https://mubeitech.com/p/2056850947947827403/markdown"},{"rank":4,"id":"2069512370217488423","account":"mubei","brand":"@mubei","title":"每次听到有人吹嘘“我们 99% 的代码都是 AI 写的”，Linux之父 Linus Torvalds 就忍不住生气。…","summary":"每次听到有人吹嘘“我们 99% 的代码都是 AI 写的”，Linux之父 Linus Torvalds 就忍不住生气。 “按照这个逻辑，这帮人怎么不说，自己 100% 的代码其实都是编译器写的？” Linus 是真正手写机器码长大的。 他直接敲十六进制数字，而不是汇编语言。 在他…","body":"每次听到有人吹嘘“我们 99% 的代码都是 AI 写的”，Linux之父 Linus Torvalds 就忍不住生气。\n“按照这个逻辑，这帮人怎么不说，自己 100% 的代码其实都是编译器写的？”\n\nLinus 是真正手写机器码长大的。\n他直接敲十六进制数字，而不是汇编语言。\n在他眼里，从手写数字到汇编器，再到编译器，最后到今天的 AI，技术演进的路线清清楚楚。\n它们都只是工具。\n\n他给出了一个对比：\n“AI 确实伟大，能把生产力提升 10 倍；但别忘了，当年编译器的出现，可是把生产力提升了 1000 倍！”\n所以，AI 并没有颠覆编程的底层。\n\n以前是好程序员写好代码，烂程序员写出各种 Bug。\n到了 AI 时代，玩 Prompt（提示词）也是一模一样。\n理解系统底层、知道自己在干嘛的人，能用 AI 码出神作；\n不懂系统复杂性的人，用 AI 攒出来的代码，一跑就会崩溃。\n\nLinus 把那种用 AI 糊一次性玩具项目的行为，称为“氛围感编程”（Vibe Coding）。\n一次性写完，爽完就扔，AI 确实是神器。\n但如果你要做的是一个需要维护 35 年的严肃项目，光靠写几句 Prompt 绝对是在埋雷。\n你要懂你的 Prompt，看懂 AI 吐出来的代码，甚至还要去盯着最终生成的汇编。\n\n技术再变，基本功的债务永远省不掉。\n那些以为靠 AI 就能弯道超车的，最后大概率要在代码维护的深渊里，把债全还回去。","category":"其它","score":100,"translated_x_url":"https://x.com/i/status/2070075793980399630","translated_status_id":"2070075793980399630","published_at":"2026-06-25 09:25:00","created_at":"2026-06-25T11:19:46.528734","url":"https://mubeitech.com/p/2069512370217488423","markdown_url":"https://mubeitech.com/p/2069512370217488423/markdown"},{"rank":5,"id":"mb-20260828-588b3f","account":"mubei","brand":"","title":"AI 能在十秒内写出一万行游戏代码，但只要按下运行，角色就会直接穿透地板掉进虚空","summary":"AI 能在十秒内写出一万行游戏代码，但只要按下运行，角色就会直接穿透地板掉进虚空","body":"AI 能在十秒内写出一万行游戏代码，但只要按下运行，角色就会直接穿透地板掉进虚空。\n更荒谬的是，大模型会在终端里信心满满地向你汇报：所有缺陷已全部修复。\n它根本不知道自己在撒谎。\n因为它既没有摸过手柄，也没看过屏幕一眼。\n现在的代码生成工具，写网页和后端接口已经快到不可思议。\n可一旦把它们扔进游戏引擎，生成的往往全是残次品。\n碰撞体积失效、按键重试卡死、界面按钮被裁切、进入第二关直接黑屏。\n为什么代码逻辑挑不出任何语法错误，游戏跑起来却处处是灾难？\n全球游戏工作室每年要砸下超过 17 亿美元，雇佣海量测试员去人工试玩。\n他们付出的这笔巨资，真正买的是什么？\n答案藏在一套完全不同的物理规则里。\n开发普通网页，测试工具可以通过 DOM 树精准抓取每一个输入框和按钮。\n但游戏引擎渲染出来的，是一张毫无文字标记的图形画布。\n屏幕上没有可供检索的代码节点，只有每秒刷新 60 次的像素流。\n每一帧画面，只有 16.6 毫秒的生命周期。\n在这个极短的时间窗口里，重力、刚体碰撞、动画过渡和状态机紧紧咬在一起。\n大语言模型写代码，本质是在离散的文本符号里做概率预测。\n这是典型的开环生成。\n它看得懂代码的字符语法，却对运行时的物理空间一无所知。\n更致命的是时钟维度的断层。\n一个多模态大模型截下一张图、完成一次思考，通常需要 1 到 3 秒。\n如果让大模型直接接入一个实时运转的游戏，等它看清第一帧画面并决定跳跃，游戏里的角色早就撞墙暴毙了上百次。\n速度相差上百倍的两套时钟，怎么可能咬合在一起？\n最近出现的一种自动化测试架构，把这道看似无解的物理鸿沟彻底拆开了。\n这台机器的核心，叫步进时钟与沙盒冻结。\n它不让大模型在现实时间里手忙脚乱地追赶游戏。\n测试智能体先通读游戏源码，在可能出问题的地方植入动态探针与断点。\n随后，它在隔离沙盒里启动游戏引擎，发出一组精准的按键序列。\n按下按键的瞬间，它立刻强行暂停游戏的主循环。\n整个游戏世界的物理时间，在这一微秒被彻底冻结。\n重力停滞，动画定格，时钟归零。\n这时候，大模型获得了近乎无限的思考时间。\n它调用视觉模型去审视这一帧被定格的画面，检查界面是否被挤压变形。\n同时，它调取内存中的动态探针，核对角色的坐标高度、物理刚体的受力数值与碰撞信号。\n视觉像素与底层内存数据，在这里完成双重交叉印证。\n想清楚下一步之后，它再解除暂停，让游戏引擎精准走过指定的帧数，然后重新冻结。\n这一整套流程，还遵循了一条严格的工程铁律：裁判与生成的物理隔离。\n测试智能体被剥夺了所有的代码修改权限。\n它只能像一个真正的玩家那样，输入操作、测量反馈、记录日志、判定胜负。\n当生成代码的人不再能够自己给自己打及格分，虚假的自我肯定就被彻底粉碎。\n原本需要人类测试员反复重试几个小时的边界用例，可以在沙盒里并行开出几十个实例，几分钟内跑完。\n这改变的远不止是找几个游戏缺陷。\n它指出了生成式技术演进的一条硬规律。\n在代码生成成本无限趋近于零的时代，代码本身正在变得极度廉价。\n真正稀缺的资产，是能够对代码运行结果进行物理检验的闭环观测能力。\n如果一个智能体不能感知它所创造的世界，再庞大的参数也只是在黑暗中盲目掷骰子。\n只有当时钟能够被自由冻结，当像素能够与物理法则相互印证，机器才真正接管了现实。","category":"科技","score":null,"translated_x_url":null,"translated_status_id":null,"published_at":"2026-08-28 16:48:39","created_at":"2026-08-28 16:48:39","url":"https://mubeitech.com/p/mb-20260828-588b3f","markdown_url":"https://mubeitech.com/p/mb-20260828-588b3f/markdown"},{"rank":6,"id":"2081374396900425875","account":"mubei","brand":"@mubei","title":"AI写代码的下一步，不是指望单个大模型变得多聪明。 而是搞一套相互复核的“审计流水线”。 这套工作流，比市面上售价过万的…","summary":"AI写代码的下一步，不是指望单个大模型变得多聪明。 而是搞一套相互复核的“审计流水线”。 这套工作流，比市面上售价过万的教程还要值钱。 它是怎么跑的？ 第一步，直接撒出16个Claude智能体。 让它们并发作业，一口气扫完整个代码库。 第二步，换一批全新的AI舰队出场。 清空记忆…","body":"AI写代码的下一步，不是指望单个大模型变得多聪明。\n而是搞一套相互复核的“审计流水线”。\n这套工作流，比市面上售价过万的教程还要值钱。\n\n它是怎么跑的？\n第一步，直接撒出16个Claude智能体。\n让它们并发作业，一口气扫完整个代码库。\n第二步，换一批全新的AI舰队出场。\n清空记忆，带着全新的上下文，把第一轮找出的线索挨个重查一遍。\n\n驱动这整套复杂流程的，不是长篇大论的提示词。\n而是一张流程图。\n\n这套系统管用吗？\n作者拿自己的代码跑了一遍自测。\n直接被这条流水线揪出了11个有问题的服务端点。","category":"其它","score":null,"translated_x_url":"https://x.com/i/status/2081463441798160651","translated_status_id":"2081463441798160651","published_at":"2026-07-26 19:34:49","created_at":"2026-07-26T21:28:03+02:00","url":"https://mubeitech.com/p/2081374396900425875","markdown_url":"https://mubeitech.com/p/2081374396900425875/markdown"}]}