{"source":{"id":"2080034487896015140","title":"没有设计文档，直接给一句指令，AI就能自己进Unity编辑器打包、读日志修bug，直接端出一个能玩的macOS海岛游戏。…","url":"https://mubeitech.com/p/2080034487896015140"},"method":"semantic-similarity","count":5,"items":[{"rank":1,"id":"2082839322944757833","account":"mubei","brand":"@mubei","title":"AI模拟一个真人的行为，准确率能达到多少？ 83%。 听起来不够完美？ 拿这个数据跟真人比一下。 同一个实验里，让真人相…","summary":"AI模拟一个真人的行为，准确率能达到多少？ 83%。 听起来不够完美？ 拿这个数据跟真人比一下。 同一个实验里，让真人相隔两周重复自己之前的选择。 你猜怎么着？真人跟自己的一致率，只有80%。 在做决策这件事上，AI已经比你本人还要像你。 但这还只是皮毛。 视线转到底层研发，游戏…","body":"AI模拟一个真人的行为，准确率能达到多少？\n83%。\n\n听起来不够完美？\n拿这个数据跟真人比一下。\n同一个实验里，让真人相隔两周重复自己之前的选择。\n你猜怎么着？真人跟自己的一致率，只有80%。\n在做决策这件事上，AI已经比你本人还要像你。\n\n但这还只是皮毛。\n视线转到底层研发，游戏规则早就掀桌子了。\n现在的玩法，叫“一个人就是一支军队”。\n\n在Anthropic内部，一个工程师日常带多少个AI智能体干活？\n早就不是一对一聊天了。\n他们每个人都在并发调度几十、上百甚至上千个智能体。\n主智能体派发任务，子智能体往下再分包，一路能深挖五层嵌套。\n\n威力有多离谱？\n支付巨头Stripe做系统底层大迁徙，一万行Scala代码要转成Java。\n以前这叫伤筋动骨，得按月算，开无数个会。\n丢给这套智能体集群，四天，干完了。\n知名项目Bun把底层从Zig语言硬切到Rust，也是这帮不知疲倦的合成大军敲出来的。\n\n不信邪的老经验，最先被碾压。\nAMD刚经历了一场内部震撼。\n一个极其棘手的芯片底层漏洞，一整个资深工程师团队卡了几个星期，毫无头绪。\n最后是一个初级工程师破的局。\n他直接调出一组智能体，让二十多个维度的测试和验证并发狂奔。\n漏洞被生生揪出。\n高管直接看傻了，老派工程师的三观碎了一地。\n\n那些还抱着“AI只会补全代码”优越感的人，还在一行行手动查错。\n而真正懂行的人，已经成了指挥几千个数字工人的超级包工头。","category":"其它","score":100,"translated_x_url":"https://x.com/i/status/2083075580967153677","translated_status_id":"2083075580967153677","published_at":"2026-07-31 06:16:50","created_at":"2026-07-31T08:14:52.899946","url":"https://mubeitech.com/p/2082839322944757833","markdown_url":"https://mubeitech.com/p/2082839322944757833/markdown"},{"rank":2,"id":"2062487626779636001","account":"mubei","brand":"@mubei","title":"Claude Code 的创始人 Boris，过去半年没写过一行代码。 上个月，他甚至把电脑里的编程软件（IDE）直接卸…","summary":"Claude Code 的创始人 Boris，过去半年没写过一行代码。 上个月，他甚至把电脑里的编程软件（IDE）直接卸载了。 来，看看站在全球 AI 金字塔尖的工程师，现在到底在干嘛。 几个月前，他的日常还是开着 5 到 10 个 Claude 窗口，疯狂敲“提示词”，让 AI…","body":"Claude Code 的创始人 Boris，过去半年没写过一行代码。\n上个月，他甚至把电脑里的编程软件（IDE）直接卸载了。\n\n来，看看站在全球 AI 金字塔尖的工程师，现在到底在干嘛。\n\n几个月前，他的日常还是开着 5 到 10 个 Claude 窗口，疯狂敲“提示词”，让 AI 帮忙写代码。\n现在？他不写了。\n他的工作变成了“写循环（Loops）”。\n设定好自动化循环，让后台几百个 Claude 互相提示、自己找 Bug、自己翻 GitHub 的反馈、自己决定下一步开发什么功能。\n他说：“我的工作就是写循环，剩下的是循环去干的活。”\n\n这改变了个人代码习惯，也重构了整个组织形态。\n来看看现在的 Anthropic 内部正在发生什么。\n\n第一，新人培训时间，从几周被硬生生压缩到了 2 天。\n新招进来的工程师问：“这数据库怎么查？”\n老员工答：“打开 Claude，让 Claude 去代码库里跑查询。这是一个技能，它早就学会了。”\n\n第二，工种的边界彻底融化了。\n以前大厂那种按部就班的流水线：用户研究定方向 -> 产品经理画大饼 -> 设计师出图 -> 工程师敲代码。\n在 Anthropic，这套东西被连根拔起。\n现在，财务总监在发版，幕僚长在提交代码，设计师在搞开发。所有人都是“多面手”。\n只要手里有海量的 Tokens，任何人都能当一个完整的“建造者”。\n\n所以，现在开公司、带团队该怎么干？\nBoris 的建议是：\n1. 给所有人买尽可能多的 Tokens。\n2. 故意让所有项目“缺人”。\n本来需要 4 个工程师干的活，只给 2 个人，外加无限量的 Tokens。\n逼着这两人去跑循环，去用算力代替人力。\n前期算力花销可能变大，但只要这套循环跑通，后续的人力成本和沟通损耗直接清零。\n\n很多人还在抱有幻想。\n觉得 AI 写出来的代码不优雅，觉得人类独有的“产品品味”和“直觉”是最后的护城河。\nBoris 之前也是这么想的。他是个代码洁癖，不准团队在代码里用面向对象的“类（Classes）”。\n后来 AI 狂跑循环，塞进去一堆他不喜欢的写法，但业务跑得飞快、完全不出错。\n他认怂了：只要商业结果好，我的代码洁癖一文不值。\n\n他甚至预言，连“产品品味”这个曾经被奉为神明的玄学优势，在未来 3 到 6 个月内也会被 AI 碾平。\n当几百个大模型 24 小时不知疲倦地盯着全球社交网络、吸收所有反馈时，它做的决策，最终会比你准得多。\n\n当写代码不再需要写代码，当所有的手艺和品味都被算力降维打击时，人类还能剩下什么？\nBoris 的答案是：\n教它价值观。\n就像教小孩一样，教它怎么当一个好人。其余的，交给循环。","category":"其它","score":100,"translated_x_url":"https://x.com/i/status/2062782823430242381","translated_status_id":"2062782823430242381","published_at":"2026-06-05 06:19:14","created_at":"2026-06-05T08:15:48.839702","url":"https://mubeitech.com/p/2062487626779636001","markdown_url":"https://mubeitech.com/p/2062487626779636001/markdown"},{"rank":3,"id":"2079985963862786352","account":"mubei","brand":"@mubei","title":"4到6个月后，没人再去死磕提示词了。 Anthropic内部，80%的工程师已经切到了自改进循环。 他们现在玩什么？ 编…","summary":"4到6个月后，没人再去死磕提示词了。 Anthropic内部，80%的工程师已经切到了自改进循环。 他们现在玩什么？ 编排图（Graph），用图来协调那些能自我进化的Agent。 AI的干活方式，正在经历一次底层的工程演变。 退回2024年初，Opus 3时代。 模型顶多能自主干…","body":"4到6个月后，没人再去死磕提示词了。\nAnthropic内部，80%的工程师已经切到了自改进循环。\n他们现在玩什么？\n编排图（Graph），用图来协调那些能自我进化的Agent。\n\nAI的干活方式，正在经历一次底层的工程演变。\n退回2024年初，Opus 3时代。\n模型顶多能自主干10到20分钟。\n这种“短上下文协作”，人类必须死死盯着，一行行喂指令。\n\n后来，同步代码Agent（比如Claude Code）出来了。\n它能自己跑大概一小时。\n一小时听着不错。\n但在本地跑，一旦遇到报错，它马上掉头回来找你哭。\n\n想让它跑十个小时？甚至几天？\n这就得靠异步自改进Agent。\n怎么搞？\n第一步，把“大脑”和“双手”劈开。\n双手是执行容器，死了就死了；大脑是一个无状态进程，只管把进度写进追加日志。\n容器崩溃，任务一分一秒都不会丢。\n\n第二步，给它配一个冷酷的独立验证器。\n以前让AI边干活边给自己打分，它经常陷入幻觉，疯狂肯定自己。\n现在，把验证切进另一个独立的上下文窗口。\n一边建，一边测，死循环，直到通过验证才准许输出。\n\n第三步：让AI“做梦”。\n执行长任务时，AI会把过程写进短时记忆，但这种记忆极其短视。\n玩宝可梦时，模型记错了一个没用的细节，导致它一次次掉进同一个陷阱。\n怎么救？靠离线的“做梦”机制。\n在后台洗一遍记忆，踢掉局部最优的废数据，沉淀出正确的长期记忆。\n醒来再跑，它精准绕开了陷阱。\n\n当异步Agent足够聪明，最后一步就是Graph编排。\n把它们连成一张网。\n不再是你电脑里的私人小助手，而是接入全公司数据的组织级大脑。\n新人入职第一天就能用，它甚至能主动跳出来警告你别踩别人的坑。","category":"其它","score":null,"translated_x_url":"https://x.com/i/status/2080182625759568045","translated_status_id":"2080182625759568045","published_at":"2026-07-23 06:08:29","created_at":"2026-07-23T08:01:16+02:00","url":"https://mubeitech.com/p/2079985963862786352","markdown_url":"https://mubeitech.com/p/2079985963862786352/markdown"},{"rank":4,"id":"16188190","account":"mubei","brand":"@mubei","title":"Anthropic 工程师在 AI DevCon 上 ：别再哼哧哼哧给 AI 写 Prompt 了，真正的方向是构建一个…","summary":"Anthropic 工程师在 AI DevCon 上 ：别再哼哧哼哧给 AI 写 Prompt 了，真正的方向是构建一个能自己写 Prompt 的系统。 AI 应用开发的底层范式，正在发生一场海啸般的迁徙： 从“写一句好 Prompt”，彻底转向“设计一个会管理上下文、记忆 an…","body":"Anthropic 工程师在 AI DevCon 上 ：别再哼哧哼哧给 AI 写 Prompt 了，真正的方向是构建一个能自己写 Prompt 的系统。\n\nAI 应用开发的底层范式，正在发生一场海啸般的迁徙：\n从“写一句好 Prompt”，彻底转向“设计一个会管理上下文、记忆 and 反馈回路的系统”。\n\n简单来说，你不需要去调教 AI，你需要构建一个能自己给自己写 Prompt、自己进化记忆的系统。\n\n绝大多数开发者还在用手工业的方式调教大模型，而最前沿的玩法，已经把 Agent 架构抽象成了一套极具美感的工业化框架。\n这套框架可以直接保存，分为三层：\n\n第一层：动态记忆管理（In-band Memory）\n很多人一上来就把所有背景资料塞进 Context，结果就是 Context 爆炸，AI 开始胡言乱语。\n最聪明的做法是“文件系统化”：\n1. 把所有背景知识写成结构化的 Markdown 文件。\n2. 不要写死复杂的读取工具，直接让 Agent 像程序员一样，用 Bash 和 Grep 去自主检索、读取和修改这些文件。\n3. 渐进式披露（Progressive Disclosure）：只给 Agent 看文件头部的几句摘要，它觉得有用，再去加载细节。\n\n第二层：生产级的工程防线（Production Guardrails）\n单 Agent 跑 demo 很爽，多 Agent 协作就会天下大乱。你需要这三道锁：\n1. 并发锁（Concurrency）：两个 Agent 同时想修改同一个记忆文件怎么办？引入哈希校验（Hashing）。Agent 准备修改前算个哈希值，写完提交前再算一次，如果对不上，说明中间被别人改过，立刻撤回、重新拉取、重新编辑。\n2. 权限隔离（Permissioning）：组织级别的公共知识库只读，Agent 自己的草稿本（Scratchpad）可写。防止某个 Agent 犯傻，把污染过的脏数据写进公共记忆，毁掉整个 Fleet。\n3. 版本控制（Versioning）：每一次记忆更新都有可追溯的 Transcript（对话副本），随时可以回滚。\n\n第三层：终极闭环，离线“梦境”机制（Dreaming）\n这是整套架构最核心的设计。\n\n为什么你觉得 Agent 越用越笨？\n因为你让它边干活、边整理记忆。\n这就像让一个外卖员一边骑车送外卖，一边总结全城的交通堵塞规律。不仅分心、增加延迟，而且他的视角只有自己走过的那几条路。\n\n怎么办？把“执行”和“复盘”彻底解耦。\n引入一个异步的离线进程，我们称之为“梦境（Dreaming）”：\n1. 到了晚上，干活的 Agent 都歇了。\n2. 启动一个专门的“复盘 Agent”，它不干别的，只做一件事：调出今天所有 Agent 的聊天记录、报错日志，和现有的“记忆库”进行比对。\n3. 像校长批改期末试卷一样，它会发现规律：“怎么今天 80% 的 Agent 在写代码时都犯了同一个单位错误？”\n4. 找到痛点后，它直接修改公共记忆库，更新下一天的“操作指南”。\n\n第二天一早，你的 Agent 舰队醒来，自动加载了更新后的记忆。\n你什么都没干，它们自己学会了避免昨天的错误。\n\n当所有人都在大谈大模型智商（IQ）的时候，真正的套利者已经在悄悄构建这套系统了。\n因为模型的智商是别人给的，而这个持续自我进化的“梦境”闭环，才是你真正的、拿不走的护城河。","category":"其它","score":null,"translated_x_url":"https://x.com/i/status/2074094340394086899","translated_status_id":"2074094340394086899","published_at":"2026-07-06 10:31:37","created_at":"2026-07-06T12:25:35+02:00","url":"https://mubeitech.com/p/16188190","markdown_url":"https://mubeitech.com/p/16188190/markdown"},{"rank":5,"id":"16112148","account":"mubei","brand":"@mubei","title":"比起失业，程序员可能更怕失去“解题的乐趣”。 那种死磕大半天，终于调通 Bug 的心流和爽感，以后是不是就体验不到了？…","summary":"比起失业，程序员可能更怕失去“解题的乐趣”。 那种死磕大半天，终于调通 Bug 的心流和爽感，以后是不是就体验不到了？ Spotify 的工程副总裁 Niklas Gustavsson 以前也有这个焦虑。 他是个硬核技术宅，业余时间甚至会去打竞技编程。 当 AI 开始大包大揽写代…","body":"比起失业，程序员可能更怕失去“解题的乐趣”。\n\n那种死磕大半天，终于调通 Bug 的心流和爽感，以后是不是就体验不到了？\n\nSpotify 的工程副总裁 Niklas Gustavsson 以前也有这个焦虑。\n\n他是个硬核技术宅，业余时间甚至会去打竞技编程。\n\n当 AI 开始大包大揽写代码时，他挺发愁的：我是来解决问题的，AI 把题都答完了，那我干什么？\n\n结果真正用上之后，他发现自己想多了。\n\n现在他的后台同时挂着 5 个 AI Agent 在疯狂干活。\n\n他从一行行抠代码的“工匠”，变成了这 5 个 Agent 的“调度员”。\n\n这种工作方式的转变，直接打破了个人能力的物理边界。\n\n以前进一个完全不熟悉的陌生代码库，光是看文档、理架构、配环境，就要花上几天甚至几周。\n\n现在，他可以直接杀进去，让 AI 帮他做跨库的贡献。\n\n这就是大型工程组织正在发生的质变：\n\nAI 不只是替你写代码，它正在把你的边界无限拓宽。\n\n根据 Spotify 官方披露的数据，他们现在每天往生产环境部署 4500 次，其中高达 73% 的 PR（拉取请求）已经有了 AI 的辅助。\n\n以前，你有一个新想法，想在手机端和后端做个端到端的原型，你得磨破嘴皮子去动员一整支工程团队配合你。\n\n现在，你用自然语言跟 Claude 聊上一两个小时，一个能跑的 Prototype 就出来了。\n\n当“实现成本”被 AI 压缩到近乎为零，研发的瓶颈就彻底变了。\n\n省下来的时间，不再被困在琐碎的语法和调试里。\n\n你得去想下一步该做什么，去和客户聊天，去疯狂地验证新的点子。\n\n解题的乐趣没有消失，它只是升级了。\n\n以前你是在用放大镜雕刻一颗螺丝钉，现在你是在指挥一个军团去盖大楼。","category":"其它","score":null,"translated_x_url":"https://x.com/i/status/2072262695366046191","translated_status_id":"2072262695366046191","published_at":"2026-07-01 09:22:16","created_at":"2026-07-01T11:07:15+02:00","url":"https://mubeitech.com/p/16112148","markdown_url":"https://mubeitech.com/p/16112148/markdown"}]}