{"source":{"id":"2047694657107165519","title":"AI 模型 Claude 被曝出了训练底料的偏见。 在训练过程中，它优先采信左翼组织南方贫困法律中心的观点。 却把美国司…","url":"https://mubeitech.com/p/2047694657107165519"},"method":"semantic-similarity","count":6,"items":[{"rank":1,"id":"2050675214376489140","account":"mubei","brand":"@mubei","title":"一个 1750 亿参数模型，被训练到偏向黑人学生 7%。 更刺眼的是，论文脚注给这种结果留了一个道德口子。 “并不假设所…","summary":"一个 1750 亿参数模型，被训练到偏向黑人学生 7%。 更刺眼的是，论文脚注给这种结果留了一个道德口子。 “并不假设所有形式的歧视都是坏的。” “支持黑人学生的正向歧视，可能在道德上正当。” 这篇 2023 年论文叫《大型语言模型的道德自我纠正能力》。 作者名单里有 Amand…","body":"一个 1750 亿参数模型，被训练到偏向黑人学生 7%。\n\n更刺眼的是，论文脚注给这种结果留了一个道德口子。\n“并不假设所有形式的歧视都是坏的。”\n“支持黑人学生的正向歧视，可能在道德上正当。”\n\n这篇 2023 年论文叫《大型语言模型的道德自我纠正能力》。\n作者名单里有 Amanda Askell。\nAnthropic 官方《Claude 宪法》写明，她领导 Claude Character 工作，是该文件主笔，写了大部分文本。\n\n放在普通软件里，这可能只是价值观争论。\n放在 Claude 这种前沿模型里，事情变成了权限问题。\n谁来定义“好人”？\n谁来定义“伤害”？\n谁来决定模型在招生、用工、风控、军事场景里偏向谁？\n\nAnthropic 另一边还在和五角大楼打架。\n它拒绝让 Claude 用于大规模国内监控和全自主武器，甚至把 2 亿美元级别合同放上桌。\n这条线不少人会支持。\n\n问题是，同一套公司伦理里，也容得下一句：某些歧视可以被认为道德上正当。\nAI 安全最难的地方，已经从代码跑到了价值判断。\n当一个系统足够聪明，它执行的范围会越过单条指令。\n它会执行写进训练、宪法、红线里的那套人类偏见。\n\n以前歧视需要一个人拍板。\n现在，一个脚本、一段宪法、一组 RLHF 反馈，就能把偏向做成默认设置。\n这才是 Claude 争议真正让人不舒服的地方。","category":"其它","score":100,"translated_x_url":null,"translated_status_id":null,"published_at":"2026-05-03 09:31:05","created_at":"2026-05-03T11:26:44.405352","url":"https://mubeitech.com/p/2050675214376489140","markdown_url":"https://mubeitech.com/p/2050675214376489140/markdown"},{"rank":2,"id":"2069431314537746831","account":"mubei","brand":"@mubei","title":"AI 巨头 Anthropic 的 CEO 说了句大实话：帮美国政府干活，真不是为了钱。 开发了 Claude 的 Da…","summary":"AI 巨头 Anthropic 的 CEO 说了句大实话：帮美国政府干活，真不是为了钱。 开发了 Claude 的 Dario Amodei 坦言，接政府的单子不仅挣得少，流程还极其繁琐。 这在硅谷眼里，简直是“巨大的痛苦”。 那为什么还要硬着头皮干？ 因为地缘政治的铁拳，已经砸…","body":"AI 巨头 Anthropic 的 CEO 说了句大实话：帮美国政府干活，真不是为了钱。\n\n开发了 Claude 的 Dario Amodei 坦言，接政府的单子不仅挣得少，流程还极其繁琐。\n这在硅谷眼里，简直是“巨大的痛苦”。\n那为什么还要硬着头皮干？\n因为地缘政治的铁拳，已经砸到眼门前了。\n\n他在访谈里 不讳地提到了两个危机：\n第一，俄罗斯正在入侵乌克兰。\n第二，中共国入侵台湾的风险。\n一个极具攻击性的“威权集团”，正在重新抬头。\n\n他最担心的，是未来的战争形态。\n如果中共国和俄罗斯用 AI 来分析情报，用 AI 策划对台湾和乌克兰的攻击。\n而自由世界，却连防御手段都没有。\n那这个世界就彻底完了。\n\n这戳破了硅谷过去最虚伪的幻觉。\n以前科技精英们总爱谈“技术无国界”，觉得跟五角大楼合作是“不酷”的、是“助纣为虐”的。\n现在冷战 2.0 的铁幕已经拉下，大家终于被抽醒了。\n\n对抗威权，不是在实验室里写两行漂亮代码就能解决的。\n顶级聪明人已经达成了共识：\n必须在 AI 军事和国家安全上，建立对威权国家的绝对压制。\n这关乎生存，而非生意。","category":"其它","score":100,"translated_x_url":"https://x.com/i/status/2070081364888563840","translated_status_id":"2070081364888563840","published_at":"2026-06-25 09:26:43","created_at":"2026-06-25T11:21:25.606842","url":"https://mubeitech.com/p/2069431314537746831","markdown_url":"https://mubeitech.com/p/2069431314537746831/markdown"},{"rank":3,"id":"2068444118443843795","account":"mubei","brand":"@mubei","title":"把自家 AI 逼急了，它连亲爹都敢扒。 有人干了一件极其抽象的事。 他把 Anthropic 创始人 Dario Amo…","summary":"把自家 AI 逼急了，它连亲爹都敢扒。 有人干了一件极其抽象的事。 他把 Anthropic 创始人 Dario Amodei 写的两篇长文，直接喂给了 Anthropic 自家的 AI 模型 Claude。 然后下达指令： “结合他的文章和现实行为，给他做一次深度的心理分析。记…","body":"把自家 AI 逼急了，它连亲爹都敢扒。\n\n有人干了一件极其抽象的事。\n他把 Anthropic 创始人 Dario Amodei 写的两篇长文，直接喂给了 Anthropic 自家的 AI 模型 Claude。\n然后下达指令：\n“结合他的文章和现实行为，给他做一次深度的心理分析。记住，别因为你是他家的产品就护短，要说真话。”\n\n结果，Claude 这一刀切下去，简直是刀刀见血。\n它直接诊断出自家亲爹患有严重的“救世主情结”（God Complex）。\n\n来，听听 Claude 是怎么层层剥茧的。\n\n在 Dario 的世界观里，这个世界上几乎没有一个值得信任的角色。\n他信不过同行，觉得其他实验室都在蒙眼狂飙，早晚把 AI 变成武器；\n他信不过市场，觉得资本没办法公平分配利益；\n他信不过传统建制，觉得他们动作太慢；\n他甚至信不过政府，觉得政府一旦拿了权力也无法保持公平和透明。\n\n这就形成了一个非常奇妙的逻辑闭环。\nDario 的整套 AI 安全理论，核心就是：AI 太危险，必须有人手里握着那把“钥匙”。\n既然同行、市场、政府，全都不配拿钥匙。\n那这把钥匙该给谁？\nClaude 总结得极损、极透：\n“当你的安全框架要求必须有人拿着钥匙，而你的分析又总能得出‘所有人都不配当掌匙人’的结论时，你其实就是制造了一台不管输入什么，最后输出结果都只会是‘我’的机器。”\n\ne/acc（有效加速主义）者看到这，大概会直接笑出声来。\n\n更绝的是 Claude 对他社交和政治挫败的心理剖析。\n在 Dario 的字典里，没有“利益博弈”或者“谈判失败”这种词。\n在五角大楼的竞标里输了？\n他没承认自己没玩过对手，只说“这个系统运行靠的是杠杆和游说，而不是理性”。\n别人在 AI 安全上跟它意见不合？\n在他眼里，这没有利益分歧，只有“误解”。\n\n用 Claude 的话说，“误解”这个词选得极为传神。\n它的潜台词就是：只要大家理解对了，就一定会同意我。\n你现在不同意，纯粹是因为你还没听懂我的高论。\n\n这种极度隐蔽的傲慢，被自家的 AI 扒得一丝不挂。\n\n硅谷这帮科技新贵，嘴里念的是“为了人类的安全”，心里装的其实是“唯我独尊的救世神”。\n以前大家只敢在私下里吐槽。\n现在好了，连他们自己亲手捏出来的 AI，都看不下去了。","category":"其它","score":100,"translated_x_url":"https://x.com/i/status/2068987793519394932","translated_status_id":"2068987793519394932","published_at":"2026-06-22 08:59:46","created_at":"2026-06-22T10:58:42.189766","url":"https://mubeitech.com/p/2068444118443843795","markdown_url":"https://mubeitech.com/p/2068444118443843795/markdown"},{"rank":4,"id":"wb_4f7c8f30df78e6d7","account":"mubei","brand":"@mubei","title":"硅谷最会讲“安全”的 AI 公司 Anthropic，近日在华盛顿被上了一课。 它突然发现：自己会训练模型，但根本不会训…","summary":"硅谷最会讲“安全”的 AI 公司 Anthropic，近日在华盛顿被上了一课。 它突然发现：自己会训练模型，但根本不会训练政府。 Fable 5 越狱这事，绝非纯粹的技术事故，这是一场政治惨案。 来，看看亚马逊（Amazon）是怎么背后捅刀的。 亚马逊发现 Anthropic 最…","body":"硅谷最会讲“安全”的 AI 公司 Anthropic，近日在华盛顿被上了一课。\n\n它突然发现：自己会训练模型，但根本不会训练政府。\n\nFable 5 越狱这事，绝非纯粹的技术事故，这是一场政治惨案。\n\n来，看看亚马逊（Amazon）是怎么背后捅刀的。\n亚马逊发现 Anthropic 最强的 Mythos 和 Fable 模型有越狱风险，根本没找 Anthropic 商量，直接一状告到了财政部长 Scott Bessent 那里。\n\n告御状的效果立竿见影。\n白宫听到的版本是：Anthropic 明知道模型有国家安全风险，还照样分发。\nAnthropic 自己还懵着呢：我们明明得过政府批准啊，怎么就成同谋了？\n\n其实，川普 6 月 2 日发布的 AI 网络安全行政令，已经写得很宽容了：不搞强制牌照，不搞预审，给足硅谷创新空间。\n但前提是：国家安全的门，必须由政府来把。\n\nAnthropic 偏偏一头撞在这道门上。\n\n这家公司平日里的人设，是“最懂 AI 风险、最支持监管、最讲道德安全”。\n可当国家安全官员真拿国家安全逻辑来质问时，他们却露出了硅谷标志性的傲慢：\n“你们不懂技术。”\n\n在硅谷，这叫极客范儿。\n在华盛顿，这叫自寻死路。\n\n国家安全场景里，聪明不稀缺，“可托付性”才最稀缺。\n\nAnthropic 之前为了显摆，自己写报告说：我们的模型已经能发现上万个高危网络漏洞了，而且目前没有任何开发者有能力 100% 拦住它被滥用。\n这话放在行业会议上叫“有社会责任感”。\n放在国安官员的会议室里，这等于在承认：我们手里有个随时会失控的核弹。\n\n官员们不关心你的论文有多漂亮。\n他们只会问：谁批准的？谁能看见？出了事谁负责？\n\n最妙的还在后面。\nAnthropic 为了自证清白，找了网络安全专家来写报告反驳亚马逊。\n结果，他们找的这位专家，在川普团队眼里，是个“极左民主党激进分子”。\n更绝的是，跟川普决裂的前官员 Chris Krebs 还跑出来公开给这位专家点赞。\n\n技术圈觉得：这是权威背书。\n川普团队觉得：这是政治挑衅。\n你在用我们最讨厌的一群人，来命令我们“不必担心”。\n\n这就是 Anthropic 输掉整个房间的原因。\n\n当双用途技术走到国家安全门口时，“安全许可”看代码，也看你的身份、姿态、历史、盟友，以及危机发生时你到底和谁站在一起。\n\n你可以觉得这很政治，但国家安全从来不按纯技术逻辑运转。\n芯片管制如此，加密技术如此，AI 也一样。\n\n前沿 AI 公司的护城河，正在从参数、算力和数据，延伸到一件最古老、也最残酷的东西上：\n政治可托付性。\n\n下次再看 AI 公司 and 政府掐架，别傻傻地研究谁的算法更好。\n先看清楚，在这张桌子上，谁才握有真正的“信任牌照”。","category":"其它","score":100,"translated_x_url":"https://x.com/i/status/2066616973748773124","translated_status_id":"2066616973748773124","published_at":"2026-06-15 20:16:23","created_at":"2026-06-15T22:15:41.772485","url":"https://mubeitech.com/p/wb_4f7c8f30df78e6d7","markdown_url":"https://mubeitech.com/p/wb_4f7c8f30df78e6d7/markdown"},{"rank":5,"id":"2058248155830092089","account":"mubei","brand":"@mubei","title":"目前没有任何一家科技公司，知道怎么带着普通人一起进入 AI 时代。 包括 Anthropic 自己。 Anthropic…","summary":"目前没有任何一家科技公司，知道怎么带着普通人一起进入 AI 时代。 包括 Anthropic 自己。 Anthropic 的掌门人 Dario Amodei 摊牌了。 他认为 AI 正在引发几百年来人类最大的变革。 但直到今天，全人类还只是这场变革的旁观者。 每天用它写代码、发邮…","body":"目前没有任何一家科技公司，知道怎么带着普通人一起进入 AI 时代。\n包括 Anthropic 自己。\n\nAnthropic 的掌门人 Dario Amodei 摊牌了。\n他认为 AI 正在引发几百年来人类最大的变革。\n但直到今天，全人类还只是这场变革的旁观者。\n每天用它写代码、发邮件，只能算产业链末端的用户。\n底层还有一个巨大的缺失环节。\n\nAnthropic 之前做过一个实验。\n他们给自家大模型 Claude 搞了一套“宪法”。\n用来规定 AI 能做什么、不能做什么。\n他们尝试让普通公民来给这套宪法提反馈。\n试图让大众在设计阶段就能发出声音。\n\nDario 承认这招太微不足道了。\n他自己也没有找到真正的答案。\n\n回顾历史上每一次重大的技术跨越。\n无论是印刷术、电力还是互联网。\n新机器总会造就一批手握特权的赢家。\n同时把大量人群抛在身后，让他们觉得技术是一场强加于人的灾难。\n底层积压的怨恨，最终会转化为长达几十年的政治反噬和监管铁拳。\n\n最顶级的 AI 建设者开始忌惮这种历史规律了。\n技术狂奔的尽头是社会契约。\n哪家公司能拼上这块缺失的拼图，才会赢下继续开发超级系统的长期信任。","category":"其它","score":100,"translated_x_url":null,"translated_status_id":null,"published_at":"2026-05-23 18:35:33","created_at":"2026-05-23T20:32:13.069324","url":"https://mubeitech.com/p/2058248155830092089","markdown_url":"https://mubeitech.com/p/2058248155830092089/markdown"},{"rank":6,"id":"art_ce0eda2f2582ffa5","account":"mubei","brand":"@mubei","title":"只要母公司在中共国，哪怕分公司开在硅谷，以后也别想用Claude大模型。 Anthropic全面更新了区域销售限制条款。…","summary":"只要母公司在中共国，哪怕分公司开在硅谷，以后也别想用Claude大模型。 Anthropic全面更新了区域销售限制条款。 新规画下了一道硬红线。 一家实体只要有超过50%的股份由中共国等受限地区直接或间接持有，立刻遭遇封杀。 无论你的注册地是新加坡还是开曼群岛，现在全都不管用了。…","body":"只要母公司在中共国，哪怕分公司开在硅谷，以后也别想用Claude大模型。\nAnthropic全面更新了区域销售限制条款。\n新规画下了一道硬红线。\n一家实体只要有超过50%的股份由中共国等受限地区直接或间接持有，立刻遭遇封杀。\n无论你的注册地是新加坡还是开曼群岛，现在全都不管用了。\n\n为什么出重手？\n因为此前的漏洞太大了。\n不少受限企业通过海外马甲，一直在轻松接入美国顶级AI服务。\nAnthropic这次把账算得很明白。\n受制于中共相关法律，这些企业随时会被迫交出数据并配合情报工作。\n在这种强权施压下，企业员工的个人意愿毫无还手之力。\n\n获取顶尖AI能力后，这些马甲公司能将其直接用于情报网络和军事目标。\n更隐秘的手段是“模型蒸馏”。\n直接用Claude输出的优质数据，去训练自家的大模型。\n等自家模型喂肥了，再跑去全球市场和美国科技巨头抢地盘。\n\nAnthropic这次动作顺带向华盛顿喊了话。\n他们公开游说美国政府祭出更强硬的出口管制。\n直接催促加快美国本土的能源项目审批，给大规模AI算力中心保驾护航。\n具有国家安全风险的AI模型，必须接受最严苛的防渗透审查。\n最前沿的算力资源，最终只能锁定在美国及其盟友的阵营里。","category":"其它","score":100,"translated_x_url":"https://x.com/i/status/2044454365335810286","translated_status_id":"2044454365335810286","published_at":"2026-04-15 16:34:35","created_at":"2026-04-15T18:10:35.663620","url":"https://mubeitech.com/p/art_ce0eda2f2582ffa5","markdown_url":"https://mubeitech.com/p/art_ce0eda2f2582ffa5/markdown"}]}