其它·via @mubei·100.0 分
都在拼命卷大模型的上下文窗口? 谷歌核心人物 Jeff Dean 刚刚泼了一盆冷水。 盲目追求一万亿 token 的吞吐…
都在拼命卷大模型的上下文窗口? 谷歌核心人物 Jeff Dean 刚刚泼了一盆冷水。 盲目追求一万亿 token 的吞吐量完全没必要。
大模型确实极其依赖投喂的信息。 你想让它处理全网所有文档。 你想让它读完你这辈子所有的邮件和照片。 这绝对是个极其庞大的数字。 目前主流的一百万 token 容量连塞牙缝都不够。
这要怎么解? 暴力扩容死路一条。 Jeff Dean 给出的答案是“分阶段检索”。 先用极轻量级的机制快速过一遍底库。 把一万亿个 token 粗筛出一两千万。 再精筛出最核心的一百万。
最后只把这一百万喂给上下文窗口。 机器根本不需要同时处理一万亿条数据。 它只要准确找到最关键的那一百万条。
算力狂飙的方向已经变了。 下半场拼的是过滤废话的能力。
翻译视频 / X
相关 / RELATED
JSON- M科技在两张显卡上跑一个 27B 参数的大模型,跑出了每秒 135 个标记的惊人速度
- M100万token的上下文窗口,听起来很唬人。 但把资料全塞进去,只会让AI变笨。 上下文窗口从来不是仓库,而是一笔注意…
- MAndrej Karpathy揭开了一个反直觉的行业真相。 现在的AI模型动辄上万亿参数,根本不需要这么大的“脑容量”。…
- M“模型,已经不再是产品了。” 说这话的,是 OpenAI 的联合创始人 Greg Brockman,和 Perplexi…
- M未来的AI护城河可能不在模型。 能让几十亿人天天用、还不会崩溃的底层基础设施,才是关键。 谷歌DeepMind首席执行官…
- M谷歌一口气点亮了 96 万张 Rubin GPU 的跨站点集群。 AI 算力牌桌上的筹码规模被强行拉升。 先盘点一下对手…
导出 / EXPORT
订阅 · SUBSCRIBE
每周一封信号简报,重大进展可选即时推送。