其它·via @mubei

AI芯片的下一步不再是单纯堆算力,直接把模型结构“刻”进硅片成了新方向。 谷歌正在开发一款内部代号为“Frozen v2…

AI芯片的下一步不再是单纯堆算力,直接把模型结构“刻”进硅片成了新方向。

谷歌正在开发一款内部代号为“Frozen v2”的新AI芯片。 它的核心思路,就是把Gemini架构的一部分,直接烧进硬件的物理层里。 为什么要这么干? 过去大家都在拼命加速矩阵计算,但其实现在的瓶颈,在于数据在内存和计算单元之间来回搬运。

数据搬运不仅耗电,还极大地拖慢了速度。 把模型结构写进硅片,数据就不用再做繁杂的路径决策,直接省掉了大量的数据移动过程。 如果这条路走通,它运行Gemini模型的效率,可能会比谷歌目前最新的TPU还要高出6到10倍。

翻译视频 / X

导出 / EXPORT