---
id: "mb-20260907-2c9d31"
kind: "deep"
title: "Supermicro 上架了一台桌面 AI 工作站，标价 92,887 美元"
topic: "Supermicro 上架了一台桌面 AI 工作站，标价 92,887 美元"
source_type: "generated"
status: "published"
generated_at: "2026-09-07 16:25:55"
frame_type: ["一致性内存架构（Coherent Memory", "机制"]
legal_anchor_count: 0
transcript_citation_count: 0
---

# Supermicro 上架了一台桌面 AI 工作站，标价 92,887 美元

Supermicro 上架了一台桌面 AI 工作站，标价 92,887 美元。
折合人民币将近 67 万。
这价格能买一辆崭新的保时捷 911，或者买 7 台顶配 256GB 内存的苹果 Mac Studio。
很多人第一反应是荒谬：
把一台电脑卖到 9 万多美元，谁会买？
为什么不把这笔钱拿去租云端算力，或者直接调商业大模型的 API？

参数表很吓人：72 核 Grace CPU、Blackwell Ultra GPU、20 PFLOPS 算力、88 磅重量。
但参数过两年就会贬值。
真正值 9 万美元的，是它底下两台被彻底重构的物理与经济机器。

第一台机器，叫一致性内存。
它解决的是计算机体系里一道撞了三十年的老坎。
1995 年，两位计算机学者 Wulf 和 McKee 发了一篇著名论文，把这道坎命名为内存墙。
过去几十年，电脑芯片的算力涨得飞快，但内存把数据喂进芯片的速度远远跟不上。
更致命的是结构割裂：
CPU 有自己的内存，GPU 有自己的显存。
两块地盘各自为政，中间只靠一条狭窄的 PCIe 通道连着。
平时跑小程序没问题。
一旦要跑万亿参数的超大模型，显存塞不下，数据就必须在 CPU 和 GPU 之间来回搬运。
结果就是，算力芯片大部分时间根本不是在算，是在干等数据挪过来。
这台 GB300 工作站的物理结构，把这个孤岛炸平了。
它把 252GB 的高带宽显存和 496GB 的系统内存，用每秒 900GB 的 NVLink-C2C 高速通道缝在了一起。
整整 748GB 内存，变成了一个完全互通的一致性内存池。
CPU 和 GPU 随时共享同一个地址，不再需要把数据拷来拷去。
那笔交了三十年的数据搬运税，在桌面上被免掉了。

第二台机器，是代币边际成本的买断。
这才是企业和顶尖实验室算得最精的一笔账。
如果只是偶尔写几句代码，调云端 API 确实便宜。
但现在的 AI 正在从一问一答，变成 24 小时不停运转的自主智能体。
智能体在后台自主规划、反复推理、自我纠错。
每秒钟都在疯狂吞吐上下文。
在云端，每一个代币都是跳表的租金。
一旦智能体集群全天候跑起来，每天消耗上亿代币，云端账单就是一个没有尽头的无底洞。
而这台工作站提供的是本地每秒 1200 个代币的吞吐能力。
配上一个 1600W 的钛金电源，它插在办公室墙上的插座就能跑。
每天本地喷出上亿个代币，除了电费，边际成本是零。
它把云端永无止境的按量抽税，变成了一笔一次性的固定资产投资。

所以别把它当成一台昂贵的个人电脑。
它在物理上绕开了 1995 年的物理内存墙，在商业上买断了云巨头的代币租金。
当核心研发数据永远不需要离开自己的桌子，当千万次推理不再需要看云厂商的账单脸色，
9 万美元买的从来不是机箱和风扇。
买的是把算力主权握在自己手里的入场券。

_Rendered by mubei-terminal._
