AI 芯片的竞争,正在从「单卡性能」转向一个更现实的问题:每度电能跑出多少 token。Nvidia 最新公布的数据显示,下一代 Vera Rubin NVL72 在 DeepSeek V4 Pro 的 1.6 万亿参数模型上,每兆瓦 token 吞吐量是 Blackwell 的 7 倍。
Nvidia 的新算账方式
具体数字是:在每人每秒 100 token 的假设下,Rubin 每兆瓦能输出 5940 万 token/秒,而 GB300 只有 2850 万。Nvidia 还顺势抛出一个新指标——「每吉瓦年利润」:Rubin 约 1499 亿美元,GB300 约 1053 亿。这显然是冲着「电力和产能才是瓶颈」这个行业痛点去的,因为功耗正是每个买家本月都在撞的墙。
需要说明的是,Vera Rubin 是 Nvidia 继 Blackwell 之后的下一代架构(以天文学家薇拉·鲁宾命名),而「7 倍」是建模推算值,并非实测。但即便打对折,也足以解释为什么所有超大规模客户都在 Blackwell 还没折旧完之前,就抢着下单 Rubin——电力配额有限,谁的单位能耗产出更高,谁就能在同样的大楼里服务更多用户。
Meta 自研芯片加速
另一边,Meta 确认其自研 MTIA 450 芯片将在 2027 上半年量产、MTIA 500 在 2027 年底跟进:前者 HBM 带宽比上代翻倍,后者再提升 50%、HBM 容量最高增加 80%,主打相比 GPU 约 44% 的 TCO(总拥有成本)节省,配合约 1150 亿美元的资本开支计划。
一个共同点是:内存成了所有自研芯片的核心。Meta 加 HBM、Positron 上周推出 2304GB/片,都指向同一个结论——现在短缺的不是算力,而是内存。
还有一家搅局者
值得注意的还有 Cornelis:这家公司融资 2.05 亿美元,做的是「GPU 无关」的互连层,对标 InfiniBand 和 NVLink,400Gbps 的 CN5000 已上市,800Gbps 的 CN6000 四季度出货。它的意义在于,让买家能把 Nvidia、AMD 和自研芯片混在同一集群里。
对普通用户而言,这些变化最终会体现在两件事上:AI 服务的成本继续下降,以及更长的可用时间。持续追踪 AI 工具与基础设施动态,欢迎访问 AI Dash。
