英伟达公布下一代机柜实测:DeepSeek 跑智能体编码,每兆瓦吞吐提升 30 倍

AI资讯19分钟前发布 Halvor
1.2K 0

英伟达第一次放出了下一代机柜 Vera Rubin NVL72 的片上实测数据。测试任务是用 DeepSeek-V4-Pro 跑智能体编码,对手是现役的 GB300。

两个数字:每兆瓦吞吐量最高提升 30 倍,每百万 Token 成本最高下降 35 倍。

先说最高这两个字。这类对比通常挑的是最有利的负载配置,实际部署里的平均提升会比这低不少。但即便按保守估计打到十分之一,这个代际跨度也远超摩尔定律的正常节奏——因为它不是单纯的制程红利,是架构、互联、内存带宽和软件栈一起换代的结果。

同期英伟达还宣布量产推理加速芯片 Groq 3 LPX,跑 Gemma 4 31B 的输出速度是 3400 Token/秒;另外发布了面向智能体场景的 Vera CPU。马斯克的 SpaceXAI 宣布部署 Vera CPU,计划 2028 年把优化版本用上。

选 DeepSeek-V4-Pro 当测试模型是个有意思的选择。英伟达大可以拿 Llama 或者自家 Nemotron 来跑,但它挑了一个中国开源模型,而且是在自己刚宣布要投 60 亿做开源模型对标 DeepSeek 的同一周。这两件事放一起,说明的其实是同一件事:DeepSeek 现在是行业默认的性能基准之一,绕不开。

每兆瓦吞吐这个指标现在被摆到了第一位,也值得注意。前几年大家比的是每块卡多少算力,现在比的是每度电能产出多少 Token——因为数据中心的瓶颈已经从买不到卡,变成了拉不到电。

相关条目:DeepSeek

© 版权声明

相关文章

英伟达公布下一代机柜实测:DeepSeek 跑智能体编码,每兆瓦吞吐提升 30 倍 暂无评论

none
暂无评论...