AI Infrastructure2026-09-17NVIDIA AI Blog

英伟达Vera Rubin NVL72首秀MLPerf推理榜登顶

英伟达宣布,Vera Rubin NVL72系统在MLPerf Inference v6.1的首秀中取得了领先结果。MLPerf Inference是衡量AI系统处理真实推理负载时有多快、多高效的基准测试。英伟达这次不只是把它当成一次速度纪录,而是当作一个信号:推理性能正在成为AI工厂的核心经济指标。 在这个逻辑里,吞吐量每提升一点,单位时间生成的token就更多,直接关系到那些对外卖模型访问、或跑大规模AI服务的运营方能赚多少钱。 英伟达同时强调,系统级表现和单颗芯片的规格一样重要。Vera Rubin NVL72定位为机架级平台,它的基准成绩反映的是GPU、网络、内存和软件协同推进的结果。 第二个支柱是基础设施的高效扩展:客户加硬件时,吞吐量应当可预期地增长,而不是因为某个瓶颈提前见顶。第三个支柱是持续的软件优化,让已经部署的系统不用换硬件就能随时间变强。 这次MLPerf首秀给客户提供了一个标准化的参照,用来把英伟达的说法和竞品系统放在一起比。它也在释放一个信号:AI基础设施的竞争,正从拼训练速度转向拼推理经济学。 对企业和云厂商来说,结论是——现在选推理平台,要在性能、扩展效率、软件成熟度和每token总成本之间做权衡。随着AI负载从试验走向大规模生产,英伟达这份成绩大概率会让这场讨论更热。

相关资讯