AI Infrastructure2026-08-27NVIDIA AI Blog

Groq 3 LPX全面量产,英伟达Vera Rubin NVL72扩展推理能力服务智能体

英伟达正在扩展其Vera Rubin NVL72平台,以支持下一波智能体AI浪潮,Groq 3 LPX现已全面量产。这一消息是在一次技术简报中公布的,英伟达强调,AI推理的未来将由AI工厂每一层如何协同工作来定义——而不是靠单一芯片的突破。 智能体AI系统能够规划、推理并执行多步骤任务,相比传统聊天机器人,它们需要显著更快的token生成速度。这类系统往往需要多次调用模型、从外部工具检索信息,并近乎实时地迭代响应。Vera Rubin NVL72的扩展正是为应对这种负载而设计,提供低延迟推理,能跟上复杂智能体工作流的需求。 Groq 3 LPX现已全面量产,是这一战略的关键组成部分。它提供高速token生成,缩短从用户输入到最终输出之间的时间,让智能体系统响应更快、能力更强。这对自主研究、代码生成和客服自动化等应用尤其重要——在这些场景中,延迟会直接毁掉用户体验。 英伟达的做法是整体性的。不是优化单一组件,而是聚焦整个推理流水线——从模型加载到内存访问再到输出流式传输。结果是,平台能应对智能体AI不可预测的多步骤特性,同时不牺牲效率。 对正在构建AI智能体的开发者和企业来说,这意味着可以部署更复杂的系统,而不用担心基础设施瓶颈。随着智能体AI需求增长,搭载Groq 3 LPX的Vera Rubin NVL72有望成为下一波智能自动化时代的基础平台。

相关资讯