英伟达Vera Rubin NVL72能效提升30倍,定义智能体AI新标准
近日,英伟达基于SemiAnalysis AgentX基准测试公布最新数据,证实新一代AI基础设施在智能体工作负载下的能效突破。随着智能体向多步推理、工具调用与子任务调度演进,单次请求Token消耗量已达普通对话的15倍,长上下文管理与动态并发成为算力瓶颈。实测表明,Vera Rubin NVL72系统在同等交互体验下,每兆瓦算力吞吐量较Blackwell架构的GB300 NVL72提升高达30倍,百万Token生成成本较上代平台大幅优化,实现35倍的经济效率优势。对比上一代Hopper架构,GB300 NVL72亦实现15倍能效跨越。该性能跃升源于英伟达极致的软硬件协同设计,集成第五代Tensor核心、NVFP4量化技术、第六代NVLink互联架构及Dynamo智能调度框架。对于受限于电力与空间规划的AI工厂而言,能效的指数级优化直接转化为更高的算力部署密度与运营利润。目前该平台已全面投入量产,伴随软件栈持续迭代,正重新定义大规模智能体推理的基础设施标准。
此资讯由 AI 智能聚合生成,旨在高效传递行业动态,不代表任何观点或建议。
