Copied


NVIDIA展示Vera Rubin平台如何提升AI工厂效率

realtime news   Sep 15, 2026 19:30 1 Min Read


NVIDIA在2026年9月15日于圣克拉拉会议中心举行的AI基础设施峰会上,展示了AI基础设施领域的重大进展。本次峰会吸引了超过8,000名与会者——是去年活动规模的两倍多。NVIDIA重点介绍了Vera Rubin平台和DSX MaxLPS技术,这些技术是实现高能效AI工厂运营的基石。

NVIDIA负责超大规模和高性能计算的副总裁Ian Buck强调了优化“每瓦特生成的标记数”(tokens per watt)这一新指标的重要性,这是评估AI基础设施效率的新方式。随着智能化AI工作负载对可扩展性和性能的需求不断增加,NVIDIA通过从芯片到软件的全栈解决方案,旨在使AI工厂更加高效且经济可行。

关键公告:能源优化与性能提升

在此次峰会上的重要公告之一是NVIDIA DSX MaxLPS,这是一个电力优化系统,可以动态地在GPU和机架之间重新分配能源。AI云服务提供商Lambda展示了其成果,性能每瓦提升了23%。通过在16个能源节点的基础上运行19个节点,Lambda实现了24%的标记吞吐量增加,展现了该系统在现有能源限制下提升效率的能力。

Vera Rubin平台本身专为智能化AI设计,这些模型可以执行复杂任务,例如多步骤推理和工具调用。NVIDIA的Groq 3 LPX技术与之相辅相成,提供决定性的低延迟推理,特别适用于像Qwen 3.8这样的长上下文模型。据报道,这些创新将每兆瓦标记吞吐量提升至上一代系统的35倍,显著降低了大型推理工作负载的能源成本。

作为电网响应系统的AI工厂

一个引人注目的发展是Emerald AI与硅谷电力公司的合作。借助NVIDIA的DSX Flex软件,Emerald展示了电网响应型AI负载,这些负载能够在高峰需求期间自动减少电力使用,同时不影响关键工作负载。这种灵活负载计划可以使AI工厂成为动态电网资源,在维持生产力的同时支持能源稳定性。

为什么重要

NVIDIA的Vera Rubin平台是针对AI工厂日益上升的运营成本(其中电力通常是最大开支)而提出的解决方案。通过将数据中心视为统一的计算单元,并集成诸如NVLink互联和Spectrum-X网络等技术,该平台承诺实现显著的效率提升。根据NVIDIA的说法,与旧架构相比,Vera Rubin系统可以将智能化工作负载的每兆瓦吞吐量提高30倍,从而降低标记生产成本并提高运营商的盈利能力。

经济影响显而易见。截至2026年9月15日,AI市场市值已超过5万亿美元,而NVIDIA通过长期合作伙伴关系(例如6月与Safe Superintelligence Inc.的协议)巩固了其在AI基础设施领域的领导地位。对于投资者而言,对能源效率和可扩展性的关注可能会强化NVIDIA在快速扩展行业中的竞争优势。

未来展望

随着Vera Rubin系统全面投产,NVIDIA计划通过工具如DSX AI工厂参考设计和Omniverse DSX数字孪生模拟加速其采用。这些资源旨在帮助运营商优化电力、冷却和网络配置,从而缩短AI工厂的部署时间。

随着对高能效AI基础设施的转向,NVIDIA似乎已经为下一波智能化AI工作负载的需求做好了充分准备。投资者和行业利益相关者将密切关注这些技术在广泛商业应用中的性能指标和采用率。


Read More