快讯 23:54PS2初代安全芯片MechaCon被破解,爱好者耗时四年攻克26年谜题23:47古特雷斯呼吁全球协作管控AI风险,联大高级别周将成关键节点23:07华邦电子11.2亿美元接手英飞凌NOR与F-RAM业务,飞索半导体品牌将重启 全部快讯 →
深度观察 新大陆研究院 约 2 分钟读完 素材来源 IT之家

英伟达DSX MaxLPS功耗调度系统亮相,AI工厂每兆瓦token吞吐量提升最高40%

英伟达在AI基础设施峰会上展示DSX MaxLPS功耗调度系统,可将AI工厂每兆瓦token吞吐量最高提升40%。该系统已集成至Emerald AI的Conductor平台,Lambda测试显示固定功率预算下token吞吐量提升24%,每瓦性能提升23%。

在近日举行的AI基础设施峰会上,英伟达向外界展示了其面向AI工厂场景的功耗调度系统DSX MaxLPS。据科技媒体Wccftech报道,该系统能够将AI工厂的每兆瓦token吞吐量最高提升40%。所谓每兆瓦token吞吐量,是指数据中心在消耗1兆瓦电力时,AI系统每秒可生成或处理的token数量。这一指标将功耗纳入考量,因而更能反映AI数据中心在电力受限条件下的实际产出能力。

从技术落地路径来看,DSX MaxLPS已由Emerald AI集成至其Conductor平台,用于在电网条件下对数据中心负载进行编排。该平台中的DSX Flex模块可根据电网状态动态调整数据中心的用电需求。目前平台已接收200次电网状态信号,所有相关操作均无需用户干预,实现了自动化响应。

云服务商Lambda的测试结果为这套系统提供了实际验证。Lambda是一家GPU云服务商,客户数量超过10,000家。其测试集群包含5个机架和19个节点。在与16个节点满功率运行相同的功率预算下,19个节点的集群吞吐量从约每秒400万个token提升至每秒500万个,增幅达24%,每瓦性能提升23%。这意味着在电力预算不变的前提下,系统能够输出更多有效算力。

英伟达同时披露,Vera Rubin和Groq 3 LPX机架在相同站点功耗范围内也取得了相应表现。随着AI数据中心规模持续扩张,电力供给日益成为制约算力输出的关键瓶颈,如何在既定功耗下最大化token产出,正成为基础设施厂商竞争的新焦点。

英伟达AI基础设施功耗调度数据中心
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
41
企业落地案例
5
完整版提示词