Techub News 消息,NVIDIA 发布 Vera Rubin NVL72 系统的早期性能数据。数据显示,在运行 AI 代理工作负载时,该系统每兆瓦的吞吐量比 NVIDIA GB300 NVL72 系统高出高达 30 倍,同时每百万个令牌的成本降低高达 35 倍。 性能测试基于 SemiAnalysis AgentX 工作负载进行,该负载模拟了现实世界的代理编码会话,保留了实际上下文增长、工具调用和子代理生成。对于受电力限制的 AI 工厂而言,这意味着在相同能耗下可完成多达 30 倍的代理工作。 NVIDIA 表示,其 DSX MaxLPS 技术可在 GPU、机架和工作负载级别管理功耗,从而在相同的兆瓦预算内调配多达 40% 的 GPU,进一步提升了 AI 工厂规模的每兆瓦吞吐量。 (NVIDIA Blog)

如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,NVIDIA 发布 Vera Rubin NVL72 系统的早期性能数据。数据显示,在运行 AI 代理工作负载时,该系统每兆瓦的吞吐量比 NVIDIA GB300 NVL72 系统高出高达 30 倍,同时每百万个令牌的成本降低高达 35 倍。 性能测试基于 SemiAnalysis AgentX 工作负载进行,该负载模拟了现实世界的代理编码会话,保留了实际上下文增长、工具调用和子代理生成。对于受电力限制的 AI 工厂而言,这意味着在相同能耗下可完成多达 30 倍的代理工作。 NVIDIA 表示,其 DSX MaxLPS 技术可在 GPU、机架和工作负载级别管理功耗,从而在相同的兆瓦预算内调配多达 40% 的 GPU,进一步提升了 AI 工厂规模的每兆瓦吞吐量。 (NVIDIA Blog)

如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。