扫码下载
搜索“Vera Rubin”共有10条相关结果
Techub News 消息,AI 云服务提供商 CoreWeave 已部署多机架 Nvidia Vera Rubin NVL72 集群。受此消息影响,CoreWeave 股价上涨 14%。该集群的快速部署可能重塑云服务领域的竞争格局,推动创新和需求增长。 (Crypto Briefing)
Techub News 消息,英伟达超大规模与高性能计算副总裁 Ian Buck 在 AI Infra 峰会上介绍了 AI 工厂效率的最新进展。会上,英伟达与亚马逊 Annapurna Labs 在 NVHBM 高带宽内存技术、与 d-Matrix 在 NVLink Fusion 平台集成方面达成合作。此外,Emerald AI 与硅谷电力公司展示了 AI 工厂灵活负荷项目,Lambda 通过 DSX MaxLPS 将每瓦性能提升 23%,Pinterest 则采用 Blackwell 平台与 Dynamo 推理软件为视觉发现引入对话式 AI。 英伟达强调,AI 基础设施的衡量标准正从峰值性能转向经过验证的每兆瓦智能体令牌数。其 DSX MaxLPS 通过全工厂电力优化,可将每兆瓦令牌数提升高达 1.4 倍。同时,DSX Flex 软件能接收电网信号,自动根据预设的工作负载层级调整能耗,使 AI 工厂可作为灵活的电网资源运行。 (NVIDIA Blog)
Techub News 消息,英伟达正在使用 Palantir Foundry 平台和其开源优化库 cuOpt 来自动化其全球制造基地的硬件供应链分配决策。该公司构建了“数字供应链智能”指挥中心,通过混合整数线性编程来最小化物料所有权时间,并协调零部件供应、产能限制与客户交付计划之间的依赖关系。 为处理非结构化运营变量(如供应商通话记录、天气预测和地缘政治事件),英伟达对 Nemotron 3.5 Lightning 模型进行了领域微调。该模型在历史分配记录上实现了 86.7% 的决策准确率,优于未调优的基础模型和更大的 Nemotron 3 Ultra 模型。微调过程在两块 B200 GPU 上仅耗时数分钟。 英伟达即将为 Vera Rubin 架构构建的供应链网络规模将是支持 Grace Blackwell 网络的两倍。运营选择、计划修订和实际工厂产出数据将持续写回 Palantir 的本体模型中。 (AI News)
Techub News 消息,戴尔科技已向 AI 云服务商 CoreWeave 交付全球首批英伟达 Vera Rubin NVL72 AI 服务器机架。该部署标志着 AI 效率的重大飞跃,有望降低大规模 AI 应用的成本与能耗。 (Crypto Briefing)
Techub News 消息,AI 云服务提供商 Nscale 承诺向人形机器人初创公司 Figure 提供至少 35 亿美元的 AI 云容量支持。该计划包括在德克萨斯州部署 10 万台英伟达 Vera Rubin GPU。 此次合作旨在为 Figure 的机器人研发提供大规模计算基础设施,以加速其人工智能模型的训练与部署。(Crypto Briefing)
Techub News 消息,Elon Musk 旗下 SpaceX 与英伟达合作,共同开发太空优化的 Vera Rubin NVL72 系统。该系统计划于 2027 年第四季度发射入轨,并计划在 2028 年进行大规模扩展。 该系统旨在为太空应用提供高性能计算能力,以满足未来太空任务对数据处理和人工智能工作负载的需求。(@Cointelegraph)
Techub News 消息,SpaceX 与英伟达合作设计了一款太空优化的 Vera Rubin NVL72 系统,计划最早于 2027 年第四季度发射入轨,并在 2028 年实现大规模部署。该系统将搭载英伟达专为 AI 智能体设计的 Vera CPU,配备 88 个 Olympus 核心和高达 1.2 TB/s 的内存带宽,旨在将 AI 计算架构从地面数据中心扩展至轨道基础设施。 尽管埃隆·马斯克在 X 平台上公开称赞此次合作,但两家公司的股价在宣布当日均出现下跌。英伟达股价下跌 2.91% 至 208.48 美元,SpaceX 股价下跌 1.44% 至 135 美元。分析认为,股价波动更多受英伟达即将发布的财报及 SpaceX IPO 后持续波动影响,而非直接源于合作消息本身。(BeInCrypto)
Techub News 消息,SpaceX 与 Nvidia 达成合作,计划于 2027 年第四季度将 Vera Rubin AI 超级计算机通过 Starmind AI 卫星送入近地轨道,标志着高性能推理计算进入太空新 frontier。 该系统基于 Vera Rubin NVL72 架构,配备 72 颗 Rubin GPU 和 36 颗 Vera CPU,专为代理式 AI 工作负载和推理任务设计。马斯克在 8 月 4 日的财报电话会议上称该平台为「最佳 AI 计算机」,并表示 SpaceX 将独家使用 Vera Rubin 平台。Nvidia 强调,地球与太空将维持统一的软件生态系统,开发者无需为轨道部署维护独立代码库。(CryptoBriefing)
Techub News 消息,NVIDIA 发布 Vera Rubin NVL72 系统的早期性能数据。数据显示,在运行 AI 代理工作负载时,该系统每兆瓦的吞吐量比 NVIDIA GB300 NVL72 系统高出高达 30 倍,同时每百万个令牌的成本降低高达 35 倍。 性能测试基于 SemiAnalysis AgentX 工作负载进行,该负载模拟了现实世界的代理编码会话,保留了实际上下文增长、工具调用和子代理生成。对于受电力限制的 AI 工厂而言,这意味着在相同能耗下可完成多达 30 倍的代理工作。 NVIDIA 表示,其 DSX MaxLPS 技术可在 GPU、机架和工作负载级别管理功耗,从而在相同的兆瓦预算内调配多达 40% 的 GPU,进一步提升了 AI 工厂规模的每兆瓦吞吐量。 (NVIDIA Blog)
Techub News 消息,NVIDIA 宣布其 Vera Rubin 机架级系统 NVIDIA Groq 3 LPX 已投入全面生产。该系统在运行开源智能体模型 Gemma 4 31B 的基准测试中,针对 10 万令牌的长上下文用例,每秒可生成 3400 个输出令牌,速度比最接近的替代平台快 4 倍。 全球行业合作伙伴正在采用 Vera Rubin 平台解决方案。SpaceXAI 宣布将使用 NVIDIA Vera CPU 为其下一代智能体 AI 提供动力。CoreWeave 已部署 Spectrum-X Multiplane 进入生产环境,该技术通过多个并行交换机连接 NVIDIA Vera Rubin 机架,提供高带宽、扁平且无损的 AI 网络。Nebius 成为首个采用 NVIDIA Groq 3 LPX 的 AI 云。 NVIDIA 表示,随着 AI 从训练转向推理和智能体化,推理已成为新前沿。智能体 AI 系统正在生成更多令牌,处理更大的上下文窗口,并越来越多地与其他 AI 系统协作以解决复杂问题。这些工作负载需要一类新型基础设施,不仅针对性能,还需在空前规模下优化吞吐量、响应能力和经济性。(NVIDIA Blog)