扫码下载
搜索“Nemotron”共有10条相关结果
Techub News 消息,英伟达创始人兼CEO黄仁勋周二出席Salesforce Dreamforce大会,与Salesforce CEO马克·贝尼奥夫同台。此次亮相正值Salesforce发布其首个CRM推理模型Koa,该模型基于英伟达Nemotron 3 Super构建。黄仁勋在会上强调了AI“无所不知、无所不能”的潜力。 (NVIDIA Newsroom)
Techub News 消息,Salesforce 与英伟达合作推出名为 Koa 的新型 AI 推理模型。该模型基于英伟达的开源权重模型 Nemotron 构建,专门训练用于执行销售、营销和客户支持任务。此举标志着企业软件巨头与芯片制造商在垂直领域 AI 应用上的深度整合。(TechCrunch)
Techub News 消息,英伟达正在使用 Palantir Foundry 平台和其开源优化库 cuOpt 来自动化其全球制造基地的硬件供应链分配决策。该公司构建了“数字供应链智能”指挥中心,通过混合整数线性编程来最小化物料所有权时间,并协调零部件供应、产能限制与客户交付计划之间的依赖关系。 为处理非结构化运营变量(如供应商通话记录、天气预测和地缘政治事件),英伟达对 Nemotron 3.5 Lightning 模型进行了领域微调。该模型在历史分配记录上实现了 86.7% 的决策准确率,优于未调优的基础模型和更大的 Nemotron 3 Ultra 模型。微调过程在两块 B200 GPU 上仅耗时数分钟。 英伟达即将为 Vera Rubin 架构构建的供应链网络规模将是支持 Grace Blackwell 网络的两倍。运营选择、计划修订和实际工厂产出数据将持续写回 Palantir 的本体模型中。 (AI News)
Techub News 消息,Sakana AI 发布其 Sakana Fugu 系列的两款新模型 Fugu Max 与 Fugu Ultra v2。Fugu 并非单一基础模型,而是一个通过学习训练的编排器,通过一个 API 将任务路由至背后的模型池。新发布针对两种任务优化架构:Fugu Max 旨在实现最佳单位美元输出,Fugu Ultra v2 则针对复杂、多步骤任务的最高能力。 两款模型现已通过 Sakana 的 OpenAI 兼容 API 上线,提供托管服务,但未开源权重,且不在欧盟/欧洲经济区提供服务。Fugu Max 定价为每百万输入 Token 2 美元、输出 Token 6 美元,据称其输出价格比 Sonnet 5、GPT 5.6 Terra 和 Kimi K3 低 40% 至 60%。 Fugu Ultra v2 专注于复杂推理、自主研究和全栈软件开发,在视觉与结构化数据的持续推理任务上提升显著。Sakana 强调,该架构不依赖任何单一专有模型,可降低供应商锁定、API 撤销和突然服务中断的风险。 (MarkTechPost)
Techub News 消息,OpenBMB 发布 MiniCPM5-2B 模型,这是 MiniCPM5 系列的第二代检查点。该模型为密集因果语言模型,参数量约 25.2 亿,采用标准 Llama 架构,上下文窗口为 131,072 个 token,并采用 Apache 2.0 开源许可。 在 34 项基准测试中,MiniCPM5-2B 平均得分 53.9,优于同规模基准模型 Qwen3.5-4B(51.1)。该模型在工具使用、代码推理和长上下文检索任务上表现突出,但在通用知识任务上稍弱于更大规模的模型。 OpenBMB 同时开源了训练数据集,包括 Ultra-FineWeb、UltraData-Code、UltraData-Math 等,以及多个中间检查点,以便社区验证其强化学习与策略蒸馏训练流程的效果。 (MarkTechPost)
Techub News 消息,英伟达(Nvidia)应用深度学习研究副总裁 Bryan Catanzaro 透露,公司已将开源权重 AI 模型 Nemotron 的发布周期从原来的 6-8 个月缩短至每 4-6 周一次。这一加速得益于合成数据生成、多教师蒸馏(MOPD)及强化学习环境等内部工具链的完善。 该公司最新发布的 Nemotron 3.5 Lightning 于 8 月 11 日上线,采用混合架构结合 Mamba 与 Transformer 设计。所有 Nemotron 模型均以开放权重形式发布,附带完整训练配方和数据集,开发者可免费下载修改。该策略旨在通过降低模型使用门槛来带动其推理优化芯片及相关软件平台的需求。(CryptoBriefing)
Techub News 消息,Perplexity 发布便携式 AI 计算机,这是其智能体平台 Computer 的本地优先版本,可直接在 NVIDIA DGX Spark 上运行智能体工具链、编排器、规划器及后训练模型。该系统将本地模型、推理引擎、工具沙箱和应用连接器打包,任务始于设备,本地模型处理的工作不产生按 token 计费的成本。当步骤需要实时网络或前沿推理时,编排器会暂停并询问用户,再将单一步骤发送至 15 个以上的云端模型之一。 该软件需要 GB10 级设备或配备 24 GB VRAM 的 RTX GPU 才能部署,主要面向已拥有 NVIDIA 工作站的企业、中型团队及资金充足的 AI 原生初创公司。应用场景包括金融、法律、医疗、政府及国防等对数据驻留或合同保密性有严格要求的领域。 在包含 53 项任务的本地知识工作基准测试中,运行 Qwen 3.8 27B 模型的 Computer 在 DGX Spark 上得分为 82.6%,高于开源 Pi 工具链的 77.6% 和 Hermes 的 74.0%。使用 PPLX 27B 模型时,得分提升至 85.4%。在混合模式下,完全本地运行的成本边际为零,而通过顾问升级可将性能提升,成本约为每次 0.415 美元。(MarkTechPost)
Techub News 消息,Multiverse Computing 推出 Pulsar 16B 推理模型,基于 Nvidia Nemotron 架构,拥有 161.5 亿参数但仅激活约 31 亿参数,采用 CompactifAI 压缩技术,在 Blackwell GPU 上吞吐量达每秒 4808 个 token。 该模型采用 Apache 2.0 开源许可证,支持商业用途,可在 Hugging Face 获取。Multiverse Computing 成立于 2019 年,去年 6 月完成 2.15 亿美元 B 轮融资,此前曾与加拿大央行等机构合作将量子计算应用于金融模拟。(CryptoBriefing)
Techub News 消息,据 huggingface.co 报道,Nemotron 开发了一种任务引导的合成问答生成工作流程,旨在提升 Ultra 和 Super 训练的效果。该流程利用广泛的公共任务数据集作为能力种子,生成与任务对齐的新示例,并通过推理和相关知识进行丰富,最终过滤成策划的合成数据集。 该流程包括收集种子任务、标准化记录、生成相似示例、丰富答案和过滤打包等五个阶段。在对 Nemotron-3 Nano 模型进行的 100B-token 续写实验中,任务引导的合成问答生成在多个评估指标上均有所提升,显示出该流程在知识密集型和推理密集型任务中的有效性。
Techub News 消息,据 CryptoBriefing 报道,Cadence Design Systems 发布与英伟达合作的 ChipStack AI Super Agent,将芯片验证周期从五周缩短至一天以内,效率提升超 40 倍。 该系统基于英伟达 Nemotron 基础模型构建,具备 Level-5 自主能力,可独立执行复杂芯片设计和验证流程。该公司曾于 2 月推出初版,预计下半年开放新功能的早期访问。