扫码下载
搜索“Nvidia Nemotron”共有4条相关结果
Techub News 消息,英伟达创始人兼CEO黄仁勋周二出席Salesforce Dreamforce大会,与Salesforce CEO马克·贝尼奥夫同台。此次亮相正值Salesforce发布其首个CRM推理模型Koa,该模型基于英伟达Nemotron 3 Super构建。黄仁勋在会上强调了AI“无所不知、无所不能”的潜力。 (NVIDIA Newsroom)
Techub News 消息,Sakana AI 发布其 Sakana Fugu 系列的两款新模型 Fugu Max 与 Fugu Ultra v2。Fugu 并非单一基础模型,而是一个通过学习训练的编排器,通过一个 API 将任务路由至背后的模型池。新发布针对两种任务优化架构:Fugu Max 旨在实现最佳单位美元输出,Fugu Ultra v2 则针对复杂、多步骤任务的最高能力。 两款模型现已通过 Sakana 的 OpenAI 兼容 API 上线,提供托管服务,但未开源权重,且不在欧盟/欧洲经济区提供服务。Fugu Max 定价为每百万输入 Token 2 美元、输出 Token 6 美元,据称其输出价格比 Sonnet 5、GPT 5.6 Terra 和 Kimi K3 低 40% 至 60%。 Fugu Ultra v2 专注于复杂推理、自主研究和全栈软件开发,在视觉与结构化数据的持续推理任务上提升显著。Sakana 强调,该架构不依赖任何单一专有模型,可降低供应商锁定、API 撤销和突然服务中断的风险。 (MarkTechPost)
Techub News 消息,Perplexity 发布便携式 AI 计算机,这是其智能体平台 Computer 的本地优先版本,可直接在 NVIDIA DGX Spark 上运行智能体工具链、编排器、规划器及后训练模型。该系统将本地模型、推理引擎、工具沙箱和应用连接器打包,任务始于设备,本地模型处理的工作不产生按 token 计费的成本。当步骤需要实时网络或前沿推理时,编排器会暂停并询问用户,再将单一步骤发送至 15 个以上的云端模型之一。 该软件需要 GB10 级设备或配备 24 GB VRAM 的 RTX GPU 才能部署,主要面向已拥有 NVIDIA 工作站的企业、中型团队及资金充足的 AI 原生初创公司。应用场景包括金融、法律、医疗、政府及国防等对数据驻留或合同保密性有严格要求的领域。 在包含 53 项任务的本地知识工作基准测试中,运行 Qwen 3.8 27B 模型的 Computer 在 DGX Spark 上得分为 82.6%,高于开源 Pi 工具链的 77.6% 和 Hermes 的 74.0%。使用 PPLX 27B 模型时,得分提升至 85.4%。在混合模式下,完全本地运行的成本边际为零,而通过顾问升级可将性能提升,成本约为每次 0.415 美元。(MarkTechPost)
Techub News 消息,Multiverse Computing 推出 Pulsar 16B 推理模型,基于 Nvidia Nemotron 架构,拥有 161.5 亿参数但仅激活约 31 亿参数,采用 CompactifAI 压缩技术,在 Blackwell GPU 上吞吐量达每秒 4808 个 token。 该模型采用 Apache 2.0 开源许可证,支持商业用途,可在 Hugging Face 获取。Multiverse Computing 成立于 2019 年,去年 6 月完成 2.15 亿美元 B 轮融资,此前曾与加拿大央行等机构合作将量子计算应用于金融模拟。(CryptoBriefing)