Techub News 消息,据 NVIDIA 博客报道,NVIDIA 已优化 Google DeepMind 发布的 DiffusionGemma 开源模型,使其在 GeForce RTX GPU、RTX PRO 平台及 DGX Spark 系统上运行速度提升高达 4 倍,支持每步并行生成最多 256 个 token。 该模型基于 Gemma 4 架构(260 亿参数,每步激活 38 亿参数),采用扩散机制从噪声中并行精炼文本块,而非传统自回归模型的逐字生成。其以 Apache 2.0 许可证开源,可在本地硬件实现每秒 1000 token 的生成速度,无需云端调用或按 token 付费。
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,据 NVIDIA 博客报道,NVIDIA 已优化 Google DeepMind 发布的 DiffusionGemma 开源模型,使其在 GeForce RTX GPU、RTX PRO 平台及 DGX Spark 系统上运行速度提升高达 4 倍,支持每步并行生成最多 256 个 token。 该模型基于 Gemma 4 架构(260 亿参数,每步激活 38 亿参数),采用扩散机制从噪声中并行精炼文本块,而非传统自回归模型的逐字生成。其以 Apache 2.0 许可证开源,可在本地硬件实现每秒 1000 token 的生成速度,无需云端调用或按 token 付费。
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)
