Techub News 消息,AI 公司 Liquid AI 发布了 LFM2.5 系列模型的 DSpark 草稿模型检查点,包括 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B。这些草稿模型为现有目标模型添加了推测解码路径,通过一个约 3 亿参数的草稿模型提出候选词块,再由目标模型一次性验证,在模型输出不变的情况下实现解码加速。 实测显示,在 H100 GPU 上,解码速度最高可提升 3.18 倍;在 M4 Max MacBook Pro 上最高提升 2.87 倍。该技术适用于本地部署的开发者工具、消费级应用、机器人及嵌入式系统等场景。llama.cpp 和 SGLang 已提供首日支持。 根据 LFM 开放许可协议 v1.0,年收入低于 1000 万美元的实体可免费商用,更大规模的企业需联系 Liquid AI 获取商业许可。 (MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,AI 公司 Liquid AI 发布了 LFM2.5 系列模型的 DSpark 草稿模型检查点,包括 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B。这些草稿模型为现有目标模型添加了推测解码路径,通过一个约 3 亿参数的草稿模型提出候选词块,再由目标模型一次性验证,在模型输出不变的情况下实现解码加速。 实测显示,在 H100 GPU 上,解码速度最高可提升 3.18 倍;在 M4 Max MacBook Pro 上最高提升 2.87 倍。该技术适用于本地部署的开发者工具、消费级应用、机器人及嵌入式系统等场景。llama.cpp 和 SGLang 已提供首日支持。 根据 LFM 开放许可协议 v1.0,年收入低于 1000 万美元的实体可免费商用,更大规模的企业需联系 Liquid AI 获取商业许可。 (MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。