Techub News 消息,Hugging Face 发布 LFM2.5-2.6B 模型,该模型仅 26 亿参数,在工具使用、指令遵循和多步 Agent 任务上可与 4 倍体量的模型竞争,在苹果 M5 Max 芯片上推理速度达每秒 220 个 token,内存占用低于 2.5GB。 该模型基于约 34 万亿 token 预训练,支持 128K 上下文窗口,首发支持 llama.cpp、MLX、vLLM 等主流推理框架。得益于高效的 LFM2 架构,即使在手机等低配置设备上也能以每秒 30 个 token 的速度运行 Agent 任务。
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,Hugging Face 发布 LFM2.5-2.6B 模型,该模型仅 26 亿参数,在工具使用、指令遵循和多步 Agent 任务上可与 4 倍体量的模型竞争,在苹果 M5 Max 芯片上推理速度达每秒 220 个 token,内存占用低于 2.5GB。 该模型基于约 34 万亿 token 预训练,支持 128K 上下文窗口,首发支持 llama.cpp、MLX、vLLM 等主流推理框架。得益于高效的 LFM2 架构,即使在手机等低配置设备上也能以每秒 30 个 token 的速度运行 Agent 任务。
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。