Techub News 消息,AI 模型公司 PrismML 发布 Ternary Bonsai 2 27B 模型。该模型是 Qwen3.8 27B 的三元权重版本,体积仅 5.93 GB(FP16 版本为 53.80 GB),在 20 项基准测试中平均性能保留率达 98.2%。模型支持文本与图像输入,上下文长度达 262K token,并可在 RTX 5090 等消费级硬件上运行。 模型采用 Apache 2.0 许可,权重已开源。其架构与 Qwen3.8 27B 保持一致,参数总量 27.36B,其中语言主干 24.35B,嵌入层与语言模型头 2.54B,视觉模块 0.47B。模型使用三元量化技术,绝大多数权重仅取 -1、0、+1 三个值,配合共享的 FP16 缩放因子,实现高压缩比。 性能评估显示,模型在数学与代码任务上保留率超 99%,但在长程智能体任务(如 Terminal-Bench 2.1)上性能下降较明显。实测中,RTX 5090 解码速度达每秒 142.5 token,RTX 4090 为 96.7 token/s,苹果 M5 Max 笔记本为 46.8 token/s。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,AI 模型公司 PrismML 发布 Ternary Bonsai 2 27B 模型。该模型是 Qwen3.8 27B 的三元权重版本,体积仅 5.93 GB(FP16 版本为 53.80 GB),在 20 项基准测试中平均性能保留率达 98.2%。模型支持文本与图像输入,上下文长度达 262K token,并可在 RTX 5090 等消费级硬件上运行。 模型采用 Apache 2.0 许可,权重已开源。其架构与 Qwen3.8 27B 保持一致,参数总量 27.36B,其中语言主干 24.35B,嵌入层与语言模型头 2.54B,视觉模块 0.47B。模型使用三元量化技术,绝大多数权重仅取 -1、0、+1 三个值,配合共享的 FP16 缩放因子,实现高压缩比。 性能评估显示,模型在数学与代码任务上保留率超 99%,但在长程智能体任务(如 Terminal-Bench 2.1)上性能下降较明显。实测中,RTX 5090 解码速度达每秒 142.5 token,RTX 4090 为 96.7 token/s,苹果 M5 Max 笔记本为 46.8 token/s。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。