Techub News 消息,IBM 发布了 Granite 4.2 系列开源推理语言模型,提供 3B、8B 和 30B 三种参数规模。该模型系列围绕显式推理构建,每个模型在回答前都能生成思维链,并设有思考/非思考开关及低功耗模式。模型采用仅解码器的密集 Transformer 架构,从头预训练约 15 万亿个 token,并通过多阶段强化学习链进行后训练。 其中 8B 和 30B 模型包含智能体强化学习模块,模型可在真实沙盒环境中学习编辑代码、驱动终端和运行网络搜索。所有模型均基于 Apache 2.0 协议开源,允许下载、微调及商业生产使用。IBM 同时发布了两个 470M 参数的 Granite Speech 5.0 Turbo CTC 语音模型。 在 SWE-Bench Verified 基准测试中,8B 和 30B 模型的得分分别为 47.67 和 57.00。模型适用于软件开发、金融、医疗、电信及公共部门等行业,应用场景包括软件工程智能体、终端自动化、深度研究及长文档 RAG 等。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,IBM 发布了 Granite 4.2 系列开源推理语言模型,提供 3B、8B 和 30B 三种参数规模。该模型系列围绕显式推理构建,每个模型在回答前都能生成思维链,并设有思考/非思考开关及低功耗模式。模型采用仅解码器的密集 Transformer 架构,从头预训练约 15 万亿个 token,并通过多阶段强化学习链进行后训练。 其中 8B 和 30B 模型包含智能体强化学习模块,模型可在真实沙盒环境中学习编辑代码、驱动终端和运行网络搜索。所有模型均基于 Apache 2.0 协议开源,允许下载、微调及商业生产使用。IBM 同时发布了两个 470M 参数的 Granite Speech 5.0 Turbo CTC 语音模型。 在 SWE-Bench Verified 基准测试中,8B 和 30B 模型的得分分别为 47.67 和 57.00。模型适用于软件开发、金融、医疗、电信及公共部门等行业,应用场景包括软件工程智能体、终端自动化、深度研究及长文档 RAG 等。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。