Techub News 消息,谷歌研究院发布全新检索框架 Retrieve-for-Train(R4T),旨在解决推荐系统需返回多样化结果集而非单一最佳匹配的问题。R4T 使用强化学习学习查询扩散策略,并将其蒸馏成一个小型扩散模型,可在单次推理中生成全部检索方向,使查询扩散效率提升 12 至 20 倍。 该框架解决了通用大语言模型在执行查询扩散时的两大问题:近义坍塌(产生过于相似的子查询)和延迟过高。其通过三阶段流程实现:首先训练一个查询扩散语言模型,然后合成监督数据,最终训练一个参数为 5390 万的扩散变换器模型来直接生成目标嵌入集合。 在 Polyvore 时尚搭配数据集和专有音乐数据集上的测试显示,基于 Gemma3-4B 的 R4T 框架在开放检索质量上优于最佳采样法,其生成的子查询多样性从零样本的 56.0 提升至 76.8。该方法无需在推理时重复调用大模型,显著降低了成本与延迟。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,谷歌研究院发布全新检索框架 Retrieve-for-Train(R4T),旨在解决推荐系统需返回多样化结果集而非单一最佳匹配的问题。R4T 使用强化学习学习查询扩散策略,并将其蒸馏成一个小型扩散模型,可在单次推理中生成全部检索方向,使查询扩散效率提升 12 至 20 倍。 该框架解决了通用大语言模型在执行查询扩散时的两大问题:近义坍塌(产生过于相似的子查询)和延迟过高。其通过三阶段流程实现:首先训练一个查询扩散语言模型,然后合成监督数据,最终训练一个参数为 5390 万的扩散变换器模型来直接生成目标嵌入集合。 在 Polyvore 时尚搭配数据集和专有音乐数据集上的测试显示,基于 Gemma3-4B 的 R4T 框架在开放检索质量上优于最佳采样法,其生成的子查询多样性从零样本的 56.0 提升至 76.8。该方法无需在推理时重复调用大模型,显著降低了成本与延迟。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。