Techub News 消息,Meta Superintelligence Labs 本周发布了实时音频感知模型 Muse Voice Transcribe。该模型将流式自动语音识别、超过 20 人的说话人分离和端点检测三项任务整合到一个自回归模型中,无需后处理。该模型已作为托管 API 上线 Meta Model API,价格为每 1000 音频分钟 3 美元,并已为 Meta AI for Mac 和 Muse Code 的听写功能提供支持。 该模型基于 70 多种语言进行训练,其中 25 种在发布时经过广泛验证和推荐。它原生支持超过一小时的音频输入和 20 多名说话人,无需后处理步骤。Meta 报告称,截至 2026 年 9 月 1 日,该模型在 Artificial Analysis 的流式语音转文本和公开的说话人分离基准测试中均排名第一。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,Meta Superintelligence Labs 本周发布了实时音频感知模型 Muse Voice Transcribe。该模型将流式自动语音识别、超过 20 人的说话人分离和端点检测三项任务整合到一个自回归模型中,无需后处理。该模型已作为托管 API 上线 Meta Model API,价格为每 1000 音频分钟 3 美元,并已为 Meta AI for Mac 和 Muse Code 的听写功能提供支持。 该模型基于 70 多种语言进行训练,其中 25 种在发布时经过广泛验证和推荐。它原生支持超过一小时的音频输入和 20 多名说话人,无需后处理步骤。Meta 报告称,截至 2026 年 9 月 1 日,该模型在 Artificial Analysis 的流式语音转文本和公开的说话人分离基准测试中均排名第一。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。