扫码下载
搜索“ElevenLabs”共有10条相关结果
Techub News 消息,AI语音技术公司ElevenLabs正进行新一轮融资谈判,计划筹集超过5亿美元资金。此次融资有望加速其全球业务扩张,并巩固其在AI语音技术领域的领先地位。(Crypto Briefing)
Techub News 消息,AI 音频公司 ElevenLabs 正式发布音乐生成模型 Music v2.5,并通过其应用程序和 API 提供免费版与专业版服务。该公司称,新版本模型完全基于已获授权的音乐数据进行训练。 在近 4.8 万对样本的盲测中,听众更青睐 Music v2.5 生成的音乐,而非其前代版本。此次更新旨在为用户提供更高质量的音乐生成选项。 (The Decoder)
Techub News 消息,环球音乐集团(UMG)宣布与 AI 语音和音乐生成公司 ElevenLabs 达成一项多年期许可协议,将共同开发一个 AI 驱动的音乐平台。该平台将允许用户基于 UMG 授权的音乐目录,创作歌曲混音、混搭及新版本曲目。 艺术家可选择是否参与该平台。这是 UMG 在 AI 领域的又一合作,此前该公司已与 Udio、Spotify、英伟达等公司达成 AI 许可协议或合作开发平台。 (The Verge)
Techub News 消息,AI 语音合成公司 ElevenLabs 发布了 Dubbing v2 模型,旨在提升 AI 语音翻译的质量,使多语言媒体制作更高效、更真实。该模型的发布有望革新全球内容的可访问性。 (Crypto Briefing)
Techub News 消息,巴黎语音 AI 公司 Gradium 推出 Voice Design 功能,用户只需输入一段文本描述,即可在几秒内生成全新的合成语音,无需参考音频或处理版权问题。该功能已在其 API 和 Studio 平台上线,所有套餐包括免费层均可使用。 用户可通过描述性别、年龄、口音、音调、语速等属性来生成语音,支持英语、法语、西班牙语、葡萄牙语和德语。每次请求可生成 1 至 5 个候选声音,通常在 3 至 5 秒内完成。生成的语音可通过其文本转语音端点直接用于流媒体。 Gradium 公布的盲测结果显示,其 Voice Design 在口音提示的对比测试中,以 72.6% 的胜率领先于 ElevenLabs、Inworld 等竞争对手。该公司称其在区域口音(如魁北克法语、巴伐利亚德语)的生成上优势明显。 (MarkTechPost)
Techub News 消息,AI 语音平台 ElevenLabs 企业客户收入已占总收入的 55%,较 2025 年底的约 50% 有所增长。该公司年度经常性收入(ARR)已从 2025 年底的约 3.3 亿美元增长至 2026 年 5 月的超 5 亿美元,7 月已接近 6 亿美元。 目前 41% 的财富 500 强企业已成为其客户,包括 Meta、Stripe 和德国电信等。企业客户每周通过该平台处理数百万次对话。该公司还聘请了来自 OpenAI 的 Ashley Kramer 担任首席营收官,目标是在 2026 年底前将企业收入占比提升至 60%。(CryptoBriefing)
Techub News 消息,Meta Superintelligence Labs 本周发布了实时音频感知模型 Muse Voice Transcribe。该模型将流式自动语音识别、超过 20 人的说话人分离和端点检测三项任务整合到一个自回归模型中,无需后处理。该模型已作为托管 API 上线 Meta Model API,价格为每 1000 音频分钟 3 美元,并已为 Meta AI for Mac 和 Muse Code 的听写功能提供支持。 该模型基于 70 多种语言进行训练,其中 25 种在发布时经过广泛验证和推荐。它原生支持超过一小时的音频输入和 20 多名说话人,无需后处理步骤。Meta 报告称,截至 2026 年 9 月 1 日,该模型在 Artificial Analysis 的流式语音转文本和公开的说话人分离基准测试中均排名第一。(MarkTechPost)
Techub News 消息,Gradium AI 发布了新版文本转语音模型,并已将其设为 API 和 Studio 的默认模型。该公司报告称,其模型在涵盖五种语言的 500 句硬案例测试集中,获得了 81.0% 的人工评分通过率,领先于 Cartesia Sonic 3.6 的 75.1% 和 ElevenLabs v3 Conversational 的 65.4%。在 Coval 基准测试中,首次音频生成时间中位数为 216 毫秒,比其替代模型快 170 毫秒。 新模型已于 2026 年 8 月 31 日上线并设为默认,现有用户无需迁移。该公司已在 Hugging Face 上开源了包含 500 个句子的评估数据集。(MarkTechPost)
Techub News 消息,总部位于班加罗尔的 AI 公司 Sarvam AI 在印度语言语音识别任务上的表现超越了 OpenAI 和 ElevenLabs。其成功突显了针对特定区域的 AI 解决方案在应对语言多样性、提升可及性与包容性方面的潜力。 (Crypto Briefing)
Techub News 消息,据 CryptoBriefing 报道,AI 音频公司 ElevenLabs 与 Stan Lee Universe 达成授权协议,将使用生成式 AI 重现已故漫威传奇 Stan Lee 的声音和形象,用于有声书朗读及漫画内容生成。该协议于 5 月 27 日最终确定,AI 模型基于 Lee 职业生涯期间的专业录音训练而成。 Stan Lee 于 2018 年去世,享年 95 岁。此次合作将通过 Iconic Marketplace 向用户提供商业应用授权,同时开放公共领域有声书及非商业漫画模板供粉丝使用。该公司今年 2 月完成 5 亿美元融资,估值达 110 亿美元,此次签约为其标志性声音库增添了重要 IP。