美国 AI 语音公司 ElevenLabs 正式推出 ElevenLabs v4 与 v4 Turbo 两款语音模型。新模型采用全新架构,强化情绪表达控制,降低语音智能体响应延迟,支持 90 余种语言,较旧版的 70 种显著提升。
v4 系列实现更精细的语音控制和更快的声音克隆,用户仅需 10 秒音频素材即可完成克隆。朗读大段文本时,模型能更好维持说话人音色,并记住前后语境调整语气。内联标签功能进一步扩充,支持叠加多个标签并按顺序执行。日语、巴西葡萄牙语、普通话及粤语合成质量提升最为显著。
ElevenLabs 超 55%业务收入来自大型企业,新模型适配语音智能体场景,可在后端大语言模型输出回答时同步生成语音音频。公司年化营收已从年初约 3.3 亿美元攀升至 6 亿美元以上,员工超 800 人,并计划未来几年内完成 IPO 上市。