从声音克隆到220亿美元估值:ElevenLabs的崛起之路
据TechCrunch报道,AI语音技术公司ElevenLabs目前估值已高达220亿美元,成为生成式AI浪潮中最受瞩目的独角兽之一。这家成立于2022年的公司,凭借其高度逼真的AI语音合成技术,迅速在客服、内容创作、有声书制作等领域占据了一席之地。记者Connie Loizos本周与ElevenLabs CEO进行了20分钟的深度对话,探讨了AI语音的商业化路径、用户告知义务以及行业的未来走向。
ElevenLabs的核心技术在于能够以极低的延迟生成自然流畅、富有情感的语音。与传统的文本转语音(TTS)系统不同,ElevenLabs的模型能够捕捉语调、停顿、重音等细微的语音特征,使得机器生成的声音几乎无法与真人区分。这一技术突破为其赢得了大量企业客户,尤其是在客服中心场景中,AI语音正逐步替代传统IVR(交互式语音应答)系统,成为企业与用户沟通的第一道接口。
“企业应该告诉你,电话那头是AI”
在访谈中,ElevenLabs CEO提出了一个颇具争议的观点:企业应当主动告知用户,他们正在与AI语音系统对话——至少在当前阶段应该如此。他坦言,随着AI语音越来越逼真,用户往往难以分辨电话另一端是人还是机器。这种信息不对称可能引发信任危机,甚至带来伦理和法律风险。
“企业应该主动披露他们使用了AI语音,直到人们普遍预期电话另一端就是机器为止。”——ElevenLabs CEO
这一观点触及了AI语音行业的核心争议:透明度与用户体验之间的平衡。支持者认为,主动披露有助于建立用户信任,避免“被欺骗”的负面感受;反对者则担心,告知用户可能导致他们立即挂断电话,降低客服效率。目前,美国部分州已开始立法要求AI语音系统在通话开始时进行自我披露,欧盟的《人工智能法案》也对深度合成内容的透明度提出了明确要求。
AI语音的商业版图:客服之外还有哪些想象空间?
ElevenLabs的技术应用远不止客服中心。在媒体与娱乐行业,该公司已与多家出版机构合作,将文字内容快速转化为高质量有声书;在游戏领域,其语音引擎能够为NPC角色提供实时、动态的对话能力;在教育场景中,AI语音可以模拟不同口音的教师,帮助语言学习者提升听力与口语。此外,ElevenLabs还推出了语音克隆服务,用户仅需上传几分钟的音频样本,即可生成高度相似的个性化语音。
然而,语音克隆技术也引发了严重的安全担忧。诈骗分子利用AI语音冒充亲友或企业高管实施电信诈骗的案件在全球范围内屡见不鲜。对此,ElevenLabs表示已采取多项措施,包括语音验证、水印嵌入以及与执法机构的合作,但技术滥用的问题依然严峻。
编者按:AI语音的“告知义务”不应成为选择题
ElevenLabs CEO的表态值得肯定,但把“是否告知用户”交给企业自行决定,显然不够。当AI语音已经能够以假乱真,用户的知情权就不应被商业效率所绑架。我们建议,监管机构应尽快出台统一标准,要求AI语音系统在交互开始时进行明确标识。同时,技术提供商也应在产品设计层面嵌入“透明度默认”原则,而非事后补救。AI语音的未来无疑是光明的,但只有在信任的基础上,这项技术才能真正服务于社会。
截至发稿,ElevenLabs尚未对估值传闻做出官方回应。但可以肯定的是,随着生成式AI竞争进入白热化阶段,语音作为最自然的交互方式,将成为下一个兵家必争之地。
本文编译自TechCrunch
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接