ElevenLabs 是一家总部位于英国伦敦的人工智能公司,主营面向音频的生成式人工智能,核心业务是把文字转换为接近真人朗读的语音,并延伸到语音克隆、多语言配音、音乐与音效生成和对话式语音智能体[1]。公司由波兰创业者皮奥特·东布科夫斯基(Piotr Dąbkowski)与马特乌什·斯坦尼舍夫斯基(Mateusz Staniszewski)于2022年创立,两人此前分别任职于谷歌和 Palantir[2]。2026年2月,公司完成5亿美元D轮融资,估值达110亿美元,成立以来累计融资约7.81亿美元[3]。
定义
ElevenLabs 是一家研发生成式音频人工智能的英国企业,总部设在伦敦,产品线从最早的文本转语音模型扩展到语音转文本、音效、配音、音乐以及对话智能体。它的基础能力是把书面内容转换成可听的语音,并能在保留说话人音色的前提下把同一段内容换成另一种语言[4]。
公司的起点与影视配音有关。两位创始人是波兰高中同学,年少时常看到配音质量很差的美国影视作品,后来各自进入科技行业,决定搭建一个能打破内容语言壁垒的平台,并由此转向文本转语音技术[5][2]。官方资料把公司定位为专注音频的高级生成式人工智能研究与产品机构[1]。
原理
ElevenLabs 的语音效果来自其自研的音频基础模型。同一体系下针对不同用途提供多个型号:Turbo 与 Flash 偏重速度和低延迟,主要用于实时助手与呼叫场景;Eleven v3 以表达力为目标,面向有声书、影视和游戏等对成品质量要求更高的内容[6]。公司方面多次表示,语音模型的关键并不在于堆叠参数与数据量,模型结构本身起决定作用[7]。
在 Eleven v3 中,情绪、语气和非语言反应通过嵌入脚本文本的小写方括号标签控制,例如 [whispers]、[excited],标点符号同样会影响停顿与重音[6]。多人对话交由 Text to Dialogue 接口处理,输入若干条带说话人标识的片段后,模型会自行安排说话人切换、情绪过渡与插话[6]。有技术分析认为,这类模型把情绪、意图和说话人动态当作生成阶段的控制信号,而非在合成完成后再叠加效果[8]。
语音克隆分为即时克隆与专业克隆两类,只有经本人验证的专业克隆才被允许在语音库中共享,用语音设计工具生成的合成音色不能上传[9]。平台方面称,由其模型生成的音频可以追溯到发起该次生成的用户[10]。由于复刻一个人的声音只需要很短的一段样本,这项能力在带来便利的同时也成为滥用风险的来源。
发展历程
两位创始人在高中时期相识,此后分别就职于谷歌和 Palantir,并在工作之余一起试验人工智能;2022年两人拿出积蓄辞职,全职投入 ElevenLabs,公司在伦敦成立[11][12]。2023年1月,公司推出语音设计与克隆功能,上线约半年后注册用户超过100万[7]。
2024年11月,其用户规模超过3300万;2025年1月,公司完成1.8亿美元C轮融资,估值33亿美元[7][3]。2025年6月6日,公司发布文本转语音模型 Eleven v3 的预览版本,支持语言从33种扩大到70多种[13][6]。同年8月,公司推出音乐生成功能,并在发布前与音乐版权机构达成授权协议[14]。
2025年9月,公司与日本非营利组织 AILAS 合作,在语音库中为已获本人同意、可用于人工智能的专业声音加注标识[15]。同月,公司完成第一次员工股权出售,估值66亿美元[16]。11月11日,公司上线 Iconic Voice Marketplace,由品牌方与声音权利人签约后使用名人声音[17]。英伟达在2025年9月参与投资,公司当年年度经常性收入超过3.3亿美元。
2026年2月,公司完成由红杉资本领投的5亿美元D轮融资,估值升至110亿美元,成立以来的累计融资额约7.81亿美元[4]。同年3月,公司首席执行官称计划在2至3年内具备上市条件[18]。7月有报道称公司正就员工股权出售与投资者初步接触,交易可能对应约220亿美元估值[16]。9月,公司与环球音乐集团宣布合作,围绕艺人声音的多语言使用与授权机制展开。
应用
企业级对话智能体是公司近年投入最大的方向,可用于销售、市场、客户服务和内部沟通等环节[4]。使用其语音基础设施或相关产品的企业包括 Meta、Salesforce、德国电信、Revolut、Deliveroo 等[14]。
面向创作者与品牌的音频生成平台被用于广告制作、有声书、影视配音和游戏音频,Epic、迪士尼等公司也在客户名单之中[7]。出版机构与芯片厂商同样采用其工具。
在无障碍方向,公司称其技术可帮助因疾病或意外失去说话能力的人重新获得声音。2026年1月,公司发布了一张由多位格莱美获奖音乐人参与、使用其音乐模型制作的专辑,参与者保留作品控制权与流媒体收益。
局限
语音克隆技术被用于冒充他人。诈骗者只需很短的语音样本就能复刻一个人的声音,进而制作深度伪造内容实施诈骗。美国联邦调查局统计,2025年美国境内与人工智能相关的诈骗报案损失超过8.93亿美元[19]。2023年11月,一段冒充时任美国总统的自动外呼电话被报道与该公司的技术有关[20]。
公司表示已建立多层防护,包括禁止克隆公众人物与高风险声音、在语音注册环节进行验证、依据 C2PA 标准为生成音频嵌入来源信息,并对外提供人工智能语音分类器。但美国《消费者报告》在2025年3月对6款主流语音克隆产品的测试认为,包括 ElevenLabs 在内的4款产品没有设置能够阻止未获授权克隆的有效屏障[20][21]。2026年4月,美国参议员玛吉·哈桑致函该公司等4家企业,要求说明防范诈骗滥用的具体措施[19]。
法律层面,一份2026年提交的集体诉讼起诉书指控公司在未告知、未取得同意的情况下采集并商业化利用美国伊利诺伊州声音从业者的生物识别信息,原告依据该州生物识别信息隐私法提出索赔[22]。
技术层面,Eleven v3 需要更细致的提示词,延迟也更高,不适合实时对话,官方建议实时场景继续使用 v2.5 Turbo 或 Flash;该版本对专业语音克隆的适配同样不充分[6]。有测评认为其非英语语言的表现与英语仍有差距[23]。公司自己也说明,任何安全系统都难以做到完全可靠,防护措施可能误拦正常用户,也可能漏掉恶意行为。
参见
参考资料
- What is ElevenLabs? | ElevenLabs Documentation . elevenlabs.io [引用日期2026-09-29]
- ElevenLabsとは何ですか? | ElevenLabs Documentation . elevenlabs.io [引用日期2026-09-29]
- elevenlabs-raises-500-million-11-142911464 . yahoo.com [引用日期2026-09-29]
- ElevenLabs raises $500m Series D led by Sequoia . sifted.eu [引用日期2026-09-29]
- ElevenLabs — 获取媒体资料 . elevenlabs.io [引用日期2026-09-29]
- Eleven v3: Most Expressive AI TTS Model Launched . elevenlabs.io [引用日期2026-09-29]
- 36kr.com 上的网页 . 36kr.com [引用日期2026-09-29]
- cloudthat.com 上的网页 . cloudthat.com [引用日期2026-09-29]
- can-i-share-an-ai-generated-voice-in-the-voice-library . elevenlabs.io [引用日期2026-09-29]
- elevenlabs.io 上的网页 . elevenlabs.io [引用日期2026-09-29]
- Mati Staniszewski . forbes.com [引用日期2026-09-29]
- Piotr Dabkowski . forbes.com [引用日期2026-09-29]
- 20250606-eleven-labs-eleven-v3 . gigazine.net [引用日期2026-09-29]
- bmmagazine.co.uk 上的网页 . bmmagazine.co.uk [引用日期2026-09-29]
- ailas . elevenlabs.io [引用日期2026-09-29]
- elevenlabs-tender-offer-22-billion-valuation . thenextweb.com [引用日期2026-09-29]
- ElevenLabs Launches AI Voice Licensing Marketplace . radioworld.com [引用日期2026-09-29]
- pap.pl 上的网页 . pap.pl [引用日期2026-09-29]
- senate.gov 上的网页 . senate.gov [引用日期2026-09-29]
- biometricupdate.com 上的网页 . biometricupdate.com [引用日期2026-09-29]
浏览次数:0 次
阅读量:0 次 · 阅读完成量:0 次
最近更新:2026-09-29T08:58:07Z
完成率 = 阅读完成量 ÷ 阅读量,分母是阅读量不是浏览次数 —— 关了 JS 的、秒退的都在浏览次数里、不在阅读量里。 详细口径在后台的「数据统计」页。