AI 音乐产品解读:Suno 打 Udio、ElevenLabs 闷声发财——三年烧出百亿估值
覆盖产品:Suno / Udio / ElevenLabs(均无公开技术论文,以官方博客、公告、融资文件及权威媒体报道为准) 2023 年 12 月,一个叫 Suno 的网站静悄悄上线,没人想到三年后它会变成 1 亿注册用户的平台,也没人想到它会和一众大厂在法庭上掰手腕。这篇文章把 AI 音乐这条赛道上最重要的三家玩家——Suno、Udio、ElevenLabs——从头到尾捋一遍:它们各自怎么起家、怎么迭代、怎么融资、怎么跟版权方从对簿公堂走到握手言和。看懂了这三家,就基本看懂了 AI 音乐这个行业的全部骨架。
一、Suno:从 Copilot 里的彩蛋到 1 亿用户的平台
1. 起源:Kensho 系的”AI 音乐第一站”
Suno 于 2022 年创立,四位创始人都出身金融 AI 公司 Kensho(一家被 S&P 收购的金融科技公司),所以常被叫”Kensho 系”。它 2023 年 4 月开源过 Bark——一个 GPT 风格的文本到音频模型,算是技术家底的亮相。2023.12.20,Suno 正式公开上线,并直接集成进微软 Copilot——这是 AI 音乐第一次以”大众入口”的方式被推到数亿用户面前,当年的”AI 音乐平台”这个物种就此诞生。
2. 版本战争:六代模型,一部产品进化史
Suno 的产品节奏快得惊人,几乎每个大版本都在定义新标准:
- v3(2024.03.21):2 分钟歌曲,“广播级”质量,被 Rolling Stone、Wired 评为首批能在短片段里骗过普通听众的 AI 音乐——这是 AI 音乐破圈公认的**“ChatGPT 时刻”**;
- v3.5(2024.05.30):首次支持 4 分钟歌曲,主歌-副歌-桥段的结构显著改善;
- v4(2024.11.19):推出 Remaster(重制)/ Cover(翻唱)/ Persona(固定声线)/ ReMi(歌词助手),Suno 从”生成器”往”制作工具”转型;
- v4.5(2025.05.01):8 分钟歌曲、1200+ 流派、非破坏编辑(Replace/Extend/Remaster/Covers),可以只改某一段不动其他部分;
- v5(2025.09.23):官方称”complete re-architecture”(彻底重构),44.1 kHz、12 分轨导出、320 kbps、比 v4 快 10 倍,内部代号 chirp-crow,测试中拿到 ELO 1293 的当时最高分。12 分轨意味着歌曲可以被拆成人声、贝斯、鼓、吉他等独立轨道——第一次真正接进专业混音工作流;
- v5.5(2026.03.26):代号 chirp-fenix,主打声音克隆(Voices)和自定义模型(Custom Models)——上传自己的演唱样本,Suno 就用你的声音唱歌;上传自己的曲库,Suno 就学你的风格。另加全用户可用的个性化引擎 My Taste。
3. Suno Studio:生成式 DAW
2025.09.25,Suno 发布 Suno Studio,一个类 DAW(数字音频工作站)的编辑环境:多分轨、段落级编辑、stem 分离、负面提示、sample-to-song(把上传的小样扩展成整曲)。Suno 的自我定位从”AI 歌曲按钮”变成了”生成式音频工作站”——生成完还能继续改,这是它 2025 年最关键的转型。
4. 融资与规模:数据最能说明问题
- B 轮:1.25 亿美元,估值约 5 亿(2024.05/06 间,正值 v3 破圈之后);
- C 轮:2.5 亿美元,估值 24.5 亿(2025.11.19,Menlo Ventures 领投);
- 规模:约 1 亿注册用户、200 万付费用户、ARR(年化收入)3 亿美元(2026.02 口径);“日生成约 700 万首”出自其 2025.11 融资材料(Billboard 报道);
- 2025.11.25 与华纳音乐和解并签授权协议——这是 AI 音乐公司与主流唱片厂牌的第一个授权合作,被整个行业视为风向标(但注意:环球、索尼对 Suno 的诉讼截至 2026 年中仍在进行)。
二、Udio:DeepMind 系的”控制党”
1. 创立与开局
Udio 由 Uncharted Labs(纽约)开发,创始团队是前 Google DeepMind 研究员(David Ding 任 CEO,另有 Conor Durkan、Charlie Nash、Yaroslav Ganin、Andrew Sanchez)。2024.04.10 公开测试,种子轮约 1000 万美元,a16z(Andreessen Horowitz)领投,参投名单里有 will.i.am、Common、Kevin Wall、Steve Stoute、Instagram 联合创始人 Mike Krieger 等。它一出生就跟 Suno 并称”AI 音乐双子星”,而且口碑上普遍被认为音质更细腻、控制更细。
2. 版本线:一路往”可编辑”走
- v1.5(2024.07.23):48 kHz 采样率、分轨导出、调性控制,首次把”整曲”做成”可拆解”的;
- v1.5 Allegro(2025.03.18):生成提速约 30%,质量不变;
- Styles(2025.03.31):上传你拥有的音频,模型提取其”声学身份”生成风格相近的新歌;
- iOS App(2025.05.21):正式上架苹果应用商店(Android 端长期缺位);
- Sessions(2025.06.26):时间线式编辑视图,支持对作品分段扩展与修改;
- Voices(2025.09.11):固定复用某个人声,跨曲保持一致。
Udio 的产品哲学是”更强的控制、更长的时间线”——它对制作人友好,但对普通用户门槛略高。
3. 版权路径:环球先和解
2025.10.29,Udio 与环球音乐(UMG)宣布和解版权诉讼,并共建授权音乐创作平台(计划 2026 年上线,用获得授权的音乐训练新模型);其后华纳音乐也与 Udio 达成安排⚠️(媒体报道为授权合作,具体条款未全公开)。索尼音乐对 Udio 的诉讼截至 2026 年中仍在进行。
三、ElevenLabs:从 TTS 到”音频全栈”
1. 起点:让 AI 说话像人
ElevenLabs 于 2022 年创立,2023 年 1 月公测,靠”极其像人的 AI 语音”一炮而红。它本不是音乐公司,但三年内从 TTS(文本转语音)一路扩张到转录、配音、音效、音乐,成了音频 AI 里融资和估值最凶的一家。
2. 融资史:教科书级的滚雪球
- pre-seed:200 万美元(2023.01,Credo Ventures);
- A 轮:1900 万美元(2023.06);
- B 轮:8000 万美元,估值 11 亿(2024.01.22,成为独角兽);
- C 轮:1.8 亿美元,估值 33 亿(2025.01.30);
- D 轮:5 亿美元,估值 110 亿(2026.02.04,红杉领投,a16z 追投加码,累计融资 7.81 亿美元)。
支撑这个估值的是实打实的收入:2025 年底 ARR 3.3 亿美元,客户包括 Deutsche Telekom、Square、乌克兰政府、Revolut 等企业客户。
3. 产品线:语音→转录→音乐
- Eleven v3 TTS(2025.06 发布 / 2026.02 正式 GA):官方称”最富表现力”,支持 70+ 语种,Flash 模型延迟 75 ms(官方口径)——“快得像即时对话”;
- Scribe v2(2026.01.09):90+ 语种转录,主打”最准”;
- Eleven Music(2025.08.05 上线):AI 音乐生成,最大卖点是授权数据训练、商业可用——在 Suno/Udio 还在打版权官司时,ElevenLabs 用”干净”当差异化。
四、版权战争:RIAA 的一纸诉状与行业的和解潮
2024.06.24,美国唱片业协会(RIAA)代表索尼、环球、华纳起诉 Suno 与 Udio,指控其未经授权使用版权录音训练模型——Suno 被点名 662 首、Udio 1670 首,单曲最高索赔 15 万美元。这是 AI 音乐行业的”珍珠港”,直接逼出了后来的和解潮:
- Suno:2025.11.25 与华纳和解并签约(首个主流厂牌);环球、索尼的诉讼截至 2026 年中仍在进行;
- Udio:2025.10.29 与环球和解并共建授权平台;华纳亦有安排⚠️;索尼仍在诉;
- 行业主流判断是:诉讼本身可能永远不会等到判决,版权方真正想要的是授权费与分成——和解、授权、共建平台,才是这个行业的终局剧本。
收尾:我的一点看法
三年看下来,这三家其实代表了 AI 音乐的三条不同路线:Suno 是产品流(最快最爽地出歌,用户规模压倒一切),Udio 是工具流(更细的控制、更像 DAW 的工作流),ElevenLabs 是基建流(不跟你拼整首歌,拼的是音频全栈 + 商业授权)。三条路没有输家,但未来的决胜点不在”谁生成的歌更好听”——这个差距正在被快速抹平——而在两件事上:
一是版权与授权。 华纳跟 Suno 和解、环球跟 Udio 共建平台,说明厂牌已经认定”打不赢就收租”。但索尼还在硬刚,AI 音乐能不能彻底走出”灰色训练数据”的阴影,2026 年的几场官司很关键。对于创作者,这意味着”AI 生成歌曲能不能放心商用”这个问题,在不同平台上有完全不同的答案——ElevenLabs 从一开始就押注授权数据,反而是最有先见之明的选择。
二是从”生成”到”制作”的跨越。 Suno 出了 Studio、Udio 出了 Sessions,说明大家都明白:“点一下就出一首歌”的惊喜只能吃一次,真正黏住用户的是”生成之后还能改”。 谁能先让 AI 音乐进到专业制作人的混音台,谁就赢了下一回合。
说点批判性的。Suno 的版本节奏(v3→v5.5 一年半六代)令人叹服,但也暴露出”发布即弃”的毛病,老版本说下线就下线;Udio 品质口碑好,却长期困于用户规模和增长,版权和解之后还能不能打,要看 2026 年那个”授权平台”做成什么样;ElevenLabs 估值冲得最猛,但 AI 语音/音乐的真金白银能不能撑起 110 亿美金的估值,还要看企业客户续费率和音乐订阅的转化。以及一个更根本的隐忧:当所有模型都能生成”还不错的歌”,AI 音乐的天花板就从技术变成了审美——而这个领域至今还没有出现一个”AI 版周杰伦”。
附:核心数据速查
Suno 基本盘
| 项目 | 数值 |
|---|---|
| 创立/上线 | 2022 年创立 / 2023.12.20 公开上线(集成微软 Copilot) |
| 版本线 | v3=2024.03.21(2 分钟)、v3.5=05.30(4 分钟)、v4=11.19(Remaster/Cover/Persona/ReMi)、v4.5=2025.05.01(8 分钟)、v5=09.23(44.1 kHz/12 分轨/320 kbps/快 10 倍)、v5.5=2026.03.26(声音克隆/自定义模型) |
| Suno Studio | 2025.09.25 上线(类 DAW 编辑环境) |
| 融资 | B 轮 1.25 亿美元 @约 5 亿(2024);C 轮 2.5 亿 @24.5 亿(2025.11.19,Menlo Ventures) |
| 规模 | 约 1 亿注册用户、200 万付费、ARR 3 亿美元(2026.02 口径);日生成约 700 万首(2025.11 融资材料) |
| 版权 | 2025.11.25 与华纳和解并授权(首个主流厂牌);环球/索尼诉讼截至 2026 年中仍在进行 |
Udio 基本盘
| 项目 | 数值 |
|---|---|
| 上线/机构 | 2024.04.10 公测;Uncharted Labs,前 Google DeepMind 成员创立 |
| 种子轮 | 约 1000 万美元,a16z 领投 |
| 版本线 | v1.5=2024.07.23(48 kHz/分轨/调性控制);Allegro=2025.03.18(提速约 30%);iOS=2025.05.21 |
| 版权 | 2025.10.29 与环球(UMG)和解并共建授权平台;华纳亦有安排⚠️;索尼仍诉 |
ElevenLabs 基本盘
| 项目 | 数值 |
|---|---|
| 创立/公测 | 2022 年创立 / 2023.01 公测 |
| 融资史 | pre-seed 200 万(2023.01)→ A 1900 万(2023.06)→ B 8000 万@11 亿(2024.01.22)→ C 1.8 亿@33 亿(2025.01.30)→ D 5 亿@110 亿(2026.02.04,红杉领投),累计 7.81 亿美元 |
| 收入 | 2025 年底 ARR 3.3 亿美元 |
| 产品 | v3 TTS(2025.06 发布/2026.02 GA,70+ 语种,Flash 75 ms);Scribe v2(2026.01.09,90+ 语种);Eleven Music(2025.08.05) |
版权关键节点
- RIAA 2024.06.24 起诉:Suno 662 首 / Udio 1670 首,单曲最高索赔 15 万美元
- 截至 2026 年中:环球、索尼对 Suno 诉讼仍在进行;索尼对 Udio 诉讼仍在进行
关键概念清单
- ARR = Annual Recurring Revenue,年度经常性收入
- DAW = Digital Audio Workstation,数字音频工作站
- stem = 分轨(把歌曲拆成人声/贝斯/鼓等独立音轨)
- Remaster = 重制,对已有生成曲目整体重做
- Cover = 翻唱,把一首歌用另一种风格重新演绎
- Persona = 固定声线(Suno 的持续人声角色)
- ReMi = Suno 的 AI 歌词助手
- sample-to-song = 上传音频小样扩展成完整歌曲
- flash model = 低延迟模型(ElevenLabs 的快速 TTS 档)
- RIAA = Recording Industry Association of America,美国唱片业协会
- 广播级(broadcast quality)= 达到电台/电视台播出标准的音质
如果这篇文章对你有帮助,欢迎分享给更多人!
部分信息可能已经过时





