你输入一句“做一段适合悬疑片追车场景的器乐”,AI就能生成完整曲目;也可以只补一小段音频。对创作者来说,这像多了一位随叫随到的制作助手。但音乐不是普通数据:训练素材、生成作品和发行权利都牵涉版权。Stability AI如今押注音乐,真正值得看的不只是模型,而是它把唱片公司从潜在对手变成了投资者和授权方。
本文关于公司重组、融资和产品的事实主要来自 TechCrunch,报道又引用了 The Information、Sean Parker及公司公告,尚缺少独立信源交叉印证。
从救火到转向音乐
Stability AI因Stable Diffusion闻名。这个文生图模型系列可以根据文字生成图片,其可下载的模型权重推动了开源生成图像生态,也成为公司的主要品牌资产。但据TechCrunch报道,公司后来因过度支出和内部动荡濒临崩溃,创始人Emad Mostaque随之离任。
两年前,Sean Parker参与了一笔8000万美元的救助性融资。此后,他与出任CEO的老友Prem Akkaraju推动重组。这里容易混淆两个数字:8000万美元是两年前的救助资金;2026年8月下旬宣布的7600万美元,则是另一笔新融资。
新的战略重心是音乐。Parker对外描述的目标,是让Stability AI成为音乐专业人士常用的AI工具提供商。这仍是战略愿景,不代表公司已经取得市场领先地位,也不能据此判断它已经放弃图像业务。
先拿许可,再训练模型
这次融资最关键的地方,在投资者名单。TechCrunch报道称,Sony、Warner和Universal参与了7600万美元融资,并在交易中授权Stability AI使用各自的音乐目录训练模型。版权许可,就是权利人允许他人在约定范围内使用作品,通常伴随费用或收益安排。对生成式音乐AI而言,它决定了训练录音和后续商业化能否站得住脚。
Parker的身份让这笔合作格外醒目。他是文件分享服务Napster的联合创始人。Napster曾成为数字音乐版权冲突的象征:据The Information和美联社,Metallica发现尚未正式发行的《I Disappear》已在网上流传后提起诉讼,Napster后来在唱片业围剿和法院禁令下关闭。二十多年后,Parker选择先谈曲库授权,再让三大唱片公司成为投资者。他也承认,自己从Napster学到,“先做了再求原谅”不是好策略。
产品已经做到哪一步?
据TechCrunch,Stability AI已经发布三个新的音频模型和一套AI音乐编辑软件。现有工具可以根据文字提示生成完整的纯器乐曲目,也能生成较短的音频片段。
Parker还预告,后续更新将允许用户用哼唱旋律或beatbox鼓点引导生成。直观地说,创作者不必先把想法写成专业乐谱,只要把脑中的旋律哼出来,模型就能据此继续制作。不过,这项能力目前只是预告,不能写成已经上线。
为什么值得关注
Stability AI的重建提供了一个产业信号:版权方与生成式AI公司的关系,可能不再只是起诉与防守,也可以变成“投资、授权、共同商业化”的组合。唱片公司提供资金和训练素材,公司则为音乐专业人士开发工具。
这也延续了Stability AI自身的版权转向。据英国法院与审裁处司法机构、美联社和TechCrunch,Getty Images此前指控其抓取约1200万条图片链接训练Stable Diffusion。英国案件的核心版权侵权主张后来被撤回,但商标问题继续审理,美国诉讼也另行推进。新团队强调音乐模型使用获授权数据,像是在为上一轮图片版权纠纷划出新的边界。
局限与未知
- 三大唱片公司的具体授权范围、期限、费用及生成内容的权利安排尚未披露,关键交易细节目前只能按报道表述。
- 三个音频模型和编辑软件的实际质量、使用规模及专业音乐人的反馈,材料没有提供。
- 音乐能否成为Stability AI稳定的商业支柱仍待观察;目前看到的是融资、授权和产品发布,而不是市场领先地位的证明。