返回文章列表
语音与音频

Stability AI押注音乐:从生成图片转向服务专业创作者

阅读约 3 分钟

导语

曾因Napster改变音乐行业的肖恩·帕克,如今再次回到音乐领域。不过,这一次他试图以与唱片公司合作的方式进入,而不是先行动、后寻求原谅。帕克参与救援的Stability AI,正在从一家以图像生成闻名的初创公司,重新定位为面向音乐专业人士的AI工具提供商。

从危机中重组

两年前,Stability AI因过度支出和内部动荡陷入严重困境,创始人Emad Mostaque离任。帕克当时参与了一轮8000万美元的救援融资,他的长期朋友Prem Akkaraju随后出任首席执行官。经过重组,公司现在开始公开展示新的产品方向。

这一方向的核心不是单纯推出面向大众的“AI作曲玩具”,而是服务音乐行业中的专业创作者、制作人和相关团队。Stability AI希望凭借生成、编辑和交互式控制工具,进入音乐制作流程,而不只是依靠图像模型维持原有定位。

核心要点

  • 8月底,Stability AI宣布获得7600万美元融资,投资方包括索尼、华纳和环球等大型唱片公司。
  • 融资安排同时包含唱片目录授权,用于模型训练,显示公司正尝试以正式许可替代未经授权使用音乐数据的做法。
  • 公司已经发布三个新的音频模型,以及面向音乐编辑的AI软件。
  • 用户可以通过文本提示生成完整器乐曲,也可以生成较短的音乐片段。
  • 即将到来的更新将允许用户哼唱旋律或用节奏口技演示鼓点,以此引导模型生成内容。

意义与影响

对Stability AI而言,音乐押注既是业务转型,也是一次信任修复。图像生成领域的竞争已经十分激烈,而音乐行业长期更关注版权、收益分配和创作者控制权。索尼、华纳和环球既提供资金,也授权目录进行训练,意味着Stability AI正在尝试把版权方从潜在对手变成产品共建者。

这种合作并不意味着音乐生成的版权和商业问题已经解决。授权范围、生成内容的权利归属,以及AI工具如何嵌入现有制作流程,仍会影响产品能否真正被专业人士采用。帕克过去与音乐行业的关系带有强烈的冲突色彩,因此这次“按规则行事”的路线本身也具有象征意义。

如果后续产品能让音乐人用自然的哼唱、节奏或文字快速探索创意,Stability AI或许能在专业工作流中找到差异化位置。对整个行业来说,真正值得观察的不是AI能否生成一段音乐,而是模型公司与唱片公司能否建立可持续的授权和合作机制。

来源:TechCrunch AI

评论

正在确认登录状态……

正在加载评论……

相关文章

CCTest · Blog
Gemini 3.8 Live 发布:实时语音对话开始进入“边聊边做”阶段
语音与音频
cctest.ai
语音与音频

Gemini 3.8 Live 发布:实时语音对话开始进入“边聊边做”阶段

Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,重点提升实时语音交互、视觉理解、并行推理与后台工具调用能力。两款模型面向不同复杂度的语音代理任务,并已通过 API、Workspace、Search 和 Gemini 应用逐步开放。

阅读全文