要闻列表ElevenLabs 和 Stability AI 發布全新 AI 音樂模型——它們能追上 Suno 嗎?
Decrypt2026-05-27 19:33:13 警示

ElevenLabs 和 Stability AI 發布全新 AI 音樂模型——它們能追上 Suno 嗎?

ORIGINALElevenLabs, Stability AI Drop New AI Music Models—Can They Catch Suno?
AI 影响分析Grok 分析中...
📄完整原文· 由 trafilatura 自动抓取Gemini 翻譯5719 字
简报 - ElevenLabs 发布了 Music v2,支持在曲目中途切换流派、分段构建歌曲以及对特定部分进行重绘(inpainting)。 - Stability AI 发布了 Stable Audio 3.0,这是一个包含四个模型的系列,其中三个变体提供开放权重,基于授权数据训练,可生成长达 6 分 20 秒的曲目。 - 两者的发布都极力强调使用授权训练数据——但估值 24.5 亿美元、拥有约 1 亿用户的 Suno 依然是大多数人首选的平台。 本周出现了两项重要的 AI 音乐更新,但均非来自 Suno。 ElevenLabs 这家总部位于波兰的语音 AI 公司在 2 月份完成 5 亿美元 Series D 融资后,估值已达 110 亿美元,此次推出了 Music v2。Stability AI(即 Stable Diffusion 的开发方)发布了 Stable Audio 3.0,这是一个包含四个模型、提供开放权重且曲目时长可超过 6 分钟的系列。 背景是美国唱片业协会(Recording Industry Association of America)在 2024 年针对 Suno 和 Udio 发起的版权诉讼,这使得“基于授权数据训练”成为任何 AI 音乐公告中最关键的短语。ElevenLabs 和 Stability 都在极力强调这一点,以确保用户生成的输出内容不会产生版权问题。 Music v2:一首曲目,从歌剧到重金属,无需中断 Music v2 是 ElevenLabs 的第二款音乐模型,距离第一款发布约 10 个月。其核心卖点是在压力下的连贯性。据 ElevenLabs 称,单首曲目可以在歌剧和重金属之间切换并切回,在快速说唱中保持一致,并嵌入非音乐音效——且整个作品不会散架。 生成式音频往往在提示词变得复杂时表现不佳,因此这一点值得关注,尤其是在较长的作品中。 重绘(Inpainting)功能现在变得真正实用:选择一个片段,重新生成它,同时保持其他部分不变。用户还可以分段构建歌曲——前奏、主歌、副歌——模型在整个过程中保持连贯性,而不是将每个片段视为独立的生成。多语言支持也有所改进,尽管 ElevenLabs 没有公布具体细节。 该模型为三个平台提供支持:面向创作者的 ElevenMusic、面向开发者的 ElevenAPI 以及面向品牌的 ElevenCreative。目前已在 ElevenMusic 和 ElevenCreative 上线;API 访问权限目前通过销售团队进行早期接入。 ElevenLabs 还将 ElevenAPI 的 Music v1 和 v2 定价下调了最高 50%,将 ElevenCreative 自助服务的定价下调了最高 40%。该公司在 2026 年 4 月实现了 5 亿美元的年度经常性收入。音乐业务在其中占比尚小——但 4 月作为消费者应用推出的 ElevenMusic,是对 Suno 用户群的直接冲击。 Stable Audio 3.0:开放权重、端侧运行、时长更长 Stable Audio 2.0 的上限为 3 分钟,在 2024 年发布时就已经落后于 Suno。Stable Audio 3.0 包含四个模型:Small SFX(端侧音效)、Small(端侧完整音乐创作)、Medium(最长 6:20,需要更强硬件)和 Large(仅限 API)。其中三个模型在 Hugging Face 上提供开放权重。 Small 模型每个拥有 4.59 亿参数——无需 GPU 即可运行。(参数本质上是衡量 AI 模型容量的标准。)Medium 模型达到 14 亿参数,在 H200 GPU 上约 1.31 秒即可生成 6 分 20 秒的输出。27 亿参数的 Large 模型仅面向年收入超过 100 万美元的企业提供 API 访问。按秒计的生成粒度意味着你得到的是精确的曲目长度,而不是近似值。 它也支持在 ComfyUI 中进行本地部署。 其架构是全新的:Stability 称之为 SAME 的语义声学自动编码器,旨在在更长的输出中保持旋律连贯性。支持 LoRA 微调,因此艺术家可以根据自己的曲库调整模型。重绘功能也包含在内——支持单段、多段以及因果延续(causal continuation),以将曲目延长至其原始终点之外。 作为背景,LoRA(低秩适应模型)就像一个微小的模型,用于调节完整模型如何生成输出。如果你在蓝调音乐上训练 LoRA,模型就会产生蓝调;如果你在 BB King 的蓝调上训练 LoRA
数据状态✓ 已抓取全文阅读原文(Decrypt)
🔍历史类似事件· 关键词 + 标的比对6 则
💡 目前用关键词 + 标的比对(MVP)· 之后会升级为 embedding 语义搜寻
原始信息
ID:e953f81c65
来源:Decrypt
发布:2026-05-27 19:33:13
分类:bearish · 导出分类 bearish
标的:未指定
社群投票:+0 /0 · ⭐ 0 重要 · 💬 0 留言