Stability AI 推出一款能够生成六分钟歌曲的音频模型
Stable Diffusion 的开发者 Stability AI 近日发布了一系列名为 Stability Audio 3.0 的新音频模型。据该公司介绍,其旗舰模型能够生成时长超过六分钟的专业级音乐作品。
在 Stability Audio 3.0 系列下,该公司推出了四款模型:小型 SFX(4.59 亿参数)、小型(4.59 亿参数)、中型(14 亿参数)和大型(27 亿参数)。其中两款小型模型专为设备端音效和音乐生成设计,最大输出时长为两分钟。
中型和大型模型可生成长达6分20秒的完整乐曲,并能保持音乐结构与旋律连贯性。这比2024年推出的Stable Audio 2.0所能实现的时长延长了一倍多。
Stability AI将以开放权重形式发布小型SFX、小型及中型模型,允许任何人使用和修改。2024年,该公司推出了Stable Audio Open,支持生成长达47秒的音乐。这一全新模型系列相较于其开源前代产品实现了重大飞跃。

图片来源:StabilityAI
大型模型仅可通过API及付费的自托管服务访问。此外,年收入超过100万美元的企业必须获取企业许可证。
包括谷歌和ElevenLabs在内的众多公司正陆续推出音乐生成模型和工具。然而,正如涉及Suno和Udio的持续法律纠纷所表明的,数据授权以及与音乐厂牌的合作关系,可能对这些服务的长期可行性至关重要。
去年,Stability AI 与华纳音乐集团(Warner Music Group)及环球音乐集团(Universal Music Group)签署协议,共同开发模型和音乐创作工具。该公司表示,其最新的音频模型是在完全获得授权的数据上进行训练的。
这家AI初创公司正在开发一套专为专业音乐人打造的新产品套件,尽管尚未披露具体功能。曾任环球音频(Universal Audio)和芬达(Fender)首席数字官的伊桑·卡普兰(Ethan Kaplan)已加入该公司,将领导Stability的专业音乐部门。
多家AI公司正通过招募音乐行业高管来提升自身公信力。今年早些时候,Suno任命前Merlin首席执行官杰里米·西罗塔(Jeremy Sirota)为首席商务官。ElevenLabs也从独立音乐出版商Kobalt挖来了德里克·科诺耶(Derek Cournoyer),担任其音乐业务的战略负责人。
相关文章
Spotify 通过与 Merlin 的合作扩展其 AI 混音与翻唱项目
Spotify 在第二季度财报电话会议上重申了推出一项全新 AI 驱动功能的计划,该功能允许粉丝在获得艺人明确授权的情况下,创作音乐翻唱和混音作品。独立版权合作伙伴 Merlin 已加入环球音乐集团(UMG)的此项倡议,从而将访问权限扩展至 Merlin 网络中的超过 30,000 家唱片公司,打造一个专注于艺人授权粉丝创作的平台。与备受争议的生成合成音轨的 AI 音乐工具不同,Spotify 联合首席执行官 Gustav Söderström 向投资者强调,该产品的核心在于“真实艺人,而非
ElevenLabs 推出可在歌曲进行中切换音乐风格的 AI 技术
语音人工智能公司ElevenLabs推出了其音乐生成模型的最新版本Music v2,该版本具备在歌曲进行到中途时切换音乐风格的功能。这款模型专为处理复杂的人声与曲目结构而设计。距离这家初创公司首次推出音乐生成模型至今已近十个月,此次新版本终于问世。据ElevenLabs称,该模型能够实现从歌剧到重金属等多种风格的快速转换,并且在保持连贯性的同时输出快速的说唱内容,还能将非音乐类的音效融入歌曲中。艺术家们还可以选择歌曲中的某一段落,通过提示词重新生成该部分内容,而无需改动歌曲的其余部分。此外,
TIDAL暂停AI音乐的商业化运营
音乐流媒体服务商TIDAL推出了一项针对AI生成音乐的新政策。完全由AI生成的曲目将不再具备在该平台实现变现的资格。此外,TIDAL表示将部署自动化工具,以移除冒充某位艺人或乐队的AI生成音乐。“我们致力于保护和奖励真正的创造力,以便艺术家能够继续与TIDAL订阅用户建立联系,并扩大其粉丝群体,”TIDAL执行副总裁兼总编辑托尼·杰尔维诺(Tony Gervino)在一份声明中表示。 “许多订阅
相关专题推荐
评论 (0)
0/500
Stable Diffusion 的开发者 Stability AI 近日发布了一系列名为 Stability Audio 3.0 的新音频模型。据该公司介绍,其旗舰模型能够生成时长超过六分钟的专业级音乐作品。
在 Stability Audio 3.0 系列下,该公司推出了四款模型:小型 SFX(4.59 亿参数)、小型(4.59 亿参数)、中型(14 亿参数)和大型(27 亿参数)。其中两款小型模型专为设备端音效和音乐生成设计,最大输出时长为两分钟。
中型和大型模型可生成长达6分20秒的完整乐曲,并能保持音乐结构与旋律连贯性。这比2024年推出的Stable Audio 2.0所能实现的时长延长了一倍多。
Stability AI将以开放权重形式发布小型SFX、小型及中型模型,允许任何人使用和修改。2024年,该公司推出了Stable Audio Open,支持生成长达47秒的音乐。这一全新模型系列相较于其开源前代产品实现了重大飞跃。

图片来源:StabilityAI
大型模型仅可通过API及付费的自托管服务访问。此外,年收入超过100万美元的企业必须获取企业许可证。
包括谷歌和ElevenLabs在内的众多公司正陆续推出音乐生成模型和工具。然而,正如涉及Suno和Udio的持续法律纠纷所表明的,数据授权以及与音乐厂牌的合作关系,可能对这些服务的长期可行性至关重要。
去年,Stability AI 与华纳音乐集团(Warner Music Group)及环球音乐集团(Universal Music Group)签署协议,共同开发模型和音乐创作工具。该公司表示,其最新的音频模型是在完全获得授权的数据上进行训练的。
这家AI初创公司正在开发一套专为专业音乐人打造的新产品套件,尽管尚未披露具体功能。曾任环球音频(Universal Audio)和芬达(Fender)首席数字官的伊桑·卡普兰(Ethan Kaplan)已加入该公司,将领导Stability的专业音乐部门。
多家AI公司正通过招募音乐行业高管来提升自身公信力。今年早些时候,Suno任命前Merlin首席执行官杰里米·西罗塔(Jeremy Sirota)为首席商务官。ElevenLabs也从独立音乐出版商Kobalt挖来了德里克·科诺耶(Derek Cournoyer),担任其音乐业务的战略负责人。
Spotify 通过与 Merlin 的合作扩展其 AI 混音与翻唱项目
Spotify 在第二季度财报电话会议上重申了推出一项全新 AI 驱动功能的计划,该功能允许粉丝在获得艺人明确授权的情况下,创作音乐翻唱和混音作品。独立版权合作伙伴 Merlin 已加入环球音乐集团(UMG)的此项倡议,从而将访问权限扩展至 Merlin 网络中的超过 30,000 家唱片公司,打造一个专注于艺人授权粉丝创作的平台。与备受争议的生成合成音轨的 AI 音乐工具不同,Spotify 联合首席执行官 Gustav Söderström 向投资者强调,该产品的核心在于“真实艺人,而非
ElevenLabs 推出可在歌曲进行中切换音乐风格的 AI 技术
语音人工智能公司ElevenLabs推出了其音乐生成模型的最新版本Music v2,该版本具备在歌曲进行到中途时切换音乐风格的功能。这款模型专为处理复杂的人声与曲目结构而设计。距离这家初创公司首次推出音乐生成模型至今已近十个月,此次新版本终于问世。据ElevenLabs称,该模型能够实现从歌剧到重金属等多种风格的快速转换,并且在保持连贯性的同时输出快速的说唱内容,还能将非音乐类的音效融入歌曲中。艺术家们还可以选择歌曲中的某一段落,通过提示词重新生成该部分内容,而无需改动歌曲的其余部分。此外,
TIDAL暂停AI音乐的商业化运营
音乐流媒体服务商TIDAL推出了一项针对AI生成音乐的新政策。完全由AI生成的曲目将不再具备在该平台实现变现的资格。此外,TIDAL表示将部署自动化工具,以移除冒充某位艺人或乐队的AI生成音乐。“我们致力于保护和奖励真正的创造力,以便艺术家能够继续与TIDAL订阅用户建立联系,并扩大其粉丝群体,”TIDAL执行副总裁兼总编辑托尼·杰尔维诺(Tony Gervino)在一份声明中表示。 “许多订阅





首页






