Stability AI 推出一款能生成六分鐘歌曲的音訊模型
Stable Diffusion 的開發商 Stability AI 近日推出了一系列名為 Stability Audio 3.0 的新音訊模型。據該公司表示,其旗艦模型能夠生成長度超過六分鐘的專業級音樂曲目。
在 Stability Audio 3.0 系列下,該公司推出了四款模型:小型 SFX(4.59 億參數)、小型(4.59 億參數)、中型(14 億參數)以及大型(27 億參數)。其中兩款小型模型專為裝置端音效與音樂生成設計,最大輸出長度為兩分鐘。
中型與大型模型則能生成長達 6 分 20 秒的完整樂曲,並能維持音樂結構與旋律連貫性。這比 2024 年推出的 Stable Audio 2.0 所能達成的長度多出兩倍以上。
Stability AI 將以開放權重形式釋出小型 SFX、小型及中型模型,讓任何人都能使用並修改它們。2024 年,該公司推出了 Stable Audio Open,可生成長達 47 秒的音樂。這套新模型系列相較於其開源前代產品,代表著顯著的進步。

圖片來源:StabilityAI圖片來源:Stability AI
大型模型僅可透過 API 及付費的自建伺服器服務存取。此外,年營收超過 100 萬美元的企業必須取得企業授權。
包括 Google 和 ElevenLabs 在內的眾多企業,正陸續推出音樂生成模型與工具。然而,正如 Suno 與 Udio 之間持續的法律糾紛所示,數據授權以及與音樂廠牌的合作夥伴關係,對於這些服務的長期可行性至關重要。
去年,Stability AI 已與華納音樂集團(Warner Music Group)及環球音樂集團(Universal Music Group)簽署協議,共同開發模型與音樂創作工具。該公司聲明,其最新的音訊模型均採用完全取得授權的數據進行訓練。
這家 AI 新創公司正開發一套專為專業音樂人量身打造的新產品組合,儘管尚未透露具體功能。曾任 Universal Audio 和 Fender 數位長(CDO)的 Ethan Kaplan 將加入該公司,領導 Stability 的專業音樂部門。
多家 AI 公司正透過招募音樂產業高管來提升其公信力。今年稍早,Suno 任命前 Merlin 執行長 Jeremy Sirota 為首席商務官。ElevenLabs 也從獨立音樂出版商 Kobalt 挖角 Derek Cournoyer,擔任其音樂業務的策略負責人。
相關文章
Spotify 透過與 Merlin 的合作擴充套件其 AI 混音與翻唱專案
Spotify 在第二季度財報電話會議上重申了推出一項全新 AI 驅動功能的計劃,該功能允許粉絲在獲得藝人明確授權的情況下,創作音樂翻唱和混音作品。獨立版權合作伙伴 Merlin 已加入環球音樂集團(UMG)的此項倡議,從而將訪問許可權擴充套件至 Merlin 網路中的超過 30,000 家唱片公司,打造一個專注於藝人授權粉絲創作的平臺。與備受爭議的生成合成音軌的 AI 音樂工具不同,Spotify 聯合執行長 Gustav Söderström 向投資者強調,該產品的核心在於“真實藝人,而非
ElevenLabs 推出可在歌曲進行中切換音樂風格的 AI 技術
語音人工智慧公司ElevenLabs推出了其音樂生成模型的最新版本Music v2,該版本具備在歌曲進行到中途時切換音樂風格的功能。這款模型專為處理複雜的人聲與曲目結構而設計。距離這家初創公司首次推出音樂生成模型至今已近十個月,此次新版本終於問世。據ElevenLabs稱,該模型能夠實現從歌劇到重金屬等多種風格的快速轉換,並且在保持連貫性的同時輸出快速的說唱內容,還能將非音樂類的音效融入歌曲中。藝術家們還可以選擇歌曲中的某一段落,透過提示詞重新生成該部分內容,而無需改動歌曲的其餘部分。此外,
TIDAL 暫停 AI 音樂的商業化運作
音樂串流服務平台 TIDAL 推出了一項針對 AI 生成音樂的新政策。完全由 AI 生成的曲目將不再具備在該平台上獲利的資格。此外,TIDAL 表示將部署自動化工具,以移除冒充特定藝人或團體的 AI 生成音樂。「我們致力於保護並獎勵原創的創意,讓藝術家能夠持續與 TIDAL 訂閱用戶建立連結,並在其中拓展粉絲群體,」TIDAL 執行副總裁兼總編輯 Tony Gervino 在一份聲明中表示。 「
相關專題推薦
評論 (0)
0/500
Stable Diffusion 的開發商 Stability AI 近日推出了一系列名為 Stability Audio 3.0 的新音訊模型。據該公司表示,其旗艦模型能夠生成長度超過六分鐘的專業級音樂曲目。
在 Stability Audio 3.0 系列下,該公司推出了四款模型:小型 SFX(4.59 億參數)、小型(4.59 億參數)、中型(14 億參數)以及大型(27 億參數)。其中兩款小型模型專為裝置端音效與音樂生成設計,最大輸出長度為兩分鐘。
中型與大型模型則能生成長達 6 分 20 秒的完整樂曲,並能維持音樂結構與旋律連貫性。這比 2024 年推出的 Stable Audio 2.0 所能達成的長度多出兩倍以上。
Stability AI 將以開放權重形式釋出小型 SFX、小型及中型模型,讓任何人都能使用並修改它們。2024 年,該公司推出了 Stable Audio Open,可生成長達 47 秒的音樂。這套新模型系列相較於其開源前代產品,代表著顯著的進步。

圖片來源:StabilityAI圖片來源:Stability AI
大型模型僅可透過 API 及付費的自建伺服器服務存取。此外,年營收超過 100 萬美元的企業必須取得企業授權。
包括 Google 和 ElevenLabs 在內的眾多企業,正陸續推出音樂生成模型與工具。然而,正如 Suno 與 Udio 之間持續的法律糾紛所示,數據授權以及與音樂廠牌的合作夥伴關係,對於這些服務的長期可行性至關重要。
去年,Stability AI 已與華納音樂集團(Warner Music Group)及環球音樂集團(Universal Music Group)簽署協議,共同開發模型與音樂創作工具。該公司聲明,其最新的音訊模型均採用完全取得授權的數據進行訓練。
這家 AI 新創公司正開發一套專為專業音樂人量身打造的新產品組合,儘管尚未透露具體功能。曾任 Universal Audio 和 Fender 數位長(CDO)的 Ethan Kaplan 將加入該公司,領導 Stability 的專業音樂部門。
多家 AI 公司正透過招募音樂產業高管來提升其公信力。今年稍早,Suno 任命前 Merlin 執行長 Jeremy Sirota 為首席商務官。ElevenLabs 也從獨立音樂出版商 Kobalt 挖角 Derek Cournoyer,擔任其音樂業務的策略負責人。
Spotify 透過與 Merlin 的合作擴充套件其 AI 混音與翻唱專案
Spotify 在第二季度財報電話會議上重申了推出一項全新 AI 驅動功能的計劃,該功能允許粉絲在獲得藝人明確授權的情況下,創作音樂翻唱和混音作品。獨立版權合作伙伴 Merlin 已加入環球音樂集團(UMG)的此項倡議,從而將訪問許可權擴充套件至 Merlin 網路中的超過 30,000 家唱片公司,打造一個專注於藝人授權粉絲創作的平臺。與備受爭議的生成合成音軌的 AI 音樂工具不同,Spotify 聯合執行長 Gustav Söderström 向投資者強調,該產品的核心在於“真實藝人,而非
ElevenLabs 推出可在歌曲進行中切換音樂風格的 AI 技術
語音人工智慧公司ElevenLabs推出了其音樂生成模型的最新版本Music v2,該版本具備在歌曲進行到中途時切換音樂風格的功能。這款模型專為處理複雜的人聲與曲目結構而設計。距離這家初創公司首次推出音樂生成模型至今已近十個月,此次新版本終於問世。據ElevenLabs稱,該模型能夠實現從歌劇到重金屬等多種風格的快速轉換,並且在保持連貫性的同時輸出快速的說唱內容,還能將非音樂類的音效融入歌曲中。藝術家們還可以選擇歌曲中的某一段落,透過提示詞重新生成該部分內容,而無需改動歌曲的其餘部分。此外,
TIDAL 暫停 AI 音樂的商業化運作
音樂串流服務平台 TIDAL 推出了一項針對 AI 生成音樂的新政策。完全由 AI 生成的曲目將不再具備在該平台上獲利的資格。此外,TIDAL 表示將部署自動化工具,以移除冒充特定藝人或團體的 AI 生成音樂。「我們致力於保護並獎勵原創的創意,讓藝術家能夠持續與 TIDAL 訂閱用戶建立連結,並在其中拓展粉絲群體,」TIDAL 執行副總裁兼總編輯 Tony Gervino 在一份聲明中表示。 「





首頁






