Stable Audio 3.0 オープンソース: Stability AI は「著作権順守」を備えた生成音楽を再定義します
Stability AI は 5 月 20 日に Stable Audio 3.0 モデル ファミリーをリリースしました。これは完全に認可されたデータ トレーニングとオープンソースのウェイト リリースを使用し、オーディオ コミュニティ作成の新しい基盤として位置づけています。 UMG、WMG、EA との著作権提携と相まって、Stability AI は「コンプライアンス + オープンソース」という二重のブランドを掲げて生成音楽トラックに参入しています。
Suno と Udio がまだレコード会社との法的紛争に巻き込まれている間、Stability AI は別の道を選びました。5 月 20 日にリリースされた Stable Audio 3.0 は、完全にライセンスされたデータでトレーニングされた オープンソースの重み モデルのファミリーです。公式の位置づけは非常に文学的で、「オーディオコミュニティは次の作品の基礎を築く」というものです。
オープンソースのゲームプレイを画像から音声まで再現
Stable Audio 3.0 は、芸術的な実験と創造的な自由に焦点を当て、テキスト生成オーディオの方向で Stable Audio シリーズ (Open、2.5 など) の技術的蓄積を継続しています。しかし、モデル自体よりも興味深いのは、Stability AI の差別化戦略です。Stable Diffusion 時代の「オープンソースを活用したエコシステム」アプローチをオーディオ トラックに再現しようとしています。つまり、オープンソースの重みを使用して使用のしきい値を下げ、完全に許可されたトレーニング データを使用して著作権の懸念を排除します。
著作権提携ネットワーク
Stable Audio 3.0 はパズルの 1 ピースにすぎません。過去 1 年間、Stability AI は著作権と商業協力のネットワークを集中的に構築してきました。
| 時間 | 協力 |
|---|
レビュー