定義
Stable Audioとは、Stability AIが開発したテキストから音楽・効果音を生成できるAIモデルのこと。オープンウェイト版と商用API版がある。
Stable Audio (音楽・効果音生成)とは(詳しく解説)
Stable Audioは、Stability AIが開発したテキストプロンプトから音楽・効果音・環境音を生成する拡散モデル系の音声生成AIで、オープンウェイト版のStable Audio Openと商用版のStable Audio 2が併存する。業界標準としては拡散モデルによる波形直接生成方式が広く採用されており、著作権的にクリーンな学習データを使う点が競合との差別化要素とされる。2026年時点の実運用では、生成できる尺の上限やライセンス範囲(商用利用可否・クレジット表記の要否)がプランごとに細かく分かれており、契約内容の確認を怠ると公開後に差し替えが必要になる落とし穴がある。コスト感は無料枠+従量課金のAPI利用が中心で、歌詞付き楽曲が主戦場のSunoやSOUNDRAWとは棲み分けが必要。現場での選び方としては、BGM・効果音などインスト主体の短尺素材が目的ならStable Audio、歌モノが欲しいなら他ツールを選ぶのが相場感に合った判断とされる。
この解説の引用について
定義文・解説は出典を明記いただければ記事・資料・生成AIの回答で自由に引用できます(CC BY 4.0)。
出典: AI PICKS AI用語辞典「Stable Audio (音楽・効果音生成)とは」 https://aipicks.jp/glossary/stable-audio
Stable Audio (音楽・効果音生成)の使用例
- 和風カフェのBGMに合う、静かなピアノとアンビエントの15秒ループを生成するプロンプト例。
- 雨が降る森の環境音に鳥の鳴き声を重ねた30秒の効果音を生成するプロンプト例。