Stability AI、企業向け音声生成モデル「Stable Audio 2.5」を公開
この記事の要点
- Stable Audio 2.5は企業向けの音声生成モデルとして公開され、商用制作を想定した機能を打ち出している。
- GPUで2秒未満の推論で最大3分のトラック生成をうたう高速化と、音声インペインティングをサポートする。
制作影響度78/100
音声・音楽
Stable Audio 2.5で示された主要要素
Stable Audio 2.5は企業向けを想定したモデルとして公開され、GPUで2秒未満の推論(最大3分トラック)、音声インペインティング対応、API/パートナー経由およびオンプレ向けエンタープライズライセンスの提供案内が含まれると説明されている。
制作に効く変更点
- GPUで2秒未満の推論をうたう高速化(最大3分トラック)
- 音声インペインティングのサポート(既存音源の指定位置から続き生成)
- 企業向け提供の案内(APIおよびパートナープラットフォーム、オンプレ向けエンタープライズライセンス)
制作現場への示唆
企業の音声制作チームは、Stable Audio 2.5を試用やAPI経由、パートナー/エンタープライズライセンスで導入し、長尺生成や既存素材の継続生成を含むワークフローを検討できるという案内が出ている。
主な対象:企業のブランド音響設計、広告・ゲーム・小売の音響制作チーム