AIニュース · 2026.08.25

Stability AI、企業向け音声生成モデル「Stable Audio 2.5」を公開

Stable DiffusionComfyUI
この記事の要点
  • Stable Audio 2.5は企業向けの音声生成モデルとして公開され、商用制作を想定した機能を打ち出している。
  • GPUで2秒未満の推論で最大3分のトラック生成をうたう高速化と、音声インペインティングをサポートする。
制作影響度78/100
音声・音楽

Stable Audio 2.5で示された主要要素

Stable Audio 2.5は企業向けを想定したモデルとして公開され、GPUで2秒未満の推論(最大3分トラック)、音声インペインティング対応、API/パートナー経由およびオンプレ向けエンタープライズライセンスの提供案内が含まれると説明されている。

制作に効く変更点
  • GPUで2秒未満の推論をうたう高速化(最大3分トラック)
  • 音声インペインティングのサポート(既存音源の指定位置から続き生成)
  • 企業向け提供の案内(APIおよびパートナープラットフォーム、オンプレ向けエンタープライズライセンス)

制作現場への示唆

企業の音声制作チームは、Stable Audio 2.5を試用やAPI経由、パートナー/エンタープライズライセンスで導入し、長尺生成や既存素材の継続生成を含むワークフローを検討できるという案内が出ている。

主な対象:企業のブランド音響設計、広告・ゲーム・小売の音響制作チーム