Sunoは、話し声とBGMをまとめて生成できる新機能「Speech」をパブリックβとして公開した。Webおよびモバイル版で全ユーザーが利用できる。

  • Suno、声とBGMをまとめて生成する「Speech」。全ユーザー向けに公開

    Suno、声とBGMをまとめて生成する「Speech」。全ユーザー向けに公開

Speechは、入力した文章やアイデアをもとに、ナレーションなどの話し声と、それに合わせたオリジナルのBGMを1つの音声として生成するというもの。Sunoでは、声と音楽を別々に生成して組み合わせるのではなく、両方を1つのモデルでまとめて生成する点が特徴。たとえば、詩に音楽を付けて朗読させたり、スピーチにドラマチックなBGMを加えたり、音楽付きの瞑想コンテンツや子供向けの読み聞かせを作ったりできる。BGMを無効にし、話し声だけを生成することも可能だ。

利用時は作りたい内容に加えて、声や音楽のスタイルを指定する。用意した文章を読み上げさせるだけでなく、アイデアから内容そのものを生成させることもできる。

Sunoはこれまでテキストなどから楽曲を生成するサービスを中心に展開してきたが、Speechでは歌ではなく「しゃべり」まで生成対象を広げたことで、ナレーションとBGMを別々のツールで作成して編集することなく、1つのサービスで音声コンテンツを完成させられるようになる。なお、現時点ではβ版となっており、Sunoはアクセントが生成途中で変化したり、不自然に長い間が入ったりする場合があるとしている。