AI

Suno、詩を朗読しながらBGMも同時に作曲する新機能「Speech」を公開

Susan Hill
Googleで追加する

一行のプロンプトから曲を作るアプリとして知られるSunoが、入力した言葉を朗読し、その下に流れる音楽まで同時に作るという、さらに変わった機能を加えた。詩や乾杯のスピーチ、寝る前に読み聞かせる物語を入力し、希望する声や雰囲気を指定すると、ナレーションと楽曲が後から重ねられるのではなく、一緒に作られた1本の音声トラックが返ってくる。自作の音声コンテンツで難しいのは、これまで声そのものではなかった。声と音楽が同じ空間で鳴っているように聞かせることだ。

結婚式のスピーチやショート動画、ガイド付き瞑想、ポッドキャストのイントロを作る人にとって、通常なら2つのアプリと編集タイムラインが必要な工程をひとつ減らせる。これまでは、まず別の場所でナレーションを作り、次に別の場所でロイヤリティフリーの音楽を探し、音楽が言葉をかき消さなくなるまで音量を調整する必要があった。Sunoが打ち出すのは、ひとつのモデルが両方を担当し、音声の下に音楽を貼り付けるのではなく、話し声を軸にサウンドトラックを作るという仕組みだ。

Speechには2つのモードがある。Simpleモードでは、「乗組員を鼓舞する海賊船長」のようなアイデアを説明すると、Sunoが言葉を書き、それを読み上げる。Advancedモードでは、自分で用意した台本を使い、声の性別や話し方、テイクごとの表現の変化の度合いを調整できる。トラックの長さは最大でおよそ8分。寝る前に聞く物語をまるごと収録したり、短い瞑想を作ったりするには十分な長さだ。音楽は初期設定で付いているが、ナレーションだけにしたい場合は切り替えて取り除ける。

Sunoの最高製品責任者、ジャック・ブロディ(Jack Brody)は、音声と音楽をひとつのまとまりのあるトラックとして同時に生成する初のオーディオモデルだと説明する。合成音声そのものは目新しいものではない。ElevenLabs、Adobe、Google DeepMindはいずれも人間らしい音声読み上げ機能を提供しているが、サウンドトラックは利用者が別に用意し、手作業でミックスしなければならない。Sunoはその逆側からこの分野に参入する。音声の会社が音楽を加えるのではなく、音楽の会社が声を加えるかたちだ。

まだ粗削りな部分もあり、Suno自身もいくつか挙げている。同社によると、イギリス英語のアクセントが途中でオーストラリア英語に変わり、また戻ることがあり、ドラマチックな間が大げさになりすぎる場合もある。正確な再生時間や単語単位のタイミングを指定する機能はなく、曲作りですでにユーザーが録音できるカスタム音声がSpeechでも使えるのか、Sunoは明らかにしていない。対応言語も公表されておらず、英語圏以外の利用者にとって気になる点が残るほか、ナレーショントラックの生成に必要なクレジット数もわからない。無料プランでは、Sunoの標準規約により、ユーザーが生成したコンテンツの所有権は同社にあり、商用利用も認められていない。有料ポッドキャストや広告に使う予定がある人は、まず利用規約の細部を確認したほうがいい。

Speechは、少人数のユーザーを対象に約1カ月間テストした後、10月1日にウェブ版とiOS、Androidアプリで全Sunoユーザーに公開された。現在もベータ版の扱いで、曲の生成と同じクレジットプランが適用される。正式版の公開時期について、Sunoは明らかにしていない。

このリリースは、法廷闘争のさなかでもある。Warner Music Groupは2025年11月にSunoとの訴訟を和解し、同社にライセンスを供与した。一方、Universal Music GroupとSony Musicは9月、v6の音楽モデルをめぐって新たな訴訟を起こし、Sunoが6万件を超える録音を複製したと主張。法定損害賠償として最大90億ドルを求めている。この訴訟はボストンの連邦裁判所で係争中だ。つまり、寝る前の物語の下に流れるサウンドトラックは、音楽の作り方をどう学習したのかをめぐり、今も法廷で争う企業によって作られている。

タグ: , , , , ,

Googleで追加する

ディスカッション

0件のコメントがあります。