Googleは、9月上旬にすべてのジェミニユーザーのために、その音楽世代モデルであるLyria 3.5に切り替え、テキストプロンプトを完全な曲に変換しました。
同社は、WebおよびモバイルGeminiアプリでモデルをグローバルに展開し、Gemini API、Google AI Studio、Google Flow Music、Google Vidsを通じて提供しています。 GoogleはLyria 3.5を最高の音の音楽モデルと呼んでいます。その前任者よりも、より表現力のあるボーカルと豊富なアレンジをしています。
フルソング、クリップだけでなく
ヘッドライン変更は長さです。 古い Lyria 3 クリップが 30 秒のスニペットを生成したところ、Lyria 3.5 は複数の分トラックを verses、choruses、橋で生成します。Google によると、約 3 分。 Geminiアプリ内で、ガイド付きはプロセスを通じてユーザーを歩きます。
- ジャンルやスタイルを選ぶか、自分の言葉で表現する
- ボーカルやインストゥルメンタルバージョンから選ぶ
- 背景音楽、ジンジャー、着メロ、誕生日ソングのテンプレートから始める
生成されたファイルは、Googleが人間に聞こえるというSynthID透かしを持ち、AIが作ったオーディオをフラグを立てています。 トレーニングデータでは、GoogleはライセンスされたコンテンツのみでLyriaモデルを訓練したが、特定のものを開示していません。 会社は起動時に API の価格設定を発表しなかった。
数百万人の主流アプリ内での楽曲生成を行うことで、Googleは著作権を上回る議論や、AIが自分の技術を模倣したときに音楽家がどのように補正されるかを無視する可能性が高い。



















