GoogleのDeepMindチームが9月4日、音楽生成モデル「Lyria 3.5」をGeminiアプリおよびGemini APIで全ユーザーに公開した。ウェブとモバイルアプリの両方で利用でき、開発者向けにはGoogle AI Studioからもアクセスできる。

何が変わったか

Lyria 3.5の主な変更点は以下のとおり。

  • ボーカルの表現力向上——より自然で感情的な歌声の生成が可能になった
  • アレンジの豊かさ——楽器の重なりや音楽的な流れの一貫性が改善
  • トラック長の選択——短いクリップから最長3分のトラックまで指定可能
  • テンプレート機能——バックグラウンドミュージックや誕生日曲など、用途別のスターターを用意
  • 画像からの生成——画像をアップロードしてそのイメージを楽曲に変換できる
  • 多言語ボーカル——英語以外の言語での歌声にも対応

Geminiアプリではジャンルの選択・テキスト指定、ボーカルありかインストルメンタルかの切り替えが簡単にできるようになっている。アーティスト向けにはGoogle Flow Music、動画制作向けにはGoogle Vidsとの統合も用意されている。

公式サイトのサンプルを聴くと、ファンクポップからレゲトン、ボサノバ×トリップホップまで幅広いジャンルをカバーしており、以前のLyriaと比べてボーカルのピッチ安定性と音色のリアルさが大きく向上している印象だ。

なぜこれが重要か

ポイントは「モデルが良くなった」という話ではなく、Googleが音楽生成をGeminiというプラットフォームに組み込んだという事実にある。

SunoやUdioは専用アプリとして成長してきた。だがLyria 3.5はGeminiアプリのユーザー(世界で数億人規模とされる)が追加のサインアップなしにアクセスできる。音楽生成という行為が、「使いたい人が使うツール」から「ふと試せる機能」へとシフトするかもしれない転換点だ。

開発者向けにAPIを開放したことも見逃せない。Gemini APIでLyria 3.5にアクセスできるということは、サードパーティのアプリやサービスがGoogleの音楽生成基盤を組み込める環境が整ったことを意味する。

異なる見方

もちろん、懸念もある。Googleがこれだけの規模で音楽生成を展開することで、トレーニングデータの問題が改めて問われる可能性がある。LyriaのModel Cardには安全性への言及があるが、学習に使われた音源の詳細は明らかにされていない。

また、SunoやUdioが裁判で争っている著作権問題と無縁ではいられない。Googleはより大きな法的リスクを抱えつつ、圧倒的なプラットフォーム力で普及させようとしている。

今後の展開

Lyriaのモデルファミリーにはリアルタイムインタラクティブ生成向けの「Lyria RealTime」や、オープンモデルの「Magenta RealTime」も存在する。Gemini APIへの統合が進んだことで、次はライブパフォーマンス支援やDAWとの連携といった方向に進化する可能性がある。

作り手にとってすぐに確認したいのは、Gemini APIの音楽生成エンドポイントだ。商用利用の条件やライセンス規定がどうなっているかは、実際に使う前に必ずチェックしてほしい。


ソース