Googleは2026年9月4日、音楽生成モデルLyria 3.5をGeminiアプリとGemini APIに展開すると発表しました。専用の創作ツールにとどまらず、一般利用者、開発者、映像制作者がテキストや画像から曲を作れるようになります。

Lyria 3.5で何が変わったのか

GoogleはLyria 3.5について、より表現豊かな歌声、豊かな編曲、高い忠実度を特徴に挙げています。Geminiではジャンルを選び、歌声とインストゥルメンタルを切り替え、BGMや誕生日ソングのテンプレートから始められます。

APIドキュメントでは、テキストや画像から44.1 kHzステレオ音声を生成し、歌詞や主歌、副歌、ブリッジなどの構成に対応すると説明されています。最大10枚の画像を入力でき、映像の伴奏、ブランド音楽の草案、ゲームの試作などに使えます。

どこで使えるのか

Googleによると、Lyria 3.5はGeminiのWeb版とモバイルアプリで世界向けに提供され、Google AI Studio、Gemini API、Google Vids、Flow Musicでも使えます。開発者向けのモデルIDは`lyria-3.5`で、現在はPreviewです。

アプリとAPIの使い方は同じではありません。Geminiはジャンル、歌声、長さを簡単に選ぶ設計で、APIは製品への組み込みを想定します。導入前にはアカウント資格、地域、出力形式、最新ドキュメントを確認する必要があります。

まだ本格的な音楽編集ソフトではない

公開ドキュメントでは、Lyria 3.5 APIは単発生成が中心です。副歌や歌詞が合わない場合、DAWのように一部だけ差し替えるのではなく再生成することになります。Previewの制限、料金、提供期間は変わり得ます。

Googleは特定アーティストの声の模倣や著作権付き歌詞の生成をブロックする安全境界を設け、生成音声にはSynthIDを付けます。ただし、商用許諾や素材の権利、公開時の責任が自動的に解決するわけではありません。

クリエイターと開発者への意味

重要なのはAIが作曲できることより、フルソング生成が一般向けチャットとAPIに入った点です。クリエイターは伴奏案を早く作れ、開発者は画像、テキスト、音声を製品に組み込めますが、選別、編集、権利確認、版管理は必要です。

Google公式発表: Create your best tracks yet with Lyria 3.5 in Gemini