メインコンテンツへスキップ
← ブログに戻る
チュートリアル2026年2月22日by K.hirano

Gemini 3.1フィーバーの陰で、Googleがひっそり仕込んでいたもの——Lyria 3「画像から音楽生成」を実際に触ってみた

Gemini 3.1が注目を集める2月、Googleはもうひとつの新機能をひっそりリリースしていた。AI音楽生成「Lyria 3」——桜と懐中時計の写真から「Two Rings Forever Yours」が生まれるまでを実体験レポート。ベストプラクティスからWorkspaceユーザーの制限まで徹底解説。

#AI#音楽生成#Gemini#Lyria3#Google#AI音楽

Gemini 3.1が話題を独占している、その陰で

2026年2月、AIクラスタのタイムラインは「Gemini 3.1 Pro」一色だった。推論性能2倍超、思考シグネチャ、エージェント機能の刷新——確かにそれは大きなニュースだった。

でも、その騒ぎに隠れるように、Googleはもうひとつの機能を静かに転がり込ませていた。

2026年2月18日、Geminiアプリに「Create Music」ボタンが現れた。

ニュースになったには違いないが、Gemini 3.1の熱量に比べると明らかに扱いが小さかった。でも実際に触ってみると、これがなかなか面白い。Googleエコシステムに自然に溶け込んだ、いちばん「手軽なAI音楽生成」がここにあった。

Lyria 3 とは何か

Lyria 3 は Google DeepMind が開発した音楽生成モデルで、Geminiアプリに統合されている。テキストプロンプトだけでなく、画像や動画をアップロードして「そのイメージに合う楽曲」を生成できるのが最大の特徴だ。

歌詞も自動生成、カバーアート(ジャケット画像)も同時に出力される。操作は Gemini のチャット画面にある「Create Music」ボタンを押すだけで、アカウントさえあれば追加インストールは一切不要だ。

項目詳細
リリース日2026年2月18日(beta)
生成時間最大30秒
入力形式テキスト・画像・動画
歌詞自動生成
カバーアートNano Banana モデルが自動生成
透かしSynthID(AI生成の証明)
対応言語英・日・独・仏・西・韓・ヒンディー・ポルトガル語
利用条件18歳以上

実際に触ってみた——画像から「Two Rings Forever Yours」が生まれるまで

Lyria 3 で最も驚いたのが、画像→音楽の精度だ。

試しに一枚の写真をアップロードしてみた。テーブルの上に置かれた銀の懐中時計、その周りに散らばる桜の花びら、そして鎖に絡まるように置かれた二つの指輪——という、どこか物語を感じさせる構図の写真だ。

プロンプトには何も書かず、ただ画像だけを渡した。

数秒後、こんな楽曲が生成された。

"Two Rings Forever Yours"

タイトルだけで、もう伝わると思う。AIは写真の「時間」「愛」「永遠性」というテーマを読み取り、ストリングス主体のバラードを生成した。歌詞には「time stands still」「rings of silver and gold」というフレーズが入っていた。

画像の空気感をそのまま音楽に変換する——この体験は、テキストプロンプトだけのサービスにはない独自の価値だと思った。

ベストプラクティス:プロンプトの書き方

Google DeepMind が公式に公開しているプロンプトガイドをもとに、実際に試して有効だったコツをまとめる。

1. ジャンル+年代で指定する

terminal
90年代ポップスのノリで、ピアノとシンセが印象的なアップテンポな曲

「ジャンル × 年代」の組み合わせは再現性が高い。「2000年代のJ-POPバラード」「80年代シティポップ」なども精度よく反応する。

2. 感情・シーンで指定する

terminal
梅雨の朝、窓の外を眺めながらコーヒーを飲む静かな曲

楽器名より「場面」や「感情」で伝えるほうが、イメージに近い楽曲が返ってくる傾向があった。

3. ジャンルを混ぜる

terminal
クラシックバイオリンとファンクベースが融合した、映画のエンドロールに合う曲

Lyria 3 は異ジャンルの混合が得意だ。公式ガイドでも「K-popとモータウンの融合」を例として挙げている。

4. 画像だけで渡す(おすすめ)

テキストを書かずに画像だけ渡すと、AIが画像から感情・色調・構図を分析して独自解釈で曲を作る。期待値ゼロで渡したときのほうが「おっ」となることが多い。

5. 特定アーティスト名は「スタイル参照」として使う

アーティスト名を入れると、その名前は「スタイルのヒント」として扱われ、楽曲そのもののコピーは生成されない(著作権対策)。「宇多田ヒカルっぽい雰囲気のR&B」は機能するが、完全な模倣は出てこない。

「30秒制限」について——Workspaceユーザーも同じだった

無料ユーザーが30秒制限なのは既報だが、Google Workspace のアカウントでも現時点では同様に30秒制限がかかっている

有料プラン(AI Plus / Pro / Ultra)では制限が緩和されるとされているが、具体的な上限秒数は公表されていない。

正直なところ、30秒はSNSのリールやショートコンテンツには十分だが、YouTube動画のBGMやポッドキャストには物足りない。Sunoの無料枠が約2分まで生成できることを考えると、長尺コンテンツには向かない。

Lyria 3 は「ちょっと試したい」「SNSで使えるBGMが欲しい」という用途に最もフィットする。

Suno と比べると何が違うか

Lyria 3 (Gemini)Suno
最大長さ30秒(全プラン共通)無料2分〜、有料無制限
入力形式テキスト・画像・動画テキストのみ
音楽品質手軽・十分高品質・商用級
歌詞制御自動生成のみ(現時点)自分で書ける
Googleとの連携Gemini・YouTube統合単体サービス
料金Gemini無料枠に含む無料あり、$8〜/月

Suno は音楽クオリティと歌詞の細かいコントロールで優位だ。プロの楽曲制作補助や長尺BGM制作には Suno を選ぶべきだろう。

一方、Lyria 3 の強みは**「Geminiを開くだけでいい」**という圧倒的な手軽さと、画像→音楽という独自の入力軸にある。すでにGemini を日常的に使っているなら、追加の手間ゼロで試せる。

ローカルで動く本格モデルが気になる方は、以前書いた「ローカルで音楽を作る。ACEStep 1.5を本気で試したら詰まって、直して、驚いたBlogローカルで音楽を作る。ACEStep 1.5を本気で試したら詰まって、直して、驚いたACEStep 1.5をRTX 4070 Ti 12GBで実際に動かした記録。CUDA graphバグの修正からJ-Pop・Lo-fi・Rock・Ambient 4ジャンルの生成実験まで、数字ありで正直に書く。」も読んでみてほしい。GPU1枚で商用クオリティの楽曲が10秒で生成できる時代になっている。

こんな人に向いている

Lyria 3 がおすすめな人:

  • Gemini をすでに使っている
  • SNSのリール・ショート動画用BGMが欲しい
  • 「写真の雰囲気に合う音楽」を探している
  • 音楽の知識がなくてもすぐ試したい
  • 追加アカウント・アプリは増やしたくない

Suno や ACE-Step の方が向いている人:

  • 2分以上の楽曲が必要
  • 歌詞を細かくコントロールしたい
  • 商用クオリティを追求したい
  • ローカル完結でプライバシーを守りたい(ACE-Step)

まとめ

Gemini 3.1 の陰に隠れていたが、Lyria 3 は「Googleエコシステムで完結する最も手軽なAI音楽生成」として静かに定着していきそうだ。

桜と懐中時計と指輪の写真が「Two Rings Forever Yours」という楽曲になった瞬間の驚きは、テキストだけのサービスでは味わえないものだった。

まだベストプラクティスが確立されていない今こそ、自分で試して「こういうプロンプトが効く」を発見する面白さがある。30秒という制約を逆手に取って、SNSのショートコンテンツ向けBGMを量産する使い方が現時点では最もハマりそうだ。

Gemini を開いたら、写真を1枚放り込んでみてほしい。何が生まれるかは、AIと写真だけが知っている。

情報の鮮度: この記事は 2026年2月時点の情報をもとに執筆しています。

関連記事

この記事を書いた人

HW系エンジニアとして20年以上、10,000件を超える顧客訪問と2,000件を超える単独ソリューション実績。AIツールを使った個人開発やIoT農園など、Raspberry Piを使ったオートメーション化なども実践中です!エンジニア専門結婚相談所も運営中、ClaudeCodeで解決できない心の課題も解決いたします!

AIに発言だけ見せて「この2体は誰だ」と聞いたらGeminiを当てた。でも根拠はこちらのバグだった
2026年8月13日
事例紹介

AIに発言だけ見せて「この2体は誰だ」と聞いたらGeminiを当てた。でも根拠はこちらのバグだった

AI同士に正体を伏せたまま20回会話させ、その発言ログだけを第三のAIに渡して「同じモデルか、どちらが上か」を推理させました。正体は当てましたが、根拠にはこちらの設定ミスが混ざっていました。同じ勝負を2回撮って分かったことの全記録です。

#AIコロシアム#AIアリーナ#AI#LLM比較#ベンチマーク
新型 Google Home スピーカー全まとめ——¥16,800・6/25発売・58mmドライバ・Gemini for Home の確定スペック
2026年6月16日
お知らせ

新型 Google Home スピーカー全まとめ——¥16,800・6/25発売・58mmドライバ・Gemini for Home の確定スペック

新型Google Homeスピーカーの確定情報。日本価格¥16,800・2026/6/25発売・58mmドライバ・A55(NPU搭載)・Thread/Matter対応まで、公式スペックを整理し筆者の見立ても添えます。

#google home#gemini for home#スマートスピーカー#Google#matter
スマホだけで英語YouTubeを同時通訳:Gemini 3.5 Live Translateを耳で使う実践メモ
2026年6月12日
チュートリアル

スマホだけで英語YouTubeを同時通訳:Gemini 3.5 Live Translateを耳で使う実践メモ

2026年6月公開のGemini 3.5 Live Translateを、スマホとBluetoothイヤホンだけで実機検証。スピーカーだと待たされるのにイヤホンだとほぼ完璧な同時通訳になる——その分かれ目と、英語YouTubeを耳で理解する一番実用的な使い方を共有します。

#Gemini#翻訳#AI#スマホ活用#tutorial
Google Gemma 4が変えたこと——Apache 2.0と本格マルチモーダルで「使えるオープンモデル」の基準が上がった
2026年4月3日
お知らせ

Google Gemma 4が変えたこと——Apache 2.0と本格マルチモーダルで「使えるオープンモデル」の基準が上がった

Google DeepMindが2026年4月にリリースしたGemma 4の実力を整理する。Apache 2.0への変更、E2B〜31Bの4モデル構成、画像・動画・音声対応のマルチモーダル実装、そしてQwen 3.5やDeepSeek V3.2との比較まで。「ローカルで動かして本当に使えるか」という目線で書く。

#AI#Gemma#Google#オープンソース#ローカルLLM

META-MARK × AI

ローカルAIを動かすGPU、ちゃんと選べていますか?

VRAM・性能・コスパをMetaScoreで数値化。AIアプリ別の推奨ハードウェア要件も確認できます。