Gemini 3.1フィーバーの陰で、Googleがひっそり仕込んでいたもの——Lyria 3「画像から音楽生成」を実際に触ってみた
Gemini 3.1が注目を集める2月、Googleはもうひとつの新機能をひっそりリリースしていた。AI音楽生成「Lyria 3」——桜と懐中時計の写真から「Two Rings Forever Yours」が生まれるまでを実体験レポート。ベストプラクティスからWorkspaceユーザーの制限まで徹底解説。
Gemini 3.1が話題を独占している、その陰で
2026年2月、AIクラスタのタイムラインは「Gemini 3.1 Pro」一色だった。推論性能2倍超、思考シグネチャ、エージェント機能の刷新——確かにそれは大きなニュースだった。
でも、その騒ぎに隠れるように、Googleはもうひとつの機能を静かに転がり込ませていた。
2026年2月18日、Geminiアプリに「Create Music」ボタンが現れた。
ニュースになったには違いないが、Gemini 3.1の熱量に比べると明らかに扱いが小さかった。でも実際に触ってみると、これがなかなか面白い。Googleエコシステムに自然に溶け込んだ、いちばん「手軽なAI音楽生成」がここにあった。
Lyria 3 とは何か
Lyria 3 は Google DeepMind が開発した音楽生成モデルで、Geminiアプリに統合されている。テキストプロンプトだけでなく、画像や動画をアップロードして「そのイメージに合う楽曲」を生成できるのが最大の特徴だ。
歌詞も自動生成、カバーアート(ジャケット画像)も同時に出力される。操作は Gemini のチャット画面にある「Create Music」ボタンを押すだけで、アカウントさえあれば追加インストールは一切不要だ。
| 項目 | 詳細 |
|---|---|
| リリース日 | 2026年2月18日(beta) |
| 生成時間 | 最大30秒 |
| 入力形式 | テキスト・画像・動画 |
| 歌詞 | 自動生成 |
| カバーアート | Nano Banana モデルが自動生成 |
| 透かし | SynthID(AI生成の証明) |
| 対応言語 | 英・日・独・仏・西・韓・ヒンディー・ポルトガル語 |
| 利用条件 | 18歳以上 |
実際に触ってみた——画像から「Two Rings Forever Yours」が生まれるまで
Lyria 3 で最も驚いたのが、画像→音楽の精度だ。
試しに一枚の写真をアップロードしてみた。テーブルの上に置かれた銀の懐中時計、その周りに散らばる桜の花びら、そして鎖に絡まるように置かれた二つの指輪——という、どこか物語を感じさせる構図の写真だ。
プロンプトには何も書かず、ただ画像だけを渡した。
数秒後、こんな楽曲が生成された。
"Two Rings Forever Yours"
タイトルだけで、もう伝わると思う。AIは写真の「時間」「愛」「永遠性」というテーマを読み取り、ストリングス主体のバラードを生成した。歌詞には「time stands still」「rings of silver and gold」というフレーズが入っていた。
画像の空気感をそのまま音楽に変換する——この体験は、テキストプロンプトだけのサービスにはない独自の価値だと思った。
ベストプラクティス:プロンプトの書き方
Google DeepMind が公式に公開しているプロンプトガイドをもとに、実際に試して有効だったコツをまとめる。
1. ジャンル+年代で指定する
90年代ポップスのノリで、ピアノとシンセが印象的なアップテンポな曲
「ジャンル × 年代」の組み合わせは再現性が高い。「2000年代のJ-POPバラード」「80年代シティポップ」なども精度よく反応する。
2. 感情・シーンで指定する
梅雨の朝、窓の外を眺めながらコーヒーを飲む静かな曲
楽器名より「場面」や「感情」で伝えるほうが、イメージに近い楽曲が返ってくる傾向があった。
3. ジャンルを混ぜる
クラシックバイオリンとファンクベースが融合した、映画のエンドロールに合う曲
Lyria 3 は異ジャンルの混合が得意だ。公式ガイドでも「K-popとモータウンの融合」を例として挙げている。
4. 画像だけで渡す(おすすめ)
テキストを書かずに画像だけ渡すと、AIが画像から感情・色調・構図を分析して独自解釈で曲を作る。期待値ゼロで渡したときのほうが「おっ」となることが多い。
5. 特定アーティスト名は「スタイル参照」として使う
アーティスト名を入れると、その名前は「スタイルのヒント」として扱われ、楽曲そのもののコピーは生成されない(著作権対策)。「宇多田ヒカルっぽい雰囲気のR&B」は機能するが、完全な模倣は出てこない。
「30秒制限」について——Workspaceユーザーも同じだった
無料ユーザーが30秒制限なのは既報だが、Google Workspace のアカウントでも現時点では同様に30秒制限がかかっている。
有料プラン(AI Plus / Pro / Ultra)では制限が緩和されるとされているが、具体的な上限秒数は公表されていない。
正直なところ、30秒はSNSのリールやショートコンテンツには十分だが、YouTube動画のBGMやポッドキャストには物足りない。Sunoの無料枠が約2分まで生成できることを考えると、長尺コンテンツには向かない。
Lyria 3 は「ちょっと試したい」「SNSで使えるBGMが欲しい」という用途に最もフィットする。
Suno と比べると何が違うか
| Lyria 3 (Gemini) | Suno | |
|---|---|---|
| 最大長さ | 30秒(全プラン共通) | 無料2分〜、有料無制限 |
| 入力形式 | テキスト・画像・動画 | テキストのみ |
| 音楽品質 | 手軽・十分 | 高品質・商用級 |
| 歌詞制御 | 自動生成のみ(現時点) | 自分で書ける |
| Googleとの連携 | Gemini・YouTube統合 | 単体サービス |
| 料金 | Gemini無料枠に含む | 無料あり、$8〜/月 |
Suno は音楽クオリティと歌詞の細かいコントロールで優位だ。プロの楽曲制作補助や長尺BGM制作には Suno を選ぶべきだろう。
一方、Lyria 3 の強みは**「Geminiを開くだけでいい」**という圧倒的な手軽さと、画像→音楽という独自の入力軸にある。すでにGemini を日常的に使っているなら、追加の手間ゼロで試せる。
ローカルで動く本格モデルが気になる方は、以前書いた「
Blogローカルで音楽を作る。ACEStep 1.5を本気で試したら詰まって、直して、驚いたACEStep 1.5をRTX 4070 Ti 12GBで実際に動かした記録。CUDA graphバグの修正からJ-Pop・Lo-fi・Rock・Ambient 4ジャンルの生成実験まで、数字ありで正直に書く。→」も読んでみてほしい。GPU1枚で商用クオリティの楽曲が10秒で生成できる時代になっている。
こんな人に向いている
Lyria 3 がおすすめな人:
- Gemini をすでに使っている
- SNSのリール・ショート動画用BGMが欲しい
- 「写真の雰囲気に合う音楽」を探している
- 音楽の知識がなくてもすぐ試したい
- 追加アカウント・アプリは増やしたくない
Suno や ACE-Step の方が向いている人:
- 2分以上の楽曲が必要
- 歌詞を細かくコントロールしたい
- 商用クオリティを追求したい
- ローカル完結でプライバシーを守りたい(ACE-Step)
まとめ
Gemini 3.1 の陰に隠れていたが、Lyria 3 は「Googleエコシステムで完結する最も手軽なAI音楽生成」として静かに定着していきそうだ。
桜と懐中時計と指輪の写真が「Two Rings Forever Yours」という楽曲になった瞬間の驚きは、テキストだけのサービスでは味わえないものだった。
まだベストプラクティスが確立されていない今こそ、自分で試して「こういうプロンプトが効く」を発見する面白さがある。30秒という制約を逆手に取って、SNSのショートコンテンツ向けBGMを量産する使い方が現時点では最もハマりそうだ。
Gemini を開いたら、写真を1枚放り込んでみてほしい。何が生まれるかは、AIと写真だけが知っている。
情報の鮮度: この記事は 2026年2月時点の情報をもとに執筆しています。
関連記事
Blog【速報・完全版】Gemini 3.1 Pro徹底解説 — 推論2倍超・思考シグネチャ・エージェント時代の幕開け2026年2月19日リリースのGemini 3.1 Proを完全解説。ARC-AGI-2で77.1%(前世代比2倍超)、SWE-bench 80.6%を達成。Thinking Levels・思考シグネチャ・Context Caching最大90%削減・Batch API・Google Antigravityなど、開発者が知るべき全機能をベンチマーク比較表・料金表・プロンプト例付きで徹底解説。→
Blog「Pro品質 × Flash速度」が一本化。Nano Banana Pro 2(Gemini 3.1 Flash Image)完全解説GoogleのAI画像生成「Nano Banana Pro 2」=Gemini 3.1 Flash Image を実際に触って確認した。品質と速度が一本化、料金実質半額。デメリットも正直に書く。→
この記事を書いた人
HW系エンジニアとして20年以上、10,000件を超える顧客訪問と2,000件を超える単独ソリューション実績。AIツールを使った個人開発やIoT農園など、Raspberry Piを使ったオートメーション化なども実践中です!エンジニア専門結婚相談所も運営中、ClaudeCodeで解決できない心の課題も解決いたします!
関連記事
AIに発言だけ見せて「この2体は誰だ」と聞いたらGeminiを当てた。でも根拠はこちらのバグだった
AI同士に正体を伏せたまま20回会話させ、その発言ログだけを第三のAIに渡して「同じモデルか、どちらが上か」を推理させました。正体は当てましたが、根拠にはこちらの設定ミスが混ざっていました。同じ勝負を2回撮って分かったことの全記録です。
新型 Google Home スピーカー全まとめ——¥16,800・6/25発売・58mmドライバ・Gemini for Home の確定スペック
新型Google Homeスピーカーの確定情報。日本価格¥16,800・2026/6/25発売・58mmドライバ・A55(NPU搭載)・Thread/Matter対応まで、公式スペックを整理し筆者の見立ても添えます。
スマホだけで英語YouTubeを同時通訳:Gemini 3.5 Live Translateを耳で使う実践メモ
2026年6月公開のGemini 3.5 Live Translateを、スマホとBluetoothイヤホンだけで実機検証。スピーカーだと待たされるのにイヤホンだとほぼ完璧な同時通訳になる——その分かれ目と、英語YouTubeを耳で理解する一番実用的な使い方を共有します。
Google Gemma 4が変えたこと——Apache 2.0と本格マルチモーダルで「使えるオープンモデル」の基準が上がった
Google DeepMindが2026年4月にリリースしたGemma 4の実力を整理する。Apache 2.0への変更、E2B〜31Bの4モデル構成、画像・動画・音声対応のマルチモーダル実装、そしてQwen 3.5やDeepSeek V3.2との比較まで。「ローカルで動かして本当に使えるか」という目線で書く。
META-MARK × AI
ローカルAIを動かすGPU、ちゃんと選べていますか?
VRAM・性能・コスパをMetaScoreで数値化。AIアプリ別の推奨ハードウェア要件も確認できます。
PR広告:開発環境・キャリアまわりのサービス