Lyria 3.5 は、Gemini API を介して利用できる Google の音楽生成モデル ファミリーです。Lyria 3.5 を使用すると、テキスト プロンプトや画像から、高品質の 44.1 kHz ステレオ音声を生成できます。これらのモデルは、ボーカル、タイミング付きの歌詞、完全な楽器の編曲など、構造的な一貫性を提供します。
Lyria ファミリーには次のモデルが含まれています。
| モデル | モデル ID | 最適な用途 | 所要時間 | 出力 |
|---|---|---|---|---|
| Lyria 3 Clip | lyria-3-clip-preview |
ショート クリップ、ループ、プレビュー | 30 秒 | MP3 |
| Lyria 3.5 | lyria-3.5 |
A メロ、サビ、ブリッジのあるフルレングスの曲 | 数分(プロンプトで制御可能) | MP3 |
どちらのモデルも新しい Interactions API を使用して利用できます。マルチモーダル入力(テキストと画像)をサポートし、44.1 kHz の高忠実度ステレオ音声を生成します。
音楽クリップを生成する
Lyria 3 Clip モデルは、常に 30 秒のクリップを生成します。クリップを生成するには、テキスト プロンプトを使用して interactions.create メソッドを呼び出します。レスポンスには、常に生成された歌詞と楽曲構成が、steps スキーマの音声とともに含まれます。
Python
import base64
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="lyria-3-clip-preview",
input="A short instrumental acoustic guitar piece.",
)
generated_audio = interaction.output_audio
if generated_audio:
with open("music.mp3", "wb") as f:
f.write(base64.b64decode(generated_audio.data))
lyrics = interaction.output_text
if lyrics:
print(f"Lyrics:\n{lyrics}")
JavaScript
import { GoogleGenAI } from '@google/genai';
import * as fs from 'fs';
const client = new GoogleGenAI({});
const interaction = await client.interactions.create({
model: 'lyria-3-clip-preview',
input: 'A short instrumental acoustic guitar piece.',
});
const generatedAudio = interaction.output_audio;
if (generatedAudio) {
fs.writeFileSync('music.mp3', Buffer.from(generatedAudio.data, 'base64'));
}
const lyrics = interaction.output_text;
if (lyrics) {
console.log(`Lyrics:\n${lyrics}`);
}
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.interactions.ResponseModality;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
import java.util.Arrays;
Client