Lyria 3.5 คือกลุ่มโมเดลการสร้างเพลงของ Google ซึ่งพร้อมให้บริการ ผ่าน Gemini API Lyria 3.5 ช่วยให้คุณสร้างเสียงสเตอริโอ 44.1 kHz คุณภาพสูงจากพรอมต์ข้อความหรือจากรูปภาพได้ โมเดลเหล่านี้ ให้ความสอดคล้องเชิงโครงสร้าง ซึ่งรวมถึงเสียงร้อง เนื้อเพลงที่กำหนดเวลา และดนตรีบรรเลง ทั้งหมด
ตระกูล Lyria มีโมเดลต่อไปนี้
| รุ่น | รหัสโมเดล | เหมาะสำหรับ | ระยะเวลา | เอาต์พุต |
|---|---|---|---|---|
| คลิป Lyria 3 | lyria-3-clip-preview |
คลิปสั้น ลูป ตัวอย่าง | 30 วินาที | MP3 |
| Lyria 3.5 | lyria-3.5 |
เพลงเต็มความยาวที่มีท่อนร้อง คอรัส และบริดจ์ | 2-3 นาที (ควบคุมได้โดยใช้พรอมต์) | MP3 |
คุณสามารถใช้ทั้ง 2 โมเดลได้โดยใช้ Interactions API ใหม่ ซึ่งรองรับอินพุตแบบมัลติโมดอล (ข้อความและรูปภาพ) และสร้างเสียงสเตอริโอที่มีความเที่ยงตรงสูง 44.1 kHz
สร้างมิวสิกคลิป
โมเดลคลิป Lyria 3 จะสร้างคลิปความยาว 30 วินาทีเสมอ หากต้องการสร้าง
คลิป ให้เรียกใช้เมธอด interactions.create ด้วยพรอมต์ข้อความ คำตอบ
จะมีเนื้อเพลงและโครงสร้างเพลงที่สร้างขึ้นพร้อมกับเสียงใน
สคีมา steps เสมอ
Python
import base64
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="lyria-3-clip-preview",
input="A short instrumental acoustic guitar piece.",
)
generated_audio = interaction.output_audio
if generated_audio:
with open("music.mp3", "wb") as f:
f.write(base64.b64decode(generated_audio.data))
lyrics = interaction.output_text
if lyrics:
print(f"Lyrics:\n{lyrics}")
JavaScript
import { GoogleGenAI } from