Gemini Omni Flash ( gemini-omni-1.1-flash ) është një model multimodal me performancë të lartë i projektuar për gjenerim videoje me shpejtësi të lartë, montim dhe kontroll kinematografik. Gemini Omni është ndërtuar mbi aftësitë kryesore të mëposhtme që e dallojnë atë nga modelet e mëparshme të videos:
- Multimodaliteti nativ: përpunon tekstin, imazhin, audion dhe videon njëkohësisht, duke ju dhënë rezultate më kohezive, konsistente dhe të kontrollueshme.
- Redaktimi bisedor: i aktivizuar nga Interactions API , ju lejon të përsosni dhe redaktoni videot tuaja në mënyrë iterative përmes bisedës në gjuhën natyrore. Përshkruani se çfarë doni të ndryshoni dhe modeli zbaton redaktimin duke ruajtur pjesët e videos që dëshironi të ruani.
- Njohuri për botën: Gemini Omni kombinon një kuptim të fizikës me njohuritë e Gemini për historinë, shkencën dhe kontekstin kulturor, duke kapërcyer hendekun nga fotorealizmi te rrëfimi kuptimplotë.
Gjenerimi i tekstit në video
Gjenero një video nga një kërkesë me tekst. Modeli gjeneron një video me audio bazuar në përshkrimin tënd me tekst. Shkruaj kërkesa me detaje si përshkrimi i skenës, lëvizja e kamerës, ndriçimi dhe atmosfera për rezultatet më të mira.
Python
import base64
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-omni-1.1-flash",
input="A marble rolling fast on a chain reaction style track, continuous smooth shot."
)
with open("marble.mp4", "wb") as f:
f.write(base64.b64decode(interaction.output_video.data))
JavaScript
import { GoogleGenAI } from '@google/genai';
import * as fs from 'fs';
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: