Kako Gemini može da produži postojeći video?
Jedna od glavnih novina je produžavanje scena, pri čemu model može analizirati do 10 sekundi prethodnog sadržaja kako bi zadržao vizuelnu dosljednost i tok priče, a snimci se mogu produžavati u intervalima od po 10 sekundi do ukupno 40 sekundi.
Programeri mogu da odrede i prvi i posljednji kadar, nakon čega Gemini Omni 1.1 Flash generiše kontinuirani video između njih, što omogućava pravljenje složenijih pokreta kamere, zumiranja, prelaza i video-zapisa koji se neprimjetno ponavljaju.
Kako Google ubrzava i pojeftinjuje izradu videa?
Model omogućava izradu probnih snimaka u rezoluciji 360p, koja je prema Googleu do 60 odsto brža i košta trećinu cijene u odnosu na standardno generisanje u rezoluciji 720p, što bi trebalo da olakša brzo testiranje ideja i izradu prototipova.
Kada je projekat završen, korisnici mogu da dobiju snimke u rezoluciji 1080p ili da ih povećaju do 4K kvaliteta pogodnog za profesionalnu produkciju.
Šta omogućavaju referentni video-snimci?
Blog navodi da Gemini Omni 1.1 Flash podržava i do tri sekunde referentnog videa kao dio multimodalnog ulaza, čime se olakšava očuvanje vizuelnog konteksta, izgleda likova i njihovih pokreta u novoj generisanoj sceni.
Google navodi da se model već koristi u profesionalnim alatima, uključujući Adobe Firefly, dok su predstavnici Figma Weavea, GMI Clouda i Runwaya istakli mogućnosti modela za uređivanje, korištenje referenci, očuvanje detalja i brzo pretvaranje kreativnih ideja u video.
Gdje je novi Gemini dostupan?
Gemini Omni 1.1 Flash dostupan je programerima preko Google AI Studija i Gemini Enterprise Agent Platforme, dok je u Google Flowu dostupan pretplatnicima Google AI Plus, Pro i Ultra širom svijeta, a mogućnost produžavanja scena ponuđena je istim kategorijama korisnika i u aplikaciji Gemini.
