Kép és videó generálása 4 másodperc alatt: új AI-modelljei a Google-nak
A Google bejelentette Nano Banana 2 Lite nevű képalkotó és Gemini Omni Flash nevű videógeneráló modelljét. Előbbi 4 másodperc alatt készít képet, utóbbi pedig videók szerkesztésére alkalmas.

A Google új generatív média modelleket tett elérhetővé fejlesztők számára: a Nano Banana 2 Lite a leggyorsabb és legköltséghatékonyabb képalkotó modelljük, míg a Gemini Omni Flash kiváló minőségű videógenerálást és konverzációszerkesztést tesz lehetővé. A két újítás a Google AI Studio, a Gemini API és a Gemini Enterprise Agent Platformon keresztül érhető el, valamint a Google keresési AI módjában és a Gemini alkalmazásban is megjelenik.
A Nano Banana 2 Lite különösen alkalmas nagy sebességű, nagy volumenű munkafolyamatokhoz, ahol az alacsony késleltetés kulcsfontosságú. A modell 4 másodperc alatt képes szöveges utasítások alapján képeket generálni, ami ideálissá teszi interaktív prototípusokhoz és gyors vizuális vázlatokhoz. A modell költséghatékonysága is kiemelkedő: 1000 felbontású kép előállítása mindössze 0,034 dollárba kerül. A Google szerint a sebesség prioritása ellenére a Nano Banana 2 Lite megbízhatóan tartja a promptokat, stabil karakterkonzisztenciát biztosít, és olvasható szöveget jelenít meg a képeken.
Kapcsolódó: Gemini 3.1 Flash-Lite
A Nano Banana család új tagjai
A Nano Banana 2 Lite a Gemini 3.1 Flash Lite Image modellje, amelyet a rendkívül alacsony késleltetésű, nagy volumenű munkafolyamatokra optimalizáltak. Ez a modell a korábbi Nano Banana (Gemini 2.5 Flash Image) utódja, és jobb minőséget, gyorsabb sebességet és alacsonyabb költségeket kínál. A Nano Banana 2 (Gemini 3.1 Flash Image) egy általános célú modell, amely jó minőséget és alacsony késleltetést kínál, míg a Nano Banana Pro (Gemini 3 Pro Image) a legösszetettebb, professzionális felhasználási esetekre optimalizált, ahol a pontosság fontosabb a sebességnél.
Kapcsolódó: Nano Banana 2
Gemini Omni Flash: videók generálása és szerkesztése
A Google I/O-n bemutatott Gemini Omni Flash modell mostantól elérhető a fejlesztők számára a Gemini API-n és a Google AI Studión keresztül. A modell natívan támogatja a kiváló minőségű videógenerálást és a konverzációszerkesztést, szöveges, képi és videós bemenetek kombinálásával. A modell ára versenyképes: 0,10 dollár másodpercenkénti videókimenetért, ami megegyezik a Veo 3.1 Fast árával. Az Omni Flash kiemelkedik a konverzációs videószerkesztésben, ahol természetes nyelvhasználattal finomíthatók a videók, valamint a multimodális hivatkozásokban, amelyek lehetővé teszik képek, szövegek és videók kombinálását a jelenet következetességének megőrzése érdekében. A modell a Gemini tudására támaszkodik, beleértve a történelmet, biológiát és narratív logikát, hogy lenyűgöző videókat hozzon létre.
Kapcsolódó: Gemini 3.1 Flash-Lite sebessége
A Gemini Omni jelenleg 10 másodperces videógenerálást kínál, de hosszabb időtartamok hamarosan érkeznek. Az API-ban még nem támogatott a hanghivatkozások feltöltése és a jelenethosszabbítás, valamint a másodperces videohivatkozások feldolgozása sem tökéletes. A karakterkonzisztencia változó jelenetek vagy pásztázó mozgások esetén korlátozott, de a Google dolgozik a javításon. A Gemini Omni nyilvános előzetese ma indul a Google AI Studióban és a Gemini API-ban.
Kapcsolódó: Gemini 3.1 Flash Live
A két modell együttműködése új lehetőségeket nyit: a Nano Banana 2 Lite nagy sebességű képgenerálásra használható, majd az így létrehozott képet a Gemini Omni Flash animálhatja videóvá. Az Interactions API használatával akár három egymást követő szerkesztés is elvégezhető. A Google két demóalkalmazást is készített, az Anywhere-t és a Space Lift-et, amelyek bemutatják a két modell együttes használatát egy munkafolyamatban. A Nano Banana 2 Lite és a Gemini Omni Flash 2026. június 30-tól érhető el.
Kapcsolódó: DeepMind Veo 3.1 Lite