Notebookcheck Logo

Google Nano Banana 2.1: Továbbfejlesztett képgeneráló modell feleannyiért

A Google DeepMind grafikája a Nano Banana 2.1 képmodellről
ⓘ Google DeepMind
A Google bevezeti a Nano Banana 2.1-et a Gemini alkalmazásban és a Google Keresőben, továbbfejlesztett képszerkesztést kínálva, és nagyjából felére csökkentve a fejlesztők számára a képenkénti költséget
A Google bemutatta Nano Banana 2.1 képgeneráló modelljét. A Google saját tesztjei szerint állítólag mind az elődjét, mind a Pro modellt felülmúlja, és javult a képek egyes részeinek szerkesztése, valamint az emberek megjelenésének megőrzése több szerkesztési lépés során. A fejlesztők számára a képenkénti ár nagyjából a felére csökken, bár a bemeneti költségek magasabbak.
AI Software

A Google februárban újította meg képgeneráló modelljét a Nano Banana 2-vel, és máris itt az újabb frissítés. A Nano Banana 2.1 a Gemini 3.6 Flashre épül, és a Google szerint minden téren felülmúlja elődeit, különösen a vizuális tervezésben, a képek egyes részeinek szerkesztésében, valamint az emberek és tárgyak megjelenésének megőrzésében több szerkesztési lépésen át. A Google fokozatosan teszi elérhetővé a modellt a Gemini alkalmazásban, a Google Search AI Mode funkciójában, a Google Adsben, valamint a fejlesztői eszközökben, köztük az AI Studio, a Flow és a Stitch szolgáltatásokban.

Egyelőre kizárólag a Google saját adatai jelzik, mekkora a fejlődés. Az emberi értékelőkkel végzett összehasonlító tesztekben a Nano Banana 2.1 bekapcsolt Thinking funkcióval 1 050 Elo-pontot ér el az összesített preferencia tekintetében, szemben a Nano Banana 2 990 és a drágább Nano Banana Pro 935 pontjával. Az infografikáknál különösen nagy a különbség: az új modell 0,521 pontot ér el a tényszerű pontosság terén, míg a Nano Banana 2 mindössze 0,179-et. Független tesztek még nem állnak rendelkezésre.

Terület kijelölése a kép újragenerálása helyett

A mindennapi használatban valószínűleg a maszkalapú szerkesztés lesz a leghasznosabb fejlesztés: a felhasználók kijelölik a kép egy területét, és csak az a rész változik meg. A funkció jelei már márciusban megjelentek a Gemini alkalmazásban. A Nano Banana 2.1 egyszerre akár 14 referenciaképet is kezel, köztük legfeljebb négy ember és tíz tárgy képét, amelyek megjelenését meg kell őriznie. Akár 4K kimeneti felbontást és 8:1 képarányt is támogat. Szükség esetén a modell a Google Search segítségével tájékozódik, mielőtt valós témákat ábrázolna.

Alacsonyabb képárak, magasabb bemeneti költségek

A Google nagyjából megfelezi a fejlesztők számára a képenkénti árat: a Gemini API-n keresztül egy 1K felbontású kép 6,7 cent helyett körülbelül 3,4 centbe kerül, míg egy 4K felbontású kép ára 15,1 cent helyett körülbelül 7,6 cent. A kötegelt feladatok 50%-kal kevesebbe kerülnek. A számítás azonban nem ennyire egyszerű, mert a bemeneti költségek emelkednek: a Google mostantól a szöveges, képi és videós bemenetekért millió tokenenként 1,50 dollárt számít fel a korábbi 0,50 dollár helyett. A sok referenciaképpel dolgozó fejlesztők ezért kevesebbet takarítanak meg, mint amennyit a megfelezett képárak sugallhatnak.

Marad így szerepe a Nano Banana Prónak? Sok feladatnál valószínűleg nem, feltéve, hogy a Google adatai a gyakorlatban is megállják a helyüket. Az új modell továbbra sem tökéletes, ahogy azt a Google is elismeri a modell adatlapján: a kis méretű szöveg 1K felbontásnál gyakran elmosódott marad, az emberek nem mindig néznek ki pontosan úgy, mint a referenciaképeiken, és a modell időnként összekeveri a bal és a jobb oldalt. A Nano Banana 2.1 tehát inkább egy megbízható frissítés, mintsem az eredeti verzióhoz mérhető ugrás, és a legerősebb érv mellette az ára.

Google LogoAdd as a preferred source on Google
Mail Logo
> Magyarország - Kezdőlap > Hírek > News Archive > Newsarchive 2026 10 > Google Nano Banana 2.1: Továbbfejlesztett képgeneráló modell feleannyiért
Jan Gruber, 2026-10- 8 (Update: 2026-10- 8)