Szóstego października Google wypuściło do aplikacji Gemini nowy model do obrazków, Nano Banana 2.1. W rankingu preferencji, w którym ludzie porównują grafiki z różnych modeli obok siebie, wygrywa z poprzednikiem i z droższym Nano Banana Pro, więc de facto z czymkolwiek, co Google miało do tej pory. Może pisać po polsku, rozumie polecenia po polsku, a do jednego obrazka przyjmie aż czternaście zdjęć referencyjnych, co otwiera rzeczy, które jeszcze rok temu były domeną specjalistycznych programów.
Ten tekst to instrukcja od zera. Pokażę trzy ścieżki: aplikację Gemini na telefon i komputer, Google AI Studio dla osób, które chcą mieć większą kontrolę, i plac bojowy bez logowania dla niecierpliwych. Dorzucam ceny planów w Polsce, sprawę znaku wodnego i listę rzeczy, które ten model robi źle, bo ich poznanie oszczędzi ci godziny przeformułowywania promptów.
Spis treści:
- Co to jest Nano Banana 2.1
- Jak zacząć za darmo w aplikacji Gemini
- Google AI Studio: więcej kontroli, także bez opłat
- Obrazki bez logowania: co realnie działa
- Co dają plany płatne w Polsce
- Znak wodny: co siedzi w wygenerowanym obrazku
- Czego się spodziewać: znane ograniczenia
- Źródła
Co to jest Nano Banana 2.1
Nazwa brzmi jak żart, ale technicznie to członek rodziny Gemini 3 oparty na modelu Gemini 3.6 Flash, czyli na tym samym silniku, który napędza szybki czat Google. Model przyjmuje tekst i obrazki, zwraca obrazek plus wyjaśnienie, a okno kontekstu sięga miliona tokenów. W praktyce możesz wrzucić kilkanaście fotografii i długie polecenie naraz.
Jeśli znałeś generowanie obrazków w ChatGPT, to tu jest ta sama idea: piszesz, co chcesz zobaczyć, model rysuje. Różnica robi się widoczna przy poprawkach. Nano Banana 2.1 prowadzi rozmowę o obrazie, więc zamiast pisać prompt od nowa mówisz „zmień tło na kuchnię” albo „usuń osobę z prawej”. W testach porównawczych ogłoszonych wraz z premierą model w trybie „Thinking” dostał 1050 punktów ogólnej preferencji wobec 990 poprzednika i 935 wersji Pro, a w spójności wielu postaci na jednym obrazie skoczył na 1106 punktów. To ostatnie brzmi jak szczegół, ale to właśnie spójność postaci psuła serię grafik do sklepu czy bloga charakter.
Model radzi sobie też z tekstem na grafice, w tym w różnych językach, co przy napisach na plakacie czy infografice odróżnia użyteczny obrazek od bełkotu z literówek. Znane ograniczenie pozostaje: drobny tekst przy niskiej rozdzielczości wychodzi rozmyty, a przy dłuższych akapitach literówki się zdarzają. Google chwali się renderowaniem napisów w wielu językach, ale polskich nie testowaliśmy na własnych generacjach, więc traktuj to jako funkcję do sprawdzenia, nie obietnicę.
Cena jest ciekawa od strony technicznej: w API obrazek w rozdzielczości 1K kosztuje teraz około 0,034 dolara, bo Google przeceniło tokeny obrazu o połowę względem poprzednika. Dla ciebie jako użytkownika aplikacji ważniejsze jest jedno: darmowe konto dostaje dostęp do modelu bez płacenia.
Jak zacząć za darmo w aplikacji Gemini
Potrzebujesz konta Google i przeglądarki albo aplikacji. Wchodzisz na gemini.google, logujesz się i piszesz po polsku, na przykład „narysuj plakat warsztatów jogi w tonacji zieleni, z datą i miejscem”. Pod czatem pojawia się wygenerowana grafika, którą poprawiasz kolejnymi zdaniami. Nie ma tu żadnej instalacji ani karty płatniczej.
Edycja własnych zdjęć działa tak samo: wgrywasz fotografię przyciskiem plus i opisujesz zmianę. To jest właśnie ta funkcja „na podstawie zdjęcia”, po którą ludzie szukają najczęściej: wgranie portretu i prośba o zmianę tła, ubrania czy stylu. Google w tym tygodniu dopiąło też w aplikacji generowanie obrazów z osobami bliskimi, czyli scen z udziałem osób z twoich zdjęć, co Telepolis opisało 7 października. Zanim rzucisz na to rodzinne albumy, przeczytaj niżej sekcję o znaku wodnym i o tym, gdzie te zdjęcia trafiają.
Dokładnego dziennego limitu darmowych generacji Google nie publikuje. Limit istnieje, odnawia się codziennie i zależy od obciążenia, więc w dzień szczytu bywa niższy. Jeśli trafisz na jego kraniec, poczekaj albo sięgnij po AI Studio z następnej sekcji. Osobna ścieżka dla posiadaczy Windows: aplikacja Gemini na komputer, dostępna od sierpnia pod skrótem Alt plus Spacja, również generuje obrazki z Nano Banana, więc można rysować prosto z pulpitu bez otwierania przeglądarki.
Google AI Studio: więcej kontroli, także bez opłat
AI Studio to warsztat Google dla ludzi testujących modele, dostępny na aistudio.google po zalogowaniu kontem Google. Wybierasz model Nano Banana 2.1, wpisujesz prompt i dostajesz obrazek, ale po drodze możesz ustawić proporcje kadru, rozdzielczość 1K, 2K albo 4K i podejrzeć parametry, które w aplikacji są schowane. Do tego interfejs po angielsku, więc jeśli angielski cię odpycha, zostań przy aplikacji Gemini.
Rozdzielczości mają znaczenie praktyczne. Do mediów społecznościowych wystarczy 1K, do druku ulotki chcesz 4K, a różnica w cenie jest przy API odczuwalna tylko dla twórców aplikacji, nie dla ciebie przy pojedynczych grafikach. Obsługiwane proporcje to między innymi 1:1, 16:9 i 9:16, więc pionowa historia na Instagram czy poziomy nagłówek bloga ustawisz jednym przełącznikiem zamiast docięć w edytorze.
Obrazki bez logowania: co realnie działa
Fraza „generowanie obrazów bez logowania” jest w Google jedną z najczęstszych podpowiedzi, więc powiem wprost, jak to wygląda. Oficjalne ścieżki Google, czyli aplikacja Gemini i AI Studio, wymagają konta, choć darmowego. Nie ma oficjalnego Google bez rejestracji.
Bez konta zostają tzw. areny modeli, jak LMArena, gdzie porównuje się modele z innymi i można trafić na tryb generowania obrazów. To dobre miejsce, żeby podejrzeć, co potrafi Nano Banana 2.1 w porównaniu z konkurencją, z dwoma zastrzeżeniami: kolejka bywa długa, a dostępność konkretnego modelu zmienia się z dnia na dzień. Na marginesie: znalezione tam obrazki nie mają historii rozmowy, więc poprawki piszesz od zera. Do regularnej pracy załóż darmowe konto, to dwie minuty i żadnych opłat.
Co dają plany płatne w Polsce
Darmowe konto wystarczy do nauki i do okazjonalnych grafik. Subskrypcje wchodzą do gry, gdy generujesz dużo i chcesz wyższe limity oraz najmocniejsze modele w czacie obok obrazków. Według cennika Google sprawdzanego na początku października plan AI Plus kosztuje w Polsce 46,99 złotego miesięcznie, a AI Pro 97,99 złotego. Najwyższa półka, AI Ultra z narzędziem do wideo Gemini Omni, na polskiej liście planów w tamtym tygodniu nie figurowała.
Ceny samych narzędzi śledzimy zresztą na bieżąco w naszej tabeli narzędzi AI, gdzie Gemini ma swój wiersz obok ChatGPT i Claude’a. Osobna droga dla twórców: API. Google nie przewidziało darmowego tieru dla Nano Banana 2.1 w API, tam płaci się od tokena. Skala jest jednak niska, bo wspomniane 0,034 dolara za obrazek 1K oznacza, że setka grafik kosztuje około trzech i pół dolara. To opcja dla kogoś, kto buduje własny katalog czy generator na stronie, nie dla osoby potrzebującej banera na czwartek.
Znak wodny: co siedzi w wygenerowanym obrazku
Obrazki z Gemini niosą niewidoczny znak SynthID, wbudowany w piksele przez Google. Od 8 października działa też publiczny detektor SynthID, więc można sprawdzić, czy dana grafika pochodzi z modeli Google. Do tego Nano Banana 2.1 zapisuje w plikach metadane Content Credentials (C2PA), czyli podpis informujący, że obraz powstał maszynowo i jak był edytowany.
Dlaczego to ważne w poradniku o darmowych obrazkach? Bo gdy publikujesz takie grafiki na firmowym blogu albo w sklepie, coraz więcej narzędzi i platform potrafi rozpoznać ich pochodzenie, i lepiej, żebyś ty wiedział o tym pierwszy. Pisaliśmy szerzej o tym mechanizmie w tekście o znaku wodnym w ChatGPT, zasada jest ta sama: nie ma się czego wstydzić, ale nie ma co udawać, że śladu nie ma.
Czego się spodziewać: znane ograniczenia
Karta modelu wymienia słabości wprost i warto je znać przed pierwszą sesją. Drobny tekst na grafice wychodzi rozmyty, zwłaszcza w rozdzielczości 1K. Spójność postaci między wgranym zdjęciem a wynikiem nie jest idealna, więc twarz z rodzinnej fotografii po zmianie stroju może się różnić. Model myli czasem stronę lewą z prawą przy poleceniach pozycyjnych, a przy edycji zdarza mu się trzymać pozę oryginału, nawet gdy prosiłeś o zmianę ustawienia.
Do tego dochodzi cicha pułapka wiedzy: silnik Gemini 3.6 Flash zna świat do marca 2026, a w niektórych dziedzinach do stycznia 2025, więc grafiki „z ostatnich wydarzeń” mogą pokazywać stan sprzed miesięcy. Model odtwarza scenę z pamięci treningowej, nie szuka w sieci.
Nota uczciwości: ścieżki w tym tekście odtworzyłem według dokumentacji Google i materiałów z premiery, nie na własnym koncie, a jakość polskich napisów na obrazkach nie była przez nas mierzona. Liczby punktów i cen pochodzą z karty modelu oraz cenników z 6 i 7 października.
Źródła
- Karta modelu Nano Banana 2.1, Google DeepMind (6.10.2026)
- Unite.AI 6.10.2026: Nano Banana 2.1 Halves the Per-Token Image Price of Its Predecessor
- OneTech.pl 7.10.2026: Google wypuściło Nano Banana 2.1
- Notki wersji aplikacji Gemini, Google (aplikacja na Windows, sierpień 2026)
- Telepolis.pl 7.10.2026: Gemini wygeneruje obrazy z Twoimi bliskimi
- Cennik Gemini API, Google AI (aktualizacja 7.10.2026)
- Detektor SynthID, Google DeepMind (dostęp publiczny od 8.10.2026)
