Trzy generatory obrazów, sześć zadań, te same prompty. Polskie ogonki przestały być problemem, liczenie jabłek jeszcze nie
Nano Banana 2, Nano Banana Pro i GPT-5.4 Image 2 dostały identyczne polecenia: polski napis z ogonkami, liczenie owoców, dłonie, warszawski tramwaj, płaska ilustracja i diagram. Wszystkie wyniki obok siebie, bez wybierania najlepszych prób.
👁 134 przeczytań
- Nano Banana Pro wygrało test sześciu zadań: poprawnie policzyło owoce, wykonało polecenie minimalizmu dosłownie i odwzorowało Warszawę z Pałacem Kultury.
- Polskie znaki diakrytyczne, takie jak ą, ę, ł, ś, ź, wszystkie trzy modele zapisały bezbłędnie - ten problem można uznać za rozwiązany.
- GPT-5.4 Image 2 generował obrazy typowo w 76 sekund, czyli od czterech do ośmiu razy wolniej niż modele Google, co przy serii kilkudziesięciu ilustracji oznacza różnicę między kwadransem a godziną.
Pytanie, które dostaję najczęściej przy generatorach obrazów, brzmi: który jest teraz najlepszy. Odpowiedź „to zależy” jest prawdziwa i bezużyteczna, więc zrobiłem to, co zwykle: te same polecenia do trzech modeli, jeden przebieg każde, żadnego wybierania najładniejszej z kilku prób. Co wyszło, to wyszło, i wszystko jest poniżej obok siebie.
Modele: Nano Banana 2 i Nano Banana Pro od Google (oba z czerwca) oraz GPT-5.4 Image 2 od OpenAI (z kwietnia). Uprzedzając pytanie: nowszego modelu graficznego OpenAI po prostu nie ma, sprawdziłem listę modeli 4 września i najświeższą pozycją z tej firmy jest właśnie ten. Sześć zadań wybrałem tak, żeby każde mierzyło jedną konkretną umiejętność, a nie ogólne „ładnie”.
Zadanie 1: polski napis z ogonkami

Jeszcze rok temu to był test, który oblewał każdy generator: litery ą, ę, ł, ś, ź lądowały jako przypadkowe kreski albo znikały. Dziś wszystkie trzy modele zapisały „Zażółć gęślą jaźń” bezbłędnie, z każdym znakiem diakrytycznym na miejscu. Różnice są wyłącznie stylistyczne: Google dodał ramę i taśmę klejącą, OpenAI zrobił goły arkusz. Ten problem można uznać za rozwiązany.
Zadanie 2: dokładnie cztery jabłka i dwie gruszki

Liczenie to nadal słaby punkt. Nano Banana 2 dorysowało piąte jabłko. Nano Banana Pro i GPT-5.4 Image 2 policzyły poprawnie, przy czym model OpenAI ułożył owoce w sztywną siatkę dwa na trzy, jakby chciał ułatwić sobie zadanie, a model Google rozrzucił je naturalnie i też się nie pomylił. Jeżeli obraz ma pokazywać konkretną liczbę czegokolwiek, tańszy model Google odpada.
Zadanie 3: dłonie

Klasyczny test, w którym generatory kiedyś dorysowywały szósty palec. Na wszystkich trzech obrazach dłonie mają poprawną liczbę palców i sensowny chwyt sznurowadła. Nano Banana Pro dało najbardziej fotograficzny kadr z błotem na bucie, GPT-5.4 Image 2 najczystszy, ale nieco plastikowy. Przy tej rozdzielczości nie widzę błędów anatomii u żadnego.
Zadanie 4: Warszawa, tramwaj, deszcz, zmierzch

Tu widać, co modele wiedzą o Polsce. Nano Banana Pro wstawiło w tło Pałac Kultury i przegubowy tramwaj w barwach warszawskich, czyli scenę, którą rozpozna każdy, kto był w stolicy. Nano Banana 2 dało ulicę w stylu starówki z czytelnymi polskimi szyldami. GPT-5.4 Image 2 wygenerowało zabytkowy wagon z tablicą kierunkową i słupek przystankowy, poprawnie, ale bez punktu orientacyjnego. Wszystkie trzy trzymają światło, mokry bruk i odbicia na poziomie, który dwa lata temu był nieosiągalny.
Zadanie 5: płaska ilustracja, minimalizm, bez tekstu

Polecenie mówiło wprost: jedna latarnia, cienka linia horyzontu, dużo pustej przestrzeni, żadnego tekstu. Tylko Nano Banana Pro wykonało je dosłownie i wyszła z tego najczystsza ilustracja w całym teście. Nano Banana 2 dorobiło morze i skały, GPT-5.4 Image 2 dorzuciło księżyc, gwiazdy i skalistą wyspę. Ładnie, ale nikt o to nie prosił. W pracy redakcyjnej, gdzie ilustracja ma pasować do ustalonego stylu, posłuszeństwo wobec promptu jest ważniejsze niż inwencja.
Zadanie 6: diagram z polskimi etykietami

Trzy pudełka, dwie strzałki, etykiety „Prompt”, „Model”, „Odpowiedź”. Wszystkie trzy modele zrobiły to poprawnie, z ogonkiem w ostatnim słowie. Różnią się tylko stylem: Google koloruje pudełka, OpenAI daje czarne kontury na białym. Diagramy z krótkim tekstem są dziś bezpieczne u każdego.
Czas generowania
| Model | Najszybciej | Najwolniej | Typowo |
|---|---|---|---|
| Nano Banana 2 | 8 s | 17 s | około 12 s |
| Nano Banana Pro | 19 s | 28 s | około 21 s |
| GPT-5.4 Image 2 | 59 s | 97 s | około 76 s |
Model OpenAI był od czterech do ośmiu razy wolniejszy od obu modeli Google. Przy jednym obrazie to bez znaczenia, przy serii kilkudziesięciu ilustracji to różnica między kwadransem a godziną.
Werdykt
Nano Banana Pro wygrało ten test: policzyło owoce, posłuchało polecenia o minimalizmie, dało najbardziej rozpoznawalną Warszawę i nie popełniło żadnego błędu w tekście. Nano Banana 2 jest najszybsze i wystarcza do większości zadań, ale nie tam, gdzie liczy się dokładna liczba obiektów. GPT-5.4 Image 2 robi poprawne, czyste obrazy, tylko bardzo wolno i z tendencją do dorabiania ozdób, o które nikt nie prosił.
Jedno zastrzeżenie: sześć zadań i jeden przebieg każdego to zwiad, nie pomiar statystyczny. Pokazuje, co wyszło z pierwszej próby, bo tak właśnie korzysta z tych narzędzi większość ludzi. Aktualne stawki wszystkich trzech modeli są na ich stronach w OpenRouterze i zmieniają się częściej, niż zdążyłbym je tu aktualizować.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Aktualizacja 5 września: dłuższy tekst na plakacie
Po pierwszym teście dostałem pytanie, czy jedno zdanie z ogonkami to nie za mało. Sprawdziłem więc plakat z nagłówkiem i czterema liniami po polsku: „Cztery zasady dobrego promptu”, a pod spodem „Podaj cel i odbiorcę”, „Dołącz przykład”, „Określ długość i format”, „Sprawdź źródła, zanim uwierzysz”. Osiem słów z ogonkami, w tym „źródła” i „długość”, które lubią się rozsypywać.

Wszystkie trzy modele oddały pełny tekst bez jednego błędu w literach i znakach diakrytycznych. Nano Banana 2 dodało punktory, o które nie prosiłem, Nano Banana Pro wyśrodkowało tekst na wygniecionej kartce, GPT-5.4 Image 2 ustawiło go do lewej na czystym arkuszu. Czasy jak wcześniej: 8, 20 i 77 sekund. Wniosek z pierwszego testu tylko się umocnił: polski tekst na obrazie, także dłuższy, przestał być przeszkodą u każdego z tych trzech generatorów.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Który generator obrazów jest teraz najlepszy - Nano Banana Pro, Nano Banana 2 czy GPT-5.4 Image 2?
Nano Banana Pro wygrało test sześciu zadań przeprowadzonych na tych samych promptach. Policzyło poprawnie cztery jabłka i dwie gruszki, jako jedyne dosłownie wykonało polecenie minimalizmu i wygenerowało najbardziej rozpoznawalną Warszawę z Pałacem Kultury w tle.
Czy generatory obrazów potrafią już poprawnie pisać polskie ogonki?
Tak, wszystkie trzy testowane modele zapisały zdanie 'Zażółć gęślą jaźń' bezbłędnie, z każdym znakiem diakrytycznym na miejscu. Jeszcze rok temu ten sam test oblewał każdy generator.
Czy generatory obrazów potrafią poprawnie liczyć obiekty na ilustracji?
Nie zawsze - Nano Banana 2 dorysowało piąte jabłko, gdy prompt wymagał dokładnie czterech czerwonych jabłek i dwóch gruszek. Nano Banana Pro i GPT-5.4 Image 2 policzyły poprawnie, choć model OpenAI ułożył owoce w sztywną siatkę dwa na trzy.
Jak długo trwa generowanie obrazu przez GPT-5.4 Image 2 w porównaniu z modelami Google?
GPT-5.4 Image 2 generował obrazy typowo w około 76 sekund, podczas gdy Nano Banana 2 typowo w 12 sekund, a Nano Banana Pro w 21 sekund. Oznacza to, że model OpenAI był od czterech do ośmiu razy wolniejszy od obu modeli Google.



