🔥 5 promocji w KinetyceGemini Pro 170 zł -91%Adobe CC 169 zł -84%Brain.fm 109 zł -70%i 2 więcej do 13.09 Zobacz →
Przejdź do treści
Magazyn

Trzy generatory obrazów, sześć zadań, te same prompty. Polskie ogonki przestały być problemem, liczenie jabłek jeszcze nie

Nano Banana 2, Nano Banana Pro i GPT-5.4 Image 2 dostały identyczne polecenia: polski napis z ogonkami, liczenie owoców, dłonie, warszawski tramwaj, płaska ilustracja i diagram. Wszystkie wyniki obok siebie, bez wybierania najlepszych prób.

5 min czytania
Warszawski tramwaj wygenerowany przez Nano Banana Pro

👁 134 przeczytań

// w skrócie
  • Nano Banana Pro wygrało test sześciu zadań: poprawnie policzyło owoce, wykonało polecenie minimalizmu dosłownie i odwzorowało Warszawę z Pałacem Kultury.
  • Polskie znaki diakrytyczne, takie jak ą, ę, ł, ś, ź, wszystkie trzy modele zapisały bezbłędnie - ten problem można uznać za rozwiązany.
  • GPT-5.4 Image 2 generował obrazy typowo w 76 sekund, czyli od czterech do ośmiu razy wolniej niż modele Google, co przy serii kilkudziesięciu ilustracji oznacza różnicę między kwadransem a godziną.

Pytanie, które dostaję najczęściej przy generatorach obrazów, brzmi: który jest teraz najlepszy. Odpowiedź „to zależy” jest prawdziwa i bezużyteczna, więc zrobiłem to, co zwykle: te same polecenia do trzech modeli, jeden przebieg każde, żadnego wybierania najładniejszej z kilku prób. Co wyszło, to wyszło, i wszystko jest poniżej obok siebie.

Modele: Nano Banana 2 i Nano Banana Pro od Google (oba z czerwca) oraz GPT-5.4 Image 2 od OpenAI (z kwietnia). Uprzedzając pytanie: nowszego modelu graficznego OpenAI po prostu nie ma, sprawdziłem listę modeli 4 września i najświeższą pozycją z tej firmy jest właśnie ten. Sześć zadań wybrałem tak, żeby każde mierzyło jedną konkretną umiejętność, a nie ogólne „ładnie”.

Zadanie 1: polski napis z ogonkami

Porównanie generatorów obrazów, zadanie 1
Zadanie 1: plakat z napisem „Zażółć gęślą jaźń". Od lewej: Nano Banana 2, Nano Banana Pro, GPT-5.4 Image 2.

Jeszcze rok temu to był test, który oblewał każdy generator: litery ą, ę, ł, ś, ź lądowały jako przypadkowe kreski albo znikały. Dziś wszystkie trzy modele zapisały „Zażółć gęślą jaźń” bezbłędnie, z każdym znakiem diakrytycznym na miejscu. Różnice są wyłącznie stylistyczne: Google dodał ramę i taśmę klejącą, OpenAI zrobił goły arkusz. Ten problem można uznać za rozwiązany.

Zadanie 2: dokładnie cztery jabłka i dwie gruszki

Porównanie generatorów obrazów, zadanie 2
Zadanie 2: dokładnie cztery czerwone jabłka i dwie zielone gruszki. Od lewej: Nano Banana 2 (pięć jabłek), Nano Banana Pro, GPT-5.4 Image 2.

Liczenie to nadal słaby punkt. Nano Banana 2 dorysowało piąte jabłko. Nano Banana Pro i GPT-5.4 Image 2 policzyły poprawnie, przy czym model OpenAI ułożył owoce w sztywną siatkę dwa na trzy, jakby chciał ułatwić sobie zadanie, a model Google rozrzucił je naturalnie i też się nie pomylił. Jeżeli obraz ma pokazywać konkretną liczbę czegokolwiek, tańszy model Google odpada.

Zadanie 3: dłonie

Porównanie generatorów obrazów, zadanie 3
Zadanie 3: dłonie wiążące sznurowadła. Od lewej: Nano Banana 2, Nano Banana Pro, GPT-5.4 Image 2.

Klasyczny test, w którym generatory kiedyś dorysowywały szósty palec. Na wszystkich trzech obrazach dłonie mają poprawną liczbę palców i sensowny chwyt sznurowadła. Nano Banana Pro dało najbardziej fotograficzny kadr z błotem na bucie, GPT-5.4 Image 2 najczystszy, ale nieco plastikowy. Przy tej rozdzielczości nie widzę błędów anatomii u żadnego.

Zadanie 4: Warszawa, tramwaj, deszcz, zmierzch

Porównanie generatorów obrazów, zadanie 4
Zadanie 4: czerwony tramwaj w Warszawie o zmierzchu, w deszczu. Od lewej: Nano Banana 2, Nano Banana Pro, GPT-5.4 Image 2.

Tu widać, co modele wiedzą o Polsce. Nano Banana Pro wstawiło w tło Pałac Kultury i przegubowy tramwaj w barwach warszawskich, czyli scenę, którą rozpozna każdy, kto był w stolicy. Nano Banana 2 dało ulicę w stylu starówki z czytelnymi polskimi szyldami. GPT-5.4 Image 2 wygenerowało zabytkowy wagon z tablicą kierunkową i słupek przystankowy, poprawnie, ale bez punktu orientacyjnego. Wszystkie trzy trzymają światło, mokry bruk i odbicia na poziomie, który dwa lata temu był nieosiągalny.

Zadanie 5: płaska ilustracja, minimalizm, bez tekstu

Porównanie generatorów obrazów, zadanie 5
Zadanie 5: płaska, minimalistyczna ilustracja latarni na ciemnym tle, bez tekstu. Od lewej: Nano Banana 2, Nano Banana Pro, GPT-5.4 Image 2.

Polecenie mówiło wprost: jedna latarnia, cienka linia horyzontu, dużo pustej przestrzeni, żadnego tekstu. Tylko Nano Banana Pro wykonało je dosłownie i wyszła z tego najczystsza ilustracja w całym teście. Nano Banana 2 dorobiło morze i skały, GPT-5.4 Image 2 dorzuciło księżyc, gwiazdy i skalistą wyspę. Ładnie, ale nikt o to nie prosił. W pracy redakcyjnej, gdzie ilustracja ma pasować do ustalonego stylu, posłuszeństwo wobec promptu jest ważniejsze niż inwencja.

Zadanie 6: diagram z polskimi etykietami

Porównanie generatorów obrazów, zadanie 6
Zadanie 6: diagram z etykietami „Prompt", „Model", „Odpowiedź". Od lewej: Nano Banana 2, Nano Banana Pro, GPT-5.4 Image 2.

Trzy pudełka, dwie strzałki, etykiety „Prompt”, „Model”, „Odpowiedź”. Wszystkie trzy modele zrobiły to poprawnie, z ogonkiem w ostatnim słowie. Różnią się tylko stylem: Google koloruje pudełka, OpenAI daje czarne kontury na białym. Diagramy z krótkim tekstem są dziś bezpieczne u każdego.

Czas generowania

Model Najszybciej Najwolniej Typowo
Nano Banana 2 8 s 17 s około 12 s
Nano Banana Pro 19 s 28 s około 21 s
GPT-5.4 Image 2 59 s 97 s około 76 s
Czas od wysłania polecenia do odebrania pliku, przez to samo API, tego samego wieczoru.

Model OpenAI był od czterech do ośmiu razy wolniejszy od obu modeli Google. Przy jednym obrazie to bez znaczenia, przy serii kilkudziesięciu ilustracji to różnica między kwadransem a godziną.

Werdykt

Nano Banana Pro wygrało ten test: policzyło owoce, posłuchało polecenia o minimalizmie, dało najbardziej rozpoznawalną Warszawę i nie popełniło żadnego błędu w tekście. Nano Banana 2 jest najszybsze i wystarcza do większości zadań, ale nie tam, gdzie liczy się dokładna liczba obiektów. GPT-5.4 Image 2 robi poprawne, czyste obrazy, tylko bardzo wolno i z tendencją do dorabiania ozdób, o które nikt nie prosił.

Jedno zastrzeżenie: sześć zadań i jeden przebieg każdego to zwiad, nie pomiar statystyczny. Pokazuje, co wyszło z pierwszej próby, bo tak właśnie korzysta z tych narzędzi większość ludzi. Aktualne stawki wszystkich trzech modeli są na ich stronach w OpenRouterze i zmieniają się częściej, niż zdążyłbym je tu aktualizować.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Aktualizacja 5 września: dłuższy tekst na plakacie

Po pierwszym teście dostałem pytanie, czy jedno zdanie z ogonkami to nie za mało. Sprawdziłem więc plakat z nagłówkiem i czterema liniami po polsku: „Cztery zasady dobrego promptu”, a pod spodem „Podaj cel i odbiorcę”, „Dołącz przykład”, „Określ długość i format”, „Sprawdź źródła, zanim uwierzysz”. Osiem słów z ogonkami, w tym „źródła” i „długość”, które lubią się rozsypywać.

Zadanie 7: plakat z listą czterech zasad
Zadanie 7: nagłówek i cztery linie polskiego tekstu. Od lewej: Nano Banana 2, Nano Banana Pro, GPT-5.4 Image 2.

Wszystkie trzy modele oddały pełny tekst bez jednego błędu w literach i znakach diakrytycznych. Nano Banana 2 dodało punktory, o które nie prosiłem, Nano Banana Pro wyśrodkowało tekst na wygniecionej kartce, GPT-5.4 Image 2 ustawiło go do lewej na czystym arkuszu. Czasy jak wcześniej: 8, 20 i 77 sekund. Wniosek z pierwszego testu tylko się umocnił: polski tekst na obrazie, także dłuższy, przestał być przeszkodą u każdego z tych trzech generatorów.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Który generator obrazów jest teraz najlepszy - Nano Banana Pro, Nano Banana 2 czy GPT-5.4 Image 2?

Nano Banana Pro wygrało test sześciu zadań przeprowadzonych na tych samych promptach. Policzyło poprawnie cztery jabłka i dwie gruszki, jako jedyne dosłownie wykonało polecenie minimalizmu i wygenerowało najbardziej rozpoznawalną Warszawę z Pałacem Kultury w tle.

Czy generatory obrazów potrafią już poprawnie pisać polskie ogonki?

Tak, wszystkie trzy testowane modele zapisały zdanie 'Zażółć gęślą jaźń' bezbłędnie, z każdym znakiem diakrytycznym na miejscu. Jeszcze rok temu ten sam test oblewał każdy generator.

Czy generatory obrazów potrafią poprawnie liczyć obiekty na ilustracji?

Nie zawsze - Nano Banana 2 dorysowało piąte jabłko, gdy prompt wymagał dokładnie czterech czerwonych jabłek i dwóch gruszek. Nano Banana Pro i GPT-5.4 Image 2 policzyły poprawnie, choć model OpenAI ułożył owoce w sztywną siatkę dwa na trzy.

Jak długo trwa generowanie obrazu przez GPT-5.4 Image 2 w porównaniu z modelami Google?

GPT-5.4 Image 2 generował obrazy typowo w około 76 sekund, podczas gdy Nano Banana 2 typowo w 12 sekund, a Nano Banana Pro w 21 sekund. Oznacza to, że model OpenAI był od czterech do ośmiu razy wolniejszy od obu modeli Google.

// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony
🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 336 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie