✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Benchmarki

FLUX 3 pod lupą: 4K kontra 6 modeli

FLUX 3 jako jedyny daje prawdziwe 4K (16,8 Mpx detalu), ale w napisach wypadł średnio, a obraz 4K generował 392 sekundy.

9 min czytania
FLUX 3 Image - FLUX 3 pod lupą: 4K kontra 6 modeli

👁 162 przeczytań

// w skrócie
  • FLUX 3 Image jako jedyny z siedmiu testowanych modeli dostarcza prawdziwe 4K: 5456 x 3072 px z pełnymi 16,8 Mpx efektywnego detalu.
  • Generowanie jednego obrazu 4K w FLUX 3 trwało 392 sekundy, czyli ponad 10 razy dłużej niż u Nano Banana Pro (38 s) czy Ideogramu (19 s).
  • GPT Image 2.5 Sunburst, Grok Imagine 2 i Seedream 5 Pro poprawnie wyrenderowały wszystkie 8 napisów z promptu, podczas gdy FLUX 3 zaliczył tylko 6 z 8.

FLUX 3 Image jako jedyny z siedmiu sprawdzonych modeli daje 4K, które naprawdę jest 4K: 5456 × 3072 px i pełne 16,8 Mpx prawdziwego detalu. Nano Banana Pro i Nano Banana 2 też oddają plik około 16,9 Mpx, ale po moim pomiarze niosą tyle szczegółów, co obraz 4,2 Mpx. Rozdzielczość to jednak nie wszystko: w napisach FLUX 3 wypadł średnio (6 z 8), a GPT Image 2.5, Grok Imagine 2 i Seedream 5 Pro napisały wszystkie osiem bez błędu. Do tego 4K w FLUX 3 trwało 392 sekundy, dziesięć razy dłużej niż u konkurencji.

Black Forest Labs reklamuje FLUX 3 Image hasłem „natywne 4K”. To samo hasło widzę dziś przy połowie generatorów obrazów, więc zamiast liczyć piksele w nagłówku pliku, sprawdziłem, ile w tych pikselach jest prawdziwej informacji. Dałem siedmiu modelom ten sam szczegółowy kadr, kazałem wygenerować go w najwyższej rozdzielczości, jaką oferują, i obejrzałem wynik w skali 100%.

Kadr wybrałem złośliwie: Rynek Główny w Krakowie o zmierzchu, sześć szyldów sklepów, kiosk z gazetą i tramwaj z numerem linii. Drobne napisy, kostka brukowa, gołębie i detal architektury szybko pokazują, czy model rysuje szczegóły, czy tylko powiększa mniejszy obraz.

Hub FLUX - modele Black Forest Labs, testy i prompty: FLUX 3 Image i FLUX.2.

Jak testowałem

  • Data: 1 października 2026, dzień premiery FLUX 3 Image.
  • Dostęp: wszystkie modele przez API fal.ai, każdy w najwyższej dostępnej rozdzielczości dla proporcji 16:9.
  • Jedno podejście: jeden obraz na model, bez losowania kilku wersji i bez wybierania najlepszej.
  • Ten sam prompt: identyczne polecenie po angielsku dla wszystkich, bez rozszerzania promptu po stronie modelu.
  • Napisy: osiem tekstów do wyrenderowania. Policzyłem je dwa razy - automatycznie (OCR modelem Gemini 3.8 Flash na kafelkach w natywnej rozdzielczości) i ręcznie, oglądając każdy szyld w powiększeniu.
  • Detal: „efektywna rozdzielczość” liczona testem zmniejszania i powiększania (wyjaśniam niżej).

Polecenie, które dostał każdy model:

Wide street photograph of the Main Market Square in Kraków at dusk, warm street lamps, many people walking. Small shop signs along the tenement facades, each clearly readable: "APTEKA", "KWIATY", "ZEGARMISTRZ", "LODY NATURALNE", "ANTYKWARIAT", "KANTOR". A newspaper kiosk in the foreground with a headline on the front page: "MIASTO BEZ KORKÓW?". A tram with route number "8" in the background. Cobblestones, pigeons, fine architectural detail.

Ustawienia na fal.ai:

  • FLUX 3 Image: resolution 4k, aspect_ratio 16:9.
  • Nano Banana Pro i Nano Banana 2: resolution 4K, aspect_ratio 16:9.
  • GPT Image 2.5 Sunburst: 3840 × 2160, quality high (to największy rozmiar, jaki przyjmuje).
  • Seedream 5 Pro: zamówiłem 4096 × 2304, a dostałem 2728 × 1536, bo model ma limit powierzchni 2048 × 2048 px.
  • Grok Imagine 2: resolution 2k, czyli maksimum.
  • Ideogram 4.5: landscape_16_9, quality high. API oddało 1280 × 720 px.

Co to jest efektywna rozdzielczość

Plik 5504 × 3072 px nie musi zawierać 16,9 Mpx szczegółów. Model może wygenerować mniejszy obraz i podbić go do „4K” zwykłym powiększeniem. Liczba pikseli rośnie, ale nowych informacji nie przybywa: dostajesz to samo, tylko bardziej rozmyte w zbliżeniu.

Sprawdziłem to prostą metodą. Z centrum każdego obrazu wyciąłem fragment, zmniejszyłem go (do 85%, 70%, 50% i dalej), a potem powiększyłem z powrotem do pierwotnego rozmiaru. Następnie porównałem wynik z oryginałem miarą SSIM, która mówi, jak bardzo dwa obrazy są do siebie podobne (1 oznacza identyczne).

  • Jeśli po zmniejszeniu o połowę i ponownym powiększeniu obraz prawie się nie zmienia (SSIM co najmniej 0,97), to połowa pikseli w każdym wymiarze była pusta, a prawdziwy detal mieści się w czterech razy mniejszym pliku.
  • Jeśli już lekkie zmniejszenie do 85% psuje obraz, to każdy piksel niesie informację i rozdzielczość jest prawdziwa.

Efektywna rozdzielczość to liczba megapikseli po największym zmniejszeniu, które jeszcze przechodzi próg 0,97. To przybliżenie, a nie normalizowany pomiar laboratoryjny, ale dobrze oddziela modele, które rysują detal, od tych, które go podbijają.

Wyniki: piksele, detal, napisy

ModelRozmiar plikuMpxEfektywnieNapisy (ręcznie)Napisy (OCR)CzasCena na fal.ai
FLUX 3 Image5456 × 307216,816,8 Mpx6/85/8392 s1K = 0,024 USD, 4K drożej (patrz niżej)
Nano Banana Pro5504 × 307216,94,2 Mpx7/87/838 s0,30 USD (4K)
Nano Banana 25504 × 307216,94,2 Mpx6/83/834 s0,16 USD (4K)
GPT Image 2.5 Sunburst3840 × 21608,34,1 Mpx8/85/845 s0,10 USD (high)
Grok Imagine 22816 × 15844,53,3 Mpx8/86/886 s0,06-0,08 USD (2K)
Seedream 5 Pro2728 × 15364,22,1 Mpx8/85/863 s0,135 USD
Ideogram 4.51280 × 7200,90,7 Mpx4/84/819 s0,22 USD (high)
Efektywna rozdzielczość (Mpx prawdziwego detalu)
FLUX 3 Image16,8
Nano Banana Pro4,2
Nano Banana 24,2
GPT Image 2.5 Sunburst4,1
Grok Imagine 23,3
Seedream 5 Pro2,1
Ideogram 4.50,7

Różnica jest duża. FLUX 3 nie przeszedł progu już przy zmniejszeniu do 85%, czyli każdy z jego 16,8 Mpx coś znaczy. Obie wersje Nano Banana zniosły zmniejszenie o połowę bez straty, więc ich „4K” to w praktyce obraz około 2750 × 1540 px rozciągnięty dwukrotnie. GPT Image 2.5 ma plik 8,3 Mpx, a detalu na 4,1 Mpx. Grok Imagine 2 wykorzystuje swoje 4,5 Mpx najlepiej spośród konkurentów (3,3 Mpx efektywnie).

Wycinki 100%: środek kadru

Każdy wycinek ma szerokość 12% kadru, w natywnych pikselach. Dlatego wycinek z większego obrazu ma więcej pikseli i na stronie wygląda ostrzej, jeśli model rzeczywiście narysował detal, albo bardziej miękko, jeśli tylko powiększył obraz.

Wycinek 100% ze środka kadru FLUX 3 Image: kamienice i dachy Rynku Głównego
FLUX 3 Image5456 × 3072 · wycinek 654 px
Wycinek 100% ze środka kadru Nano Banana Pro: fasada kamienicy
Nano Banana Pro5504 × 3072 · wycinek 660 px
Wycinek 100% ze środka kadru Nano Banana 2: latarnie i kamienice
Nano Banana 25504 × 3072 · wycinek 660 px
Wycinek 100% ze środka kadru GPT Image 2.5: tramwaj 8 Bronowice i latarnie
GPT Image 2.5 Sunburst3840 × 2160 · wycinek 460 px
Wycinek 100% ze środka kadru Grok Imagine 2: szyldy LODY NATURALNE i ANTYKWARIAT
Grok Imagine 22816 × 1584 · wycinek 337 px
Wycinek 100% ze środka kadru Seedream 5 Pro: tłum przechodniów i kiosk
Seedream 5 Pro2728 × 1536 · wycinek 327 px
Wycinek 100% ze środka kadru Ideogram 4.5: Sukiennice o zmierzchu
Ideogram 4.51280 × 720 · wycinek 153 px

W wycinku FLUX 3 widać pojedyncze dachówki, gzymsy i ozdoby attyk. U Nano Banana Pro fasada w tej samej skali wygląda jak miękko wyretuszowana: krawędzie okien są czyste, ale faktury tynku prawie nie ma. Wycinek z Ideogramu ma 153 px i [zdanie urwane - brak kontynuacji]. w powiększeniu zamienia się w plamy.

Wycinki 100%: dół kadru

Wycinek 100% z dołu kadru FLUX 3 Image: tramwaj z numerem 8, przechodnie i gołąb
FLUX 3 Image5456 × 3072 · wycinek 654 px
Wycinek 100% z dołu kadru Nano Banana Pro: gazeta z nagłówkiem MIASTO BEZ KORKOW
Nano Banana Pro5504 × 3072 · wycinek 660 px
Wycinek 100% z dołu kadru Nano Banana 2: kiosk z gazetą MIASTO BEZ KORKÓW
Nano Banana 25504 × 3072 · wycinek 660 px
Wycinek 100% z dołu kadru GPT Image 2.5: gazeta i stojak z prasą
GPT Image 2.5 Sunburst3840 × 2160 · wycinek 460 px
Wycinek 100% z dołu kadru Grok Imagine 2: kiosk z plakatami
Grok Imagine 22816 × 1584 · wycinek 337 px
Wycinek 100% z dołu kadru Seedream 5 Pro: nogi przechodniów na kostce brukowej
Seedream 5 Pro2728 × 1536 · wycinek 327 px
Wycinek 100% z dołu kadru Ideogram 4.5: drewniany kiosk
Ideogram 4.51280 × 720 · wycinek 153 px

Napisy: rozdzielczość to nie to samo co poprawny tekst

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Tu FLUX 3 nie wygrywa. Sprawdziłem osiem tekstów z promptu: sześć szyldów, nagłówek gazety i numer tramwaju.

Poprawne napisy (ręczna ocena, na 8)
GPT Image 2.5 Sunburst8
Grok Imagine 28
Seedream 5 Pro8
Nano Banana Pro7
FLUX 3 Image6
Nano Banana 26
Ideogram 4.54

Co dokładnie poszło nie tak:

  • FLUX 3 Image (6/8): szyldy APTEKA, KWIATY, LODY NATURALNE, ANTYKWARIAT i KANTOR są czyste i ostre, tramwaj ma „8”. Szyld ZEGARMISTRZ zasłoniła latarnia, widać tylko „GARMISTRZ”. Największy problem to kiosk: model obłożył go dziesiątkami gazet z wariacjami nagłówka („MATST BEZ KORKÓW?”, „NAZ KORKÓW”, „BEZ KORKÓW?”), a pełnego, poprawnego „MIASTO BEZ KORKÓW?” na żadnej nie ma.
  • Nano Banana Pro (7/8): wszystkie szyldy i tramwaj poprawne, w nagłówku zgubił polski znak: „KORKOW?” zamiast „KORKÓW?”.
  • Nano Banana 2 (6/8): zamiast KANTOR napisał coś w rodzaju „KAAYVWAL”, a tramwaj nie ma numeru.
  • GPT Image 2.5, Grok Imagine 2, Seedream 5 Pro (8/8): komplet. GPT dorzucił od siebie tablicę „8 Bronowice”, szyld „PRASA” i tytuły gazet, wszystko bez literówek.
  • Ideogram 4.5 (4/8): przy 1280 × 720 px szyldy APTEKA i KWIATY zamieniły się w zielony neon bez czytelnych liter, a nagłówka gazety nie da się odczytać.

Dlaczego automatyczny OCR dał inne liczby? Gemini dzielił napisy na linie („LODY” i „NATURALNE” osobno, „MIASTO” i „BEZ KORKÓW?” osobno), a kafelki cięły czasem szyld w połowie, więc mój skrypt porównujący całe frazy nie zaliczał poprawnych napisów. Najmocniej odbiło się to na Nano Banana 2 (OCR 3/8, ręcznie 6/8) i GPT Image 2.5 (5/8 kontra 8/8). Dlatego w tabeli podaję obie liczby, ale we wnioskach opieram się na ręcznej ocenie.

Wniosek: rozdzielczość i poprawność tekstu to dwie różne umiejętności. Nano Banana Pro ma cztery razy mniej prawdziwego detalu niż FLUX 3, a napisał o jeden napis więcej. Grok Imagine 2 z plikiem 4,5 Mpx napisał wszystko. Jeśli robisz plakat z dużym hasłem, 4K z FLUX 3 nic nie da, jeśli hasło wyjdzie z błędem.

4K jest wolne i nie zawsze tanie

FLUX 3 w trybie 4k generował obraz 392 sekundy, czyli ponad sześć i pół minuty. Nano Banana Pro oddał swój plik w 38 sekund, Ideogram w 19. Fal.ai sam ostrzega w opisie parametru, że 4k „może trwać kilka minut”. Do masowej produkcji to poważne ograniczenie: sto obrazów to ponad dziesięć godzin czekania przy jednym wątku.

Z ceną jest zamieszanie. Producent i komunikaty premierowe mówią o 0,024 USD za obraz w promocji do 8 października i 0,048 USD później. Strona modelu na fal.ai doprecyzowuje jednak, że cena „zależy od rozdzielczości” i że 0,024 USD dotyczy obrazu 1K (1 Mpx), a najtańszy wariant zaczyna się od 0,0205 USD. Publiczne API cennika fal.ai podaje stawkę 0,024 USD za megapiksel. Gdyby liczyć liniowo, jeden obraz 4K (16,8 Mpx) kosztowałby w promocji około 0,40 USD, a po 8 października około 0,80 USD. Fal.ai nie podaje ceny 4K wprost, więc przed większą serią sprawdź rozliczenie w panelu po pierwszym obrazie.

Dla porównania Nano Banana Pro w 4K kosztuje na fal.ai 0,30 USD, Nano Banana 2 w 4K 0,16 USD, a GPT Image 2.5 w 3840 × 2160 i jakości high 0,10 USD.

Który model do czego

  • Druk, duże ekrany, kadrowanie po fakcie: FLUX 3 Image. Tylko on daje detal, który przetrwa wycięcie fragmentu i powiększenie. Pomoże przy tapetach (zobacz 12 tapet 4K z FLUX 3) i wizualizacjach do druku.
  • Grafiki z dużą ilością tekstu: GPT Image 2.5, Grok Imagine 2 albo Seedream 5 Pro. W tym teście nie zrobiły ani jednego błędu w napisach.
  • Szybkie „4K” do internetu: Nano Banana Pro. Plik jest powiększony, ale na ekranie telefonu tego nie zobaczysz, a dostajesz go w niecałe 40 sekund.
  • Nie do dużych formatów: Ideogram 4.5 przez fal.ai w 16:9 oddaje tylko 1280 × 720 px.

Pozostałe testy FLUX 3

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

FAQ

Czy FLUX 3 Image naprawdę generuje w 4K?

Tak. W trybie 4k dostałem plik 5456 × 3072 px i mój test zmniejszania pokazał, że cała ta rozdzielczość niesie detal. To odróżnia go od Nano Banana Pro i Nano Banana 2, których pliki 4K mają tyle szczegółów, co obraz 4,2 Mpx.

Ile trwa generowanie obrazu 4K w FLUX 3?

W moim teście 392 sekundy na fal.ai. Konkurencyjne modele w najwyższej rozdzielczości oddawały obraz w 19-86 sekund.

Który model najlepiej pisze polskie napisy na obrazach?

W tym teście GPT Image 2.5 Sunburst, Grok Imagine 2 i Seedream 5 Pro napisały wszystkie 8 tekstów poprawnie, razem z „Ó”. Nano Banana Pro zgubił ogonek w „KORKÓW”, FLUX 3 poległ na nagłówku gazety. To jedno podejście na model, więc traktuj to jako wskazówkę, a nie ranking na zawsze.

Ile kosztuje obraz 4K z FLUX 3 na fal.ai?

Fal.ai podaje 0,024 USD za obraz 1K w promocji do 8 października i 0,048 USD później, a cena rośnie z rozdzielczością. API cennika liczy 0,024 USD za megapiksel, co dla 4K dawałoby około 0,40 USD w promocji. Dokładną kwotę zobaczysz w panelu rozliczeń.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Czy FLUX 3 Image naprawdę generuje natywne 4K?

Tak, FLUX 3 Image jako jedyny z siedmiu testowanych modeli generuje obraz z pełnymi 16,8 Mpx prawdziwego detalu przy rozdzielczości 5456 x 3072 px. Dla porównania Nano Banana Pro i Nano Banana 2 oferują pliki o podobnej liczbie pikseli (16,9 Mpx), ale ich efektywna rozdzielczość wynosi tylko 4,2 Mpx, co oznacza, że to zwykłe skalowanie mniejszego obrazu.

Ile kosztuje generowanie obrazu w FLUX 3 Image na fal.ai?

Cena zaczyna się od 0,0205 USD i zależy od rozdzielczości - wariant 1K (1 Mpx) kosztuje 0,024 USD w promocji do 8 października, a po tej dacie 0,048 USD. Strona modelu na fal.ai zastrzega, że podana cena 0,024 USD dotyczy obrazu 1K, nie 4K.

Który model AI najlepiej renderuje napisy i tekst na obrazach?

GPT Image 2.5 Sunburst, Grok Imagine 2 i Seedream 5 Pro wyrenderowały poprawnie wszystkie 8 tekstów z promptu, w tym szyldy sklepów, nagłówek gazety i numer tramwaju. FLUX 3 Image zaliczył 6 z 8 - model nie wyświetlił poprawnie szyldu ZEGARMISTRZ i nagłówka "MIASTO BEZ KORKÓW?" na kiosku.

Jak długo trwa generowanie obrazu 4K w FLUX 3 Image?

Generowanie jednego obrazu w trybie 4K zajęło 392 sekundy, czyli ponad sześć i pół minuty. Fal.ai ostrzega w opisie parametru, że tryb 4K "może trwać kilka minut", a przy produkcji stu obrazów sekwencyjnie oznacza to ponad dziesięć godzin oczekiwania.

// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro+ 99 zł/mc Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›