FLUX 3 pod lupą: 4K kontra 6 modeli
FLUX 3 jako jedyny daje prawdziwe 4K (16,8 Mpx detalu), ale w napisach wypadł średnio, a obraz 4K generował 392 sekundy.

👁 165 przeczytań
- FLUX 3 Image jako jedyny z siedmiu testowanych modeli dostarcza prawdziwe 4K: 5456 x 3072 px z pełnymi 16,8 Mpx efektywnego detalu.
- Generowanie jednego obrazu 4K w FLUX 3 trwało 392 sekundy, czyli ponad 10 razy dłużej niż u Nano Banana Pro (38 s) czy Ideogramu (19 s).
- GPT Image 2.5 Sunburst, Grok Imagine 2 i Seedream 5 Pro poprawnie wyrenderowały wszystkie 8 napisów z promptu, podczas gdy FLUX 3 zaliczył tylko 6 z 8.
FLUX 3 Image jako jedyny z siedmiu sprawdzonych modeli daje 4K, które naprawdę jest 4K: 5456 × 3072 px i pełne 16,8 Mpx prawdziwego detalu. Nano Banana Pro i Nano Banana 2 też oddają plik około 16,9 Mpx, ale po moim pomiarze niosą tyle szczegółów, co obraz 4,2 Mpx. Rozdzielczość to jednak nie wszystko: w napisach FLUX 3 wypadł średnio (6 z 8), a GPT Image 2.5, Grok Imagine 2 i Seedream 5 Pro napisały wszystkie osiem bez błędu. Do tego 4K w FLUX 3 trwało 392 sekundy, dziesięć razy dłużej niż u konkurencji.
Black Forest Labs reklamuje FLUX 3 Image hasłem „natywne 4K”. To samo hasło widzę dziś przy połowie generatorów obrazów, więc zamiast liczyć piksele w nagłówku pliku, sprawdziłem, ile w tych pikselach jest prawdziwej informacji. Dałem siedmiu modelom ten sam szczegółowy kadr, kazałem wygenerować go w najwyższej rozdzielczości, jaką oferują, i obejrzałem wynik w skali 100%.
Kadr wybrałem złośliwie: Rynek Główny w Krakowie o zmierzchu, sześć szyldów sklepów, kiosk z gazetą i tramwaj z numerem linii. Drobne napisy, kostka brukowa, gołębie i detal architektury szybko pokazują, czy model rysuje szczegóły, czy tylko powiększa mniejszy obraz.
Jak testowałem
- Data: 1 października 2026, dzień premiery FLUX 3 Image.
- Dostęp: wszystkie modele przez API fal.ai, każdy w najwyższej dostępnej rozdzielczości dla proporcji 16:9.
- Jedno podejście: jeden obraz na model, bez losowania kilku wersji i bez wybierania najlepszej.
- Ten sam prompt: identyczne polecenie po angielsku dla wszystkich, bez rozszerzania promptu po stronie modelu.
- Napisy: osiem tekstów do wyrenderowania. Policzyłem je dwa razy - automatycznie (OCR modelem Gemini 3.8 Flash na kafelkach w natywnej rozdzielczości) i ręcznie, oglądając każdy szyld w powiększeniu.
- Detal: „efektywna rozdzielczość” liczona testem zmniejszania i powiększania (wyjaśniam niżej).
Polecenie, które dostał każdy model:
Wide street photograph of the Main Market Square in Kraków at dusk, warm street lamps, many people walking. Small shop signs along the tenement facades, each clearly readable: "APTEKA", "KWIATY", "ZEGARMISTRZ", "LODY NATURALNE", "ANTYKWARIAT", "KANTOR". A newspaper kiosk in the foreground with a headline on the front page: "MIASTO BEZ KORKÓW?". A tram with route number "8" in the background. Cobblestones, pigeons, fine architectural detail.Ustawienia na fal.ai:
- FLUX 3 Image: resolution 4k, aspect_ratio 16:9.
- Nano Banana Pro i Nano Banana 2: resolution 4K, aspect_ratio 16:9.
- GPT Image 2.5 Sunburst: 3840 × 2160, quality high (to największy rozmiar, jaki przyjmuje).
- Seedream 5 Pro: zamówiłem 4096 × 2304, a dostałem 2728 × 1536, bo model ma limit powierzchni 2048 × 2048 px.
- Grok Imagine 2: resolution 2k, czyli maksimum.
- Ideogram 4.5: landscape_16_9, quality high. API oddało 1280 × 720 px.
Co to jest efektywna rozdzielczość
Plik 5504 × 3072 px nie musi zawierać 16,9 Mpx szczegółów. Model może wygenerować mniejszy obraz i podbić go do „4K” zwykłym powiększeniem. Liczba pikseli rośnie, ale nowych informacji nie przybywa: dostajesz to samo, tylko bardziej rozmyte w zbliżeniu.
Sprawdziłem to prostą metodą. Z centrum każdego obrazu wyciąłem fragment, zmniejszyłem go (do 85%, 70%, 50% i dalej), a potem powiększyłem z powrotem do pierwotnego rozmiaru. Następnie porównałem wynik z oryginałem miarą SSIM, która mówi, jak bardzo dwa obrazy są do siebie podobne (1 oznacza identyczne).
- Jeśli po zmniejszeniu o połowę i ponownym powiększeniu obraz prawie się nie zmienia (SSIM co najmniej 0,97), to połowa pikseli w każdym wymiarze była pusta, a prawdziwy detal mieści się w czterech razy mniejszym pliku.
- Jeśli już lekkie zmniejszenie do 85% psuje obraz, to każdy piksel niesie informację i rozdzielczość jest prawdziwa.
Efektywna rozdzielczość to liczba megapikseli po największym zmniejszeniu, które jeszcze przechodzi próg 0,97. To przybliżenie, a nie normalizowany pomiar laboratoryjny, ale dobrze oddziela modele, które rysują detal, od tych, które go podbijają.
Wyniki: piksele, detal, napisy
| Model | Rozmiar pliku | Mpx | Efektywnie | Napisy (ręcznie) | Napisy (OCR) | Czas | Cena na fal.ai |
|---|---|---|---|---|---|---|---|
| FLUX 3 Image | 5456 × 3072 | 16,8 | 16,8 Mpx | 6/8 | 5/8 | 392 s | 1K = 0,024 USD, 4K drożej (patrz niżej) |
| Nano Banana Pro | 5504 × 3072 | 16,9 | 4,2 Mpx | 7/8 | 7/8 | 38 s | 0,30 USD (4K) |
| Nano Banana 2 | 5504 × 3072 | 16,9 | 4,2 Mpx | 6/8 | 3/8 | 34 s | 0,16 USD (4K) |
| GPT Image 2.5 Sunburst | 3840 × 2160 | 8,3 | 4,1 Mpx | 8/8 | 5/8 | 45 s | 0,10 USD (high) |
| Grok Imagine 2 | 2816 × 1584 | 4,5 | 3,3 Mpx | 8/8 | 6/8 | 86 s | 0,06-0,08 USD (2K) |
| Seedream 5 Pro | 2728 × 1536 | 4,2 | 2,1 Mpx | 8/8 | 5/8 | 63 s | 0,135 USD |
| Ideogram 4.5 | 1280 × 720 | 0,9 | 0,7 Mpx | 4/8 | 4/8 | 19 s | 0,22 USD (high) |
Różnica jest duża. FLUX 3 nie przeszedł progu już przy zmniejszeniu do 85%, czyli każdy z jego 16,8 Mpx coś znaczy. Obie wersje Nano Banana zniosły zmniejszenie o połowę bez straty, więc ich „4K” to w praktyce obraz około 2750 × 1540 px rozciągnięty dwukrotnie. GPT Image 2.5 ma plik 8,3 Mpx, a detalu na 4,1 Mpx. Grok Imagine 2 wykorzystuje swoje 4,5 Mpx najlepiej spośród konkurentów (3,3 Mpx efektywnie).
Wycinki 100%: środek kadru
Każdy wycinek ma szerokość 12% kadru, w natywnych pikselach. Dlatego wycinek z większego obrazu ma więcej pikseli i na stronie wygląda ostrzej, jeśli model rzeczywiście narysował detal, albo bardziej miękko, jeśli tylko powiększył obraz.







W wycinku FLUX 3 widać pojedyncze dachówki, gzymsy i ozdoby attyk. U Nano Banana Pro fasada w tej samej skali wygląda jak miękko wyretuszowana: krawędzie okien są czyste, ale faktury tynku prawie nie ma. Wycinek z Ideogramu ma 153 px i [zdanie urwane - brak kontynuacji]. w powiększeniu zamienia się w plamy.
Wycinki 100%: dół kadru







Napisy: rozdzielczość to nie to samo co poprawny tekst
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Tu FLUX 3 nie wygrywa. Sprawdziłem osiem tekstów z promptu: sześć szyldów, nagłówek gazety i numer tramwaju.
Co dokładnie poszło nie tak:
- FLUX 3 Image (6/8): szyldy APTEKA, KWIATY, LODY NATURALNE, ANTYKWARIAT i KANTOR są czyste i ostre, tramwaj ma „8”. Szyld ZEGARMISTRZ zasłoniła latarnia, widać tylko „GARMISTRZ”. Największy problem to kiosk: model obłożył go dziesiątkami gazet z wariacjami nagłówka („MATST BEZ KORKÓW?”, „NAZ KORKÓW”, „BEZ KORKÓW?”), a pełnego, poprawnego „MIASTO BEZ KORKÓW?” na żadnej nie ma.
- Nano Banana Pro (7/8): wszystkie szyldy i tramwaj poprawne, w nagłówku zgubił polski znak: „KORKOW?” zamiast „KORKÓW?”.
- Nano Banana 2 (6/8): zamiast KANTOR napisał coś w rodzaju „KAAYVWAL”, a tramwaj nie ma numeru.
- GPT Image 2.5, Grok Imagine 2, Seedream 5 Pro (8/8): komplet. GPT dorzucił od siebie tablicę „8 Bronowice”, szyld „PRASA” i tytuły gazet, wszystko bez literówek.
- Ideogram 4.5 (4/8): przy 1280 × 720 px szyldy APTEKA i KWIATY zamieniły się w zielony neon bez czytelnych liter, a nagłówka gazety nie da się odczytać.
Dlaczego automatyczny OCR dał inne liczby? Gemini dzielił napisy na linie („LODY” i „NATURALNE” osobno, „MIASTO” i „BEZ KORKÓW?” osobno), a kafelki cięły czasem szyld w połowie, więc mój skrypt porównujący całe frazy nie zaliczał poprawnych napisów. Najmocniej odbiło się to na Nano Banana 2 (OCR 3/8, ręcznie 6/8) i GPT Image 2.5 (5/8 kontra 8/8). Dlatego w tabeli podaję obie liczby, ale we wnioskach opieram się na ręcznej ocenie.
Wniosek: rozdzielczość i poprawność tekstu to dwie różne umiejętności. Nano Banana Pro ma cztery razy mniej prawdziwego detalu niż FLUX 3, a napisał o jeden napis więcej. Grok Imagine 2 z plikiem 4,5 Mpx napisał wszystko. Jeśli robisz plakat z dużym hasłem, 4K z FLUX 3 nic nie da, jeśli hasło wyjdzie z błędem.
4K jest wolne i nie zawsze tanie
FLUX 3 w trybie 4k generował obraz 392 sekundy, czyli ponad sześć i pół minuty. Nano Banana Pro oddał swój plik w 38 sekund, Ideogram w 19. Fal.ai sam ostrzega w opisie parametru, że 4k „może trwać kilka minut”. Do masowej produkcji to poważne ograniczenie: sto obrazów to ponad dziesięć godzin czekania przy jednym wątku.
Z ceną jest zamieszanie. Producent i komunikaty premierowe mówią o 0,024 USD za obraz w promocji do 8 października i 0,048 USD później. Strona modelu na fal.ai doprecyzowuje jednak, że cena „zależy od rozdzielczości” i że 0,024 USD dotyczy obrazu 1K (1 Mpx), a najtańszy wariant zaczyna się od 0,0205 USD. Publiczne API cennika fal.ai podaje stawkę 0,024 USD za megapiksel. Gdyby liczyć liniowo, jeden obraz 4K (16,8 Mpx) kosztowałby w promocji około 0,40 USD, a po 8 października około 0,80 USD. Fal.ai nie podaje ceny 4K wprost, więc przed większą serią sprawdź rozliczenie w panelu po pierwszym obrazie.
Dla porównania Nano Banana Pro w 4K kosztuje na fal.ai 0,30 USD, Nano Banana 2 w 4K 0,16 USD, a GPT Image 2.5 w 3840 × 2160 i jakości high 0,10 USD.
Który model do czego
- Druk, duże ekrany, kadrowanie po fakcie: FLUX 3 Image. Tylko on daje detal, który przetrwa wycięcie fragmentu i powiększenie. Pomoże przy tapetach (zobacz 12 tapet 4K z FLUX 3) i wizualizacjach do druku.
- Grafiki z dużą ilością tekstu: GPT Image 2.5, Grok Imagine 2 albo Seedream 5 Pro. W tym teście nie zrobiły ani jednego błędu w napisach.
- Szybkie „4K” do internetu: Nano Banana Pro. Plik jest powiększony, ale na ekranie telefonu tego nie zobaczysz, a dostajesz go w niecałe 40 sekund.
- Nie do dużych formatów: Ideogram 4.5 przez fal.ai w 16:9 oddaje tylko 1280 × 720 px.
Pozostałe testy FLUX 3
- FLUX 3 Image - premiera, ceny i nowości
- Kompozycja z ramek: FLUX 3 kontra 5 modeli
- 5 zmian jednym poleceniem: FLUX 3 kontra 6 modeli
- Wizualizacje wnętrz w FLUX 3
- Reklamy i packshoty w FLUX 3
- Grafiki z ramkami w FLUX 3: układy JSON
- Ranking generatorów obrazów AI
- GPT Image 2.5 i Ideogram - osobne huby z testami
FAQ
Czy FLUX 3 Image naprawdę generuje w 4K?
Tak. W trybie 4k dostałem plik 5456 × 3072 px i mój test zmniejszania pokazał, że cała ta rozdzielczość niesie detal. To odróżnia go od Nano Banana Pro i Nano Banana 2, których pliki 4K mają tyle szczegółów, co obraz 4,2 Mpx.
Ile trwa generowanie obrazu 4K w FLUX 3?
W moim teście 392 sekundy na fal.ai. Konkurencyjne modele w najwyższej rozdzielczości oddawały obraz w 19-86 sekund.
Który model najlepiej pisze polskie napisy na obrazach?
W tym teście GPT Image 2.5 Sunburst, Grok Imagine 2 i Seedream 5 Pro napisały wszystkie 8 tekstów poprawnie, razem z „Ó”. Nano Banana Pro zgubił ogonek w „KORKÓW”, FLUX 3 poległ na nagłówku gazety. To jedno podejście na model, więc traktuj to jako wskazówkę, a nie ranking na zawsze.
Ile kosztuje obraz 4K z FLUX 3 na fal.ai?
Fal.ai podaje 0,024 USD za obraz 1K w promocji do 8 października i 0,048 USD później, a cena rośnie z rozdzielczością. API cennika liczy 0,024 USD za megapiksel, co dla 4K dawałoby około 0,40 USD w promocji. Dokładną kwotę zobaczysz w panelu rozliczeń.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Czy FLUX 3 Image naprawdę generuje natywne 4K?
Tak, FLUX 3 Image jako jedyny z siedmiu testowanych modeli generuje obraz z pełnymi 16,8 Mpx prawdziwego detalu przy rozdzielczości 5456 x 3072 px. Dla porównania Nano Banana Pro i Nano Banana 2 oferują pliki o podobnej liczbie pikseli (16,9 Mpx), ale ich efektywna rozdzielczość wynosi tylko 4,2 Mpx, co oznacza, że to zwykłe skalowanie mniejszego obrazu.
Ile kosztuje generowanie obrazu w FLUX 3 Image na fal.ai?
Cena zaczyna się od 0,0205 USD i zależy od rozdzielczości - wariant 1K (1 Mpx) kosztuje 0,024 USD w promocji do 8 października, a po tej dacie 0,048 USD. Strona modelu na fal.ai zastrzega, że podana cena 0,024 USD dotyczy obrazu 1K, nie 4K.
Który model AI najlepiej renderuje napisy i tekst na obrazach?
GPT Image 2.5 Sunburst, Grok Imagine 2 i Seedream 5 Pro wyrenderowały poprawnie wszystkie 8 tekstów z promptu, w tym szyldy sklepów, nagłówek gazety i numer tramwaju. FLUX 3 Image zaliczył 6 z 8 - model nie wyświetlił poprawnie szyldu ZEGARMISTRZ i nagłówka "MIASTO BEZ KORKÓW?" na kiosku.
Jak długo trwa generowanie obrazu 4K w FLUX 3 Image?
Generowanie jednego obrazu w trybie 4K zajęło 392 sekundy, czyli ponad sześć i pół minuty. Fal.ai ostrzega w opisie parametru, że tryb 4K "może trwać kilka minut", a przy produkcji stu obrazów sekwencyjnie oznacza to ponad dziesięć godzin oczekiwania.
