🎬 Higgsfield Plus na rok 649 zł 1 990 zł -67% zostało 8 szt. albo Pro na rok 464 zł Kup teraz →
Przejdź do treści
Artykuły

ChatGPT Images 2.5: wszystko, co ogłosiło OpenAI, i co z tego sprawdziłem

5 min czytania
ChatGPT Images 2.5, kluczowa grafika z zapowiedzi OpenAI

👁 161 przeczytań

// w skrócie
  • Edycja komentarzem pozwala wskazać konkretny fragment obrazu i zmienić tylko jego część, bez przepisywania całego promptu od nowa.
  • Model ChatGPT Images 2.5 nie jest jeszcze dostępny przez API - na OpenRouter nadal widnieją starsze warianty obrazowe OpenAI.
  • OpenAI nie podało ceny ani informacji o tym, w których planach abonamentowych nowy model jest dostępny.

OpenAI ogłosiło ChatGPT Images 2.5 8 września 2026. To nie jest sama poprawka jakości: razem z modelem firma wypuściła cztery nowe funkcje w ChatGPT i dwa osobne modele w interfejsie programistycznym. Poniżej wszystko, co producent podaje wprost, z liczbami tam, gdzie je podał. Nasze własne pomiary są niżej, w osobnej sekcji, i w kilku miejscach nie potwierdzają obietnic.

Skala, od której OpenAI zaczyna

Firma podaje, że w ChatGPT Images i modelach GPT-Image w API powstaje ponad 3 miliardy obrazów tygodniowo. To liczba, która tłumaczy, dlaczego akurat tutaj OpenAI walczy o czas generowania: przy tej skali każda sekunda to realny koszt serwerowy.

Co zmienia się w samym modelu

Czas generowania krótszy nawet o 50 procent względem Images 2.0. To jedyna liczba, którą producent podaje przy wydajności, i dotyczy porównania z poprzednią generacją.

Wierność zdjęć referencyjnych. Model ma lepiej zachowywać rozpoznawalność osoby, gdy przenosisz ją w inną scenerię, styl czy kompozycję. OpenAI pisze o naturalniejszym świetle i bogatszych fakturach.

Edycja tylko wskazanego fragmentu. Deklaracja brzmi: zmienia się to, o co poprosisz, reszta zostaje bez zmian, nawet przy złożonym tle. To jest ta sama obietnica, którą sprawdziłem na jedenastu kolejnych poprawkach, z wynikiem opisanym niżej.

Spójność przy wielu turach. W długiej rozmowie kolejne poprawki mają nie psuć wcześniejszych i nie degradować jakości obrazu z każdą turą.

Złożone układy i przezroczystość. Model ma lepiej rozumieć skomplikowane instrukcje wizualne i radzić sobie z przezroczystym tłem, co ma znaczenie przy materiałach do dalszej obróbki.

Przykład producenta: zdjęcie wejściowe i wynik

Zdjęcie wejściowe: fotografia wydrukowanego portretu studyjnego
Materiał wejściowy: zdjęcie wydrukowanej odbitki, razem z ramką i odblaskami papieru. Źródło: OpenAI.
Wynik edycji: ten sam portret po zmianie ubioru
Wynik po edycji. Zmieniony strój, zachowana twarz, poza i charakter oryginalnej odbitki. Źródło: OpenAI.

Co producent pokazuje jako dowód

OpenAI zilustrowało zapowiedź zestawem przykładów dobranych tak, żeby pokazać nie ładność, tylko trzymanie zadanej konwencji: układ, typografia, powtarzalny wzór, przezroczyste tło. To są akurat te rzeczy, na których generatory dotąd się przewracały, więc warto na nie popatrzeć uważniej niż na sam ładny kadr. Wszystkie poniższe obrazy pochodzą z materiałów prasowych OpenAI.

Retrofuturystyczna ilustracja z zapowiedzi ChatGPT Images 2.5
Retrofuturyzm. Konwencja, w której łatwo o kicz, a model trzyma spójną paletę i fakturę druku.
Plakaty w stylu mid-century modern
Plakaty mid-century. Tu liczy się układ i typografia, czyli to, co dotąd wychodziło generatorom najgorzej.
Impresjonistyczna panorama miasta
Panorama w konwencji impresjonistycznej. Sprawdzian z trzymania jednej maniery pociągnięcia pędzla w całym kadrze.
Zaproszenie ślubne z układem tekstu
Zaproszenie ślubne. Przykład złożonego układu z hierarchią tekstu, a nie samej ilustracji.
Surrealistyczna scena science fiction
Surrealizm science fiction. Kadr wymagający logiki przestrzennej, na której modele zwykle się gubią.
Seria znaczków parków narodowych w stylu vintage
Seria znaczków. Najtrudniejsze zadanie z całego zestawu, bo kilka elementów musi trzymać wspólną konwencję.
Grafika do prezentacji z zachowaną strukturą
Grafika do prezentacji. Producent podkreśla trzymanie zadanej struktury, a nie tylko estetyki.
Kompozycja w formie mozaiki
Mozaika. Powtarzalny wzór, przy którym widać, czy model utrzymuje rytm, czy zaczyna improwizować.
Zestaw naklejek na przezroczystym tle
Naklejki. Tutaj wchodzi zapowiadana obsługa przezroczystego tła, przydatna przy dalszej obróbce.
Scena w konwencji cyberpunkowej
Cyberpunk. Konwencja, którą generatory lubią najbardziej i do której zsuwają się nawet nieproszone.

Cztery nowe funkcje w ChatGPT

Sketch. Rysujesz odręcznie bezpośrednio w ChatGPT, a rysunek służy jako szkic kompozycji dla gotowego obrazu. Uruchamia się wpisaniem @Sketch. To najciekawsza z czwórki, bo rozwiązuje problem, którego opisem słownym nie da się załatwić: rozmieszczenie elementów w kadrze.

Szablony. Zamiast pustego pola wybierasz format, na przykład „Poster” albo „Merch”, i uzupełniasz treść oraz styl. OpenAI wymienia też ulotki i zdjęcia produktowe.

Komentarze na obrazie. Nanosisz uwagę bezpośrednio w miejscu, które ma się zmienić, zamiast opisywać je słowami.

Udostępnianie promptu. Dzieląc się obrazem, możesz dołączyć polecenie, którym powstał, żeby ktoś inny uruchomił ten sam pomysł na własnych zdjęciach.

Dwa modele w API, i to jest najważniejsza część dla pracujących seryjnie

Zamiast jednego następcy OpenAI dało dwa modele o różnym przeznaczeniu.

Model Do czego Co deklaruje producent
GPT-Image-2.5 Flare domyślny wybór do większości zastosowań wyższa jakość niż GPT-Image-2 przy o 50 procent niższej latencji; treści społecznościowe, wyszukiwanie wizualne, szybkie prototypy, generowanie masowe
GPT-Image-2.5 Sunburst materiały premium wymagające ścisłej kontroli przy edycji wyższa precyzja przy dłuższym czasie generowania; kreacje kampanijne i dopracowane zdjęcia produktowe

Praktyczny wniosek: jeśli generujesz dużo i szybko, bierzesz Flare. Jeśli robisz jeden obraz, który pójdzie do klienta, bierzesz Sunburst i płacisz czasem. Rozbieram oba w osobnym tekście o Flare kontra Sunburst.

Dostępność

Model jest udostępniany wszystkim użytkownikom ChatGPT, ChatGPT Work i Codeksa, we wszystkich planach, na komputerze, w telefonie i w przeglądarce. Oba modele API są dostępne od razu. To istotna zmiana wobec poprzednich premier, przy których nowość najpierw trafiała wyłącznie do planów płatnych.

Oznaczanie obrazów

OpenAI deklaruje utrzymanie metadanych C2PA i niewidocznego znaku wodnego, czyli dwóch niezależnych sposobów rozpoznania, że plik powstał w ich narzędziu. Dla każdego, kto publikuje takie obrazy zawodowo, to jest informacja praktyczna, a nie ciekawostka: metadane C2PA przetrwają wgranie na część platform i da się je odczytać.

Kto już z tego korzysta

W zapowiedzi wypowiadają się Higgsfield AI, Adobe, Manus i Runway. Szef produktu w Higgsfield AI zwraca uwagę na jedną rzecz: model rozumie, „what not to change”, czyli czego nie ruszać. To trafna diagnoza, bo w pracy z grafiką problemem nigdy nie było wygenerowanie czegoś ładnego, tylko powtórzenie tego samego obrazu z jedną zmianą.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Moje testy, czyli gdzie zapowiedź się nie potwierdziła

Sprawdziłem najważniejszą obietnicę, czyli edycję wyłącznie wskazanego fragmentu, na dwóch niezależnych seriach i jedenastu kolejnych poprawkach. Niezamówione zmiany pojawiły się już przy pierwszej poprawce i występowały przy każdej następnej, w drugiej serii potwierdzone porównaniem pikseli.

Ważne zastrzeżenie, które sam sobie stawiam: wbudowane narzędzie graficzne w ChatGPT nie pokazuje, którą wersją modelu odpowiada, a testy przeprowadziłem 8 września, czyli w dniu, w którym 2.5 dopiero się rozchodziło. Nie możemy więc wykluczyć, że mierzyłem jeszcze poprzednią generację. Powtórzę pomiar na modelach API, gdzie nazwa jest jednoznaczna, i dopiszę wynik tutaj.

Co natomiast wyszło jednoznacznie dobrze: dwadzieścia na dwadzieścia polskich znaków diakrytycznych odwzorowanych poprawnie na pięciu grafikach tekstowych. To najsłabszy punkt całej kategorii i akurat tu widać realny postęp.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Co to jest ChatGPT Images 2.5?

Model graficzny OpenAI ogłoszony 8 września 2026. Wnosi krótszy czas generowania, wierniejsze odwzorowanie zdjęć referencyjnych, dokładniejszą edycję fragmentu i spójność przy wielu kolejnych poprawkach.

Ile kosztuje i kto ma dostęp?

Model jest udostępniany wszystkim użytkownikom ChatGPT, ChatGPT Work i Codeksa we wszystkich planach, na komputerze, w telefonie i w przeglądarce. W API dostępne są dwa płatne modele, GPT-Image-2.5 Flare i GPT-Image-2.5 Sunburst.

Czym różni się GPT-Image-2.5 Flare od Sunburst?

Flare to domyślny model do większości zastosowań, z o 50 procent niższą latencją niż GPT-Image-2. Sunburst daje wyższą precyzję przy dłuższym czasie generowania i jest przeznaczony do materiałów premium.

O ile szybsze jest Images 2.5?

OpenAI podaje skrócenie czasu generowania nawet o 50 procent względem Images 2.0. To jedyna liczba dotycząca wydajności podana w zapowiedzi.

Czym jest funkcja Sketch?

Sketch pozwala narysować odręczny szkic bezpośrednio w ChatGPT i użyć go jako wskazówki kompozycyjnej dla gotowego obrazu. Uruchamia się wpisaniem @Sketch.

Czy obrazy z Images 2.5 są oznaczane?

Tak. OpenAI deklaruje metadane C2PA oraz niewidoczny znak wodny, czyli dwa niezależne sposoby rozpoznania pochodzenia pliku.

Czy edycja naprawdę zmienia tylko wskazany fragment?

W naszym teście na jedenastu kolejnych poprawkach nie. Niezamówione zmiany pojawiły się już przy pierwszej poprawce. Zastrzegamy, że narzędzie w ChatGPT nie ujawnia wersji modelu, a test wykonano w dniu udostępniania.

Link do Higgsfield jest partnerski: jeśli kupisz przez niego, serwis dostaje prowizję, a Ty płacisz tyle samo. Nie wpływa to na treść, także tam, gdzie piszę krytycznie.

// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony
🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro 440 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie