🔥 5 promocji w KinetyceGemini Pro 170 zł -91%Adobe CC 169 zł -84%Brain.fm 109 zł -70%i 2 więcej do 13.09 Zobacz →
Przejdź do treści
Artykuły

ChatGPT Images 2.5: edycja komentarzem zmienia sposób pracy z grafiką

4 min czytania
Edycja komentarzem: zmiana tylko wskazanego fragmentu

👁 115 przeczytań

// w skrócie
  • Edycja komentarzem pozwala wskazać konkretny fragment obrazu i zmienić tylko jego część, bez przepisywania całego promptu od nowa.
  • Model ChatGPT Images 2.5 nie jest jeszcze dostępny przez API - na OpenRouter nadal widnieją starsze warianty obrazowe OpenAI.
  • OpenAI nie podało ceny ani informacji o tym, w których planach abonamentowych nowy model jest dostępny.

OpenAI wypuściło ChatGPT Images 2.5. Firma wymienia cztery zmiany: szybsze generowanie, wierniejsze odwzorowanie, spójność szczegółów przy wielu kolejnych poprawkach oraz edycję komentarzem, czyli wskazywanie fragmentu obrazu, który ma się zmienić. Ostatnia z nich jest najciekawsza i to o niej warto porozmawiać najpierw, bo zmienia sposób pracy, a nie tylko jakość wyniku.

Edycja komentarzem, czyli koniec opisywania całego obrazu od nowa

Dotąd poprawianie wygenerowanej grafiki wyglądało tak: opisujesz jeszcze raz, co ma być na obrazie, dodajesz uwagę o tym, co zmienić, i modlisz się, żeby reszta została nietknięta. W praktyce zwykle nie zostawała. Poprawiłeś rękę, zepsuło się tło. Poprawiłeś tło, zmieniła się twarz.

Edycja komentarzem odwraca ten układ. Wskazujesz miejsce i piszesz, co ma się tam zmienić, a reszta obrazu zostaje. To jest ta sama różnica, co między przepisaniem całego akapitu a poprawieniem jednego słowa. Jeśli zadziała tak, jak zapowiada producent, znika główny powód, dla którego profesjonaliści woleli generatory z dokładną kontrolą nad fragmentem, opisane w przewodniku po generatorach obrazów AI.

Trzy pozostałe zmiany

Szybsze generowanie. Producent nie podaje liczb, więc to trzeba zmierzyć samemu. Przy pracy seryjnej czas jednego obrazu przekłada się wprost na to, ile wariantów zdążysz sprawdzić.

Wierniejsze odwzorowanie. W zapowiedzi mowa o obrazach bardziej naturalnych i lepiej rozpoznawalnych. To sformułowanie zwykle oznacza mniej dziwnych rąk, mniej zniekształconych twarzy i mniej przedmiotów, które nie trzymają się fizyki.

Spójność przy wielu poprawkach. Najbardziej praktyczna z trzech. Przy piątej poprawce tej samej grafiki dotychczasowe modele potrafiły zgubić styl albo podmienić postać. Jeśli to naprawiono, dopiero wtedy da się prowadzić serię obrazów jako komplet.

Czego jeszcze nie wiadomo

Nie ma informacji o cenie ani o tym, w których planach model jest dostępny. Nie ma go jeszcze w interfejsie programistycznym: na OpenRouter widnieją nadal starsze warianty obrazowe OpenAI, więc automatyzacje oparte na API na razie działają na poprzedniej generacji. Nie ma też żadnych niezależnych porównań. Wszystko powyżej pochodzi z oficjalnej zapowiedzi i tak to tutaj podaję.

Najważniejsze pytanie z polskiej perspektywy zostaje bez odpowiedzi: jak model radzi sobie z polskim tekstem na obrazie. To najsłabszy punkt całej kategorii i sprawdzam go osobno w teście polskiej typografii w generatorach. Wyniki dla nowej wersji dopiszę, gdy je zmierzę.

Jak to sprawdzić samemu w kwadrans

  1. Ten sam prompt, dwa modele. Wygeneruj identyczne polecenie na starej i nowej wersji i porównaj obok siebie. Bez tego wszystko jest wrażeniem.
  2. Pięć poprawek pod rząd. Weź jeden obraz i zmieniaj po jednym elemencie. Licz, przy której poprawce model gubi resztę.
  3. Polski napis. Poproś o plakat z tekstem zawierającym ą, ę, ś, ż i ź. To rozstrzyga, czy nadaje się do materiałów na polski rynek.
  4. Ta sama postać dwa razy. Sprawdź, czy w drugim obrazie to nadal ta sama osoba. Na tym wykłada się większość generatorów.

Porównanie z poprzednią generacją opisuję w tekście ChatGPT Images 2.5 kontra 2.0, a co potrafiła wersja poprzednia, w opracowaniu o ChatGPT Images 2.0.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Nasze testy, wszystkie w jednym miejscu

Zamiast powtarzać zapowiedzi producenta, sprawdziliśmy je po kolei na własnym materiale. Każdy z tekstów opisuje jeden test, jego wynik i granice wniosku. Wspólne zastrzeżenie dla całej serii: wbudowane narzędzie graficzne OpenAI nie ujawnia identyfikatora modelu, więc wyniki opisują stan zastany, a nie konkretną, nazwaną generację.

  • Edycja komentarzem: jedenaście poprawek w dwóch seriach. Niezamówione zmiany pojawiły się już przy pierwszej, w drugiej serii potwierdzone porównaniem pikseli.
  • Polskie znaki na grafice: dwadzieścia diakrytyków na pięciu grafikach tekstowych, wszystkie odwzorowane poprawnie.
  • Logotyp z AI: sześć wariantów jednego znaku. Spójne stylistycznie, ale nie identyczne, i dlatego to jeszcze nie jest identyfikacja.
  • Miniatury na YouTube: sześć miniatur ocenianych w rozmiarze, w jakim widzi je widz, czyli przy szerokości 320 pikseli.
  • Portrety postaci historycznych: sześciu polskich uczonych i decyzja o konwencji, którą trzeba podjąć przed pierwszym poleceniem.
  • Rebranding znanych marek: osiem makiet spekulacyjnych i zaskakujący szczegół, bo model sam podpisał obrazy jako propozycje.
// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Co nowego wprowadza ChatGPT Images 2.5 w porównaniu do poprzedniej wersji?

OpenAI wymienia cztery zmiany: szybsze generowanie, wierniejsze odwzorowanie, spójność szczegółów przy wielu kolejnych poprawkach oraz edycję komentarzem. Ta ostatnia pozwala wskazać fragment obrazu i zmienić tylko jego część, bez wpływu na resztę grafiki.

Czy ChatGPT Images 2.5 jest dostępny przez API?

Nie - na OpenRouter nadal widnieją starsze warianty obrazowe OpenAI, więc automatyzacje oparte na API działają na poprzedniej generacji. Brak dostępu przez interfejs programistyczny to jedno z kluczowych ograniczeń na ten moment.

Jak sprawdzić samemu, czy ChatGPT Images 2.5 jest lepszy od poprzedniej wersji?

Najprostszy test to ten sam prompt wygenerowany na obu wersjach i porównanie wyników obok siebie. Autor poleca też test pięciu poprawek pod rząd oraz sprawdzenie napisu z polskimi znakami - ą, ę, ś, ż i ź.

Jak ChatGPT Images 2.5 radzi sobie z polskim tekstem na obrazie?

Tego jeszcze nie wiadomo - autor zaznacza, że sprawdza to osobno w teście polskiej typografii w generatorach i wyniki dopisze po zmierzeniu. Obsługa polskiego tekstu jest opisana jako najsłabszy punkt całej kategorii generatorów obrazów.

// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony
🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro 440 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie