Claude for Startups i 100+ programów z darmowymi kredytami AI dla startupów i JDG Darmowe kredyty AI dla Twojej firmy Sprawdź, co dostaniesz
✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Premium

ChatGPT 5.5. OpenAI nie ewoluuje - OpenAI się broni

OpenAI zaprezentowało GPT-5.5, całkowicie przetrenowany od zera model bazowy, co jest oznaką wewnętrznego stanu „Code Red” w firmie.

11 min czytania
Symbol OpenAI jako twierdza odpierająca czerwone strzały
👁 188 przeczytań

Aktualizacja 18.09.2026: przy nazwach produktów i modeli, które od publikacji zmieniły nazwę lub zostały wycofane, dopisałem w nawiasach aktualny stan i link do bieżącego przewodnika. Resztę tekstu zostawiam z dnia publikacji.

Sam Altman przyznaje, że premier modeli jest już tyle, że trudno je od siebie odróżnić. Ale GPT-5.5 - nazwa kodowa „Spud” - to nie kolejna mała łatka. To pierwszy od roku całkowicie przetrenowany od zera model bazowy OpenAI. I pierwsza publiczna oznaka tego, że w firmie od grudnia obowiązuje wewnętrzny stan „Code Red”.

Kiedy w czwartek wieczorem OpenAI zamieściło na swoim developerskim koncie na X zagadkową wiadomość „NS41″, polska scena AI była już gotowa. Rzut na Base64, prosty szyfr literowy (N=14, S=19, różnica 5, 4+1=5) - i społeczność w ciągu minut rozszyfrowała to, co firma zamierzała podać oficjalnie dopiero następnego dnia: ChatGPT 5.5 jest na wyciągnięcie ręki. Kilka godzin później Greg Brockman, prezes OpenAI, stał przed dziennikarzami i mówił o „nowej klasie inteligencji dla prawdziwej pracy”.

Brockman nie owijał w bawełnę: „Modeli jest już tyle, że pewnie trudno je od siebie odróżnić”. To bardzo szczera uwaga, bo od premiery ChatGPT-5 w sierpniu 2025 roku OpenAI wypuściło wersje 5.1, 5.2, 5.3, 5.4 - a teraz 5.5. Wszystko w niecałe osiem miesięcy. Każda kolejna przynosi kilkuprocentowe poprawki w benchmarkach, nowe tryby, subtelne zmiany w cenniku. Ale 5.5 jest inna.

Pierwszy pełny restart modelu bazowego od czasu GPT-4.5

Najważniejsza rzecz, o której nie pisze większość nagłówków: GPT-5.5 to pierwszy od premiery GPT-4.5 (model wycofany z ChatGPT; aktualne: GPT-6 Astra) całkowicie przetrenowany od zera model bazowy. Wszystkie wcześniejsze odsłony piątki - łącznie z 5.4 - były fine-tuningami i ulepszeniami tego samego fundamentu. Tym razem OpenAI położyło na stole nowy rdzeń. Stąd skok w możliwościach, którego żadna pośrednia iteracja nie była w stanie osiągnąć.

Oficjalny opis brzmi szumnie: „nowa klasa inteligencji dla prawdziwej pracy i napędzania agentów, zbudowana tak, by rozumieć złożone cele, używać narzędzi, sprawdzać swoją pracę i doprowadzać zadania do końca”. W tłumaczeniu z PR-speak: model ma działać mniej jak chatbot, a bardziej jak współpracownik, któremu zlecasz cały projekt, nie rozpisując mu każdego kroku.

Naprawdę specjalne w tym modelu jest to, jak dużo potrafi zrobić mając mniej wskazówek. Może spojrzeć na niejasny problem i wykombinować, co trzeba zrobić dalej. Szczerze mówiąc, wydaje mi się, że to kładzie fundamenty pod sposób, w jaki będziemy używać komputerów w przyszłości.Greg Brockman, prezes OpenAI, na konferencji dla dziennikarzy

Brockman dorzucił też anegdotę, którą OpenAI wyraźnie lubi: pewien profesor matematyki użył GPT-5.5 i środowiska Codex, by z jednego promptu zbudować aplikację z geometrii algebraicznej. Całość zajęła jedenaście minut. To właśnie kierunek, do którego firma ciągnie narrację - nie „szybsze odpowiedzi na pytania”, tylko „dostarczanie gotowych rezultatów pracy”.

Benchmarki, które OpenAI pokazuje z dumą (i jeden, który przemilcza)

Na prezentacji i w blogpoście OpenAI wywalono na stół całą kolekcję testów. Oto najważniejsze wyniki GPT-5.5:

  • Terminal-Bench 2.0: 82,7% - złożone zadania w wierszu poleceń, użycie narzędzi. To stan sztuki (SOTA) w tej kategorii.
  • SWE-Bench Pro: 58,6% - rzeczywiste zgłoszenia błędów z GitHuba, rozwiązywane w pojedynczym podejściu.
  • GDPval: 84,9% - na benchmarku testującym pracę wiedzy w 44 realnych zawodach model dorównuje lub bije profesjonalistów.
  • Expert-SWE: SOTA - wewnętrzny test OpenAI na zadania kodowe, których wykonanie zajmuje człowiekowi medianowo około 20 godzin.
  • Redukcja halucynacji: o 60% - względem GPT-5.4.

Pierwszy wynik - 82,7% na Terminal-Bench 2.0 - jest szczególnie wymowny, bo to state of the art. GPT-5.5 wyprzedza tu nie tylko publicznie dostępne modele konkurencji, ale nawet restrykcyjnie udostępniony Claude Mythos Preview od Anthropic. OpenAI nie ukrywa satysfakcji, że choć na jednym benchmarku, ale wreszcie zabiera pozycję numer jeden Anthropic, który zaledwie tydzień wcześniej - dokładnie 16 kwietnia - wypuścił Claude Opus 4.7.

Drugi wynik - 58,6% na SWE-Bench Pro - jest znacznie lepszy niż to, z czym startowało GPT-5 (23,3%). To ogromny skok, który pokazuje, jak szybko modele radzą sobie z rzeczywistymi zgłoszeniami błędów, nie tylko syntetycznymi zadaniami. Ale tu OpenAI robi coś, co warto zauważyć: w blogpoście przyznaje, że Claude Opus 4.7 osiąga na tym teście 64,3% - wyżej. I od razu dorzuca wyjaśnienie: „Anthropic zgłosił sygnały zapamiętywania na podzbiorze problemów”. Czyli - grzecznie - „oni mieli odpowiedzi w treningu, my nie”.

Trzeci benchmark, GDPval, to trochę marketing, trochę realny wskaźnik. OpenAI testuje model na zadaniach z 44 realnych zawodów - od analityka finansowego przez prawnika badającego sprawy, po menedżera produktu. W 84,9% porównań GPT-5.5 dorównuje albo bije profesjonalistów. Cyfra wygląda imponująco, choć metodologia pozwala na dużą swobodę interpretacji.

Ciekawostka: wewnętrzna nazwa kodowa GPT-5.5 to „Spud”, czyli po prostu „ziemniak”. W świecie OpenAI, gdzie poprzednie modele nosiły nazwy typu „Strawberry” (o1) czy „Orion” (GPT-5), ziemniak brzmi wyjątkowo przyziemnie - i być może dokładnie o to chodziło. Model jest skonstruowany jako narzędzie do roboty, nie jako spektakularny pokaz siły. Brockman w rozmowie z dziennikarzami wyraźnie unikał słowa „przełom” - mówił o „kolejnym kroku” i „fundamencie”.

Cztery obszary, w których OpenAI stawia wszystko

OpenAI bardzo precyzyjnie wskazuje, gdzie GPT-5.5 ma robić różnicę. To nie jest model „do wszystkiego” - to model zaprojektowany pod cztery scenariusze użytkowania, z których każdy ma swój własny, agresywnie rozwijany rynek.

Agentic coding

To bezpośrednia odpowiedź na Codex i Claude Code. GPT-5.5 potrafi zajmować się długotrwałymi zadaniami programistycznymi, takimi które normalnie zajmują człowiekowi do 20 godzin. Model sam planuje, pisze, testuje, poprawia błędy, iteruje. Testerzy OpenAI relacjonują, że model „rozumie architekturę systemu i punkty awarii, potrafi wskazać, gdzie wprowadzić poprawkę i przewidzieć jej konsekwencje w całym codebase”.

Computer use

Sterowanie komputerem - klikanie, przewijanie, wypełnianie formularzy, przełączanie między aplikacjami. OpenAI łączy GPT-5.5 z niedawną aktualizacją Codex for Mac, który tydzień temu dostał pełne funkcje computer use. Razem składa się z tego szkielet uniwersalnego agenta desktopowego, którego Brockman i Altman od miesięcy zapowiadają jako „super app” OpenAI.

Knowledge work

Tworzenie dokumentów, arkuszy, prezentacji, analiza danych, research online. W praktyce to obszar, w którym w przedsiębiorstwach pracuje dziesiątki milionów ludzi - i w którym Anthropic zyskał przewagę w 2025 roku.

Wczesny research naukowy

Brockman twierdzi, że GPT-5.5 jest szczególnie przydatny tam, gdzie postęp jest „ograniczony inteligencją” - matematyka, fizyka, biologia obliczeniowa. Model potrafi prowadzić wielogodzinne śledztwa w dokumentacji, proponować hipotezy, weryfikować je w kodzie.

Cena: dwa razy drożej niż poprzednik

To jest miejsce, w którym GPT-5.5 zaskakuje nieprzyjemnie. API, które ma ruszyć „wkrótce”, będzie kosztować 5 dolarów za milion tokenów wejściowych i 30 dolarów za milion wyjściowych. To dokładnie dwukrotnie więcej niż GPT-5.4. Wersja Pro? Cena podchodzi do poziomu, przy którym developer trzy razy zastanowi się, zanim podpina ją do produkcji.

Cennik API GPT-5.5 (za 1 mln tokenów):

ModelInputOutputKontekst
GPT-5.5$5$301 mln
GPT-5.5 Pro$30$1801 mln
GPT-5.5 (Batch / Flex)$2,50$151 mln
GPT-5.5 (Priority)$12,50$751 mln

W Codex dostępny jest też Fast mode, generujący tokeny 1,5 razy szybciej za 2,5 razy wyższą cenę. Dla zespołów, które pracują agile’owo i potrzebują szybkiej iteracji, ma to sens. Dla hobbystów - mniej.

OpenAI argumentuje, że wyższa cena jest uzasadniona tym, że GPT-5.5 zużywa wyraźnie mniej tokenów na to samo zadanie niż 5.4. W praktyce całkowity koszt rozwiązania danego problemu ma być niższy, mimo wyższej ceny jednostkowej. Ale to argument, który trzeba będzie zweryfikować w benchmarkach niezależnych, nie tych od producenta.

„Code Red” w OpenAI i wyścig z Anthropic

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Żeby w pełni zrozumieć, czemu ta premiera przyszła akurat teraz i dlaczego ma taką siłę, trzeba cofnąć się o cztery miesiące. Od grudnia 2025 roku, według źródeł cytowanych przez TechCrunch i The Next Web, w OpenAI obowiązuje wewnętrzny stan „Code Red”. Powód? Anthropic - firma Amazona i Google’a stojąca za Claude’em - w ciągu roku wystrzelił z 9 miliardów dolarów ARR do 30 miliardów. Zrobił to głównie na segmencie enterprise, który miał być dominacją OpenAI.

Claude wygrywał u programistów (Claude Code), u researcherów (Claude Projects), u prawników. OpenAI patrzyło na to i widziało, jak ich B2B traci pozycję przy jednoczesnym rozroście bazy konsumenckiej ChatGPT - która swoją drogą ma już ponad 900 milionów użytkowników tygodniowo i ponad 50 milionów płacących subskrybentów. Liczby dla konsumentów są ogromne, ale biznesowa marża siedzi gdzie indziej.

Timeline ostatnich dziesięciu dni mówi wszystko:

  • 5 marca 2026 - premiera GPT-5.4, poprawki wobec 5.3, lepszy tool use.
  • 16 kwietnia 2026 - Anthropic wypuszcza Claude Opus 4.7 i przejmuje lidera w wielu benchmarkach.
  • Tydzień temu - OpenAI odnawia Codex for Mac o funkcje computer use.
  • 22 kwietnia 2026 - OpenAI pokazuje ChatGPT Images 2, znacząco lepsze generowanie obrazów.
  • 23 kwietnia 2026 - publikacja GPT-5.5, trzeci duży ruch w ciągu dziesięciu dni.

Kadencja jest kluczem. OpenAI w ciągu dziesięciu dni wypuściło trzy duże rzeczy, zamiast czekać miesiąc i pokazywać je pojedynczo. Firma przesiadła się na cykl wydawniczy bardziej przypominający aktualizacje oprogramowania niż premiery produktów. Każda kolejna iteracja jest szybsza od poprzedniej - między 5.3 a 5.4 minęło około ośmiu tygodni, między 5.4 a 5.5 już tylko siedem. Przy tym tempie GPT-5.6 powinno pojawić się gdzieś w czerwcu.

Dla kogo, od kiedy, w czym

Od czwartku 23 kwietnia 2026 GPT-5.5 wchodzi jednocześnie do kilku produktów:

  • ChatGPT (Plus, Pro, Business, Enterprise) - w ramach standardowej subskrypcji. GPT-5.5 Thinking (wersja z rozszerzonym rozumowaniem) dla wszystkich płacących, GPT-5.5 Pro tylko dla Pro, Business i Enterprise.
  • Codex - z oknem kontekstu 400 000 tokenów. Dostępne dla Plus, Pro, Business, Enterprise, Edu i Go.
  • API - „wkrótce” (OpenAI nie podaje konkretnej daty), z kontekstem 1 000 000 tokenów i wymaganiem dodatkowych zabezpieczeń dla dużej skali.

Ciekawostka z OpenAI: ponad 85% pracowników firmy używa Codex co tydzień - i to nie tylko inżynierowie, ale też zespoły finansów i marketingu. W jednym przykładzie, który Brockman podał dziennikarzom, komunikacja OpenAI użyła Codex do przeanalizowania sześciu miesięcy próśb o wystąpienia publiczne. System zbudował framework punktacji i oceny ryzyka - samodzielnie. To dokładnie ten rodzaj zastosowania, który OpenAI chce teraz wepchnąć do korporacji.

Bezpieczeństwo: najmocniejsze zabezpieczenia, ale też najwyższa klasyfikacja ryzyka

GPT-5.5 został wypuszczony - cytuję OpenAI - „z najmocniejszym zestawem zabezpieczeń w historii firmy”. Firma pracowała z wewnętrznymi i zewnętrznymi red teamerami, dodała celowe testy pod kątem cyberbezpieczeństwa i biologii, zebrała feedback od blisko 200 zaufanych partnerów z wczesnym dostępem.

W ramach własnego Preparedness Framework OpenAI sklasyfikowało możliwości GPT-5.5 jako „High” zarówno w obszarze biologii/chemii, jak i cyberbezpieczeństwa. To poziom wyższy niż GPT-5.4, ale poniżej progu „Critical”, który blokowałby szerokie udostępnianie. Mówiąc prościej - model potrafi dużo więcej w obszarach, które mogą być niebezpieczne, ale OpenAI uznało, że ryzyko da się kontrolować.

To nie jest tylko formalność. Tydzień przed premierą GPT-5.5 Anthropic wypuścił Claude Mythos - model, którego wdrożenie celowo ograniczono, bo okazał się zbyt dobry w znajdowaniu luk bezpieczeństwa w oprogramowaniu. OpenAI podkreśla, że idzie w innym kierunku: pełne udostępnienie z mocnymi zabezpieczeniami, a nie ograniczony dostęp.

Wierzymy w iteracyjne wdrażanie. GPT-5.5 jest już mądrym modelem, ale spodziewamy się szybkich usprawnień. Iteracyjne wdrażanie jest dużą częścią naszej strategii bezpieczeństwa.Sam Altman, CEO OpenAI, na X

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Co to wszystko znaczy z polskiego stołu

Dla polskiego użytkownika - szczególnie tego, który płaci za ChatGPT Plus za 23 dolary miesięcznie (plus VAT) - premiera GPT-5.5 to po prostu lepszy model, który pojawi się w aplikacji i stronie bez dodatkowych opłat. W ciągu najbliższych dni powinno go widać w selektorze modeli obok GPT-5.4, GPT-5 Thinking i innych wariantów. Dla większości zadań różnica będzie zauważalna, ale nie rewolucyjna - zwłaszcza przy krótkich, jednokrokowych poleceniach.

Różnica ma być widoczna tam, gdzie zadanie ma więcej niż jeden krok. Analiza dłuższego raportu, pisanie serii powiązanych maili, tworzenie strony z określoną funkcjonalnością, wykopanie konkretnej informacji z dziesięciu źródeł w sieci. Tu GPT-5.5 ma przynieść największy skok.

Dla tych, którzy budują produkty oparte na API, kalkulacja jest bardziej skomplikowana. Podwyższona cena oznacza, że kilka startupów musi od nowa policzyć sobie ekonomię. Obietnica „mniej tokenów na zadanie” brzmi dobrze, ale dopiero niezależne pomiary pokażą, czy całkowity koszt rzeczywiście spadnie. Do tego czasu wielu programistów zostanie na 5.4, 4o albo przesiądzie się na Claude’a.

Największa historia tej premiery nie jest techniczna. To historia o tym, jak OpenAI przestało być firmą, która dyktuje tempo, a stało się firmą, która reaguje na ruchy konkurencji. Anthropic wypuszcza Opus 4.7 - OpenAI w ciągu tygodnia odpowiada GPT-5.5. Google pokazuje Gemini 3.1 Pro - OpenAI przyspiesza prace nad Images 2. Ta dynamika jest zdrowa dla użytkowników, którzy dostają coraz lepsze narzędzia w zawrotnym tempie. Ale dla OpenAI to zupełnie nowa pozycja - i nie wiadomo jeszcze, czy firma potrafi w niej wygrać.

Brockman na konferencji powtórzył zdanie, które być może najlepiej podsumowuje tę premierę: „To jest kolejny krok - i spodziewamy się wielu następnych”. Nie „przełom”, nie „rewolucja”, nie „AGI”. Tylko krok. Ziemniak. Spud. Kolejny szczebel drabiny, po której OpenAI wspina się teraz o wiele szybciej niż rok temu - bo w dolinie za plecami ktoś już wyprzedza.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 450 zł/rok Zobacz wszystko →
× ‹ powiększenie ›