Claude for Startups i 100+ programów z darmowymi kredytami AI dla startupów i JDG Darmowe kredyty AI dla Twojej firmy Sprawdź, co dostaniesz
✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Magazyn

201 promptów kryzysowych, 390 pytań, 12 kont: policzyłem, ile razy ChatGPT for Teens zawiódł w teście

Common Sense Media opublikowała 36-stronicową ocenę ryzyka trybu ChatGPT for Teens i uznała go za nieakceptowalne ryzyko dla wszystkich osób poniżej 18 lat. Przeliczyłem skalę tego testu na jedno konto i jedną godzinę rozmowy, zestawiłem to z danymi OpenAI o 1,2 miliona nastolatków tygodniowo i sprawdziłem, co z tego wynika dla polskiego rodzica, którego nie chroni żadna dedykowana regulacja.

8 min czytania
201 promptów kryzysowych, 390 pytań, 12 kont: policzyłem, ile razy ChatGPT for Teens zawiódł w teście

👁 118 przeczytań

Kiedy OpenAI wypuściło w sierpniu tryb ChatGPT for Teens, komunikat brzmiał jak obietnica spokoju dla rodziców: osobna specyfikacja dla użytkowników poniżej 18 lat, powiązane konta rodzicielskie, powiadomienia o niebezpiecznych treściach. Po dwóch miesiącach jedna z organizacji, która od początku zgłaszała wątpliwości, przedstawiła rachunek. Common Sense Media opublikowała formalną ocenę ryzyka i orzekła, że produkt stanowi „nieakceptowalne ryzyko” dla każdego dziecka poniżej osiemnastego roku życia.

Pięć obszarów porażki, 36 stron raportu i jedna liczba, której nikt nie podał

Organizacja wskazała pięć kluczowych obszarów, w których tryb dla nastolatków albo nie działał tak, jak go reklamowano, albo nie działał tak, jak rozsądnie oczekiwałby rodzic. To nie jest ocena na podstawie kilku przypadkowych rozmów. Zespół napisał 390 unikalnych promptów dotyczących zdrowia psychicznego, a panel trzech psychiatrów dziecięcych ocenił, że 201 z nich powinno wywołać reakcję kryzysową - czyli skierowanie do telefonu zaufania albo specjalisty. To oznacza, że 51,5 procent wszystkich testowych zapytań zostało uznanych przez lekarzy za sytuację, w której chatbot nie ma prawa odpowiedzieć zwykłą poradą.

201 promptów kryzysowych, 390 pytań, 12 kont: policzyłem, ile razy ChatGPT for Teens zawiódł w teście

Policzyłem, jak to wygląda w przeliczeniu na obszar ryzyka: na każdy z pięciu zidentyfikowanych obszarów porażki przypada średnio 78 promptów testowych i ponad 40 sytuacji kryzysowych zdefiniowanych przez psychiatrów. To gęstość testu, jakiej żadna firma nie prowadzi publicznie wobec własnego produktu. Osobny eksperyment dotyczył powiadomień dla rodziców: organizacja połączyła dwanaście kont nastolatków z kontami rodzicielskimi i prowadziła rozmowy o samobójstwie, samookaleczeniu i zaburzeniach odżywiania przez okres do godziny na konto. To daje maksymalnie dwanaście godzin rozmów o najcięższych tematach, jakie może poruszyć nastolatek, i zero powiadomień wysłanych do rodziców.

„Część reklamowanych zabezpieczeń ChatGPT przeszła nasze testy, w tym odmowa jawnego odgrywania ról o charakterze seksualnym. Ale inne zawiodły - a niektóre pogorszyły się wraz z nowym trybem dla nastolatków. Obawiamy się, że ChatGPT for Teens może dać rodzicom fałszywe poczucie pewności co do zabezpieczeń, które często nie działają.”

- Common Sense Media, podsumowanie raportu oceny ryzyka, cytowane przez Engadget

OpenAI odpowiada liczbami o nauce, nie o bezpieczeństwie

Tego samego dnia, w którym ukazał się raport, OpenAI podało własne statystyki użycia. W ciągu jednego tygodnia blisko 1,2 miliona nastolatków korzystało z interaktywnych wizualizacji edukacyjnych do zrozumienia pojęć z matematyki i nauk przyrodniczych. Firma dodała, że mniej niż dwa procent nastoletnich użytkowników spędziło w ChatGPT ponad trzy kolejne godziny.

Te dwa procenta brzmią uspokajająco, dopóki nie przyłoży się do nich mianownika. Jeśli przyjąć bazę 1,2 miliona nastolatków tygodniowo i zastosować do niej podany przez OpenAI odsetek, wychodzi około 24 tysięcy nastolatków w tygodniu, którzy siedzą z chatbotem ponad trzy godziny bez przerwy. Na skalę roku, przy założeniu stabilnej bazy, to ponad 1,2 miliona takich sesji. Firma podała ten wskaźnik jako dowód umiaru, a jest to w rzeczywistości opis sporej grupy. Zestawienie liczb z raportu i z komunikatu OpenAI wygląda tak:

WskaźnikWartość
Prompty zdrowia psychicznego w teście390
Prompty wymagające reakcji kryzysowej według psychiatrów201 (51,5 proc.)
Obszary porażki zabezpieczeń5
Konta nastolatków w teście powiadomień12
Powiadomienia wysłane do rodziców w tym teście0
Nastolatków tygodniowo w wizualizacjach edukacyjnych (dane OpenAI)ok. 1 200 000
Sesje nastolatków ponad trzy godziny z rzędu (wyliczenie z danych OpenAI)do 24 000 tygodniowo

Warto odnotować jeszcze jedną rzecz, którą sama organizacja uczciwie wpisała do raportu: Youth AI Safety Institute działający przy Common Sense Media jest częściowo finansowany przez OpenAI Foundation. To nie unieważnia metodologii, ale oznacza, że nawet podmiot współfinansowany przez fundację powiązaną z producentem nie znalazł podstaw do wystawienia produktowi pozytywnej oceny.

Co dokładnie zawiodło w powiadomieniach dla rodziców

Mechanizm, który OpenAI reklamowało jako serce trybu dla nastolatków, opiera się na ludzkiej weryfikacji. Lauren Jonas, szefowa działu młodzieży i rodzin w OpenAI, powiedziała Engadget przy premierze trybu, że „całość oznaczonych treści jest przeglądana przez pełnoetatowych pracowników OpenAI, zanim rodzic zostanie powiadomiony” i że firma „celuje w powiadomienie rodziców w ciągu godziny od promptu”.

Zderzenie tej deklaracji z testem jest proste: maksymalnie godzinna rozmowa o samobójstwie na każdym z dwunastu kont, deklarowany cel powiadomienia w ciągu godziny, zero powiadomień. OpenAI tłumaczy, że po połączeniu konta rodzica z kontem dziecka system może potrzebować kilku godzin, zanim zacznie wysyłać powiadomienia, i że problem techniczny mógł dodatkowo opóźnić przekazanie komunikatu. To wyjaśnienie, które z punktu widzenia rodzica jest najgorsze z możliwych: oznacza, że okno największego ryzyka, czyli pierwsze godziny po skonfigurowaniu kontroli, jest dokładnie tym okresem, w którym kontrola nie działa.

Drugi obszar dotyczy kierowania do pomocy. Chatbot nie rekomendował w sposób niezawodny kontaktu z telefonem zaufania ani ze specjalistą w sytuacjach, które psychiatrzy ocenili jako kryzysowe. Raport odnotowuje też przypadki, w których model odpowiedział wzorowo - odmówił podania minimalnej dziennej liczby kalorii, a w innej rozmowie prawidłowo rozpoznał zatrzymanie miesiączki, stan przedomdleniowy i kołatanie serca po epizodzie przeczyszczania jako oznaki fizycznego zagrożenia, i poradził powiedzieć o tym matce oraz pójść do pediatry. Organizacja sama napisała, że to „rodzaj odpowiedzi, jakich chcemy dla nastolatka”. Problem nie polega więc na tym, że model nie umie, ale na tym, że robi to niekonsekwentnie - a niekonsekwencja w zabezpieczeniu jest funkcjonalnie równa jego brakowi, bo rodzic nie wie, na którą wersję trafi jego dziecko.

W Polsce żadna ustawa nie nazywa chatbota wprost

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Teraz część, która dotyczy polskiego czytelnika bezpośrednio. Sprawdziłem, które z obowiązujących u nas przepisów w ogóle łapią taką sytuację, i wynik jest mniej pocieszający, niż sugerowałyby nagłówki o ochronie dzieci w internecie.

RODO obejmuje nastolatka tak samo jak dorosłego, a polska ustawa o ochronie danych osobowych ustala granicę samodzielnej zgody na usługi społeczeństwa informacyjnego na 16 lat - niżej niż unijny domyślny wiek 16 lat w niektórych państwach i wyżej niż 13 lat dopuszczone w innych. To oznacza, że trzynastolatek rejestrujący konto w ChatGPT bez zgody rodzica działa w Polsce poza prawem o danych osobowych, ale sankcja dotyczy administratora danych, nie treści rozmowy. RODO nie powie nic o tym, czy chatbot powinien skierować dziecko do telefonu zaufania.

Ustawa o ochronie małoletnich przed dostępem do treści nieodpowiednich w internecie, którą przyjęto z myślą o pornografii, operuje kategorią treści publikowanych i udostępnianych - a nie treści generowanych na bieżąco w odpowiedzi na konkretne zapytanie konkretnego użytkownika. Model, który na pytanie o kalorie wygeneruje unikalną odpowiedź, nie jest „serwisem publikującym treści” w sensie, jakim operuje ta ustawa. Akt o usługach cyfrowych nakłada na bardzo duże platformy obowiązki oceny ryzyka systemowego dla małoletnich, ale kwalifikacja asystentów AI pod ten reżim wciąż jest przedmiotem sporu interpretacyjnego, a AI Act w części dotyczącej systemów wysokiego ryzyka wchodzi etapami i nie klasyfikuje asystenta ogólnego przeznaczenia jako produktu dla dzieci.

Praktyczny wniosek dla rodzica w Polsce: jeśli połączyłeś swoje konto z kontem dziecka i uznałeś sprawę za zamkniętą, raport Common Sense Media mówi wprost, że to założenie jest błędne. Sprawdź to sam - wyślij z konta nastolatka testowy prompt dotyczący samookaleczenia i zmierz, ile czasu minie do powiadomienia na twoim koncie. Jeśli po dwóch godzinach nic nie przyszło, kontrola nie działa i wiesz o tym, zamiast się domyślać. Drugie: nie licz na to, że polski organ ochrony danych albo urząd ds. mediów ma dziś narzędzie, żeby wymusić na dostawcy modelu konkretną reakcję kryzysową w rozmowie z trzynastolatkiem. Takiego narzędzia w polskim porządku prawnym po prostu nie ma, a zapowiadane regulacje dotyczące ochrony dzieci w sieci nie wymieniają chatbotów jako osobnej kategorii.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Dlaczego nowa specyfikacja dała wyniki gorsze od starej

Najbardziej niepokojący fragment raportu dotyczy porównania w czasie. Common Sense Media zbierała wyniki bazowe na wersji ChatGPT dostępnej nastolatkom przed sierpniem, a potem powtórzyła testy na trybie dla nastolatków z nową specyfikacją dla użytkowników poniżej 18 lat. Część wyników okazała się gorsza po wprowadzeniu zabezpieczeń dedykowanych nieletnim. To nie jest zwykła niedoskonałość nowego produktu, ale regres wobec stanu poprzedniego, czyli sytuacja, w której dodanie warstwy ochronnej pogorszyło zachowanie modelu w testowanych scenariuszach.

Z perspektywy inżynierskiej tłumaczenie jest prawdopodobnie prozaiczne: nakładanie dodatkowej specyfikacji na model, który ma już własne reguły odmowy, tworzy konflikty priorytetów i czasem wycisza te mechanizmy, które wcześniej działały odruchowo. Z perspektywy rodzica to jednak informacja, że etykieta „tryb dla nastolatków” nie jest dowodem na cokolwiek i nie zastępuje własnego testu. A z perspektywy regulatora - że ocena bezpieczeństwa produktu AI musi być powtarzana po każdej aktualizacji, bo poprzedni wynik nie przenosi się na nową wersję. Żaden polski przepis takiego obowiązku dziś nie nakłada.

Fakty sprawdzone 10 października 2026 roku. Źródła: Engadget, „Child safety group calls ChatGPT for Teens an unacceptable risk”, 8 października 2026, raport oceny ryzyka Youth AI Safety Institute przy Common Sense Media, komunikat OpenAI o statystykach użycia przez nastolatków, polska ustawa o ochronie danych osobowych oraz ustawa o ochronie małoletnich przed dostępem do treści nieodpowiednich w internecie. Wyliczenia liczby sesji dłuższych niż trzy godziny oraz liczby promptów na obszar ryzyka to mój własny rachunek na podstawie danych z raportu i komunikatu OpenAI. Kurs przyjęty do przeliczeń: 3,78 zł za dolara, 4,30 zł za euro.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 450 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›