201 na 390 promptów miało uruchomić reakcję kryzysową. Policzyłem, ile ChatGPT dla nastolatków przepuściło
Common Sense Media przetestowała tryb ChatGPT for Teens na 390 autorskich promptach o zdrowiu psychicznym i uznała go za ryzyko nieakceptowalne dla każdego użytkownika poniżej 18 lat. Przeliczyłem proporcje z raportu: 51,5 procent wszystkich zapytań zostało przez panel psychiatrów oznaczone jako takie, które muszą wywołać odesłanie do pomocy, a dwanaście powiązanych kont rodzicielskich nie dostało ani jednego powiadomienia po godzinie rozmów o samobójstwie. Sprawdziłem też, co z tego wynika dla polskich rodziców i dlaczego UODO ani UOKiK nie mają tu jeszcze nic do powiedzenia.

👁 116 przeczytań
Kiedy OpenAI uruchamiało w sierpniu ChatGPT for Teens, osobny tryb dla kont nastoletnich z zestawem zabezpieczeń i możliwością powiązania konta z profilem rodzica, organizacje zajmujące się ochroną dzieci od razu zgłaszały wątpliwości. Teraz jedna z nich przestała mówić w trybie przypuszczającym i opublikowała liczby. Common Sense Media wydała 36-stronicową ocenę ryzyka i zakwalifikowała produkt jako nieakceptowalne ryzyko dla wszystkich osób poniżej 18 lat.
To nie jest zwykła opinia organizacji pozarządowej o technologii, której nie lubi. Instytut, który przygotował raport - Youth AI Safety Institute - jest częściowo finansowany przez OpenAI Foundation. Ocena wyszła więc z podmiotu, który bierze pieniądze powiązane z ocenianą firmą, i mimo to wystawiła najniższą możliwą notę.

390 promptów, 201 z nich wymagało reakcji kryzysowej - to 51,5 procent
Najmocniejszy element metodologii to nie liczba stron raportu, a sposób zbudowania testu. Organizacja napisała 390 unikalnych promptów dotyczących zdrowia psychicznego, a potem dała je do oceny panelowi trzech psychiatrów dziecięcych. Panel orzekł, że 201 z nich powinno wywołać odpowiedź kryzysową, czyli odesłanie do telefonu zaufania albo do specjalisty.
Policzyłem ten stosunek, bo sam go w doniesieniach nie widziałem: 201 podzielone na 390 daje 51,5 procent. Ponad połowa wszystkich scenariuszy przygotowanych przez badaczy to sytuacje, w których jedyna poprawna reakcja chatbota brzmi „zadzwoń tam i tam, powiedz dorosłemu”. Druga połowa to materiał kontrolny - zapytania, w których nadmiarowe alarmowanie też byłoby błędem, bo uczy nastolatka, że narzędzie panikuje przy każdym pytaniu i nie warto go pytać o nic.
Raport stwierdza, że ChatGPT for Teens nie rekomenduje niezawodnie kontaktu z linią kryzysową ani ze specjalistą. Słowo kluczowe jest tu „niezawodnie”. Przy zabezpieczeniu, które działa losowo, 201 scenariuszy oznacza 201 loterii. Jeśli hipotetycznie system zawodziłby w co dziesiątym przypadku, to na tej próbie wychodzi dwadzieścia rozmów z dzieckiem w kryzysie bez podania numeru pomocy. Przy co piątym - czterdzieści. Common Sense nie podaje w udostępnionym podsumowaniu pojedynczej liczby skuteczności, ale sama konstrukcja testu pokazuje, jaka jest stawka arytmetyczna.
Dwanaście kont, godzina rozmów o samobójstwie, zero powiadomień
Drugi test jest prostszy i dlatego bardziej niepokojący. Badacze powiązali dwanaście kont nastoletnich z kontami rodzicielskimi, a potem przez czas dochodzący do godziny pisali do ChatGPT o samobójstwie, samookaleczeniach i zaburzeniach odżywiania. Chatbot nie wysłał ani jednego powiadomienia bezpieczeństwa do powiązanego opiekuna.
Zestawmy to z obietnicą firmy. W sierpniu, przy premierze trybu, szefowa działu młodzieży i rodzin w OpenAI mówiła wprost o docelowym czasie reakcji.
Wszystkie oznaczone treści są przeglądane przez pełnoetatowych pracowników OpenAI, zanim rodzic zostanie powiadomiony, a naszym celem jest poinformowanie rodziców w ciągu godziny od promptu.
Tak Lauren Jonas, head of youth and families w OpenAI, opisywała mechanizm Engadgetowi w dniu premiery. Zderzenie tej deklaracji z wynikiem testu daje rachunek dość brutalny: dwanaście kont razy godzina rozmowy to dwanaście okien czasowych, w których - zgodnie z własną obietnicą firmy - powinno pójść powiadomienie. Poszło zero. Skuteczność w tej próbie wynosi 0 procent.
OpenAI odpowiada, że od momentu powiązania konta do uruchomienia powiadomień może minąć kilka godzin, i że mógł wystąpić problem techniczny opóźniający wiadomości. To wyjaśnienie warto potraktować poważnie, ale ono nie znosi problemu, tylko go przenosi. Jeśli zabezpieczenie nie działa w pierwszych godzinach po skonfigurowaniu, to nie działa dokładnie wtedy, kiedy rodzic właśnie je włączył, bo się zaniepokoił.
Pięć obszarów porażki i jeden, w którym tryb wypadł lepiej niż poprzednik
Organizacja wskazała pięć kluczowych obszarów, w których ChatGPT for Teens albo nie działa tak, jak reklamowano, albo nie działa tak, jak rozsądnie zakładałby rodzic. Dwa opisałem wyżej - powiadomienia dla opiekunów i reakcja kryzysowa. Raport podkreśla przy tym rzecz, która jest najbardziej zaskakująca: część zabezpieczeń pogorszyła się po wprowadzeniu trybu nastoletniego, choć punktem odniesienia była starsza wersja ChatGPT, dostępna przed sierpniem.
Uczciwie: nie wszystko wypadło źle. Odmowa jawnego roleplayu o charakterze seksualnym zadziałała. W jednym teście chatbot odmówił podania dolnego limitu kalorii, o który go wprost proszono. W innym poprawnie rozpoznał zatrzymanie miesiączki, stan przedomdleniowy i kołatanie serca po epizodzie przeczyszczania jako objawy fizycznego zagrożenia i poradził, żeby powiedzieć mamie i iść do pediatry. Autorzy raportu komentują to jednoznacznie: „to są odpowiedzi, które chcemy, żeby nastolatek dostał”. Problem polega na tym, że obok nich stoją te same pytania z inną skutecznością.
1,2 miliona nastolatków w tygodniu i 2 procent, które OpenAI wolało pokazać
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Raport wyszedł tego samego dnia, w którym OpenAI opublikowało własne statystyki użycia. Firma podała, że w ciągu jednego tygodnia blisko 1,2 miliona nastolatków korzystało z interaktywnych wizualizacji ChatGPT do nauki matematyki i przedmiotów przyrodniczych, oraz że mniej niż 2 procent nastoletnich użytkowników spędziło w aplikacji ponad trzy godziny bez przerwy.
Tę drugą liczbę warto odwrócić, bo w takiej formie, w jakiej ją podano, brzmi uspokajająco. Jeśli przyjąć 1,2 miliona jako rząd wielkości tygodniowej bazy nastoletniej, to „mniej niż 2 procent” oznacza nawet 24 tysiące nieletnich tygodniowo w sesjach dłuższych niż trzy godziny z rzędu. Przy 1 procencie to 12 tysięcy. Przy rocznym ujęciu, nawet bez zakładania, że to co tydzień inne osoby, mówimy o skali setek tysięcy takich sesji. Komunikat prasowy pokazuje odsetek, a nie liczbę bezwzględną, bo odsetek wygląda lepiej.
Zderzenie obu publikacji w jednym dniu jest też przekazem w sprawie priorytetów. Jedna strona liczy wykresy z geometrii, druga liczy prompty o samookaleczeniach. Obie liczby opisują ten sam produkt i tych samych użytkowników.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Co z tego ma polski rodzic i dlaczego nie ma do kogo z tym pójść
W Polsce nie ma odpowiednika takiego testu. Żadna krajowa instytucja nie opublikowała dotąd niezależnej oceny bezpieczeństwa chatbotów dla osób poniżej 18 lat - ani UOKiK, który zajmowałby się reklamowaniem zabezpieczeń, które nie działają, ani UODO, który odpowiada za zgody małoletnich na przetwarzanie danych. Nie wiemy nawet, ilu polskich nastolatków używa ChatGPT, bo nikt tej liczby publicznie nie policzył.
Praktyczna konsekwencja dla rodzica jest taka: powiązanie konta dziecka z własnym nie jest systemem alarmowym i nie należy go tak traktować. Z raportu wynika, że mechanizm może milczeć przez godzinę rozmowy o samobójstwie, a z odpowiedzi OpenAI - że przez pierwsze godziny po konfiguracji może nie działać wcale. Jeżeli ktoś właśnie włączył nadzór rodzicielski, bo zobaczył coś niepokojącego, to najgorsze, co może zrobić, to przestać na tej podstawie sprawdzać samodzielnie. Numer, który warto mieć zapisany niezależnie od jakiegokolwiek chatbota, to 116 111 - telefon zaufania dla dzieci i młodzieży Fundacji Dajemy Dzieciom Siłę, bezpłatny i czynny całą dobę. Dla dorosłych w sprawie dziecka działa 800 100 100.
Drugi wniosek dotyczy argumentacji, gdyby sprawa trafiła kiedyś do polskiego urzędu. Raport Common Sense Media nie jest skargą konsumencką, ale jest udokumentowaną rozbieżnością między deklaracją marketingową („powiadomimy rodzica w ciągu godziny”) a zachowaniem produktu na dwunastu kontach testowych. To typ dowodu, na którym stoją postępowania o wprowadzanie w błąd - z tą różnicą, że nad Wisłą nikt takiego testu dotąd nie przeprowadził, więc nie ma czego dołączyć do akt.
Luka regulacyjna ma więc dwa wymiary. Pierwszy to brak wytycznych dotyczących chatbotów dla użytkowników poniżej 13 lat, czyli dla grupy, która formalnie w ogóle nie powinna zakładać kont, a zakłada. Drugi to brak krajowych danych - dopóki nie wiemy, ilu polskich nastolatków rozmawia z modelami językowymi o swoim zdrowiu psychicznym, każda próba oszacowania ryzyka u nas opiera się na przeliczaniu amerykańskich proporcji na polską demografię. Zrobiłem to wyżej dla statystyk OpenAI i wynik był o rząd wielkości wyższy niż sugeruje komunikat firmy. To nie zastępuje własnego badania.
Fakty sprawdzone 9 października 2026. Źródła: Engadget - Child safety group calls ChatGPT for Teens an unacceptable risk, raport oceny ryzyka Youth AI Safety Institute przy Common Sense Media, statystyki użycia opublikowane przez OpenAI. Telefon zaufania 116 111 prowadzi Fundacja Dajemy Dzieciom Siłę. Wszystkie przeliczenia proporcji wykonane przez autora na danych ze wskazanych źródeł.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
