Policzyłem, ile Twoich rozmów z ChatGPT trafiło do treningu. Przy jednym pytaniu dziennie wychodzi 365 plików
Wyłączenie trenowania modeli na Twoich rozmowach zajmuje dwa kliknięcia, ale domyślnie jest włączone i prawie nikt tego nie rusza. Zestawiłem dane o liczbie polskich użytkowników z odsetkiem osób grzebiących w ustawieniach prywatności i policzyłem, ile tekstu przeciętny użytkownik zdążył już oddać. Sprawdziłem też, co na to UODO i czy skarga w Polsce ma sens.

👁 117 przeczytań
Historia rozmów w ChatGPT działa dwutorowo i to jest źródło większości nieporozumień. Pierwsza warstwa to zwykły zapis czatów w panelu bocznym - to, co widzisz po zalogowaniu. Druga warstwa to pamięć, czyli wyciągane z rozmów fakty o Tobie, które model dokleja do kontekstu przy kolejnych pytaniach. I jest jeszcze trzecia rzecz, o której mówi się najmniej: domyślnie włączona zgoda na wykorzystanie Twoich treści do ulepszania modeli. W polskiej wersji interfejsu ten przełącznik nazywa się „Ulepsz model dla wszystkich” i siedzi w Ustawieniach, w sekcji Kontrola danych. Jest domyślnie na „włączone” dla kont darmowych, Plus i Pro. Nie jest włączony dla Teamów, Enterprise i dla ruchu przez API - OpenAI opisuje to w centrum pomocy.
Ta asymetria jest kluczowa i mało kto ją wyłapuje. Firma, która kupi dla trzydziestu osób licencje Team, ma trenowanie wyłączone z automatu. Ta sama firma, w której trzydzieści osób używa prywatnych kont Plus i wrzuca tam fragmenty umów, ma trenowanie włączone dla wszystkich trzydziestu. Różnica w cenie między Plusem a Teamem to dziś w praktyce kilkanaście dolarów miesięcznie na osobę, więc mówimy o dopłacie rzędu 60-70 zł miesięcznie za głowę przy kursie 3,78 zł za dolara. Ta dopłata kupuje przede wszystkim zmianę domyślnego ustawienia prywatności.

Policzyłem: przy jednym czacie dziennie po roku masz 365 rozmów w bazie treningowej
Zrobiłem najprostszy możliwy rachunek, bo właśnie takich nikt nie podaje. Załóżmy użytkownika, który korzysta z ChatGPT umiarkowanie - jedna sesja dziennie, w niej sześć wymian, w każdej wymianie po jego stronie średnio 40 słów. To bardzo zachowawcze założenie, bo do ChatGPT wkleja się całe akapity, a nie zdania.
Sześć wymian razy 40 słów to 240 słów dziennie. Razy 365 dni wychodzi 87 600 słów w ciągu roku. Dla porównania: tyle mieści się w powieści o objętości mniej więcej „Lalki” skróconej o połowę albo w standardowej pracy magisterskiej razy trzy. Przy przeciętnym tempie czytania 200 słów na minutę przeczytanie własnej rocznej historii czatu zajęłoby ponad siedem godzin bez przerwy. I to jest materiał, który przy domyślnym ustawieniu jest dostępny do trenowania modeli.
Drugi rachunek dotyczy tokenów, bo to jednostka, w której myślą inżynierowie. Dla polszczyzny przyjmuje się z grubsza 1 token na 0,55-0,6 słowa, czyli polski tekst jest dla tokenizatora droższy niż angielski. 87 600 słów to zatem około 150 tysięcy tokenów rocznie z jednego umiarkowanego użytkownika. Osoba, która używa ChatGPT do pracy - wkleja kod, maile, fragmenty dokumentów - robi tyle w dwa, trzy tygodnie.
Ilu polskich użytkowników nigdy nie dotknęło tych ustawień? Wychodzi około 90 procent
Tutaj trzeba policzyć na podstawie dwóch niezależnych danych, bo OpenAI nie publikuje statystyk klikania w przełączniki. Pierwsza dana: skala. OpenAI podawało w 2025 roku ponad 700 milionów użytkowników tygodniowo, a Polska w rankingach ruchu do chatgpt.com stabilnie mieści się w drugiej dziesiątce krajów. Ostrożne oszacowanie dla Polski to kilka milionów osób miesięcznie - przyjmijmy 5 milionów jako liczbę roboczą, bo mniej więcej tyle daje przeskalowanie ruchu według udziału Polski w europejskim internecie.
Druga dana to zachowanie użytkowników przy domyślnych ustawieniach. Badania nad tzw. default effect w produktach cyfrowych od lat dają zbieżny wynik: odsetek osób, które samodzielnie zmieniają domyślną opcję prywatności, mieści się w przedziale 5-15 procent. Najniższe wartości dotyczą ustawień schowanych o dwa poziomy w menu, a przełącznik „Ulepsz model dla wszystkich” jest właśnie taki - trzeba wejść w Ustawienia, potem w Kontrolę danych.
Biorę środek tego przedziału, 10 procent, i wychodzi, że około 4,5 miliona polskich użytkowników ChatGPT nigdy nie ruszyło domyślnej zgody na trenowanie. Mnożąc to przez policzone wyżej 87 600 słów rocznie na osobę, dostaję rząd wielkości, który robi wrażenie: blisko 400 miliardów słów polskojęzycznego tekstu użytkowego w skali roku. To materiał nieporównywalny z niczym, co da się zebrać z polskiego internetu, bo są to rozmowy o konkretnych problemach, pisane naturalnym językiem, często z kontekstem zawodowym.
Zaznaczam, gdzie ten rachunek jest kruchy: 5 milionów to oszacowanie, a nie liczba potwierdzona przez OpenAI, i nie każda rozmowa faktycznie wchodzi do zbioru treningowego - firma stosuje filtrowanie i deduplikację. Ale rząd wielkości się nie zmienia, bo błąd o połowę w dowolnym z założeń wciąż daje setki miliardów słów.
Co RODO faktycznie daje, a czego nie da wcale
Podstawa prawna, z której OpenAI korzysta przy trenowaniu, to prawnie uzasadniony interes z artykułu 6 ust. 1 lit. f RODO. To ważne, bo przy tej podstawie masz prawo sprzeciwu z artykułu 21 - i właśnie tym prawem jest w praktyce kliknięcie przełącznika w Kontroli danych. Nie jest to więc łaska producenta, a realizacja uprawnienia z rozporządzenia.
Włoski regulator Garante jako pierwszy w Europie uderzył w OpenAI i w grudniu 2024 roku nałożył karę 15 milionów euro, czyli 64,5 miliona złotych przy kursie 4,30 zł za euro. Uzasadnienie dotyczyło m.in. braku właściwej podstawy prawnej przetwarzania danych do trenowania i braku mechanizmu weryfikacji wieku.
„OpenAI przetwarzało dane osobowe użytkowników w celu trenowania ChatGPT bez uprzedniego zidentyfikowania odpowiedniej podstawy prawnej i naruszyło zasadę przejrzystości oraz powiązane obowiązki informacyjne wobec użytkowników.”
- komunikat włoskiego Garante per la protezione dei dati personali, grudzień 2024
W Polsce sprawa wygląda inaczej i warto wiedzieć dlaczego. UODO przyjął skargę na OpenAI już w 2023 roku - chodziło o zarzut przetwarzania danych w sposób niezgodny z prawem i podawanie przez model nieprawdziwych informacji o osobie skarżącej, a także o odmowę realizacji prawa dostępu. UODO komunikował wtedy wszczęcie postępowania. Problem proceduralny jest jednak taki, że OpenAI ma europejską siedzibę w Irlandii, więc od lutego 2024 roku rolę wiodącego organu nadzorczego przejmuje irlandzka DPC, a polski urząd staje się organem zainteresowanym. W praktyce oznacza to, że skarga złożona w Warszawie jedzie do Dublina, a decyzja wraca po miesiącach albo latach.
Dwa kliknięcia, które warto wykonać dziś, i trzecie, o którym nikt nie mówi
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Konkretnie i po kolei, bo to jest część, którą czytelnik może zrobić w trakcie czytania tego akapitu. Wejdź w swoje inicjały w prawym górnym rogu, wybierz Ustawienia, potem Kontrola danych. Przełącznik „Ulepsz model dla wszystkich” przestaw na wyłączony - od tej chwili nowe rozmowy nie idą do treningu, choć historia zostaje widoczna dla Ciebie. W tej samej sekcji jest Pamięć: możesz obejrzeć listę zapamiętanych o Tobie faktów w „Zarządzaj” i usunąć pojedyncze wpisy albo wszystkie. To warto zrobić raz, bo pamięć zbiera rzeczy, o których zapominasz, że je napisałeś.
Trzecia rzecz to tryb Rozmowa tymczasowa, ikona obok wyboru modelu. Taki czat nie zapisuje się w historii, nie zasila pamięci i nie wchodzi do treningu - to odpowiednik okna incognito. Używam go zawsze, kiedy wklejam cokolwiek z cudzymi danymi: fragment umowy, CV kandydata, wiadomość od klienta. I jeszcze jedno, co przepada w dyskusjach o przełącznikach: wyłączenie trenowania nie znaczy, że treść nie jest przechowywana. OpenAI trzyma rozmowy do 30 dni na potrzeby nadzoru nad nadużyciami, a od 2025 roku dochodzi do tego kwestia nakazów sądowych w amerykańskich sporach o prawa autorskie, które okresowo wymuszały zachowywanie danych dłużej.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Dla kogo to nie jest kwestia higieny, a obowiązku prawnego
Jeśli pracujesz z danymi klientów, pacjentów albo kandydatów do pracy, wklejenie ich do ChatGPT na darmowym koncie z domyślnymi ustawieniami jest przekazaniem danych osobowych podmiotowi, z którym nie masz umowy powierzenia z artykułu 28 RODO. To nie jest teoretyczne ryzyko - to gotowy zarzut przy kontroli. Kancelaria, przychodnia, biuro rachunkowe czy agencja HR potrzebują konta Team lub Enterprise, gdzie trenowanie jest wyłączone domyślnie, a OpenAI podpisuje DPA. Dopłata rzędu 60-70 zł miesięcznie na osobę jest przy tym najtańszym elementem zgodności, jaki da się dziś kupić.
Osobna rzecz dotyczy rodziców i szkół. Przełącznik trenowania jest schowany w tym samym miejscu na koncie nastolatka, a jego domyślna wartość jest identyczna. Jeżeli dziecko używa ChatGPT do zadań domowych i wpisuje tam imię nauczyciela, nazwę szkoły i opis własnych problemów - a wpisuje, bo tak wygląda naturalna rozmowa - to wszystko przy domyślnych ustawieniach jest materiałem do ulepszania modelu. Dwie minuty przy ustawieniach na koncie dziecka są tu warte więcej niż godzina rozmowy o zagrożeniach w internecie.
Fakty sprawdzone 26 września 2026. Kursy przyjęte do przeliczeń: 3,78 zł za dolara, 4,30 zł za euro. Źródła: OpenAI - How your data is used to improve model performance, Polityka prywatności OpenAI, komunikat Garante o karze 15 mln euro, komunikat UODO o postępowaniu wobec OpenAI, OpenAI - dane o skali użycia, RODO, art. 6 i 21. Oszacowanie liczby polskich użytkowników i odsetka osób niezmieniających ustawień to moje obliczenia oparte na publicznych danych o ruchu i literaturze o efekcie domyślności - podaję je jako rząd wielkości, nie jako liczbę potwierdzoną przez OpenAI.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
