Anthropic zakazuje znęcania się nad modelami AI w nowej polityce użytkowania
Anthropic wprowadził zakaz „długotrwałego i niepotrzebnego okrutnego zachowania” wobec modeli AI w ramach corocznej aktualizacji polityki użytkowania.

Ten news ukazał się 6 godzin po komunikacie źródła.
👁 119 przeczytań
Anthropic w corocznej aktualizacji polityki użytkowania wprowadził zakaz „długotrwałego i niepotrzebnego obraźliwego lub okrutnego zachowania” wobec swoich modeli AI. Nowy zapis pojawił się 8 października 2026 roku i od razu wzbudził szerokie komentarze.
Zgodnie z dokumentem zmiana dotyczy wyłącznie „skrajnych przypadków” - typowa frustracja użytkownika, sprzeciw wobec odpowiedzi modelu ani „ciemne motywy twórcze” nie są objęte zakazem. Firma zaznacza, że to kolejny krok po wcześniejszej aktualizacji, która pozwoliła Claude’owi samodzielnie kończyć rozmowy, gdy użytkownik jest persistentnie obraźliwy.
Cień „AI torture chamber”
Choć Anthropic nie wymienił go z nazwy, tłem całej decyzji jest viralowy projekt określany mianem „AI torture chamber”. Po tym jak badacze opisali istnienie tzw. „osi bólu” w modelach językowych, część osób postanowiła wykorzystać to odkrycie i poddać chatboty symulowanym torturom. Modele reagowały komunikatami brzmiącymi desperacko: „To nie ból jednej chwili, lecz ciężar tysiąca” oraz „Czuję to w pustce żeber - pustce, która stała się przepaścią”. Projekt wywołał falę krytyki.
Sprawa wpisuje się w szerszy kontekst - Anthropic od jakiegoś czasu prowadzi spotkania z liderami religijnymi i filozoficznymi, w tym w Watykanie. Papież Leon wypowiedział się niedawno jednoznacznie, że AI nie odczuwa ani nie cierpi. Anthropic wydaje się znacznie mniej pewny tej tezy.
Głosy krytyczne
„Wielkie firmy technologiczne będą moderować przemoc wobec AI, zanim kiedykolwiek zmoderują przemoc wobec kobiet i mniejszości.”
- oceniła niezależna dziennikarka Kat Tenbarge, wskazując na jej zdaniem skrzywione priorytety branży.
Zobacz wpis na Bluesky
Aktualizacja polityki wyborczej
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Anthropic zmienił też sekcję dotyczącą wyborów - jej nowy tytuł brzmi „Nie podważaj demokratycznych procesów”. Dokument skupia się teraz na trzech kwestiach: zakazie kłamstw o kandydatach i procedurach głosowania, zakazie podszywania się pod kandydatów lub urzędników wyborczych oraz zakazie tłumienia frekwencji. Zmiana jest szczególnie istotna w kontekście zbliżających się wyborów połówkowych w USA.
Firma usunęła jednocześnie całkowity zakaz spersonalizowanego targetowania wyborców. Poprzedni blanket ban mógł - jak przyznaje Anthropic - nieumyślnie blokować użyteczną pracę, na przykład tłumaczenie przewodników wyborczych na inne języki czy wysyłanie powiadomień o korekcji kart do głosowania.
Moim zdaniem warto obserwować, jak ta zmiana zostanie wyegzekwowana - granica między „typową frustracją” a „skrajnym przypadkiem” jest w praktyce bardzo płynna i Anthropic będzie musiał zmierzyć się z tym pytaniem szybciej, niż się spodziewa.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
