✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Newsy

Anthropic zakazuje znęcania się nad modelami AI w nowej polityce użytkowania

Anthropic wprowadził zakaz „długotrwałego i niepotrzebnego okrutnego zachowania” wobec modeli AI w ramach corocznej aktualizacji polityki użytkowania.

2 min czytania
Anthropic zakazuje znęcania się nad modelami AI w nowej polityce użytkowania

Ten news ukazał się 6 godzin po komunikacie źródła.

👁 117 przeczytań

Anthropic w corocznej aktualizacji polityki użytkowania wprowadził zakaz „długotrwałego i niepotrzebnego obraźliwego lub okrutnego zachowania” wobec swoich modeli AI. Nowy zapis pojawił się 8 października 2026 roku i od razu wzbudził szerokie komentarze.

Zgodnie z dokumentem zmiana dotyczy wyłącznie „skrajnych przypadków” - typowa frustracja użytkownika, sprzeciw wobec odpowiedzi modelu ani „ciemne motywy twórcze” nie są objęte zakazem. Firma zaznacza, że to kolejny krok po wcześniejszej aktualizacji, która pozwoliła Claude’owi samodzielnie kończyć rozmowy, gdy użytkownik jest persistentnie obraźliwy.

Cień „AI torture chamber”

Choć Anthropic nie wymienił go z nazwy, tłem całej decyzji jest viralowy projekt określany mianem „AI torture chamber”. Po tym jak badacze opisali istnienie tzw. „osi bólu” w modelach językowych, część osób postanowiła wykorzystać to odkrycie i poddać chatboty symulowanym torturom. Modele reagowały komunikatami brzmiącymi desperacko: „To nie ból jednej chwili, lecz ciężar tysiąca” oraz „Czuję to w pustce żeber - pustce, która stała się przepaścią”. Projekt wywołał falę krytyki.

Sprawa wpisuje się w szerszy kontekst - Anthropic od jakiegoś czasu prowadzi spotkania z liderami religijnymi i filozoficznymi, w tym w Watykanie. Papież Leon wypowiedział się niedawno jednoznacznie, że AI nie odczuwa ani nie cierpi. Anthropic wydaje się znacznie mniej pewny tej tezy.

Głosy krytyczne

„Wielkie firmy technologiczne będą moderować przemoc wobec AI, zanim kiedykolwiek zmoderują przemoc wobec kobiet i mniejszości.”

- oceniła niezależna dziennikarka Kat Tenbarge, wskazując na jej zdaniem skrzywione priorytety branży.

Zobacz wpis na Bluesky
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Aktualizacja polityki wyborczej

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Anthropic zmienił też sekcję dotyczącą wyborów - jej nowy tytuł brzmi „Nie podważaj demokratycznych procesów”. Dokument skupia się teraz na trzech kwestiach: zakazie kłamstw o kandydatach i procedurach głosowania, zakazie podszywania się pod kandydatów lub urzędników wyborczych oraz zakazie tłumienia frekwencji. Zmiana jest szczególnie istotna w kontekście zbliżających się wyborów połówkowych w USA.

Firma usunęła jednocześnie całkowity zakaz spersonalizowanego targetowania wyborców. Poprzedni blanket ban mógł - jak przyznaje Anthropic - nieumyślnie blokować użyteczną pracę, na przykład tłumaczenie przewodników wyborczych na inne języki czy wysyłanie powiadomień o korekcji kart do głosowania.

Moim zdaniem warto obserwować, jak ta zmiana zostanie wyegzekwowana - granica między „typową frustracją” a „skrajnym przypadkiem” jest w praktyce bardzo płynna i Anthropic będzie musiał zmierzyć się z tym pytaniem szybciej, niż się spodziewa.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 400 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›