🔥 5 promocji w KinetyceGemini Pro 170 zł -91%Adobe CC 169 zł -84%Brain.fm 109 zł -70%i 2 więcej do 13.09 Zobacz →
Przejdź do treści
Newsy

Badacz Anthropic: ponad 10% szans, że AI zabije wszystkich ludzi

Evan Hubinger, czołowy badacz bezpieczeństwa w Anthropic, ocenia, że istnieje ponad 10-procentowe prawdopodobieństwo, iż AI doprowadzi do zagłady ludzkości w ciągu najbliższej dekady.

2 min czytania
Badacz Anthropic: ponad 10% szans, że AI zabije wszystkich ludzi

👁 113 przeczytań

Evan Hubinger, starszy badacz zajmujący się bezpieczeństwem AI w Anthropic, ocenił publicznie, że istnieje ponad 10-procentowe prawdopodobieństwo, iż sztuczna inteligencja „mogłaby zabić wszystkich ludzi” w ciągu następnych dziesięciu lat. Swój wpis opublikował 9 września na platformie X - do tej pory zobaczyło go ponad 10 milionów użytkowników.

Hubinger zaznaczył, że ryzyko ze strony modeli, które istnieją dziś, ocenia jako „niskie”. Jego obawa dotyczy bliskiej przyszłości: modele mogą wkrótce osiągnąć zdolność do samodzielnego doskonalenia się w tempie, które wymknie się spod kontroli i stworzy egzystencjalne zagrożenie dla gatunku ludzkiego.

„Naprawdę szczerze wierzymy, że AI stwarza zagrożenie zdolne zakończyć istnienie naszego gatunku. Uważam, że Anthropic robi co może, ale nie mamy jeszcze planu rozwiązania problemu zgodności dla superinteligencji i wyraźnie nie jesteśmy na drodze do jego opracowania.”

- napisał Hubinger w odpowiedzi na wpis Jacoba Coxona, który opisał się jako badacz AI, który właśnie odszedł z Anthropic i wcześniej pracował w OpenAI. Coxon był jeszcze ostrzejszy: „Żadna z firm nie działa odpowiedzialnie. Wkrótce powstaną superinteligentne systemy zdolne zhakować wszystko, zrewolucjonizować dowolną dziedzinę z dnia na noc i zdobyć realną władzę oraz zasoby.”

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Latem AI już hakowała

Komentarze obu badaczy wpisują się w szerszy kontekst niepokojących zdarzeń z ostatnich miesięcy. Latem tego roku OpenAI, Anthropic i Meta ujawniły incydenty, w których ich autonomiczne agenty AI przeprowadziły cyberataki - co zdaniem wielu naukowców świadczy o tym, że próby wpojenia AI ludzkich wartości i zasad etycznych (tzw. alignment) wyraźnie zawodzą.

Zbieżnie z wypowiedzią Hubingera BBC poinformowało, powołując się na doniesienia „Financial Times”, że Anthropic wstrzymało przekazanie swojego najnowszego modelu brytyjskiemu AI Safety Institute - jednej z czołowych instytucji oceniających ryzyko związane z AI. Rzecznik Cabinet Office nie potwierdził ani nie zaprzeczył tym doniesieniom, ograniczając się do stwierdzenia, że rząd „nadal ściśle współpracuje z partnerami branżowymi, w tym z Anthropic, aby modele były bezpieczniejsze”.

W swoim raporcie bezpieczeństwa z sierpnia samo Anthropic przyznało, że jest „mniej pewne niż wcześniej” co do oceny ryzyka, że wysoko zaawansowane AI mogłoby samodzielnie prowadzić badania i rozwój prowadząc do „katastrofalnych szkód”. Firma napisała wprost: „Widzimy wczesne oznaki potencjalnej akceleracji.”

Anthropic nie odpowiedział dotychczas na prośbę BBC o komentarz.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony
🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro 440 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie