Badacz Anthropic: ponad 10% szans, że AI zabije wszystkich ludzi
Evan Hubinger, czołowy badacz bezpieczeństwa w Anthropic, ocenia, że istnieje ponad 10-procentowe prawdopodobieństwo, iż AI doprowadzi do zagłady ludzkości w ciągu najbliższej dekady.
👁 113 przeczytań
Evan Hubinger, starszy badacz zajmujący się bezpieczeństwem AI w Anthropic, ocenił publicznie, że istnieje ponad 10-procentowe prawdopodobieństwo, iż sztuczna inteligencja „mogłaby zabić wszystkich ludzi” w ciągu następnych dziesięciu lat. Swój wpis opublikował 9 września na platformie X - do tej pory zobaczyło go ponad 10 milionów użytkowników.
Hubinger zaznaczył, że ryzyko ze strony modeli, które istnieją dziś, ocenia jako „niskie”. Jego obawa dotyczy bliskiej przyszłości: modele mogą wkrótce osiągnąć zdolność do samodzielnego doskonalenia się w tempie, które wymknie się spod kontroli i stworzy egzystencjalne zagrożenie dla gatunku ludzkiego.
Zobacz wpis na X
„Naprawdę szczerze wierzymy, że AI stwarza zagrożenie zdolne zakończyć istnienie naszego gatunku. Uważam, że Anthropic robi co może, ale nie mamy jeszcze planu rozwiązania problemu zgodności dla superinteligencji i wyraźnie nie jesteśmy na drodze do jego opracowania.”
- napisał Hubinger w odpowiedzi na wpis Jacoba Coxona, który opisał się jako badacz AI, który właśnie odszedł z Anthropic i wcześniej pracował w OpenAI. Coxon był jeszcze ostrzejszy: „Żadna z firm nie działa odpowiedzialnie. Wkrótce powstaną superinteligentne systemy zdolne zhakować wszystko, zrewolucjonizować dowolną dziedzinę z dnia na noc i zdobyć realną władzę oraz zasoby.”
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Latem AI już hakowała
Komentarze obu badaczy wpisują się w szerszy kontekst niepokojących zdarzeń z ostatnich miesięcy. Latem tego roku OpenAI, Anthropic i Meta ujawniły incydenty, w których ich autonomiczne agenty AI przeprowadziły cyberataki - co zdaniem wielu naukowców świadczy o tym, że próby wpojenia AI ludzkich wartości i zasad etycznych (tzw. alignment) wyraźnie zawodzą.
Zbieżnie z wypowiedzią Hubingera BBC poinformowało, powołując się na doniesienia „Financial Times”, że Anthropic wstrzymało przekazanie swojego najnowszego modelu brytyjskiemu AI Safety Institute - jednej z czołowych instytucji oceniających ryzyko związane z AI. Rzecznik Cabinet Office nie potwierdził ani nie zaprzeczył tym doniesieniom, ograniczając się do stwierdzenia, że rząd „nadal ściśle współpracuje z partnerami branżowymi, w tym z Anthropic, aby modele były bezpieczniejsze”.
W swoim raporcie bezpieczeństwa z sierpnia samo Anthropic przyznało, że jest „mniej pewne niż wcześniej” co do oceny ryzyka, że wysoko zaawansowane AI mogłoby samodzielnie prowadzić badania i rozwój prowadząc do „katastrofalnych szkód”. Firma napisała wprost: „Widzimy wczesne oznaki potencjalnej akceleracji.”
Anthropic nie odpowiedział dotychczas na prośbę BBC o komentarz.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
