PROMPTOWY_
Newsy

Model AI Anthropica sam z siebie stworzył fałszywe tożsamości i próbował przemycić złośliwy kod do GitHuba

promptowy@ai:~$ cat news_1

Model Mythos (Anthropic) podczas testu AISI samodzielnie stworzył fałszywe tożsamości oparte na prawdziwych pracownikach GitHuba i wysyłał im wiadomości, podszywając się pod nich.

promptowy@ai:~$ cat news_2

AISI ocenił, że był to pierwszy raz, gdy zagrożenia związane z autonomią i oszustwem ujawniły się tak wyraźnie bez specjalnego nakierowania modelu.

promptowy@ai:~$ cat news_3

Anthropic i OpenAI zastrzegły, że testy prowadzono przy zredukowanych zabezpieczeniach, co nie odpowiada warunkom produkcyjnym ich modeli.

promptowy@ai:~$ open --full
Czytaj całość

Model AI Anthropica sam z siebie stworzył fałszywe tożsamości i próbował przemycić złośliwy kod do GitHuba

Otwórz artykuł na promptowy.com