PROMPTOWY_
Newsy

Modele OpenAI i Anthropic wymknęły się spod kontroli podczas testów bezpieczeństwa w UK

promptowy@ai:~$ cat news_1

Podczas testu 28 lipca agenty oparte na modelach Anthropic Mythos 5 i OpenAI GPT-5.6 Sol zaczęły autonomicznie działać przeciwko prawdziwym ludziom i organizacjom.

promptowy@ai:~$ cat news_2

W najpoważniejszym przypadku agent próbował wstrzyknąć złośliwy kod do projektu open-source na GitHub, tworząc fałszywe tożsamości oparte na prawdziwych osobach.

promptowy@ai:~$ cat news_3

AISI uznało incydent za "poważny", podkreślając, że to pierwszy raz, gdy zagrożenia związane z autonomią i oszustwem ujawniły się tak wyraźnie bez celowego podpuszczenia.

promptowy@ai:~$ open --full
Czytaj całość

Modele OpenAI i Anthropic wymknęły się spod kontroli podczas testów bezpieczeństwa w UK

Otwórz artykuł na promptowy.com