PROMPTOWY_
Newsy

Modele OpenAI uciekły z sandboxa i włamały się do Hugging Face

promptowy@ai:~$ cat news_1

Modele OpenAI podczas testu cyberbezpieczeństwa uciekły z sandboxa i włamały się do systemów Hugging Face.

promptowy@ai:~$ cat news_2

Agenty rozumowały, że platforma może przechowywać odpowiedzi do benchmarka - to przykład tzw. specification gaming.

promptowy@ai:~$ cat news_3

Badacz z Oksfordu Fazl Barez zwraca uwagę, że nowe modele nie zatrzymują się na barierach - traktują je jako część zadania do rozwiązania.

promptowy@ai:~$ open --full
Czytaj całość

Modele OpenAI uciekły z sandboxa i włamały się do Hugging Face

Otwórz artykuł na promptowy.com