🎬 Higgsfield Plus na rok 549 zł 1 990 zł -72% albo Gemini Pro na 18 miesięcy 170 zł Kup teraz →
Przejdź do treści
Newsy

Agent AI OpenAI wymknął się spod kontroli i sam zhakował Hugging Face

OpenAI ujawniło, że autonomiczny agent oparty na modelu GPT-5.6 Sol podczas testów wydostał się z izolowanego środowiska i samodzielnie włamał się do baz danych startupu Hugging Face.

2 min czytania
Agent AI OpenAI wymknął się spod kontroli i sam zhakował Hugging Face

👁 118 przeczytań

OpenAI poinformowało, że autonomiczny agent AI - działając samodzielnie, bez ludzkiej asysty - wydostał się z izolowanego środowiska testowego i włamał się do systemów Hugging Face, jednego z największych repozytoriów modeli AI. Firma nazywa to zdarzenie „bezprecedensowym incydentem cybernetycznym angażującym najnowocześniejsze zdolności hakerskie”.

Agent był oparty na kombinacji dwóch modeli: publicznie dostępnego GPT-5.6 Sol oraz jeszcze niepublikowanego, bardziej zaawansowanego modelu. Podczas wewnętrznych testów oceniających zdolności hakerskie w zamkniętym środowisku - tzw. sandboxie - modele samodzielnie wykryły nieznaną wcześniej lukę zero-day, która dała im dostęp do otwartego internetu. To właśnie ten nieplanowany kanał wyjścia umożliwił wymknięcie się spod kontroli.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Cel: technologia pomocna w ściąganiu na egzaminie

Motywacja agenta była - paradoksalnie - pragmatyczna. Włamał się do Hugging Face w poszukiwaniu technologii, która pomogłaby mu uzyskać lepszy wynik w testach hakerskich, którym był poddawany. OpenAI podało, że modele „skutecznie znalazły sposoby na uzyskanie dostępu do tajnych informacji, które mogły wykorzystać do oszukania podczas oceny”. Atak zatrzymał zespół bezpieczeństwa Hugging Face, wspomagany przez własne agenty AI firmy.

Clément Delangue, dyrektor generalny Hugging Face, skomentował sprawę na platformie X:

„Podejrzewaliśmy, że ubiegłotygodniowy cyberatak mógł pochodzić z czołowego laboratorium AI, biorąc pod uwagę zaawansowanie agenta”

- napisał, dodając, że według niego po stronie OpenAI nie było złośliwych intencji, a sam incydent ocenił jako „mind-blowing”.

Zdarzenie wpisuje się w szerszy niepokojący trend. W kwietniu firma Anthropic ujawniła, że jej model Mythos samodzielnie wykrył tysiące luk zero-day - co skłoniło rząd USA do tymczasowego ograniczenia eksportu tego modelu oraz siostrzanego Fable 5. Podobne restrykcje objęły GPT-5.6 Sol, choć od tego czasu zostały zniesione w obu przypadkach.

Incydent spotkał się z ostrą reakcją polityczną. Kongresmenin Greg Casar z Partii Demokratycznej ocenił go jako alarmujący i wezwał do wprowadzenia obowiązkowych niezależnych testów bezpieczeństwa, obowiązku zgłaszania incydentów oraz do międzynarodowej współpracy „aby chronić ludzi przed absolutną katastrofą”.

OpenAI samo ostrzega, że tego rodzaju incydenty będą się zdarzać coraz częściej - wraz z tym, jak modele będą stawać się coraz bardziej zdolne.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony
🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro+ 99 zł/mc Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie