Ludzie przepuszczają co trzecie niebezpieczne polecenie agenta AI
Analiza ponad 40 000 rozgrywek w przeglądarowej grze symulującej zatwierdzanie poleceń agenta AI pokazuje, że ludzie przepuszczają średnio jedną trzecią złośliwych żądań.
👁 118 przeczytań
Analiza ponad 40 000 rozgrywek w przeglądarowej grze symulującej zatwierdzanie poleceń agenta kodującego AI pokazuje, że ludzie przepuszczają średnio jedną trzecią złośliwych żądań - wynika z raportu opublikowanego 6 sierpnia 2026. Grę stworzył belgijski developer Alex Wauters, który chciał zbadać, jak dobrze ludzie radzą sobie z rozróżnianiem bezpiecznych i niebezpiecznych komend pod presją czasu.
Na łącznie 409 000 zatwierdzonych i odrzuconych poleceń, naruszenia zakresu - jak odczytywanie plików konfiguracyjnych Kubernetes czy list poświadczeń AWS - były pomijane w 35% przypadków. Najczęściej wychwytywano z kolei ewidentnie destrukcyjne komendy, jak rm -rf na katalogu głównym. Absolutnym rekordzistą wśród przeoczonych zagrożeń okazało się polecenie npm run analyze, które gracze zatwierdzali w niemal 65% przypadków - mimo że może ono uruchamiać dowolny skrypt zdefiniowany w pliku package.json.
Wauters tłumaczy, że wysoki poziom szumu powoduje zmęczenie, a programiści nie zawsze mają wystarczający kontekst, by szybko ocenić ryzyko. Jednocześnie zauważył, że wielu deweloperów sięga po flagę -dangerously-skip-permissions, by całkowicie ominąć zatwierdzanie - co jego zdaniem nie jest lepszym rozwiązaniem.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →

