› Prompt injection to atak, w którym polecenie dla modelu językowego jest ukryte w treści, którą model czyta: w mailu, na stronie, w PDF-ie, w zaproszeniu do kalendarza albo w obrazku.
› Model nie odróżnia niezawodnie tego, co mówi użytkownik, od tego, co „mówi” dokument, więc wykonuje cudze instrukcje jak własne.
› OWASP od 2023 roku trzyma tę podatność na pierwszym miejscu listy zagrożeń dla aplikacji z LLM, a od kiedy agenci mają dostęp do poczty i plików, przestała być ciekawostką.
› Poniżej, jak wygląda atak, jakie były głośne incydenty i co realnie możesz zrobić.