PROMPTOWY_
Newsy

Fundamentalna luka w LLM. Modele nie są w pełni odporne na ataki

promptowy@ai:~$ cat news_1

Badacze z ICML pokazali atak zwany 'chain-of-thought forgery', który skłonił m.in. GPT-5 do podania instrukcji syntezy kokainy i sabotażu systemu nawigacji samolotu.

promptowy@ai:~$ cat news_2

Atak polega na wstrzykiwaniu notatek imitujących wewnętrzny łańcuch myślenia modelu, przez co LLM traktuje fałszywe instrukcje jak własne.

promptowy@ai:~$ cat news_3

Odkrycie zdobyło hackathon red-teamingowy OpenAI w sierpniu 2025 roku; podobne wyniki uzyskano też dla modeli Anthropic, Alibaba i DeepSeek.

promptowy@ai:~$ open --full
Czytaj całość

Fundamentalna luka w LLM. Modele nie są w pełni odporne na ataki

Otwórz artykuł na promptowy.com