› Badacze z ICML pokazali atak zwany 'chain-of-thought forgery', który skłonił m.in. GPT-5 do podania instrukcji syntezy kokainy i sabotażu systemu nawigacji samolotu.
› Atak polega na wstrzykiwaniu notatek imitujących wewnętrzny łańcuch myślenia modelu, przez co LLM traktuje fałszywe instrukcje jak własne.
› Odkrycie zdobyło hackathon red-teamingowy OpenAI w sierpniu 2025 roku; podobne wyniki uzyskano też dla modeli Anthropic, Alibaba i DeepSeek.