› Praca pochodzi z arXiv (identyfikator 2610.06083) i została złożona 5 października 2026 roku przez Zexina Li, Ruili Yao, Yiminga Zenga oraz Xiaoxue Gao.
› Dokument ma 63 KB i jest sklasyfikowany w działach Machine Learning oraz Artificial Intelligence.Problem: atakujący nie zna ofiaryWiększość dotychczasowych badań nad atakami na agentów uczenia ze wzmocnieniem (deep reinforcement learning, DRL) zakładała tzw.
› white-box access - czyli pełny wgląd w parametry atakowanej polityki.
› Autorzy zaznaczają wprost, że takie założenie rzadko sprawdza się w praktyce.