› Modele generujące obrazy z tekstu są coraz częściej używane do wymuszania treści NSFW: przemocy, nagości i podobnych materiałów.
› Autorzy artykułu - Tong Zhang, Motasem Alfarra, Carlos Hinojosa, Christos Louizos i Bernard Ghanem - opisują nową metodę obrony o nazwie DiSCO, opublikowaną 17 sierpnia 2026 roku na arXiv.Problem, który dotychczasowe metody pomijałyWedług autorów większość istniejących zabezpieczeń działa w tzw.
› trybie white-box - wymaga dostępu do wewnętrznych parametrów modelu, możliwości edytowania wag sieci lub ingerowania w proces generowania.
› Takie podejście nie skaluje się do modeli komercyjnych, do których użytkownik zewnętrzny po prostu nie ma wglądu.Alternatywne metody black-box opierają się na przepisywaniu promptów przez duże modele językowe (LLM).