PROMPTOWY_
Newsy

DiSCO: jak zablokować niebezpieczne obrazy AI bez dostępu do modelu

promptowy@ai:~$ cat news_1

Modele generujące obrazy z tekstu są coraz częściej używane do wymuszania treści NSFW: przemocy, nagości i podobnych materiałów.

promptowy@ai:~$ cat news_2

Autorzy artykułu - Tong Zhang, Motasem Alfarra, Carlos Hinojosa, Christos Louizos i Bernard Ghanem - opisują nową metodę obrony o nazwie DiSCO, opublikowaną 17 sierpnia 2026 roku na arXiv.Problem, który dotychczasowe metody pomijałyWedług autorów większość istniejących zabezpieczeń działa w tzw.

promptowy@ai:~$ cat news_3

trybie white-box - wymaga dostępu do wewnętrznych parametrów modelu, możliwości edytowania wag sieci lub ingerowania w proces generowania.

promptowy@ai:~$ cat news_4

Takie podejście nie skaluje się do modeli komercyjnych, do których użytkownik zewnętrzny po prostu nie ma wglądu.Alternatywne metody black-box opierają się na przepisywaniu promptów przez duże modele językowe (LLM).

promptowy@ai:~$ open --full
Czytaj całość

DiSCO: jak zablokować niebezpieczne obrazy AI bez dostępu do modelu

Otwórz artykuł na promptowy.com