› Model ma 8B parametrów i zebrał już ponad 13 milionów pobrań na Hugging Face.
› Podejście opiera się na selektywnym blokowaniu: model odmawia odpowiedzi tylko na konkretne szkodliwe podzbiory tematu, nie na temat jako całość.
› Projekt dotyczy kwestii tego, dla kogo i w czyim interesie projektuje się mechanizmy bezpieczeństwa modeli językowych.