🔥 5 promocji w KinetyceGemini Pro 170 zł -91%Adobe CC 169 zł -84%Brain.fm 109 zł -70%i 2 więcej do 13.09 Zobacz →
Przejdź do treści
Słownik AI / Guardrails
🛡️ Bezpieczeństwo i jakość

Guardrails

Zabezpieczenia ograniczające, co model może powiedzieć lub zrobić.

Guardrails (barierki) to zabezpieczenia ograniczające zachowanie modelu: zestaw reguł, filtrów i technik treningowych, które mają zapobiegać treściom szkodliwym, nielegalnym czy po prostu niezgodnym z przeznaczeniem danej aplikacji. To przez nie model odmawia napisania instrukcji włamania albo porady, jak kogoś skrzywdzić.

Barierki działają na kilku poziomach: w treningu (model uczy się odmawiać), w system promptach i w zewnętrznych filtrach sprawdzających wejście i wyjście. Ich kalibracja to wieczny kompromis - zbyt luźne przepuszczają szkody, zbyt ciasne odmawiają niewinnych próśb.

Pojęcia powiązane
AlignmentJailbreakModeracja treściSystem prompt

← Wszystkie pojęcia w Słowniku AI

// mapa strony
🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro 440 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie