🎬 Higgsfield Plus na rok 649 zł 1 990 zł -67% zostało 9 szt. albo Gemini Pro na 18 miesięcy 170 zł Kup teraz →
Przejdź do treści
PROMPTOWY NA ANDROIDZIE

Blog pod ręką. Teraz w nowej odsłonie.

Wygodny czytnik, zapisane artykuły i wygląd, który znasz z Promptowego.

Słownik AI / RLHF
🏗️ Modele i trening

RLHF

Uczenie modelu na ludzkich ocenach odpowiedzi - dzięki temu jest pomocny, a nie tylko „przewiduje tekst”.

RLHF (Reinforcement Learning from Human Feedback) to etap treningu, w którym model uczy się na ludzkich ocenach: ludzie porównują różne odpowiedzi modelu, wskazują lepsze, a algorytm dostraja model tak, by częściej generował te preferowane.

To właśnie RLHF i pokrewne techniki zamieniły surowe „przewidywacze tekstu” w pomocnych asystentów, którzy odpowiadają na pytania zamiast je kontynuować, odmawiają szkodliwych próśb i trzymają kulturalny ton. Cena bywa taka, że model robi się przesadnie ugodowy i przytakuje użytkownikowi.

Pojęcia powiązane
AlignmentTrening modeluGuardrails

← Wszystkie pojęcia w Słowniku AI

// mapa strony
🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro+ 99 zł/mc Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie