Słownik AI / Diffusion
🎨 Obraz, wideo i dźwięk
Diffusion
Technika generowania obrazów: model „odszumia” losowy szum, aż powstanie obraz. Stoi za Midjourney i Stable Diffusion.
Modele dyfuzyjne generują obrazy przez odwrócenie procesu niszczenia: w treningu uczą się, jak obraz stopniowo zamienia się w losowy szum, a przy generowaniu wykonują tę drogę wstecz - startują od czystego szumu i krok po kroku go „odszumiają”, aż wyłoni się obraz zgodny z promptem.
Ta technika stoi za większością współczesnych generatorów obrazów, a jej warianty napędzają też generowanie wideo i dźwięku. Praktyczna intuicja: więcej kroków odszumiania to zwykle więcej detali, ale wolniejsza generacja.
Pojęcia powiązane