Przejdź do treści
Artykuły

ComfyUI: instalacja na Windowsie, pierwszy obraz i wymagania

Darmowy program do obrazów i wideo AI na własnym komputerze. Trzy sposoby instalacji, szablony zamiast pustej tablicy i ile naprawdę potrzeba VRAM.

5 min czytania
ComfyUI: instalacja na Windowsie, pierwszy obraz i wymagania

👁 116 przeczytań

ComfyUI to darmowy program do generowania obrazów i wideo AI na własnym komputerze. Zamiast jednego okienka z polem na polecenie masz tablicę z połączonymi blokami. Na tym programie zrobiłem wszystkie lokalne testy z 26 września 2026 roku: Z-Image Turbo, Qwen-Image 2.1 i wideo z Wan 2.2 na karcie RTX 4090. Poniżej jest instalacja na Windowsie, pierwszy obraz i rzeczy, na które straciłem najwięcej czasu.

W skrócie

ComfyUI jest darmowy, działa offline i obsługuje praktycznie każdy otwarty model obrazu i wideo, zwykle w dniu premiery. Początkujący powinni zacząć od aplikacji Comfy Desktop albo wersji Portable dla kart Nvidii. Pierwszy model warto wziąć z wbudowanych szablonów, bo to one podpowiadają, jakie pliki pobrać. Na RTX 4090 obraz 1344×768 z Z-Image Turbo powstawał w 4,2 sekundy. Najwięcej czasu zabiera pobieranie plików (18-21 GB na model) i pierwsze wczytanie.

0 złlicencja GPL-3.0, bez konta
4,2 sobraz 1344x768 w Z-Image Turbo
~4 minklip 5 s z Wan 2.2 5B
18-21 GBplików na jeden model

Czym ComfyUI różni się od zwykłego generatora

W ComfyUI każdy krok generowania to osobny blok (węzeł): wczytanie modelu, zamiana polecenia na wektory, próbkowanie, dekodowanie obrazu, zapis. Bloki łączysz liniami. Taki zestaw nazywa się przepływem (workflow) i można go zapisać, wysłać komuś albo wczytać z obrazka, bo ComfyUI zapisuje go w metadanych pliku PNG.

Na pierwszy rzut oka to trudne. Zyskujesz jednak dostęp do nowych modeli od razu po premierze, pełną kontrolę nad każdym ustawieniem i możliwość sterowania całością ze skryptu. Wszystkie moje testy szły właśnie przez API, bez klikania.

Przepływ ComfyUI dla Z-Image Turbo: wczytanie modelu, CLIP, koder tekstu, KSampler, pusty obraz i VAE
Domyślny przepływ w ComfyUI 0.37 to Z-Image Turbo: model, koder tekstu (qwen_3_4b), próbkowanie w 8 krokach i VAE. Zrzut z mojej instalacji, 26.09.2026.

Instalacja na Windowsie: trzy drogi

SposóbDla kogoKarta
Comfy Desktoppoczątkujący, instalator jak w zwykłym programieNvidia albo AMD (zalecane)
ComfyUI Portablekto chce mieć wszystko w jednym folderze, bez instalacjiNvidia albo sam procesor
Instalacja ręczna (git + Python)kto chce sterować przez API i skryptyNvidia, AMD, Intel, Apple

Według dokumentacji ComfyUI wersja Portable zawiera Pythona 3.13 i PyTorch z CUDA 13.0, a na kartach Nvidii od serii 20 wymagany jest PyTorch w wersji cu130 lub nowszej. Ja używam instalacji ręcznej. Krok po kroku opisałem ją w poradniku instalacji Qwen-Image 2.1, bo zaczynałem od tego modelu. W skrócie wygląda tak:

  1. Pobierz kod: git clone https://github.com/comfyanonymous/ComfyUI.
  2. Utwórz środowisko: python -m venv venv, potem zainstaluj PyTorch z CUDA ze strony pytorch.org, a na końcu pip install -r requirements.txt.
  3. Uruchom: venv\Scripts\python main.py i otwórz w przeglądarce http://127.0.0.1:8188.

Start programu trwał u mnie 6 minut, ale w tym czasie ten sam dysk pobierał kilkadziesiąt gigabajtów modeli. Na wolnym dysku NVMe to kilkadziesiąt sekund.

Pierwszy obraz: szablon zamiast pustej tablicy

Najprostsza droga to menu Templates na lewym pasku. Wybierasz szablon modelu (np. Z-Image Turbo, Qwen-Image albo Wan 2.2), a ComfyUI pokazuje, jakich plików brakuje i skąd je pobrać. Pliki trafiają do podfolderów models:

  • models/diffusion_models - główny model (np. z_image_turbo_bf16.safetensors, 12,3 GB),
  • models/text_encoders - koder tekstu (np. qwen_3_4b.safetensors, 8,0 GB),
  • models/vae - dekoder obrazu (np. ae.safetensors, 0,3 GB).

Potem wpisujesz polecenie w bloku z tekstem i klikasz Run. Pierwszy obraz po starcie trwa najdłużej, bo model wczytuje się do pamięci karty (u mnie ponad 6 minut przy zajętym dysku). Kolejne obrazy z Z-Image Turbo powstawały w 4,0-4,5 sekundy. Galerię 16 obrazów z tego testu pokazuję w tekście Z-Image Turbo kontra Qwen-Image 2.1.

Ile to wymaga sprzętu

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

ModelPlikiPamięć karty w moim teścieCzas na RTX 4090
Z-Image Turbo (obrazy, Apache 2.0)20,7 GBdo 18,2 GB4,2 s / obraz 1344×768
Qwen-Image 2.1 int8 (obrazy, licencja niekomercyjna)17,3 GBdo 16,0 GB6,5 s / obraz
Wan 2.2 TI2V 5B (wideo, Apache 2.0)18,1 GBok. 20 GBok. 4 min / klip 5 s

ComfyUI trzyma na karcie wszystko, co się zmieści, więc te liczby to górna granica, a nie minimum. Na kartach z 8-12 GB program przenosi część modelu do pamięci RAM i działa wolniej. Warto wtedy szukać wersji skwantyzowanych (fp8, GGUF). Przy lokalnym AI liczy się przede wszystkim pamięć karty, co tłumaczę w tekście jaki komputer do lokalnego AI.

Sterowanie ze skryptu

Każdy przepływ można zapisać w formacie API (opcja „Save (API Format)”) i wysyłać do serwera z Pythona. Serwer przyjmuje go pod adresem http://127.0.0.1:8188/prompt, a gotowe pliki pokazuje pod /history/<id>. Tak zrobiłem serię 8 obrazów w dwóch modelach i 4 klipy wideo z pomiarem czasu i pamięci. Przydatne jest też polecenie /free, które zwalnia pamięć karty przed następnym modelem.

Na co uważać

  • Licencje modeli są różne. Z-Image Turbo i Wan 2.2 są na Apache 2.0, ale Qwen-Image 2.1 ma licencję badawczą, która zakazuje użytku komercyjnego. Sprawdzaj kartę modelu na Hugging Face przed użyciem obrazów w pracy.
  • Dodatki (custom nodes) to cudzy kod. Instaluj tylko popularne, aktualizowane rozszerzenia. Każde uruchamia się z pełnymi uprawnieniami na twoim komputerze.
  • Polskie znaki na obrazach. W moim teście ani Z-Image, ani Qwen-Image nie napisały poprawnie słowa „ŻÓŁĆ”. Tekst po polsku dodawaj w edytorze grafiki.

Najczęstsze pytania

Czy ComfyUI jest darmowy?

Tak. ComfyUI jest otwartym oprogramowaniem na licencji GPL-3.0, działa bez konta i bez internetu po pobraniu modeli. Płatne są tylko opcjonalne węzły API, które wysyłają zadania do modeli w chmurze.

Jaka karta graficzna do ComfyUI?

Najlepiej Nvidia z co najmniej 12 GB pamięci. W moim teście Z-Image Turbo zajął do 18 GB na RTX 4090, a wideo z Wan 2.2 około 20 GB. Na mniejszych kartach działa wolniej albo z wersjami skwantyzowanymi.

ComfyUI czy Stable Diffusion WebUI?

ComfyUI szybciej dostaje obsługę nowych modeli i pozwala sterować wszystkim ze skryptu. Prostsze interfejsy z jednym oknem są łatwiejsze na start, ale zwykle później wspierają nowości. Więcej o samym Stable Diffusion jest w tekście Stable Diffusion.

Czy ComfyUI działa na Macu?

Tak, przez instalację ręczną albo Comfy Desktop na Macach z procesorem Apple. Czasów generowania na Macu nie mierzyłem.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Źródła i data sprawdzenia

Test własny 26.09.2026: ComfyUI 0.37, RTX 4090 24 GB, Windows 11. Wymagania i sposoby instalacji: docs.comfy.org. Kod i licencja: GitHub ComfyUI. Sprawdzone 26 września 2026.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok n8n Cloud Starter 320 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›