Przejdź do treści
Artykuły

Lokalne AI: modele tekstowe, obrazy i wideo na własnym komputerze

Przewodnik po lokalnym AI z własnymi testami na RTX 4090: 7 modeli tekstowych po polsku, generatory obrazów i wideo, instalacja i koszty.

3 min czytania
Lokalne AI: modele tekstowe, obrazy i wideo na własnym komputerze

👁 116 przeczytań

Lokalne AI to modele językowe, graficzne i wideo, które działają na twoim komputerze: bez konta, bez abonamentu i bez wysyłania danych do chmury. W tym przewodniku zebrałem wszystko, co przetestowaliśmy na promptowy.com. Są tu wyniki 7 modeli tekstowych po polsku, 2 generatorów obrazów i modelu wideo, zmierzone 26 września 2026 roku na karcie RTX 4090, a do tego instalacja krok po kroku i rachunek, kiedy to się opłaca.

W skrócie

Na start: Gemma 4 12B do tekstu, Z-Image Turbo do obrazów, Wan 2.2 5B do krótkich klipów. Gemma dostała 72,3 pkt w naszym teście pisania po polsku, więcej niż płatny Claude Haiku 4.5, i działa na karcie z 8 GB. Z-Image robi obraz w 4,2 s i wolno go używać komercyjnie. Wan 2.2 to około 4 minuty na 5 sekund wideo 720p. Do tekstów, które mają wyjść bez poprawek, chmura (Claude Opus 5.5, GPT-6 Luna) jest nadal wyraźnie lepsza.

7modeli tekstowych w teście po polsku
72,3pkt najlepszego lokalnego (Gemma 4 12B)
4,2 sobraz z Z-Image Turbo na RTX 4090
2xtyle traci się na złej wersji llama.cpp

Nasze testy i poradniki

Co wybrać: tekst, obraz, wideo

Do czegoModelPamięć kartySzybkość (RTX 4090)Licencja
Tekst po polsku, karta 8-16 GBGemma 4 12B8 GB104 tok/sApache 2.0
Tekst, karta 24 GBQwen 3.8 27B17 GB50 tok/sApache 2.0
Poprawna polszczyzna i wiedza o PolsceBielik 11B v317 GB (Q8)72 tok/sApache 2.0
Laptop, słabsza kartaGemma 4 E4B6 GB110 tok/sApache 2.0
Obrazy do użytku komercyjnegoZ-Image Turbodo 18 GB4,2 s / obrazApache 2.0
Obrazy, projekty prywatneQwen-Image 2.1do 16 GB6,5 s / obraztylko niekomercyjnie
WideoWan 2.2 TI2V 5Bok. 20 GBok. 4 min / 5 sApache 2.0

Programy do uruchamiania

  • LM Studio - okienkowy program z wyszukiwarką modeli. Najprostszy start z modelami tekstowymi.
  • Ollama - modele tekstowe z terminala i prosty serwer API. Popularna w automatyzacjach.
  • llama.cpp - silnik pod spodem obu powyższych. Daje pełną kontrolę i czat w przeglądarce. Na karcie Nvidii bierz wersję CUDA, bo Vulkan był u nas 2-2,6 raza wolniejszy.
  • ComfyUI - obrazy i wideo. Tablica z blokami, szablony dla nowych modeli i sterowanie ze skryptu.

Sprzęt: ile czego potrzeba

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Najważniejsza jest pamięć karty graficznej (VRAM). Modele tekstowe do 12 mld parametrów w wersji skompresowanej (Q4) mieszczą się w 8 GB. Większe, jak Qwen 3.8 27B, wymagają 16-24 GB. Generatory obrazów i wideo w pełnej jakości zajmowały w naszych testach 16-20 GB. Szczegóły i konkretne zestawy są w poradniku jaki komputer do lokalnego AI. Jak LM Studio współpracuje z narzędziami MCP i ile wtedy potrzeba pamięci, opisuje tekst LM Studio, MCP i lokalne modele.

Czy to się opłaca

Prąd za 13 zadań na Gemmie 4 12B kosztował 0,4 grosza, a te same zadania w GPT-6 Luna przez API 1,6 grosza. Obraz z Z-Image to 0,04 grosza prądu. Zakup karty zwraca się jednak dopiero po setkach godzin pracy, a najtańsze API pisze lepiej. Lokalne AI wygrywa przede wszystkim prywatnością: nic nie wychodzi z komputera. Pełny rachunek jest w tekście lokalny model czy API.

Więcej o modelach lokalnych

Najczęstsze pytania

Jaki jest najlepszy lokalny model AI po polsku?

W naszym teście z 26.09.2026 wygrała Gemma 4 12B (72,3 pkt), tuż przed Qwen 3.8 27B (72,2). Bielik 11B v3 ma najpoprawniejszą polszczyznę i najlepiej zna polskie realia, ale słabiej wykonuje polecenia.

Czy lokalne AI działa bez internetu?

Tak. Po pobraniu modelu LM Studio, Ollama, llama.cpp i ComfyUI działają całkowicie offline, a polecenia i pliki nie opuszczają komputera.

Czy mogę uruchomić lokalne AI bez karty graficznej?

Małe modele tekstowe działają na samym procesorze, ale kilka do kilkunastu razy wolniej. Obrazy i wideo bez karty graficznej są w praktyce zbyt wolne.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Źródła i data sprawdzenia

Testy własne promptowy.com z 26.09.2026 (RTX 4090 24 GB, llama.cpp b11194 CUDA, ComfyUI 0.37). Licencje: karty modeli na Hugging Face. Sprawdzone 26 września 2026.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok n8n Cloud Starter 320 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›