PROMPTOWY_
Artykuły

llama.cpp na Windowsie: instalacja, czat w przeglądarce i test CUDA

promptowy@ai:~$ cat news_1

› llama.cpp to darmowy silnik, na którym działa większość lokalnych modeli językowych, także w LM Studio i Ollamie.

promptowy@ai:~$ cat news_2

› Na Windowsie instaluje się go jedną komendą, a razem z nim dostajesz serwer z czatem w przeglądarce i API zgodne z OpenAI.

promptowy@ai:~$ cat news_3

› 26 września 2026 roku uruchomiłem go na karcie RTX 4090 z trzema modelami i trafiłem na pułapkę, o której instrukcje milczą: wersja z menedżera winget generowała tekst od 1,9 do 2,6 raza wolniej niż oficjalna wersja na CUDA.

promptowy@ai:~$ cat news_4

› W skrócie Na karcie Nvidii pobierz z GitHuba paczkę „win-cuda”, a nie wersję z winget.

promptowy@ai:~$ open --full
Czytaj całość

llama.cpp na Windowsie: instalacja, czat w przeglądarce i test CUDA

Otwórz artykuł na promptowy.com