✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Artykuły

Bielik: polski model AI - wersje, Ollama, koszty i mój test (2026)

Przewodnik po Bieliku, polskim otwartym modelu językowym: historia wersji do Bielika-PL z polskim tokenizerem, jak zacząć w czacie i w Ollamie, który wariant wybrać pod sprzęt, koszty i mój test pięciu poleceń.

9 min czytania
Logo Bielik.AI na jasnym tle - przewodnik po polskim modelu językowym

👁 120 przeczytań

// w skrócie
  • Bielik 11B v3 uzyskał 7,60 na 10 w teście 5 poleceń po polsku, wyprzedzając Llamy i mniejsze Mistrale, ale przegrywając z Gemma 4 12B i Muse Glimmer 30B.
  • Model działa na licencji Apache 2.0, jest bezpłatny do użytku komercyjnego, a w Ollamie zajmuje od 1,7 GB (wersja 1,5B) do 12 GB (wersja 11B Q8_0).
  • Bielik 11B v3 osiągnął 70,67% w benchmarku polskich kompetencji językowych PLCC, ale w zadaniach eksperckich, np. prawniczych czy medycznych, wyraźnie przegrywa z dużymi modelami.

Bielik to polski, otwarty model językowy fundacji SpeakLeash i ACK Cyfronet AGH. Najnowszy jest Bielik 11B v3 ze stycznia 2026 (plus warianty 7B, 4,5B i 1,5B), działa na licencji Apache 2.0, więc pobierzesz go za darmo i użyjesz komercyjnie, a w Ollamie zajmuje od 1,7 do 12 GB. W moim teście pięciu poleceń po polsku na RTX 4090 Bielik pisał najczyściej po polsku z modeli lokalnych, ale nie zawsze trzymał się poleceń - szczegóły niżej.

Stan na 3 października 2026

  • Najnowsza seria: v3.0 - Bielik 11B v3 (1 stycznia 2026), Bielik-PL 11B i Bielik-PL Minitron 7B z polskim tokenizerem (pokazane 14 kwietnia 2026), Bielik Minitron 7B (17 marca 2026), małe 4,5B i 1,5B. O Bieliku v4 nie ma oficjalnych informacji.
  • Licencja: Apache 2.0 - użycie komercyjne bez opłat.
  • Gdzie użyć: chat.bielik.ai (wymaga konta SpeakLeash), aplikacja InPost, aplikacja Obywatel Bielik, lokalnie w Ollamie, LM Studio i llama.cpp.
  • Skala według bielik.ai: ponad 3 mln pobrań, ponad 100 tys. użytkowników, ponad 6 tys. osób w społeczności.
  • Najbliższe wydarzenie: Bielik Summit 26 listopada 2026 w Warszawie.

Co to jest Bielik

Bielik to nie jeden model, tylko rodzina modeli językowych uczonych z naciskiem na język polski. Buduje ją fundacja SpeakLeash (społeczność, która zbiera polskie teksty do trenowania AI) razem z Akademickim Centrum Komputerowym Cyfronet AGH, na superkomputerach Helios i Athena. Projekt współtworzy Sebastian Kondracki, którego sylwetkę opisałem w tekście Sebastian Kondracki.

Od ChatGPT czy Claude’a różni się trzema rzeczami:

  • Jest mały. Największy Bielik ma 11 mld parametrów, czyli działa na domowej karcie graficznej. To też oznacza mniejszą wiedzę o świecie i słabsze rozumowanie niż u dużych modeli w chmurze.
  • Jest otwarty. Pobierasz pliki modelu i uruchamiasz je u siebie. Tekst nie wychodzi z Twojego komputera ani serwera firmy.
  • Jest uczony na polskich danych. Wersja 3 powstała na tekstach w 32 językach europejskich z naciskiem na polski, a do dostrajania użyto ponad 20 mln instrukcji (ponad 17 mld tokenów), częściowo sprawdzonych ręcznie.

Historia wersji

DataWersjaCo nowego
kwiecień 2024Bielik 7B v0.1pierwszy Bielik, dotrenowany Mistral 7B
sierpień 2024Bielik 11B v2.011 mld parametrów, licencja Apache 2.0
6 maja 2025Bielik 11B v2.5, Bielik v3 1,5B i 4,5Bmałe modele na laptop, nowy tokenizer w serii v3
1 stycznia 2026Bielik 11B v3pełna wersja 3, 32 języki europejskie, uczenie przez wzmacnianie (GRPO)
17 marca 2026Bielik Minitron 7B v3przycięty z 11B: o 33% mniejszy, do 50% szybszy, ok. 90% jakości (dane SpeakLeash), premiera na NVIDIA GTC
14 kwietnia 2026Bielik-PL 11B v3 i Bielik-PL Minitron 7Bpierwsze Bieliki z tokenizerem dobranym do polszczyzny (APT4)
czerwiec 2026Bielik 11B v3 DFlashmały model pomocniczy, który przyspiesza generowanie (dekodowanie spekulatywne)

Obok modeli do rozmowy SpeakLeash rozwija Bielik Guard (wcześniej Sójka), mały klasyfikator 0,1B i 0,5B, który wyłapuje szkodliwe treści po polsku. Przydaje się, gdy model ma rozmawiać z klientami.

Jak zacząć z Bielikiem krok po kroku

Bez instalacji

  1. Wejdź na chat.bielik.ai. Strona przekierowuje do logowania SpeakLeash - załóż darmowe konto.
  2. Pisz po polsku jak w każdym czacie. Najlepiej działają konkretne zadania: „popraw”, „streść w 3 punktach”, „napisz maila do…”.
  3. Jeśli masz aplikację InPost, czat z Bielikiem jest też w niej (od grudnia 2025).

Na własnym komputerze (Ollama)

  1. Zainstaluj Ollamę (Windows, macOS, Linux).
  2. W terminalu wpisz ollama run SpeakLeash/bielik-11b-v3.0-instruct:Q4_K_M. Ollama pobierze 6,7 GB i otworzy rozmowę.
  3. Jeśli masz kartę z 16 GB albo więcej, użyj wariantu :Q8_0 (12 GB) - pisze odrobinę staranniej.
  4. Na słabszym sprzęcie wybierz SpeakLeash/bielik-minitron-7B-v3.0-instruct:Q4_K_M (4,5 GB) albo SpeakLeash/bielik-4.5b-v3.0-instruct:Q8_0 (5,1 GB).
  5. Do pracy z programami używaj lokalnego API pod adresem http://localhost:11434.

Dokładną instrukcję dla LM Studio, Ollamy i llama.cpp, z ustawieniami i rozwiązaniami typowych problemów, opisałem w poradniku jak uruchomić Bielika lokalnie.

Który wariant Bielika wybrać

ModelPlik w OllamieKontekstSprzęt
Bielik 11B v3 Q8_012 GB32 tys. tokenówkarta 16-24 GB (RTX 4080, 4090, 5080)
Bielik 11B v3 Q4_K_M6,7 GB32 tys.karta 8-12 GB (RTX 4060, 3060 12 GB)
Bielik Minitron 7B v3 Q4_K_M4,5 GB32 tys.karta 6-8 GB, nowszy laptop
Bielik 4,5B v3 Q8_05,1 GB8 tys.laptop, także bez mocnej karty (wolniej)
Bielik 1,5B v3 Q8_01,7 GB8 tys.dowolny komputer, proste zadania

Rozmiary plików według biblioteki Ollamy na koncie SpeakLeash, stan na 3 października 2026. Na karcie potrzebujesz trochę więcej pamięci niż waży plik, bo dochodzi pamięć na kontekst rozmowy. Ogólne zasady doboru sprzętu są w tekście ile pamięci potrzeba do modelu lokalnie. Modeli Bielik-PL z polskim tokenizerem nie znalazłem w oficjalnej bibliotece SpeakLeash w Ollamie - są na Hugging Face.

Ile kosztuje Bielik

Sam model nic nie kosztuje. Licencja Apache 2.0 pozwala go pobrać, zmieniać i wbudować w płatny produkt bez opłat licencyjnych. Płacisz tylko za sprzęt i prąd:

  • Czat chat.bielik.ai: 0 zł, wymaga konta.
  • Lokalnie: koszt prądu. Odpowiedź na jedno polecenie trwa kilka sekund pracy karty, więc kosztuje ułamek grosza. Pełny rachunek z progiem opłacalności karty jest w tekście lokalny model czy API.
  • Na serwerze: wynajem maszyny z kartą graficzną. SpeakLeash nie sprzedaje oficjalnego płatnego API, którego cennik mógłbym tu podać.

Bielik po polsku: co robi dobrze, a co źle

Bielik ma najczystszą polszczyznę wśród małych modeli, które testowałem. W moim wcześniejszym teście 13 zadań na RTX 4090 dostał 8,5 na 10 za poprawność języka (najwięcej ze wszystkich modeli lokalnych) i odpowiedział dobrze na 42 z 48 trudnych pytań o Polskę - więcej niż płatny Claude Haiku 4.5. W wyniku łącznym był jednak trzeci (64,4 pkt), za Gemmą 4 12B i Qwenem 3.8 27B, bo najsłabiej wykonywał szczegółowe polecenia. Pełne wyniki są w tekście 7 lokalnych modeli AI po polsku.

Niezależne testy pokazują to samo: Bielik 11B v3 ma 70,67% w benchmarku polskich kompetencji językowych i kulturowych PLCC (wersja 2.3 miała 62,17%), ale w zadaniach eksperckich, na przykład prawniczych czy medycznych, wyraźnie przegrywa z dużymi modelami. To narzędzie do pracy z polskim tekstem, nie ekspert od wszystkiego.

Mój test: 5 poleceń po polsku

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

3 października 2026 uruchomiłem Bielika 11B v3 (Q8_0) w Ollamie na RTX 4090 i dałem mu pięć poleceń: streszczenie z limitem 60 słów, mail do administratora budynku, korektę tekstu z 10 błędami, wyjaśnienie 8-latkowi, dlaczego niebo jest niebieskie, i tłumaczenie akapitu z idiomami. Te same polecenia dostały Llama, Mistral, Gemma 4 i Muse Glimmer, a wszystkie odpowiedzi ocenił w ciemno Claude Opus 5.5.

ZadanieOcena Bielika (1-10)Co poszło dobrzeCo poszło źle
Streszczenie7,0wszystkie kluczowe liczby: 9 ulic, 3 i 4 zł, 30 zł, głosowanie 14/7/2około 63 słów przy limicie 60
Mail7,3poprawny wołacz „Szanowny Panie Tomaszu”, podpisdopisane uogólnienie „sytuacja utrudnia dostarczanie przesyłek”
Korekta9,710 z 10 błędów, bez nowych-
Wyjaśnienie dla dziecka6,04 zdania, prosty językbłąd fizyczny: „niebieski kolor jest najjaśniejszy”
Tłumaczenie8,0naturalna polszczyzna, „Przejdźmy do rzeczy”, „po nocach”„ledwo zdążyliśmy przed terminem” - odwrócony sens „missed by a hair”

Wynik łączny: 7,60 na 10, w tym poprawność języka 8,8 (najwyżej z modeli lokalnych, tyle co Mistral Large 3 w chmurze), wykonanie polecenia 6,6 i naturalność 7,4. Prędkość: 67 tokenów na sekundę, 13,6 GB pamięci karty przy kontekście 8192 tokenów. Odpowiedź na każde polecenie zajmowała 2-4 sekundy.

Wniosek jest ten sam co we wrześniowym teście 13 zadań: Bielik pisze czysto, ale trzeba pilnować, czy zrobił dokładnie to, o co prosiłeś. W tej samej puli wyprzedziły go Muse Glimmer 30B z chmury (8,67), lokalna Gemma 4 12B (8,33) i minimalnie Mistral Large 3 (7,67), a sam Bielik wyprzedził wszystkie Llamy i mniejsze Mistrale. Pełne wyniki: Bielik, Llama czy Mistral po polsku.

Bielik na tle konkurencji

ModelSkądRozmiarLicencjaPolszczyzna (mój test)
Bielik 11B v3SpeakLeash, Polska11 mldApache 2.07,60 (poprawność 8,8)
Gemma 4 12BGoogle, USA12 mldotwarte wagi8,33 (poprawność 8,2)
Muse Glimmer 30BMeta, USA30 mldApache 2.08,67 (chmura)
Mistral Large 3Mistral AI, Francja675 mld (MoE)Apache 2.07,67 (chmura)
Llama 3.1 8BMeta, USA8 mldLlama Community License5,33
Ministral 3 8BMistral AI, Francja8 mldApache 2.05,07
PLLuMkonsorcjum pod wodzą NASK, Polskakilka rozmiarówotwarte waginie testowałem

PLLuM, drugi polski model rozwijany przez konsorcjum pod wodzą NASK, opisałem osobno w tekście PLLuM: polski model językowy państwa. Mapę wszystkich polskich modeli i ludzi znajdziesz w tekście Polskie AI.

Dla kogo jest Bielik

  • Firmy z danymi, które nie mogą wyjść z serwerowni - kancelarie, przychodnie, urzędy, działy HR. Bielik streszcza, klasyfikuje i poprawia polskie dokumenty lokalnie. Jak przeprowadzić pilotaż, opisałem w tekście Bielik AI w firmie.
  • Programiści budujący polskie produkty - Apache 2.0 bez opłat, dobre wsparcie w Ollamie, vLLM i llama.cpp.
  • Osoby z kartą graficzną 8 GB+, które chcą mieć czat po polsku offline.
  • Nie dla Ciebie, jeśli potrzebujesz eksperckiej wiedzy, długiego rozumowania albo kodu. Tu wygrywają duże modele w chmurze.

Gdzie czytać dalej

Najczęstsze pytania

Czy Bielik jest darmowy?

Tak. Czat chat.bielik.ai jest bezpłatny (wymaga konta SpeakLeash), a model na licencji Apache 2.0 możesz pobrać i używać komercyjnie bez opłat. Płacisz tylko za własny sprzęt i prąd.

Jak uruchomić Bielika w Ollamie?

Zainstaluj Ollamę i wpisz ollama run SpeakLeash/bielik-11b-v3.0-instruct:Q4_K_M. Model zajmie 6,7 GB i zadziała na karcie z 8 GB pamięci. Na mocniejszej karcie użyj wariantu Q8_0 (12 GB).

Która wersja Bielika jest najnowsza?

Seria v3.0: Bielik 11B v3 ze stycznia 2026 oraz pokazane 14 kwietnia 2026 modele Bielik-PL 11B i Bielik-PL Minitron 7B z tokenizerem dobranym do polszczyzny. O wersji 4 SpeakLeash do 3 października 2026 nic nie ogłosił.

Czy Bielik jest lepszy od ChatGPT?

Nie w ogólnych możliwościach. To model kilkadziesiąt razy mniejszy, który przegrywa z ChatGPT w wiedzy, rozumowaniu i kodzie. Wygrywa prywatnością (działa offline), zerowym kosztem licencji i polszczyzną jak na swój rozmiar.

Ile pamięci karty graficznej potrzebuje Bielik?

Bielik 11B w kwantyzacji Q4_K_M potrzebuje około 8 GB pamięci karty, w Q8_0 około 13-17 GB zależnie od długości kontekstu (we wrześniowym teście z kontekstem 32 tys. tokenów zajął 16,7 GB). Bielik Minitron 7B i 4,5B zmieszczą się na kartach z 6 GB, a 1,5B działa nawet na samym procesorze.

Kto stworzył Bielika?

Fundacja SpeakLeash razem z Akademickim Centrum Komputerowym Cyfronet AGH, które udostępniło superkomputery Helios i Athena. Partnerami strategicznymi projektu są EY, InPost i Netology.

Czym Bielik różni się od PLLuM?

Bielik jest projektem społecznościowym fundacji SpeakLeash, PLLuM - projektem finansowanym publicznie, prowadzonym przez konsorcjum pod wodzą NASK i działającym w mObywatelu. Oba są otwarte. Bielik ma gotowy czat i szybciej wydaje nowe wersje.

Czy Bielik działa bez internetu?

Tak, po pobraniu modelu do Ollamy, LM Studio albo llama.cpp działa całkowicie offline. Internet jest potrzebny tylko do pierwszego pobrania pliku.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Źródła i data sprawdzenia

Sprawdzone 3 października 2026.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 400 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›