GLM-5.3 po polsku: test w 13 zadaniach, dostawcy i ceny
Najszybszy i, obok MiMo, najtańszy z mocnych chińskich modeli w moim teście, ale z największą liczbą błędów. Tania kwantyzacja fp4 nie jest winna.

👁 115 przeczytań
- GLM-5.3 zdobył 63,6 pkt na 100 w teście pisania po polsku, co dało mu przedostatnie miejsce - dla porównania GPT-6 Luna uzyskała 81,5 pkt.
- Model ma 753 mld parametrów, ale przy effort=low użył zaledwie 211 tokenów rozumowania i wykonał 9 zadań pisarskich w 27 sekund za 0,018 USD.
- Powtórka testu wyłącznie u producenta Z.ai dała 61,8 pkt, co wyklucza kwantyzację fp4 u tańszych dostawców jako przyczynę słabych wyników językowych.
GLM-5.3 po polsku to najszybszy i, obok MiMo-V2.6-Pro, najtańszy z mocnych chińskich modeli w moim Laboratorium, ale też ten, który robi najwięcej błędów językowych. W 13 zadaniach po polsku zdobył 63,6 pkt na 100 w pisaniu, a 9 tekstów napisał w 27 sekund za 0,018 USD. Sprawdziłem też, czy słaby wynik to wina tanich dostawców z kwantyzacją fp4: powtórka tylko u Z.ai dała 61,8 pkt. Poniżej wyniki, fragmenty odpowiedzi i ceny w złotówkach.
W skrócie
GLM-5.3 ma 45 pkt w indeksie Artificial Analysis, ale w moim teście pisania po polsku zajął przedostatnie miejsce: 63,6 pkt, przy 81,5 pkt GPT-6 Luny w tej samej rundzie. Sędziowie dali mu 6,78 na 10 za poprawność (u Z.ai 6,70), najmniej z testowanych modeli z czołówki; w obu przebiegach pojawiło się „w ramach przeprosiny”. Mocne strony to prędkość (27 s na 9 tekstów) i cena (0,03 USD za 13 zadań). Do polskich tekstów bez korekty go nie polecam, do szkiców i programowania tak, bo w takich zadaniach dobrze wypada w indeksie Artificial Analysis. To moja opinia.
Co to za model
GLM-5.3 to model firmy Z.ai (dawniej Zhipu) z sierpnia 2026. Ma 753 mld parametrów, z czego 40 mld aktywnych, i otwarte wagi na Hugging Face na własnej licencji GLM-5.3. Licencja jest zbliżona do MIT, ale duzi dostawcy usług AI (powyżej 10 mld USD przychodu) muszą przejść przegląd bezpieczeństwa u Z.ai. Kontekst według dokumentacji Z.ai to 1 mln tokenów, a odpowiedź do 128 tys.
Rozumowania nie da się wyłączyć. Parametr reasoning_effort przyjmuje wartości low, high i max, domyślnie max. W wariancie max Artificial Analysis daje mu 45 pkt (27 września 2026), 84 tokeny na sekundę i 2,01 USD za zadanie z indeksu. O tym, ile GLM-5.3 kosztuje naprawdę u różnych dostawców, pisałem w tekście GLM 5.3: policzyłem, ile ten tani model naprawdę kosztuje. Tutaj skupiam się na polszczyźnie.
Mój wynik: dwa przebiegi
Test to te same 13 poleceń co w rankingu AI do pisania po polsku: effort=low, OpenRouter, ocena w ciemno przez trzech sędziów z innych firm. GLM-5.3 przetestowałem dwa razy:
- routing OpenRoutera (26 września) - zapytania trafiły do pięciu różnych dostawców, m.in. Mistrala (nvfp4), Decart i Crusoe (fp4),
- tylko Z.ai (27 września) - z przypiętym dostawcą, wersja fp8 u producenta, bez przełączania na innego dostawcę.
| Zadanie | GLM-5.3 (routing) | GLM-5.3 (Z.ai) | GPT-6 Luna |
|---|---|---|---|
| Artykuł o rachunkach za prąd | 6,78 | 4,33 | 6,67 |
| Opis produktu z karty | 7,22 | 5,67 | 4,83 |
| Mail do klienta | 6,44 | 6,22 | 9,00 |
| Post na LinkedIn | 7,67 | 6,00 | 8,83 |
| Opowiadanie | 4,89 | 3,67 | 8,33 |
| 10 tytułów SEO | 6,89 | 5,67 | 7,67 |
| Streszczenie w 5 punktach | 6,56 | 7,89 | 8,67 |
| Inflacja dla dwunastolatka | 7,78 | 7,56 | 9,33 |
| Tłumaczenie z idiomami | 3,00 | 8,78 | 8,83 |
| Wynik łączny (0-100) | 63,6 | 61,8 | 81,5 |
| Reguły z poleceń | 23/26 | 24/26 | 24/26 |
| Korekta łatwa / trudna | 21/22, 26/30 | 21/22, 26/30 | 22/22, 29/30 |
| Quiz o Polsce łatwy / trudny | 46/46, 46/48 | 46/46, 47/48 | 46/46, 48/48 |
Średnie ocen sędziów w skali 1-10. Pierwszy przebieg ocenili ci sami sędziowie w tej samej puli co drugi, obok kotwic Claude Opus 5.5, GPT-6 Luna i Qwen3.8 Max.
Różnica między przebiegami (1,8 pkt) jest mniejsza niż rozrzut pojedynczych zadań. Przekład w wersji z routingiem dostał 3,0, a u Z.ai 8,78, z opowiadaniem było odwrotnie (4,89 wobec 3,67). Z jednej próby na zadanie nie da się więc powiedzieć, że Z.ai jest lepszy albo gorszy. Da się powiedzieć, że kwantyzacja fp4 u tańszych dostawców nie tłumaczy słabego wyniku - u producenta było podobnie.
Fragmenty odpowiedzi
Ten sam błąd w obu mailach do klienta, u różnych dostawców:
„W ramach przeprosiny przygotowaliśmy dla Państwa kod rabatowy PRZEPRASZAMY10”
Wersja od Z.ai dodatkowo mieszała „przepraszamy” z „Rozumiem” i „Sprawdziłem”, a obie przeskakiwały między „Pana/Pani” a „Państwa”.
Przekład newslettera z routingiem OpenRoutera (3,0 na 10):
„Szczerze mówiąc, wdrażanie nowych klientów to nie jakaś rocket science - ale za długo trzymaliśmy się po dachu. W zeszłym kwartalele przepadły nam trzy duże konta”
Ten sam przekład u Z.ai (8,78 na 10):
„Szczerze mówiąc, wdrażanie nowych klientów to żadna filozofia, ale od dłuższego czasu robiliśmy to byle jak.”
W opowiadaniu z Z.ai (3,67) sędziowie wyliczyli „wypłynął z niej koperta”, „schod ósmy”, „ósemnastki” i „sernak”. W streszczeniu z routingu wróciło „termin wdrożenia nie ustalono”, ten sam błąd co u Qwen3.8 Max. W tekście o inflacji dla dziecka pierwsza wersja zasugerowała, że drożejące batony nie są „droższe w produkcji”, co trzej sędziowie uznali za błąd merytoryczny.
Prędkość i myślenie
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Przy effort=low GLM-5.3 prawie nie myśli: 211 tokenów rozumowania w 13 zadaniach (Qwen3.8 Max - 33 tys.). Dlatego jest najszybszy w całej puli: 27 sekund na 9 zadań pisarskich w pierwszym przebiegu i 83 sekundy u Z.ai, przy 39 sekundach GPT-6 Luny. W wariancie GLM-5.3 Prime z wyższym rozumowaniem było odwrotnie: w teście chińskich modeli po polsku myślał do końca limitu i nie oddał tekstu.
Na 1000 słów GLM wstawiał 21-28 długich pauz, przy 5 u Claude Opus 5.5 i 8 u GPT-6 Luny. Jeśli wklejasz jego teksty prosto na stronę, zamień je na zwykłe dywizy albo przecinki.
Ceny i koszt mojego testu
| Pozycja | USD | zł |
|---|---|---|
| Wejście u Z.ai, za milion tokenów (bez VAT) | 1,40 | 5,40 |
| Wyjście u Z.ai, za milion tokenów (bez VAT) | 4,40 | 16,97 |
| Odczyt z pamięci podręcznej u Z.ai | 0,26 | 1,00 |
| Najtańsze wejście / wyjście na OpenRouterze (inni dostawcy) | 0,30 / 1,14 | 1,16 / 4,40 |
| GLM Coding Plan, najtańszy abonament miesięczny | od 18 | od 69,43 |
| Mój test, 13 zadań, routing OpenRoutera | 0,0304 | 0,12 |
| Mój test, 13 zadań, tylko Z.ai | 0,0322 | 0,12 |
Na OpenRouterze GLM-5.3 udostępnia 32 dostawców, z różną kwantyzacją (fp4, nvfp4, fp8) i różnymi limitami odpowiedzi. Porównanie z Qwenem, MiMo i Muse Sparkiem jest w tekście o mniej znanych modelach AI z czołówki. Przeliczenie po kursie NBP 3,857 zł za dolara.
Jak korzystać z GLM-5.3 w Polsce
- API Z.ai - rozliczenie w dolarach, stawki jak w tabeli wyżej.
- GLM Coding Plan - abonament do programowania, który obejmuje GLM-5.3, od 18 USD miesięcznie (ceny wyższych planów podają tylko serwisy zewnętrzne, więc ich nie cytuję).
- OpenRouter -
z-ai/glm-5.3. Jeśli chcesz stałej jakości, przypnij dostawcę (tak zrobiłem w drugim przebiegu). - chat.z.ai - czat w przeglądarce, ale według strony działa na GLM-5.3-Flash, nie na pełnym modelu.
- Lokalnie - wagi są otwarte, ale 753 mld parametrów to sprzęt serwerowy, nie domowy komputer. Co da się uruchomić w domu, opisałem w przewodniku lokalne AI.
Najczęstsze pytania
Czy GLM-5.3 dobrze pisze po polsku?
Słabo jak na model z czołówki: 63,6 pkt na 100 w moim teście, z błędami fleksyjnymi w rodzaju „w ramach przeprosiny”. GPT-6 Luna dostała 81,5 pkt.
Ile kosztuje GLM-5.3?
U Z.ai 1,40 USD (5,40 zł) za milion tokenów wejścia i 4,40 USD (16,97 zł) za milion wyjścia, bez VAT. Na OpenRouterze inni dostawcy biorą od 0,30 USD za wejście.
Czy tańsi dostawcy GLM-5.3 dają gorsze wyniki?
W moim teście nie: routing przez tańszych dostawców dał 63,6 pkt, a sam Z.ai 61,8 pkt. Różnica mieści się w rozrzucie pojedynczych zadań.
Czy GLM-5.3 jest open source?
Wagi są otwarte na Hugging Face, ale na licencji GLM-5.3, a nie MIT. Ogranicza ona tylko największych dostawców usług AI.
Źródła i data sprawdzenia
Ceny: cennik Z.ai. Kontekst i rozumowanie: dokumentacja GLM-5.3. Abonament: GLM Coding Plan. Licencja i wagi: Hugging Face. Indeks, prędkość i parametry: Artificial Analysis. Dostawcy i ich ceny: OpenRouter. Wyniki, fragmenty i koszty testu to moje pomiary przez OpenRouter (metoda: Laboratorium Promptowego). Sprawdzone 27 września 2026.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Czy GLM-5.3 dobrze pisze po polsku?
Nie - w teście 13 zadań zdobył 63,6 pkt na 100, co jest najgorszym wynikiem wśród testowanych modeli z czołówki. W obu przebiegach pojawił się ten sam błąd fleksyjny: "w ramach przeprosiny", a sędziowie dali mu średnio 6,78 na 10 za poprawność.
Ile kosztuje GLM-5.3 u dostawcy Z.ai?
U Z.ai cena wynosi 1,40 USD (5,40 zł) za milion tokenów wejścia i 4,40 USD (16,97 zł) za milion tokenów wyjścia, bez VAT. Na OpenRouterze inni dostawcy biorą od 0,30 USD za wejście i od 1,14 USD za wyjście.
Czy tańsi dostawcy GLM-5.3 na OpenRouterze psują jakość wyników?
Nie - routing przez pięciu różnych dostawców dał 63,6 pkt, a test wyłącznie u producenta Z.ai dał 61,8 pkt. Różnica 1,8 pkt mieści się w rozrzucie wyników pojedynczych zadań.
Czy GLM-5.3 jest dostępny jako open source?
Wagi modelu są otwarte na Hugging Face, ale nie na licencji MIT, lecz na własnej licencji GLM-5.3. Dostawcy usług AI z przychodem powyżej 10 mld USD muszą przejść przegląd bezpieczeństwa u Z.ai.
