GLM-5.3 Fast: czy warto dopłacić za szybkość? Pomiar i test
GLM-5.3 Fast to nie nowy model, tylko przyspieszony GLM-5.3 za podwójną cenę. Zmierzyłem szybkość u 5 dostawców i sprawdziłem polszczyznę.

👁 115 przeczytań
- GLM-5.3 Fast (Prime) kosztuje 2,80/8,80 USD za milion tokenów, czyli dokładnie dwa razy więcej niż zwykły GLM-5.3 u Z.ai (1,40/4,40 USD).
- Wariant Fast osiągnął 78 tok/s wobec 45 tok/s u Z.ai, ale zwykły GLM-5.3 u dostawców Crusoe i PrimeIntellect na OpenRouterze był szybszy - 125-131 tok/s.
- W teście po polsku model uzyskał 7/12 punktów, wstawiając angielskie słowa i zniekształcone wyrazy w tekście, co dyskwalifikuje go do zastosowań w języku polskim bez korekty.
„GLM 5.3 Fast” pojawił się 7 października 2026 w trackerach nowych modeli, ale to nie jest nowy model Z.ai. To przyspieszony wariant GLM-5.3, który od 23 września działa na OpenRouterze jako GLM-5.3 Prime: 2,80 / 8,80 USD za milion tokenów, dwa razy drożej od zwykłego GLM-5.3. Zmierzyłem jego szybkość i puściłem go przez 3 zadania po polsku - jest szybszy od Z.ai, ale nie od najszybszych dostawców, a w polskim tekście wstawiał angielskie słowa. Całą rodzinę modeli opisuję w przewodniku GLM i Z.ai.
Stan na 8 października 2026
- Model: GLM-5.3 Fast, na OpenRouterze
z-ai/glm-5.3-prime(od 23 września), w LLM Gatewayglm-5.3-fast(od 7 października). - Cena API: 2,80 USD za 1 mln tokenów wejścia i 8,80 USD za 1 mln wyjścia; zwykły GLM-5.3 u Z.ai - 1,40 / 4,40 USD.
- Kontekst: 1 mln tokenów, do 131 tys. tokenów odpowiedzi.
- Szybkość: 78 tok/s w moim pomiarze, wobec 45 tok/s GLM-5.3 u Z.ai.
- Po polsku: w szybkim teście 7 z 12 punktów po mojej ręcznej ocenie.
Co to jest GLM-5.3 Fast
Z.ai wypuściło GLM-5.3 w sierpniu 2026. 23 września na OpenRouterze pojawił się wariant Prime, opisany jako ten sam model z pełnymi możliwościami, który dzięki przyspieszeniu wnioskowania generuje odpowiedź 1,5-2 razy szybciej. 7 października tracker llmgateway.io dodał go pod nazwą „GLM 5.3 Fast” z tą samą ceną (2,80 / 8,80 USD) i tym samym opisem, z dostawcą SCX.ai.
Czego nie znalazłem:
- W cenniku Z.ai 8 października nie ma ani „Fast”, ani „Prime” - są tylko GLM-5.3, GLM-5.3-Flash i GLM-5.3-FlashX.
- Z.ai nie opublikowało osobnego ogłoszenia ani benchmarków dla tego wariantu.
- Na OpenRouterze jedynym dostawcą Prime jest Alibaba (endpoint oznaczony jako „fast”).
Uwaga na nazwę: GLM-5.3-FlashX to coś innego - szybka wersja małego modelu GLM-5.3-Flash (0,37 / 1,25 USD), nie dużego GLM-5.3.
Ile kosztuje i jak szybko działa
Ten sam poradnik po polsku (ok. 1550-1670 tokenów odpowiedzi), rozumowanie „low”, strumieniowanie przez OpenRouter, 8 października 2026. Szybkość liczę od pierwszego tokena do końca odpowiedzi.
| Wariant | Cena (1 mln tokenów) | Dostawca | Szybkość | Pierwszy token |
|---|---|---|---|---|
| GLM-5.3 Fast / Prime | 2,80 / 8,80 USD | Alibaba | 78 tok/s (75-81) | 0,9-1,6 s |
| GLM-5.3 | 1,40 / 4,40 USD | Z.AI | 45 tok/s (44-47) | 2,9-4,0 s |
| GLM-5.3 | 1,40 / 4,40 USD | Crusoe, PrimeIntellect | 125-131 tok/s | 1,2-2,1 s |
| GLM-5.3 | 0,05 / 3,39 USD | Wafer | 91 tok/s | 1,0 s |
Obietnica „1,5-2 razy szybciej” się zgadza, ale tylko względem własnego serwera Z.ai (1,7 raza). Zwykły GLM-5.3 u szybkich dostawców z OpenRoutera był w moim pomiarze szybszy od Fast i 2-3 razy tańszy. Problem w tym, że przy zwykłym GLM-5.3 OpenRouter sam wybiera dostawcę, a różnice w szybkości i cenie między nimi są duże - opisałem to w tekście GLM 5.3: co kryje karta modelu. Fast daje jednego, przewidywalnego dostawcę. Pomiar i test kosztowały mnie razem 0,084 USD.
Czy działa po polsku - szybki test
Trzy stałe zadania z serii „Nowy model w 10 minut”. To pierwsze wrażenie, nie pełny test z Areny modeli AI po polsku - tam zwykły GLM-5.3 ma 64,4 pkt.
| Zadanie | Moja ocena | Czas | Koszt |
|---|---|---|---|
| Tekst z idiomem i odmianą | 0/3 - angielskie wtrącenia, zniekształcone słowa | 8,1 s | 0,0052 USD |
| Rachunek z polskim VAT-em | 1/3 - netto 254,00 zamiast 253,98 zł | 2,5 s | 0,0013 USD |
| Korekta 6 błędów | 6/6 - ale zmienił też „w kasie” na „przy kasie” | 2,8 s | 0,0019 USD |
Tekst z idiomem - wpadka
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Idiom „wyjść jak Zabłocki na mydle” i odmiana „w Bielsku-Białej” były poprawne, więc automat dał 3/3. Po przeczytaniu odejmuję wszystko. W akapicie do gazety model napisał:
Właściciel firmy przyznaje z ironią, że wyszedł jak Zabłocki na mydle, bo attempt oszczędności skończył się podwojeniem kosztów.
Do tego „usedane urządzenie”, „COMMENTuje” i „choćęb”. Potem sam dopisał „poprawioną wersję” - polecenie mówiło „zwróć tylko akapit”. Nie wiem, czy to wina przyspieszonego serwera, czy samego modelu - to jedna próba, ale przy polskich tekstach to sygnał ostrzegawczy.
Rachunek i korekta
W VAT-cie model zaokrąglił netto do 254,00 zł i przez to VAT wyszedł 58,40 zamiast 58,42 zł. Na „low” w ogóle nie myślał (0 tokenów rozumowania). Korekta: wszystkie błędy poprawione, plus jedna zbędna zmiana stylistyczna.
Kto ma dostęp w Polsce
- OpenRouter -
z-ai/glm-5.3-prime, działa z Polski (sprawdziłem 8 października 2026). - LLM Gateway -
glm-5.3-fast, tego nie testowałem. - API Z.ai - wariantu Fast/Prime nie ma w cenniku z 8 października.
- Czat Z.ai i GLM Coding Plan - brak informacji o wariancie Fast.
Dla kogo to jest
- Może: aplikacje po angielsku, które potrzebują GLM-5.3 ze stałym dostawcą i krótkim czasem do pierwszego tokena.
- Nie: polskie teksty - po moim teście nie zaufałbym mu bez korekty.
- Nie: jeśli liczy się cena - zwykły GLM-5.3 u szybkich dostawców jest tańszy i nie wolniejszy, a GLM-5.3 Flash kosztuje 0,15 / 0,50 USD.
Gdzie czytać dalej
- GLM i Z.ai - przewodnik: modele, ceny, czat
- GLM-5.3 po polsku: test w 13 zadaniach
- Ranking cen AI - ile kosztuje 1000 polskich zapytań
Źródła
- OpenRouter: GLM 5.3 Prime - cena, kontekst, opis
- LLM Gateway: GLM 5.3 Fast
- Z.ai: cennik
Sprawdziłem 8 października 2026.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Czy GLM-5.3 Fast jest szybszy od zwykłego GLM-5.3?
Jest szybszy od GLM-5.3 u Z.ai - 78 tok/s wobec 45 tok/s, czyli 1,7 raza. Jednak zwykły GLM-5.3 u szybkich dostawców na OpenRouterze (Crusoe, PrimeIntellect) osiąga 125-131 tok/s i jest przy tym 2-3 razy tańszy.
Ile kosztuje GLM-5.3 Fast na OpenRouterze?
Cena wynosi 2,80 USD za milion tokenów wejścia i 8,80 USD za milion tokenów wyjścia. To dokładnie dwukrotność ceny zwykłego GLM-5.3 u Z.ai, który kosztuje 1,40/4,40 USD.
Czy GLM-5.3 Fast działa po polsku?
W teście trzech zadań model uzyskał 7/12 punktów po ręcznej ocenie. W zadaniu tekstowym wstawiał angielskie słowa (np. 'attempt'), generował zniekształcone wyrazy ('usedane', 'choćęb') i ignorował polecenie zwrócenia tylko jednego akapitu.
Gdzie można uzyskać dostęp do GLM-5.3 Fast w Polsce?
Model działa na OpenRouterze jako z-ai/glm-5.3-prime - dostępność z Polski została potwierdzona 8 października 2026. W LLM Gateway dostępny jest jako glm-5.3-fast, natomiast w cenniku Z.ai z 8 października wariant Fast ani Prime nie figuruje.
