✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Artykuły

GLM-5.3 Fast: czy warto dopłacić za szybkość? Pomiar i test

GLM-5.3 Fast to nie nowy model, tylko przyspieszony GLM-5.3 za podwójną cenę. Zmierzyłem szybkość u 5 dostawców i sprawdziłem polszczyznę.

4 min czytania
glm-5-3-fast

👁 116 przeczytań

// w skrócie
  • GLM-5.3 Fast (Prime) kosztuje 2,80/8,80 USD za milion tokenów, czyli dokładnie dwa razy więcej niż zwykły GLM-5.3 u Z.ai (1,40/4,40 USD).
  • Wariant Fast osiągnął 78 tok/s wobec 45 tok/s u Z.ai, ale zwykły GLM-5.3 u dostawców Crusoe i PrimeIntellect na OpenRouterze był szybszy - 125-131 tok/s.
  • W teście po polsku model uzyskał 7/12 punktów, wstawiając angielskie słowa i zniekształcone wyrazy w tekście, co dyskwalifikuje go do zastosowań w języku polskim bez korekty.

„GLM 5.3 Fast” pojawił się 7 października 2026 w trackerach nowych modeli, ale to nie jest nowy model Z.ai. To przyspieszony wariant GLM-5.3, który od 23 września działa na OpenRouterze jako GLM-5.3 Prime: 2,80 / 8,80 USD za milion tokenów, dwa razy drożej od zwykłego GLM-5.3. Zmierzyłem jego szybkość i puściłem go przez 3 zadania po polsku - jest szybszy od Z.ai, ale nie od najszybszych dostawców, a w polskim tekście wstawiał angielskie słowa. Całą rodzinę modeli opisuję w przewodniku GLM i Z.ai.

Stan na 8 października 2026

  • Model: GLM-5.3 Fast, na OpenRouterze z-ai/glm-5.3-prime (od 23 września), w LLM Gateway glm-5.3-fast (od 7 października).
  • Cena API: 2,80 USD za 1 mln tokenów wejścia i 8,80 USD za 1 mln wyjścia; zwykły GLM-5.3 u Z.ai - 1,40 / 4,40 USD.
  • Kontekst: 1 mln tokenów, do 131 tys. tokenów odpowiedzi.
  • Szybkość: 78 tok/s w moim pomiarze, wobec 45 tok/s GLM-5.3 u Z.ai.
  • Po polsku: w szybkim teście 7 z 12 punktów po mojej ręcznej ocenie.

Co to jest GLM-5.3 Fast

Z.ai wypuściło GLM-5.3 w sierpniu 2026. 23 września na OpenRouterze pojawił się wariant Prime, opisany jako ten sam model z pełnymi możliwościami, który dzięki przyspieszeniu wnioskowania generuje odpowiedź 1,5-2 razy szybciej. 7 października tracker llmgateway.io dodał go pod nazwą „GLM 5.3 Fast” z tą samą ceną (2,80 / 8,80 USD) i tym samym opisem, z dostawcą SCX.ai.

Czego nie znalazłem:

  • W cenniku Z.ai 8 października nie ma ani „Fast”, ani „Prime” - są tylko GLM-5.3, GLM-5.3-Flash i GLM-5.3-FlashX.
  • Z.ai nie opublikowało osobnego ogłoszenia ani benchmarków dla tego wariantu.
  • Na OpenRouterze jedynym dostawcą Prime jest Alibaba (endpoint oznaczony jako „fast”).

Uwaga na nazwę: GLM-5.3-FlashX to coś innego - szybka wersja małego modelu GLM-5.3-Flash (0,37 / 1,25 USD), nie dużego GLM-5.3.

Ile kosztuje i jak szybko działa

Ten sam poradnik po polsku (ok. 1550-1670 tokenów odpowiedzi), rozumowanie „low”, strumieniowanie przez OpenRouter, 8 października 2026. Szybkość liczę od pierwszego tokena do końca odpowiedzi.

WariantCena (1 mln tokenów)DostawcaSzybkośćPierwszy token
GLM-5.3 Fast / Prime2,80 / 8,80 USDAlibaba78 tok/s (75-81)0,9-1,6 s
GLM-5.31,40 / 4,40 USDZ.AI45 tok/s (44-47)2,9-4,0 s
GLM-5.31,40 / 4,40 USDCrusoe, PrimeIntellect125-131 tok/s1,2-2,1 s
GLM-5.30,05 / 3,39 USDWafer91 tok/s1,0 s

Obietnica „1,5-2 razy szybciej” się zgadza, ale tylko względem własnego serwera Z.ai (1,7 raza). Zwykły GLM-5.3 u szybkich dostawców z OpenRoutera był w moim pomiarze szybszy od Fast i 2-3 razy tańszy. Problem w tym, że przy zwykłym GLM-5.3 OpenRouter sam wybiera dostawcę, a różnice w szybkości i cenie między nimi są duże - opisałem to w tekście GLM 5.3: co kryje karta modelu. Fast daje jednego, przewidywalnego dostawcę. Pomiar i test kosztowały mnie razem 0,084 USD.

Czy działa po polsku - szybki test

Trzy stałe zadania z serii „Nowy model w 10 minut”. To pierwsze wrażenie, nie pełny test z Areny modeli AI po polsku - tam zwykły GLM-5.3 ma 64,4 pkt.

ZadanieMoja ocenaCzasKoszt
Tekst z idiomem i odmianą0/3 - angielskie wtrącenia, zniekształcone słowa8,1 s0,0052 USD
Rachunek z polskim VAT-em1/3 - netto 254,00 zamiast 253,98 zł2,5 s0,0013 USD
Korekta 6 błędów6/6 - ale zmienił też „w kasie” na „przy kasie”2,8 s0,0019 USD

Tekst z idiomem - wpadka

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Idiom „wyjść jak Zabłocki na mydle” i odmiana „w Bielsku-Białej” były poprawne, więc automat dał 3/3. Po przeczytaniu odejmuję wszystko. W akapicie do gazety model napisał:

Właściciel firmy przyznaje z ironią, że wyszedł jak Zabłocki na mydle, bo attempt oszczędności skończył się podwojeniem kosztów.

Do tego „usedane urządzenie”, „COMMENTuje” i „choćęb”. Potem sam dopisał „poprawioną wersję” - polecenie mówiło „zwróć tylko akapit”. Nie wiem, czy to wina przyspieszonego serwera, czy samego modelu - to jedna próba, ale przy polskich tekstach to sygnał ostrzegawczy.

Rachunek i korekta

W VAT-cie model zaokrąglił netto do 254,00 zł i przez to VAT wyszedł 58,40 zamiast 58,42 zł. Na „low” w ogóle nie myślał (0 tokenów rozumowania). Korekta: wszystkie błędy poprawione, plus jedna zbędna zmiana stylistyczna.

Kto ma dostęp w Polsce

  • OpenRouter - z-ai/glm-5.3-prime, działa z Polski (sprawdziłem 8 października 2026).
  • LLM Gateway - glm-5.3-fast, tego nie testowałem.
  • API Z.ai - wariantu Fast/Prime nie ma w cenniku z 8 października.
  • Czat Z.ai i GLM Coding Plan - brak informacji o wariancie Fast.

Dla kogo to jest

  • Może: aplikacje po angielsku, które potrzebują GLM-5.3 ze stałym dostawcą i krótkim czasem do pierwszego tokena.
  • Nie: polskie teksty - po moim teście nie zaufałbym mu bez korekty.
  • Nie: jeśli liczy się cena - zwykły GLM-5.3 u szybkich dostawców jest tańszy i nie wolniejszy, a GLM-5.3 Flash kosztuje 0,15 / 0,50 USD.

Gdzie czytać dalej

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Czy GLM-5.3 Fast jest szybszy od zwykłego GLM-5.3?

Jest szybszy od GLM-5.3 u Z.ai - 78 tok/s wobec 45 tok/s, czyli 1,7 raza. Jednak zwykły GLM-5.3 u szybkich dostawców na OpenRouterze (Crusoe, PrimeIntellect) osiąga 125-131 tok/s i jest przy tym 2-3 razy tańszy.

Ile kosztuje GLM-5.3 Fast na OpenRouterze?

Cena wynosi 2,80 USD za milion tokenów wejścia i 8,80 USD za milion tokenów wyjścia. To dokładnie dwukrotność ceny zwykłego GLM-5.3 u Z.ai, który kosztuje 1,40/4,40 USD.

Czy GLM-5.3 Fast działa po polsku?

W teście trzech zadań model uzyskał 7/12 punktów po ręcznej ocenie. W zadaniu tekstowym wstawiał angielskie słowa (np. 'attempt'), generował zniekształcone wyrazy ('usedane', 'choćęb') i ignorował polecenie zwrócenia tylko jednego akapitu.

Gdzie można uzyskać dostęp do GLM-5.3 Fast w Polsce?

Model działa na OpenRouterze jako z-ai/glm-5.3-prime - dostępność z Polski została potwierdzona 8 października 2026. W LLM Gateway dostępny jest jako glm-5.3-fast, natomiast w cenniku Z.ai z 8 października wariant Fast ani Prime nie figuruje.

// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 400 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›