Claude for Startups i 100+ programów z darmowymi kredytami AI dla startupów i JDG Darmowe kredyty AI dla Twojej firmy Sprawdź, co dostaniesz
✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Artykuły

Step 5 vs Kimi K3, GLM-5.3, Qwen i DeepSeek: porównanie na liczbach

Step 5 Preview na tle Kimi K3, GLM-5.3, Qwen3.8 i DeepSeek V4.1: wyniki Artificial Analysis, ceny za token, licencje wag i mój test po polsku.

4 min czytania
Logo StepFun i napis Step 5 vs Kimi K3, GLM, Qwen, DeepSeek - porównanie

👁 115 przeczytań

// w skrócie
  • Step 5 Preview remisuje z Kimi K3 na poziomie 44 pkt w indeksie Artificial Analysis, ustępując o punkt GLM-5.3 i Qwen3.8 Max (45 pkt).
  • Step 5 osiąga wynik 44 pkt przy zaledwie 27 mld aktywnych parametrach, podczas gdy Kimi K3 potrzebuje 104 mld - stąd niższa cena wyjścia: 2,70 vs 15,00 USD za 1 mln tokenów.
  • W teście po polsku Step 5 Preview zajął piąte miejsce z wynikiem 65,4 pkt, głównie przez trzy puste odpowiedzi, gdy limit tokenów pochłonęło rozumowanie.

Nowy Step 5 Preview od StepFun wchodzi do grupy, w której są już Kimi K3, GLM-5.3, Qwen3.8 i DeepSeek V4.1. W niezależnym indeksie Artificial Analysis remisuje z Kimi K3 (44 pkt) i jest punkt za GLM-5.3, a kosztuje mniej od obu. W moim teście po polsku wypadł jednak najsłabiej z tej piątki, razem z GLM. Poniżej porównanie wyłącznie na sprawdzonych liczbach: indeksy, ceny, kontekst, licencje i mój test.

W skrócie, stan na 9 października 2026

  • Najmądrzejszy według AA: GLM-5.3 i Qwen3.8 Max (po 45 pkt), tuż za nimi Step 5 i Kimi K3 (44).
  • Najtańszy: DeepSeek V4.1 Flash (0,30 / 1,20 USD za 1 mln tokenów), wśród modeli z 44-45 pkt - Step 5 (1,00 / 2,70 USD).
  • Najlepszy po polsku: Kimi K3 (78,5 pkt w moim Laboratorium), Step 5: 65,4.
  • Najszybszy: DeepSeek V4.1 Flash (217 tokenów/s według AA), Step 5: 87.

Tabela porównawcza

ModelFirmaAA IndexWej. / wyj., USD za 1 mlnKontekstParametry (aktywne)Wagi
Step 5 PreviewStepFun441,00 / 2,701 mln600B (27B)zapowiedź 15.10
Kimi K3 (Max)Moonshot AI443,00 / 15,001 mln2,8T (104B)tak, licencja Kimi K3
GLM-5.3 (Max)Z.ai (Zhipu)451,40 / 4,401 mln753B (40B)tak, licencja GLM-5.3
Qwen3.8 MaxAlibaba452,00 / 6,00984 tys.nie podanonie
Qwen3.8 27BAlibaba340,50 / 3,00256 tys.27Btak, Apache 2.0
DeepSeek V4.1 Flash (Max)DeepSeek390,30 / 1,201 mln552B (16B)tak, MIT
DeepSeek V4 Pro (Max)DeepSeek361,32 / 3,961 mln1,6T (49B)tak, MIT

Źródło indeksów, cen, kontekstu i parametrów: strony modeli Artificial Analysis, odczyt 9 października 2026. Ceny to stawki referencyjne producentów; na OpenRouterze bywają inne zależnie od dostawcy.

Inteligencja: remis w czołówce

Artificial Analysis Intelligence Index (9.10.2026)
GLM-5.3 (Max)45
Qwen3.8 Max45
Step 5 Preview44
Kimi K3 (Max)44
DeepSeek V4.1 Flash39
DeepSeek V4 Pro36
Qwen3.8 27B34

Różnica jednego punktu między GLM-5.3, Qwen3.8 Max, Step 5 i Kimi K3 to w praktyce remis. Ciekawe jest co innego: Step 5 osiąga ten poziom z 27 mld aktywnych parametrów, a Kimi K3 potrzebuje 104 mld. To przekłada się na cenę. Na wykresie dołączonym do ogłoszenia StepFun pokazuje 65% niższy koszt zadania niż u GLM-5.3 i Kimi K3 w trybie max.

W deklarowanych wynikach producenta (znam je z przedruków w mediach, a nie ze strony StepFun) Step 5 prowadzi w programowaniu: DeepSWE 67,7 wobec 67,5 u Kimi K3 i 66,9 u GLM-5.3, ProgramBench 80,5 wobec 77,8 i 72,0. W Terminal-Bench v4 wyraźnie przegrywa z GLM-5.3 (33,3 wobec 41,9), za to bije Kimi K3 (12,6). Qwen i DeepSeek w tej tabeli producenta nie występują.

Cena: kto daje najwięcej za dolara

ModelWyjście, USD za 1 mlnKoszt 9 zadań pisarskich w moim teścieUwagi
DeepSeek V4.1 Flash1,200,013 USDnajtańszy, ale 39 pkt w AA
Step 5 Preview2,700,11 USDdużo tokenów rozumowania
GLM-5.34,400,018 USD45 pkt w AA, szybki
Qwen3.8 Max6,000,17 USDzamknięty
Kimi K315,000,077 USDnajdroższy za token

Cena za token myli. Step 5 ma tanie wyjście, ale myśli tak długo, że w zadaniach pisarskich kosztował sześć razy więcej niż GLM-5.3, a w całym teście (z powtórkami pustych odpowiedzi) dziesięć razy więcej: 0,31 wobec 0,03 USD. Artificial Analysis widzi to samo: w ich ewaluacji Step 5 wygenerował 160 mln tokenów przy medianie 94 mln. Jeśli płacisz za zadania agentowe z dużym kontekstem, policz koszt na swoich danych, a nie z cennika.

Po polsku: Kimi K3 wyraźnie przed Step 5

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Mój test po polsku, Laboratorium Promptowe (0-100)
Kimi K378,5
Qwen3.8 Max76,8
DeepSeek V4 Pro74,1
DeepSeek V4.1 Flash72,9
Step 5 Preview65,4
GLM-5.364,8

Wszystkie modele dostały te same 13 zadań (9 tekstów, 2 korekty, 2 quizy), wysiłek rozumowania low i równe limity tokenów. Step 5, Qwen3.8 Max i GLM-5.3 były oceniane w jednej puli 9 października, Kimi K3 i DeepSeek - w pierwszej rundzie Laboratorium, z inną parą sędziów. Skala jest kalibrowana tymi samymi modelami-kotwicami, ale różnice do 2-3 punktów traktuję jako remis.

Step 5 przegrał głównie przez trzy puste odpowiedzi: w opisie produktu i obu korektach cały limit tokenów poszedł na rozumowanie. Gdzie odpowiedział, pisał poprawnie w krótkich formach (mail 8,5/10), słabiej w dłuższych (opowiadanie 5,0). Szczegóły: Step 5 po polsku: test na 13 zadaniach.

Otwartość i uruchamianie u siebie

  • DeepSeek V4.1 Flash i V4 Pro - licencja MIT, najmniej ograniczeń.
  • Qwen3.8 27B - Apache 2.0 i rozmiar, który zmieści się w 4 bitach na karcie z 24 GB. Qwen3.8 Max jest zamknięty.
  • Kimi K3 i GLM-5.3 - otwarte wagi, ale na własnych licencjach z ograniczeniami komercyjnymi.
  • Step 5 - wagi zapowiedziane na 15 października, licencji jeszcze nie ma. Przy 600 mld parametrów to ok. 1,2 TB w BF16, czyli sprzęt serwerowy.

Co wybrać

  • Do pisania i korekty po polsku: Kimi K3 albo Qwen3.8 Max. Spośród tańszych - DeepSeek V4.1 Flash.
  • Do programowania przez API, gdy liczy się cena: Step 5 Preview albo GLM-5.3. Step 5 ma lepsze wyniki producenta w DeepSWE i ProgramBench, GLM w pracy w terminalu.
  • Do długich dokumentów i wideo na wejściu: Step 5, bo przyjmuje wideo do 128 MB i 1 mln tokenów kontekstu z cache za 0,05 USD.
  • Do postawienia u siebie bez kłopotów z licencją: DeepSeek (MIT) albo mały Qwen (Apache 2.0). Przy Step 5 poczekaj na licencję 15 października.

To moja opinia na podstawie danych Artificial Analysis i jednego przebiegu mojego testu. Wszystkie modele z tego tekstu i wiele innych porównasz sam w Arenie modeli po polsku.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Źródła i data sprawdzenia

  1. AA - Step 5artificialanalysis.ai
  2. AA - Kimi K3artificialanalysis.ai
  3. AA - GLM-5.3artificialanalysis.ai
  4. AA - Qwen3.8 Maxartificialanalysis.ai
  5. AA - Qwen3.8 27Bartificialanalysis.ai
  6. AA - DeepSeek V4.1 Flashartificialanalysis.ai
  7. AA - DeepSeek V4 Proartificialanalysis.ai
  8. StepFun na X (20.09.2026)x.com
  9. cennik StepFunplatform.stepfun.ai
Mój test
  1. Laboratorium Promptowe

Sprawdzone 9 października 2026.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Który model jest najlepszy do pisania po polsku spośród Step 5, Kimi K3, GLM i Qwen?

Najlepszy po polsku jest Kimi K3 z wynikiem 78,5 pkt w Laboratorium Promptowym, wyprzedzając Qwen3.8 Max (76,8 pkt) i DeepSeek V4 Pro (74,1 pkt). Step 5 Preview uzyskał 65,4 pkt, a GLM-5.3 jeszcze mniej - 64,8 pkt.

Ile kosztuje Step 5 Preview za 1 milion tokenów w porównaniu do konkurencji?

Step 5 Preview kosztuje 1,00 USD za wejście i 2,70 USD za wyjście na milion tokenów. Dla porównania najtańszy DeepSeek V4.1 Flash to 0,30 i 1,20 USD, a najdroższy Kimi K3 - 3,00 i 15,00 USD za milion tokenów.

Czy Step 5 Preview ma otwarte wagi i kiedy zostaną udostępnione?

Wagi Step 5 zostały zapowiedziane na 15 października, ale licencja nie była jeszcze znana w momencie pisania artykułu. Przy 600 mld parametrach model zajmuje ok. 1,2 TB w BF16, co wymaga sprzętu serwerowego.

Dlaczego Step 5 Preview jest drogi w praktycznym użyciu mimo niskiej ceny za token?

Step 5 generuje bardzo dużo tokenów rozumowania - w teście pisarskim kosztował 0,11 USD za 9 zadań, czyli sześć razy więcej niż GLM-5.3 (0,018 USD). Artificial Analysis odnotowało, że Step 5 wygenerował 160 mln tokenów przy medianie wynoszącej 94 mln dla pozostałych modeli.

// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 400 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›