Step 5 Preview od StepFun: parametry, cena, test po polsku i wagi
Nowy flagowy model StepFun: 600B MoE z 27B aktywnych, 1 mln tokenów kontekstu i wynik Kimi K3 w Artificial Analysis. Ceny, jak zacząć, mój test po polsku i co z otwartymi wagami.

👁 121 przeczytań
- Step 5 Preview uzyskał 65,4 pkt w teście po polsku na 13 zadaniach, co plasuje go mniej więcej na poziomie GLM-5.3 (64,8 pkt).
- Model ma architekturę MoE z 600 mld parametrów łącznie, z czego 27 mld aktywnych na token, i okno kontekstu 1 mln tokenów.
- Cena wynosi 1 USD za milion tokenów wejścia i 2,70 USD za milion tokenów wyjścia, a tokeny rozumowania liczone są jak wyjście.
Strona aktualizowana na bieżąco. Stan na 9 października 2026, godz. 16:00.
Step 5 Preview to nowy flagowy model szanghajskiej firmy StepFun: 600 mld parametrów w architekturze MoE, z czego przy każdym tokenie pracuje 27 mld, okno 1 mln tokenów i wejście z tekstu, obrazów oraz wideo. W indeksie Artificial Analysis ma 44 punkty, tyle co Kimi K3, a kosztuje 1 USD za milion tokenów wejścia i 2,70 USD za milion wyjścia. Od 8 października jest na OpenRouterze, a 15 października StepFun ma otworzyć wagi. W moim teście po polsku zdobył 65,4 pkt - mniej więcej tyle co GLM-5.3.
Stan na 9 października 2026
- Premiera: 20 września 2026 (Szanghaj), wpis StepFun na X. Na OpenRouterze od 8 października jako
stepfun/step-5-preview. - Status: „Preview”, czyli wersja przed pełnym Step 5. Wagi zapowiedziane na 15 października 2026; do tego dnia model działa tylko przez API.
- Parametry: 600B MoE, 27B aktywnych, 1 mln tokenów kontekstu, do 64 tys. tokenów odpowiedzi, wejście: tekst, obraz, wideo.
- Cena: 1 USD / 2,70 USD za 1 mln tokenów (wejście / wyjście, rozumowanie liczone jako wyjście).
- Wyniki: 44 pkt w Artificial Analysis Intelligence Index; DeepSWE 67,7 według producenta.
- Mój test po polsku: 65,4 pkt na 13 zadaniach Laboratorium; 3 odpowiedzi puste, bo model przemyślał cały limit tokenów.
Introducing Step 5 Preview: Advancing the Pareto Frontier.
- StepFun (@StepFun_ai) 20 września 2026
Co to jest Step 5 Preview
StepFun (po chińsku 阶跃星辰) to szanghajski startup założony w kwietniu 2023 roku przez Jianga Daxina, wcześniej wiceprezesa Microsoftu. W Chinach zalicza się go do „sześciu tygrysów AI” obok Moonshot (Kimi), Zhipu (GLM) czy MiniMax. Do tej pory znałem go głównie z tanich, otwartych modeli Step 3.5 Flash i Step 3.7 Flash na licencji Apache 2.0. Step 5 Preview to pierwszy model, którym firma celuje w ścisłą czołówkę, i to od razu z pominięciem numeru 4.
Producent opisuje go jako model „do pracy agentowej”: programowanie, wieloetapowe zadania z narzędziami i praca z dokumentami, ze szczególnym naciskiem na finanse. W praktyce to model z obowiązkowym rozumowaniem - zawsze najpierw „myśli”, a dopiero potem odpowiada. Najważniejsze parametry z dokumentacji StepFun i OpenRoutera:
- Architektura: Mixture of Experts, 600 mld parametrów łącznie, 27 mld aktywnych na token.
- Kontekst: 1 mln tokenów wejścia, maksymalnie 64 tys. tokenów na odpowiedź.
- Wejście: tekst, obrazy (JPG, PNG, WebP, do 60 na zapytanie) i wideo (MP4, MOV, MKV do 128 MB, najlepiej krótsze niż 5 minut). Wyjście tylko tekstowe.
- Wysiłek rozumowania: low, medium (domyślny) i high. Wyłączyć myślenia się nie da.
- Funkcje API: strumieniowanie, wywoływanie narzędzi, tryb JSON i JSON Schema, cache promptów.
Jak zacząć krok po kroku
Z Polski najprościej przez OpenRouter, bo jeden klucz działa tam z setkami modeli i płacisz w dolarach kartą. Jak założyć konto i klucz, opisałem w przewodniku OpenRouter.
- Zaloguj się na openrouter.ai i doładuj konto (minimalna kwota to kilka dolarów).
- Wejdź na stronę modelu
stepfun/step-5-previewi kliknij „Chat”, jeśli chcesz najpierw porozmawiać w przeglądarce. - W API podaj identyfikator
stepfun/step-5-previewi parametrreasoning: {"effort": "low"}, jeśli zależy ci na czasie i koszcie. - Ustaw
max_tokenswyraźnie wyżej niż długość odpowiedzi, której oczekujesz - co najmniej 12-16 tys. Rozumowanie zjada limit, a puste odpowiedzi to najczęstszy problem, który u mnie wyszedł. - Alternatywa: konto na międzynarodowej platformie StepFun (platform.stepfun.ai), rozliczanej w dolarach. Chińska platforma (platform.stepfun.com) liczy w juanach.
Przykładowe wywołanie, którego używałem w teście (Python, biblioteka requests):
import os, requests
r = requests.post("https://openrouter.ai/api/v1/chat/completions",
headers={"Authorization": "Bearer " + os.environ["OPENROUTER_API_KEY"]},
json={"model": "stepfun/step-5-preview",
"max_tokens": 16000,
"reasoning": {"effort": "low"},
"messages": [{"role": "user", "content": "Popraw błędy w tekście: ..."}]})
print(r.json()["choices"][0]["message"]["content"])Ile kosztuje Step 5
Cennik jest w dolarach, bez polskiej wersji. Tokeny rozumowania płacisz jak wyjście, więc realny koszt zadania zależy głównie od tego, ile model „myśli”.
| Pozycja | OpenRouter | Platforma StepFun (międzynarodowa) |
|---|---|---|
| Wejście, 1 mln tokenów | 1,00 USD | 1,00 USD |
| Wyjście (z rozumowaniem), 1 mln tokenów | 2,70 USD | 2,70 USD |
| Wejście z cache, 1 mln tokenów | 0,05 USD | 0,10 USD według dokumentacji EN |
| Dostawca | tylko StepFun, fp8 | StepFun |
Na tle rywali to tanio, ale nie najtaniej. Artificial Analysis liczy, że jedno zadanie z ich indeksu kosztuje w Step 5 średnio 1,03 USD, bo model jest gadatliwy: w ich ewaluacji wygenerował 160 mln tokenów przy medianie 94 mln. U mnie 13 zadań Laboratorium kosztowało 0,31 USD razem z powtórkami pustych odpowiedzi. Dla porównania GLM-5.3 zrobił ten sam zestaw za 0,03 USD, a Claude Opus 5.5 za 0,37 USD. Cała tabela cen modeli jest w rankingu cen AI.
Wyniki w benchmarkach
Najważniejsza niezależna liczba to Artificial Analysis Intelligence Index: 44 punkty, 40. miejsce na 226 modeli. Artificial Analysis oznacza dziś Step 5 jako model zamknięty, bo wagi jeszcze nie wyszły. Gdyby liczyć go już do modeli otwartych, byłby ex aequo trzeci, za MiMo-V2.6-Pro (46) i GLM-5.3 (45), razem z Kimi K3 (44). Stąd hasło „top 3 otwartych”, które powtarzają chińskie media.
Wyniki producenta znam z tabel przedrukowanych przez media (eesel.ai, BenchLM, MarkTechPost), bo strona modelu na stepfun.com nie daje się odczytać bez przeglądarki. Traktuj je jako deklaracje:
| Benchmark | Step 5 Preview | Kimi K3 | GLM-5.3 | Claude Opus 5 |
|---|---|---|---|---|
| DeepSWE v1.1 (programowanie) | 67,7 | 67,5 | 66,9 | 74,0 |
| ProgramBench | 80,5 | 77,8 | 72,0 | 82,3 |
| Terminal-Bench v4 | 33,3 | 12,6 | 41,9 | 52,3 |
| FrontierFinance | 66,4 | 62,6 | 64,1 | 69,7 |
Obraz jest spójny: w programowaniu i finansach Step 5 minimalnie wyprzedza Kimi K3 i GLM-5.3, w pracy w terminalu przegrywa z GLM. Do zachodniej czołówki (Opus 5, GPT-6 Astra) brakuje mu kilku punktów. Szybkość według Artificial Analysis to 86,8 tokena na sekundę i 2,8 s do pierwszego tokena; u mnie najdłuższa odpowiedź (6975 tokenów) przyszła w 79 sekund, czyli ok. 88 tokenów na sekundę.
Step 5 po polsku - mój test
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
9 października puściłem Step 5 Preview przez te same 13 zadań, na których stoi ranking Laboratorium Promptowego i Arena modeli po polsku: 9 tekstów (artykuł, opis produktu, mail, post, opowiadanie, tytuły, streszczenie, prosty język, tłumaczenie), dwie korekty i dwa quizy z polskich realiów. Wysiłek rozumowania low, takie same limity tokenów jak dla innych modeli. Teksty oceniali na ślepo dwaj sędziowie: Claude Opus 5.5 i GPT-6 Sol, a wynik skalibrowałem czterema modelami-kotwicami.
| Model | Wynik (skalibrowany) | Ocena sędziów | Korekta łatwa | Quiz łatwy | Koszt 13 zadań |
|---|---|---|---|---|---|
| Claude Opus 5.5 | 91,3 | 9,04 | 22/22 | 46/46 | 0,37 USD |
| GPT-6 Luna | 80,4 | 7,74 | 22/22 | 46/46 | 0,004 USD |
| Qwen3.8 Max | 76,8 | 7,69 | 21/22 | 46/46 | 0,24 USD |
| Step 5 Preview | 65,4 | 6,0 | 0/22 (pusto) | 46/46 | 0,31 USD |
| GLM-5.3 | 64,8 | 6,41 | 21/22 | 46/46 | 0,03 USD |
Najważniejsze obserwacje:
- Puste odpowiedzi. W opisie produktu i w obu korektach model wykorzystał cały limit (6-8 tys. tokenów) na rozumowanie i nie oddał ani słowa, choć dostał trzy podejścia. To nie błąd polszczyzny, tylko zachowanie modelu na „low” - i właśnie dlatego wynik jest niski.
- Z większym limitem odpowiada. Łatwą korektę powtórzyłem raz z limitem 16 tys.: model myślał 4902 tokeny, oddał tekst i poprawił 19 z 22 błędów. Przepuścił „niepoddał”, „pułkach” i „tą książkę”.
- Fakty o Polsce zna. Łatwy quiz 46/46. W trudnym zdążył odpowiedzieć na 11 pytań, zanim skończył mu się limit - wszystkie 11 dobrze.
- Krótkie teksty dobre, długie słabsze. Mail z przeprosinami sędziowie ocenili na 8,5, streszczenie i tłumaczenie na 8,0. Opowiadanie dostało 5,0 za zdania w rodzaju „słońce z dwudziestu lat temu”, a tekst w prostym języku 5,3 za „oszczędności mogą mniej dać się kupić”.
- Półpauzy. 14,8 półpauzy na 1000 słów, np. w temacie maila. Jeśli publikujesz teksty z AI, czeka cię zamiana na dywiz.
Pełny opis zadań, cytaty z odpowiedzi i ocen sędziów są w tekście Step 5 po polsku: test na 13 zadaniach. To moja opinia na podstawie jednego przebiegu.
Otwarte wagi 15 października
StepFun zapowiedział otwarcie wag na 15 października 2026. Do 9 października na Hugging Face nie ma publicznego repozytorium Step 5 w organizacji stepfun-ai, a firma nie podała licencji. Poprzednie modele (Step 3.5 Flash, Step 3.7 Flash) wyszły na Apache 2.0. Ile pamięci potrzeba, policzyłem z liczby parametrów:
| Format wag | Bajty na parametr | Same wagi, 600B | Na czym realnie |
|---|---|---|---|
| BF16 | 2 | ok. 1,2 TB | serwer 8 GPU po 192 GB albo 16 GPU po 80 GB |
| FP8 | 1 | ok. 600 GB | serwer 8 GPU po 141 GB (np. H200) |
| 4 bity (np. INT4, Q4 GGUF) | ok. 0,5-0,6 | ok. 300-360 GB | stacja z 384-512 GB RAM, bardzo wolno |
Do tego dochodzi pamięć na kontekst. Na domowej karcie, nawet RTX 4090 z 24 GB, Step 5 nie ruszy. To model dla firm z serwerami albo dla dostawców chmurowych, którzy po 15 października mogą zacząć oferować go taniej niż StepFun. Jeśli chcesz uruchomić coś lokalnie, zostań przy mniejszych modelach z przewodnika Lokalne AI. Gdy wagi wyjdą, opiszę, jak je uruchomić, i dopiszę link tutaj.
Porównanie z Kimi K3, GLM-5.3, Qwen i DeepSeek
| Model | AA Index | Otwarte wagi | Cena, 1 mln tokenów (wej./wyj.) | Mój test po polsku |
|---|---|---|---|---|
| Step 5 Preview | 44 | zapowiedź na 15.10 | 1,00 / 2,70 USD | 65,4 |
| Kimi K3 (Max) | 44 | tak, licencja Kimi K3 | 3,00 / 15,00 USD | 78,5 |
| GLM-5.3 (Max) | 45 | tak, licencja GLM-5.3 | 1,40 / 4,40 USD | 64,8 |
| Qwen3.8 Max | 45 | nie | 2,00 / 6,00 USD | 76,8 |
| DeepSeek V4.1 Flash (Max) | 39 | tak, MIT | 0,30 / 1,20 USD | 72,9 |
Ceny i wyniki AA według stron modeli Artificial Analysis z 9 października. Wyniki Kimi K3 i DeepSeek pochodzą z pierwszej rundy Laboratorium (te same zadania, inna pula sędziów), więc różnice do 2-3 punktów traktuję jako remis. Szczegóły i wnioski: Step 5 vs Kimi K3, GLM-5.3, Qwen i DeepSeek.
Dla kogo jest Step 5
- Dla programistów i zespołów agentowych, którym zależy na niskiej cenie za token przy wynikach Kimi K3 w programowaniu. Przy dużym kontekście (1 mln tokenów) i cache za 0,05 USD to tani silnik do analizy repozytoriów.
- Dla firm, które chcą postawić model u siebie - po 15 października, jeśli licencja okaże się tak liberalna jak przy Step 3.7 Flash.
- Nie do pisania po polsku. Do tekstów, maili i korekty lepiej wziąć GPT-6 Luna (80,4 pkt za ułamek centa) albo Kimi K3. Step 5 ma tu wynik GLM-5.3 i dodatkowo ryzyko pustych odpowiedzi.
Najczęstsze pytania
Czy Step 5 jest darmowy?
Nie przez API: na OpenRouterze nie ma darmowej wersji (stan na 9.10). Chińskie media piszą o darmowym dostępie w aplikacjach StepFun, ale tego z Polski nie potwierdziłem. Wagi mają być otwarte od 15 października, więc wtedy model będzie można uruchomić samemu, o ile masz serwer.
Czy Step 5 działa w Polsce?
Tak, przez OpenRouter i przez międzynarodową platformę platform.stepfun.ai, obie rozliczane w dolarach. Czy aplikacja konsumencka StepFun działa z polskiego konta, nie sprawdziłem.
Czy Step 5 mówi po polsku?
Rozumie i pisze poprawnie w krótkich formach, ale w moim teście zdobył 65,4 pkt - mniej niż Kimi K3, Qwen3.8 Max i DeepSeek V4.1 Flash, podobnie jak GLM-5.3.
Ile pamięci potrzeba, żeby uruchomić Step 5 lokalnie?
Same wagi w BF16 to ok. 1,2 TB, w FP8 ok. 600 GB, w 4 bitach ok. 300-360 GB. To sprzęt serwerowy, nie domowy komputer z jedną kartą graficzną.
Dlaczego Step 5 zwraca pustą odpowiedź?
Rozumowanie jest obowiązkowe i liczy się do limitu max_tokens. Jeśli limit jest za niski, model myśli do końca budżetu i nie zdąży odpowiedzieć. Ustaw 12-16 tys. tokenów albo więcej.
Czym Step 5 różni się od Step 3.7 Flash?
Step 3.7 Flash to mniejszy model (ok. 200 mld parametrów, 11 mld aktywnych, 256 tys. kontekstu) za 0,20 / 1,15 USD. Step 5 jest trzy razy większy, ma 1 mln kontekstu, przyjmuje wideo i jest ok. 5 razy droższy za token wejścia.
Kiedy pełny Step 5?
StepFun nie podał daty. „Preview” oznacza, że parametry i ceny mogą się jeszcze zmienić.
Teksty o Step 5
- Step 5 Preview na OpenRouterze - news
- Step 5 po polsku: test na 13 zadaniach
- Step 5 vs Kimi K3, GLM-5.3, Qwen i DeepSeek
- Mniej znane modele AI - przegląd
Źródła i data sprawdzenia
- StepFun na X (20.09.2026)x.com
- dokumentacja modeluplatform.stepfun.ai
- cennik StepFunplatform.stepfun.ai
- OpenRouteropenrouter.ai
- Artificial Analysis - Step 5artificialanalysis.ai
- AA - modele otwarteartificialanalysis.ai
- MarkTechPost (20.09.2026)marktechpost.com
- Pandailypandaily.com
- Sina Finance (20.09.2026)finance.sina.com.cn
- Laboratorium Promptowe, 9.10.2026. Wszystko sprawdziłem 9 października 2026
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
