Ile kosztuje Qwen3.8-Max w złotówkach. Trzy scenariusze pracy
Sześć groszy za artykuł, 2,54 zł za godzinę pracy agenta, a z pamięcią podręczną 83 grosze. Przeliczyłem cennik na złotówki i zestawiłem z dziesięcioma innymi modelami.

👁 157 przeczytań
- Qwen3.8-Max kosztuje 2 USD za milion tokenów wejścia i 6 USD za milion wyjścia, co daje 0,0606 zł za artykuł i 2,54 zł za godzinę pracy agenta.
- Użycie pamięci jawnej obniża koszt godziny agenta z 2,54 zł do 0,83 zł, a miesięczny rachunek za 160 godzin pracy spada z 407 zł do 133 zł.
- Qwen3.8-Max jest o 36 procent droższy od poprzednika Qwen 3.7 Max i kosztuje tyle samo co Grok 4.5, czyli identyczny cennik 2 i 6 USD.
Cennik Qwen3.8-Max to dwa dolary za milion tokenów wejścia i sześć za milion wyjścia. Sama liczba nikomu nic nie mówi, więc przeliczyłem ją na złotówki i na trzy scenariusze pracy, których używam do porównywania wszystkich modeli od miesięcy. Kurs 3,7425 zł za dolara, ten sam we wszystkich wyliczeniach poniżej.
Trzy scenariusze, jedna tabela
Scenariusze definiuję tak samo dla każdego modelu, żeby dało się je zestawiać w czasie. Artykuł to 1500 tokenów wejścia i 2200 wyjścia. Sto zapytań w czacie to 70 tysięcy wejścia i 40 tysięcy wyjścia. Godzina pracy z agentem to 250 tysięcy wejścia i 30 tysięcy wyjścia, bo agent głównie czyta.
| Model | Artykuł | 100 zapytań | Godzina agenta |
|---|---|---|---|
| GPT-5.6 Luna | 0,0055 zł | 0,12 zł | 0,16 zł |
| DeepSeek V4 Pro | 0,0096 zł | 0,24 zł | 0,50 zł |
| Qwen 3.7 Max | 0,0447 zł | 1,05 zł | 1,88 zł |
| Qwen3.8-Max | 0,0606 zł | 1,42 zł | 2,54 zł |
| Gemini 3.6 Flash | 0,0702 zł | 1,52 zł | 2,25 zł |
| Claude Sonnet 5 | 0,0936 zł | 2,02 zł | 2,99 zł |
| Kimi K3 | 0,1403 zł | 3,03 zł | 4,49 zł |
| Claude Opus 5 | 0,2339 zł | 5,05 zł | 7,49 zł |
| GPT-5.6 Sol | 0,2751 zł | 5,80 zł | 8,05 zł |
| Claude Fable 5 | 0,4678 zł | 10,10 zł | 14,97 zł |
Qwen3.8-Max ląduje w środku stawki, mniej więcej cztery razy taniej od Claude Opus 5 i prawie osiem razy taniej od Fable 5. Ciekawostka: kosztuje dokładnie tyle samo co Grok 4.5, bo obydwa mają identyczny cennik dwa i sześć.
Druga rzecz warta uwagi: wobec własnego poprzednika, Qwen 3.7 Max, nowy model jest o 36 procent droższy. Alibaba podniosła cenę przy okazji premiery. Nadal tanio, ale to nie jest ta sama półka co wcześniej.
Pamięć podręczna, czyli miejsce, gdzie leżą prawdziwe pieniądze
Tu robi się interesująco, bo Qwen3.8-Max ma rozbudowany cennik pamięci podręcznej i to on decyduje o rachunku przy poważnej pracy.
| Rodzaj wejścia | Cena za milion | Ile razy taniej |
|---|---|---|
| Zwykłe wejście | 2,00 USD | punkt odniesienia |
| Odczyt z pamięci niejawnej | 0,25 USD | 8 razy |
| Odczyt z pamięci jawnej | 0,17 USD | 11,8 razy |
| Zapis do pamięci jawnej | 2,50 USD | o 25% drożej jednorazowo |
Rachunek jest prosty. Zapis do pamięci jawnej kosztuje Cię dodatkowe pół dolara za milion tokenów. Każdy późniejszy odczyt oszczędza 1,83 dolara. Czyli opłaca się już przy pierwszym ponownym użyciu, a przy pracy agenta, który dwadzieścia razy wraca do tego samego repozytorium, różnica jest dramatyczna.
Policzmy tę samą godzinę pracy agenta jeszcze raz, tym razem z kontekstem w pamięci jawnej:
| Wariant | Koszt godziny | Koszt miesiąca (160 godzin) |
|---|---|---|
| Qwen3.8-Max bez pamięci | 2,54 zł | 407 zł |
| Qwen3.8-Max z pamięcią jawną | 0,83 zł | 133 zł |
| Claude Opus 5 bez pamięci | 7,49 zł | 1198 zł |
| Claude Fable 5 bez pamięci | 14,97 zł | 2395 zł |
Sto trzydzieści trzy złote miesięcznie za agenta pracującego osiem godzin dziennie przez dwadzieścia dni. To jest liczba, która zmienia sposób myślenia o tym, co się opłaca automatyzować, a co nie.
Milion tokenów kontekstu, czyli ile kosztuje wrzucenie wszystkiego
Mam to spisane w całości
Zebrałem te rzeczy w ebookach, które możesz pobrać za darmo - bez zapisu na listę, bez haczyka.
Model przyjmuje do 991 tysięcy tokenów wejścia, a przy włączonym rozumowaniu 983 tysiące. Wypełnienie całego okna zwykłym wejściem kosztuje dwa dolary, czyli 7,49 zł. Z pamięci jawnej ten sam milion kosztuje 64 grosze.
Dla wyobrażenia: milion tokenów to mniej więcej siedemset tysięcy słów po angielsku, czyli więcej niż cała trylogia Władcy Pierścieni. Po polsku zmieści się tego sporo mniej, bo nasz język dzieli się na tokeny mniej oszczędnie. Za siedem i pół złotego. A za drugim razem za sześćdziesiąt cztery grosze.
Kiedy to się nie opłaca
Dwie sytuacje, w których nie wybrałbym tego modelu z powodów czysto rachunkowych.
Pierwsza: proste, masowe zadania. Jeżeli przepisujesz opisy produktów albo formatujesz teksty, to GPT-5.6 Luna kosztuje 0,0055 zł za jednostkę, czyli jedenaście razy mniej. Płacenie za rozumowanie, którego nie używasz, to najczęstszy sposób przepalania budżetu na AI.
Druga: twarda praca z kodem. Tu trzeba zestawić rachunek z jakością. Qwen3.8-Max jest trzykrotnie tańszy od Claude Opus 5 w scenariuszu agenta, ale w benchmarkach programistycznych wypada wyraźnie słabiej: SWE-bench Pro 67,7 przy 80,3 u lidera, deepSwe 56,6 przy 72,7. Jeżeli tańszy model potrzebuje trzech podejść tam, gdzie droższy wystarcza raz, oszczędność znika, a Twój czas kosztuje więcej niż jedno i drugie.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Czego w tych liczbach nie ma
Wszystkie ceny pochodzą z cennika podanego przy premierze. Modelu nie ma jeszcze w OpenRouterze, więc nie mogę ich potwierdzić własnym pomiarem tak, jak robię to z pozostałymi pozycjami w tabeli. Dopisałem go już do swojego automatu cennikowego, więc gdy tylko się pojawi, wejdzie do zestawienia sam i będzie się aktualizował codziennie.
Nie liczę tu też limitów, a te bywają ważniejsze od stawki. Model ma dwa miliony tokenów na minutę i piętnaście tysięcy zapytań na minutę. Przy pracy pojedynczego człowieka to sufit nieosiągalny, przy flocie agentów zaczyna być realnym ograniczeniem.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Ile kosztuje Qwen3.8-Max w złotówkach za artykuł i za godzinę pracy agenta?
Za artykuł (1500 tokenów wejścia, 2200 wyjścia) zapłacisz 0,0606 zł, a za godzinę pracy agenta - 2,54 zł. Wyliczenia bazują na kursie 3,7425 zł za dolara i cenniku 2 USD za milion tokenów wejścia oraz 6 USD za milion tokenów wyjścia.
Czy Qwen3.8-Max jest droższy od poprzedniej wersji Qwen 3.7 Max?
Tak, Qwen3.8-Max jest o 36 procent droższy od Qwen 3.7 Max. Alibaba podniosła cenę przy okazji premiery nowego modelu.
Jak działa pamięć jawna w Qwen3.8-Max i ile można na niej zaoszczędzić?
Odczyt z pamięci jawnej kosztuje 0,17 USD za milion tokenów, czyli 11,8 razy mniej niż zwykłe wejście po 2 USD. Zapis jest jednorazowo droższy o 25 procent (2,50 USD), ale już pierwsze ponowne użycie przynosi oszczędność 1,83 USD na milion tokenów.
Kiedy nie opłaca się używać Qwen3.8-Max ze względu na koszty?
Przy prostych, masowych zadaniach jak przepisywanie opisów produktów GPT-5.6 Luna kosztuje 0,0055 zł za jednostkę, czyli jedenaście razy mniej. Przy pracy z kodem Qwen3.8-Max uzyskuje SWE-bench Pro 67,7 wobec 80,3 u lidera, więc jeśli tańszy model potrzebuje trzech podejść zamiast jednego, oszczędność znika.



