Qwen3.8 Max: milion kontekstu za 2 dolary. Osiem razy taniej niż Astra
👁 115 przeczytań
Qwen3.8 Max to najnowszy flagowy model Alibaby, dostępny przez OpenRouter od kilku dni. Ma milion tokenów kontekstu i kosztuje 2 dolary za milion tokenów wejściowych oraz 6 za wyjściowe. Te dwie liczby warto zestawić z zachodnią czołówką, bo różnica nie jest kosmetyczna.
Porównanie, które tłumaczy wszystko
| Model | Wejście / mln | Wyjście / mln | Kontekst |
|---|---|---|---|
| Qwen3.8 Max | 2,00 USD | 6,00 USD | 1 000 000 |
| GPT-6 Astra | 10,00 USD | 50,00 USD | 1 050 000 |
Przy praktycznie identycznym oknie kontekstu Qwen jest pięć razy tańszy na wejściu i ponad osiem razy na wyjściu. Przy zadaniu, które generuje dużo tekstu, ta różnica decyduje o tym, czy projekt w ogóle ma sens ekonomiczny. Odczyt cen z OpenRouter, 8 września 2026.
Gdzie ta różnica ma znaczenie
Nie tam, gdzie zadajesz kilkanaście pytań dziennie, bo wtedy rachunek jest tak czy inaczej groszowy. Ma znaczenie przy pracy masowej: klasyfikacji tysięcy zgłoszeń, streszczaniu dokumentów, przetwarzaniu archiwum, generowaniu opisów produktów. Tam liczba tokenów idzie w miliardy, a stawka przestaje być szczegółem w tabelce i staje się główną pozycją w budżecie.
Milion tokenów kontekstu oznacza w praktyce, że model przyjmie naraz bardzo długi dokument albo cały projekt, bez dzielenia na kawałki. Przy tej cenie wejściowej wczytywanie dużych materiałów przestaje boleć.
Czego nie wiadomo i o czym trzeba pamiętać
Nie ma jeszcze niezależnych pomiarów polszczyzny tego modelu, a to jest jedyna rzecz, która przesądza o jego przydatności w polskich zadaniach. Modele chińskie bywają pod tym względem nierówne: potrafią być bez zarzutu w kodzie i wyraźnie słabsze w naturalnym polskim tekście. Zanim oprzesz na tym proces, przetestuj go na własnym zadaniu po polsku, a nie na angielskim rankingu.
Druga sprawa to dane. Korzystając z modelu przez dostawcę, wysyłasz do niego treść zapytania. Przy dokumentach objętych poufnością trzeba to rozważyć osobno, niezależnie od tego, czyj to model. Alternatywą jest uruchomienie modelu otwartego u siebie, o czym piszę w przewodniku po Ollamie.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Kontekst
Qwen dołącza do grona chińskich modeli, które konkurują przede wszystkim ceną. Najgłośniejszego z nich opisuję w przewodniku po DeepSeeku. Bieżące stawki i pozycje wszystkich modeli zbieram w rankingu modeli AI, a porównanie flagowców w tekście o GPT-6 Astra.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Ile kosztuje Qwen3.8 Max?
2 dolary za milion tokenów wejściowych i 6 dolarów za milion wyjściowych, według odczytu z OpenRouter z 8 września 2026.
Jakie okno kontekstu ma Qwen3.8 Max?
Milion tokenów, czyli praktycznie tyle samo co zachodnia czołówka. Model przyjmie naraz bardzo długi dokument bez dzielenia go na części.
Czy Qwen3.8 Max jest tańszy od GPT-6 Astra?
Tak, wyraźnie: pięć razy na wejściu i ponad osiem razy na wyjściu, przy niemal identycznym oknie kontekstu. Różnica ma znaczenie przy pracy masowej, nie przy kilkunastu pytaniach dziennie.
Czy Qwen3.8 Max dobrze radzi sobie po polsku?
Nie ma jeszcze niezależnych pomiarów polszczyzny tego modelu. Modele chińskie bywają nierówne: mocne w kodzie, słabsze w naturalnym polskim tekście. Warto przetestować na własnym zadaniu przed wdrożeniem.
Kto stoi za modelem Qwen?
Alibaba. Qwen to rodzina modeli tej firmy, konkurująca przede wszystkim stosunkiem możliwości do ceny.
