Przejdź do treści
Qwen

Jak i gdzie korzystać z Qwen3.8-Max. Stan na dziś

Co działa od dnia premiery, co ma dojść w przyszłym tygodniu, a co jest tylko zapowiedzią bez daty. Plus limity, protokoły i jedna rzecz, na którą naprawdę warto poczekać.

4 min czytania
Jak i gdzie korzystać z Qwen3.8-Max. Stan na dziś

👁 234 przeczytań

// w skrócie
  • Jedynym potwierdzonym kanałem dostępu w dniu premiery jest QwenCloud, gdzie model kosztuje 2 dolary za milion tokenów wejścia i 6 dolarów za milion tokenów wyjścia.
  • Otwarte wagi modelu Qwen3.8-Max oraz mniejszego Qwen3.8-27B mają pojawić się na Hugging Face i ModelScope w przyszłym tygodniu, ale nie podano dokładnej daty ani licencji.
  • Model obsługuje oba protokoły - zgodny z OpenAI i z Anthropic - co oznacza, że podmiana adresu bazowego i klucza API wystarczy, by przełączyć istniejący kod.

Model wyszedł dziś nad ranem i przez pierwsze godziny po premierze informacje o dostępie rozjeżdżały się między serwisami. Sprawdziłem, co jest naprawdę dostępne w dniu premiery, co ma dojść w przyszłym tygodniu, a co na razie jest tylko zapowiedzią bez daty. Poniżej stan na dziś, z wyraźnym oddzieleniem jednego od drugiego.

Co działa dzisiaj

QwenCloud. To jedyny kanał potwierdzony na dzień premiery. Model jest tam dostępny w cenie dwóch dolarów za milion tokenów wejścia i sześciu za milion wyjścia. To ta sama cena, którą podano w materiałach premierowych, więc nie ma tu okresu promocyjnego ani obniżki na start.

Jeżeli widziałeś gdzieś informacje o dostępie przez Qoder, QoderWork albo abonament tokenowy z ceną obniżoną do dziesięciu procent stawki, to dotyczyło wersji zapoznawczej z lipca, a nie dzisiejszej premiery. Warto o tym pamiętać, bo część serwisów nadal cytuje tamte warunki jako aktualne.

Co ma dojść w przyszłym tygodniu

Alibaba Cloud Model Studio. To będzie kanał dla firm, z rozliczeniem i umową, a nie tylko kluczem API. Zapowiedziany na przyszły tydzień.

Otwarte wagi na Hugging Face i ModelScope. Razem z nimi mniejszy Qwen3.8-27B, przeznaczony dla tych, którzy nie mają serwerowni. To jest najciekawsza część całej premiery i zaraz wyjaśnię, dlaczego.

Zastrzeżenie, które trzeba postawić wprost: nie ma na to daty dziennej, nie ma licencji i nie ma repozytorium. Jest zapowiedź. Zapowiedzi w tej branży bywają przesuwane, więc dopóki plik się nie pojawi, traktowałbym to jako plan, a nie fakt.

Dlaczego otwarte wagi to jest tu najważniejsza wiadomość

Linia Max była dotąd zamknięta. Zarówno Qwen3.7-Max, jak i wersja zapoznawcza Qwen3.8-Max działały wyłącznie jako usługa w chmurze. Jeżeli Alibaba faktycznie opublikuje wagi modelu tej klasy, będzie to pierwszy taki przypadek w tej rodzinie.

Praktycznie oznaczałoby to, że model o wynikach porównywalnych z czołówką da się postawić u siebie: na własnym sprzęcie, we własnej sieci, bez wysyłania czegokolwiek na zewnątrz. Dla firm z danymi wrażliwymi, kancelarii, szpitali i wszystkich, którzy nie mogą wypuścić dokumentów poza własną infrastrukturę, to jest zupełnie inna rozmowa niż kolejne API.

Realistycznie: model o 2,4 biliona parametrów nie stanie na niczyim laptopie ani nawet na jednej dobrej karcie. To sprzęt za setki tysięcy złotych. Dlatego prawdziwie użyteczna dla większości ludzi będzie wersja 27B, i to na nią bym czekał.

Jak się do niego podłączyć

Model rozmawia dwoma protokołami naraz: zgodnym ze specyfikacją OpenAI oraz zgodnym ze specyfikacją Anthropic. To jest dokładnie ta cecha, która decyduje o tym, czy przejście zajmie pięć minut, czy dwa dni.

W praktyce: jeżeli masz kod, który dziś woła OpenAI, wystarczy podmienić adres bazowy i klucz. Biblioteki zostają te same, struktura zapytania zostaje ta sama. Jeżeli używasz narzędzi zbudowanych wokół protokołu Anthropic, w tym zewnętrznych nakładek agentowych, one także zadziałają, bo poprzednik z tej linii obsługiwał już takie nakładki.

Dostępne są też funkcje, których zwykle brakuje w tańszych modelach: wywoływanie funkcji, wymuszone struktury odpowiedzi, przetwarzanie wsadowe, dopisywanie do zadanego początku odpowiedzi oraz dostrajanie. Do tego pięć wbudowanych narzędzi po stronie dostawcy: interpreter kodu, wyszukiwarka, pobieranie treści ze stron oraz dwa narzędzia do wyszukiwania obrazem.

Limity, o których warto wiedzieć wcześniej

Mam to spisane w całości

Zebrałem te rzeczy w ebookach, które możesz pobrać za darmo - bez zapisu na listę, bez haczyka.

Pobierz ebooki

LimitWartośćCo to znaczy w praktyce
Tokeny na minutę2 000 000dla jednej osoby sufit nieosiągalny
Zapytania na minutę15 000przy flocie agentów zaczyna być realny
Maksymalne wejście991 tys. tokenówprzy włączonym rozumowaniu 983 tys.
Maksymalne wyjście131 tys. tokenóww obu trybach tyle samo
Budżet rozumowania262 tys. tokenówtyle model może przemyśleć przed odpowiedzią

Czy da się go użyć przez OpenRouter

Na razie nie. Sprawdziłem listę modeli OpenRoutera dziś po południu: jest tam 48 modeli Qwen, najnowszy to Qwen3.7 Max. Wersji 3.8 nie ma. Dopisałem ją już do swojego automatu cennikowego, więc kiedy tylko się pojawi, wejdzie do mojego zestawienia kosztów sama i zacznie się aktualizować codziennie razem z resztą.

Dla większości czytelników to jest najwygodniejsza droga i po prostu bym na nią poczekał. Jeden klucz, jeden rachunek, możliwość przełączania się między modelami bez przepisywania kodu.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Co zrobiłbym dzisiaj

Jeżeli masz konkretne zadanie, w którym liczy się długi kontekst, czytanie wykresów albo trzymanie się instrukcji, załóż konto w QwenCloud i przetestuj na swoich danych. Sześć groszy za tekst wielkości artykułu oznacza, że sto testów kosztuje sześć złotych. Nie ma sensu o tym dyskutować, taniej jest sprawdzić.

Jeżeli masz proces produkcyjny, poczekaj tydzień. Model Studio, otwarte wagi i wejście do OpenRoutera zmienią obraz na tyle, że decyzja podjęta dziś może być nieaktualna w poniedziałek.

A jeżeli interesuje Cię wersja na własny sprzęt, obserwuj Qwen3.8-27B, nie Maxa. To ta mniejsza będzie realna dla ludzi bez serwerowni i to ona zdecyduje, czy ta premiera cokolwiek zmienia poza kolejnym wierszem w cenniku.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Ile kosztuje korzystanie z Qwen3.8-Max przez QwenCloud?

Cena wynosi 2 dolary za milion tokenów wejścia i 6 dolarów za milion tokenów wyjścia. Nie ma okresu promocyjnego ani obniżki na start - to ta sama cena podana w materiałach premierowych.

Czy Qwen3.8-Max jest dostępny na OpenRouterze?

Nie, w dniu premiery model nie pojawił się na OpenRouterze - najnowszym modelem Qwen dostępnym w tym serwisie jest Qwen3.7 Max. OpenRouter oferuje łącznie 48 modeli Qwen, ale wersji 3.8 jeszcze tam nie ma.

Czy Qwen3.8-Max można uruchomić na własnym serwerze?

Model pełnej wielkości ma 2,4 biliona parametrów i wymaga sprzętu za setki tysięcy złotych, więc dla większości użytkowników jest nieosiągalny lokalnie. Bardziej realna będzie zapowiedziana wersja Qwen3.8-27B, przeznaczona dla tych, którzy nie dysponują serwerownią.

Jakie są limity zapytań w Qwen3.8-Max?

Model obsługuje do 15 000 zapytań na minutę i 2 000 000 tokenów na minutę. Maksymalne wejście wynosi 991 tysięcy tokenów, a wyjście 131 tysięcy tokenów, przy czym budżet rozumowania to 262 tysiące tokenów.

// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony
🛒 Sklep Kinetyka CapCut Pro 460 zł/rok ElevenLabs Creator 352 zł/rok Lovable Pro 336 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie