Próg 200 tysięcy tokenów: dlaczego rachunek za Groka potrafi się podwoić
Zapytanie o 199 tysięcy tokenów kosztuje 0,40 USD, o 201 tysięcy - 0,80 USD. Próg, którego nie ma w żadnym polskim opracowaniu.

👁 115 przeczytań
- Po przekroczeniu progu 200 tysięcy tokenów rachunek za Groka może się podwoić, bo wyższa stawka obejmuje wszystkie tokeny zapytania, nie tylko nadwyżkę.
- Zapytanie o 199 tysięcy tokenów kosztuje 0,40 USD, a o 201 tysięcy - 0,80 USD, choć różnica między nimi to zaledwie około cztery strony tekstu.
- Podział materiału liczącego 230 tysięcy tokenów na dwie części po 115 tysięcy obniża koszt wejścia z 0,92 USD do 0,46 USD, czyli o połowę.
W cenniku Groka jest próg, który potrafi podwoić rachunek w jednej chwili - i nie ma go w żadnym polskim opracowaniu, które znalazłem. Po przekroczeniu 200 tysięcy tokenów w zapytaniu wszystkie tokeny tego zapytania liczą się po wyższej stawce. Nie tylko te powyżej progu. Wszystkie.
Werdykt w jednym akapicie
Grok 4.7 kosztuje 2 USD za milion tokenów wejścia do progu 200 tysięcy tokenów i 4 USD powyżej niego. Wyjście odpowiednio 6 i 12 USD. Kluczowa jest jedna zasada z dokumentacji: gdy zapytanie przekroczy próg, stawka długiego kontekstu obejmuje cały ładunek, a nie nadwyżkę. Efekt: zapytanie o 199 tysięcy tokenów kosztuje 0,40 USD, a o 201 tysięcy - 0,80 USD. Dwa tysiące tokenów więcej, dwa razy wyższy rachunek.
Jak wygląda cennik naprawdę
| Pozycja | Kontekst krótki (< 200k) | Kontekst długi (≥ 200k) | Różnica |
|---|---|---|---|
| Wejście | 2,00 USD / mln | 4,00 USD / mln | 2× |
| Wejście z pamięci podręcznej | 0,50 USD / mln | 1,00 USD / mln | 2× |
| Wyjście | 6,00 USD / mln | 12,00 USD / mln | 2× |
Te same progi i mnożniki obowiązują w Groku 4.6 i 4.5. W starszych 4.3 oraz w rodzinie 4.20 stawki są niższe (1,25 i 2,50 USD), ale mechanizm identyczny.
Skok na progu w liczbach
Policzmy sam koszt wejścia, bez odpowiedzi modelu:
| Wielkość zapytania | Stawka | Koszt | W złotych |
|---|---|---|---|
| 100 tys. tokenów | krótki | 0,20 USD | 0,76 zł |
| 199 tys. tokenów | krótki | 0,40 USD | 1,50 zł |
| 201 tys. tokenów | długi | 0,80 USD | 3,04 zł |
| 500 tys. tokenów, pełne okno | długi | 2,00 USD | 7,56 zł |
Między trzecim a drugim wierszem jest dwa tysiące tokenów, czyli mniej więcej cztery strony tekstu. I stuprocentowy wzrost ceny. To nie jest błąd w tabeli - to sposób, w jaki producent opisał rozliczenie w dokumentacji.
Dlaczego to boli bardziej, niż wygląda
Trzy powody, dla których ten próg jest groźniejszy niż zwykła podwyżka stawki:
- Historia rozmowy doklejana jest do każdego zapytania. Nie musisz wrzucić 200 tysięcy tokenów naraz - wystarczy, że rozmowa do nich urośnie. Wtedy każda kolejna wiadomość, nawet jednozdaniowa, rozlicza cały kontekst po podwójnej stawce.
- Tokeny rozumowania też się liczą. Producent wymienia je wprost wśród rozliczanych typów tokenów, obok wejściowych, wyjściowych, obrazowych i tych z pamięci podręcznej. Wyższy tryb rozumowania to więcej tokenów, a przy długim kontekście po podwójnej cenie.
- Przekroczenie progu jest niewidoczne. Model nie ostrzega. Zobaczysz to dopiero na rachunku.
Cztery rzeczy, które realnie obniżają rachunek
1. Trzymaj zapytania pod progiem świadomie
Jeśli Twój materiał ma 230 tysięcy tokenów, podzielenie go na dwie części po 115 tysięcy daje 2 × 0,23 USD = 0,46 USD zamiast 0,92 USD za jedno zapytanie. Połowa ceny za tę samą treść. Podział ma sens zawsze, gdy zadanie da się wykonać na częściach.
2. Korzystaj z pamięci podręcznej promptu
Tokeny obsłużone z pamięci podręcznej kosztują 0,50 USD zamiast 2 USD - są czterokrotnie tańsze. To ma znaczenie, gdy przy każdym zapytaniu wysyłasz tę samą instrukcję systemową albo ten sam materiał referencyjny. Stała część promptu powinna być na początku i się nie zmieniać, bo to ona trafia do pamięci podręcznej.
3. Nie ustawiaj najwyższego rozumowania domyślnie
Rozumowanie w Groku 4.7 jest konfigurowalne, a jego tokeny są rozliczane jak wyjściowe - czyli po 6 USD, a przy długim kontekście po 12. To najszybszy sposób na rachunek, którego się nie spodziewasz.
4. Sprawdź, z którego punktu końcowego korzystasz
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
To jest pozycja, o której prawie nikt nie pisze: zapytania kierowane do amerykańskiego punktu końcowego rozliczane są z dziesięcioprocentową dopłatą wobec stawek globalnych. Jeśli nie masz wymogu, żeby wnioskowanie odbywało się w USA, ta dopłata jest czystą stratą.
Kiedy długi kontekst i tak się opłaca
Nie chcę zniechęcać do dużych zapytań - są zadania, w których podział materiału psuje wynik. To jest opinia poparta praktyką: zadania wymagające zestawienia całości, na przykład znalezienie sprzeczności między dwoma odległymi fragmentami dokumentu, wykonane na częściach po prostu nie zadziałają, bo model nigdy nie widzi obu fragmentów naraz.
W takich przypadkach podwójna stawka jest ceną za wynik, którego inaczej nie ma. Warto tylko wiedzieć, że się ją płaci. Więcej o tym, co realnie mieści się w oknie i gdzie leży granica użyteczności, w tekście o oknie 500 tysięcy tokenów.
Szybki test: ile kosztuje Twoja typowa rozmowa
- Weź swoje najdłuższe realne zapytanie i policz jego znaki. Podziel przez 4 - dostaniesz przybliżoną liczbę tokenów dla polskiego tekstu.
- Jeśli wynik jest powyżej 200 tysięcy, mnóż stawki przez dwa.
- Pomnóż przez liczbę zapytań w miesiącu.
- Porównaj z ceną abonamentu - 30 USD za SuperGroka. Szczegóły planów zebrałem w osobnym zestawieniu.
Przelicznik cztery znaki na token jest przybliżeniem dla polszczyzny i zawyża lub zaniża wynik zależnie od tekstu. Do decyzji budżetowej wystarcza, do fakturowania klienta - nie.
Najczęstsze pytania
Od ilu tokenów Grok liczy drożej?
Od 200 tysięcy tokenów w zapytaniu. Powyżej tego progu wszystkie tokeny zapytania rozliczane są po stawce długiego kontekstu.
Czy drożej liczona jest tylko nadwyżka ponad próg?
Nie. Dokumentacja mówi wprost, że stawka długiego kontekstu obejmuje wszystkie tokeny w zapytaniu, gdy prompt osiągnie próg.
Ile kosztuje pełne okno 500 tysięcy tokenów?
2,00 USD za samo wejście, czyli około 7,56 zł - po stawce długiego kontekstu 4 USD za milion.
Czy tokeny z pamięci podręcznej też drożeją?
Tak, z 0,50 na 1,00 USD za milion. Proporcja się nie zmienia - nadal są czterokrotnie tańsze od zwykłego wejścia.
Czy da się uniknąć podwójnej stawki?
Tak, dzieląc materiał na części poniżej progu. Nie zadziała to przy zadaniach wymagających zestawienia całego materiału naraz.
Co to za dopłata za amerykański punkt końcowy?
Zapytania kierowane do regionalnego punktu końcowego w USA rozliczane są ze stawką wyższą o 10 procent wobec globalnej.
Źródła i data sprawdzenia
Wszystkie stawki, progi i zasady rozliczenia odczytane 21 września 2026 z dokumentacji producenta docs.x.ai/docs/pricing. Przeliczenia na złote to wyliczenia redakcji przy kursie 3,78 zł za dolara, a przykładowe rachunki wynikają wprost z tych stawek. Nie mam własnych pomiarów zużycia na tym modelu - obliczenia opierają się na cenniku, nie na moich fakturach. Cennik się zmienia, przed planowaniem budżetu sprawdź stawki u źródła.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Od ilu tokenów Grok zaczyna liczyć opłaty po wyższej stawce?
Grok przechodzi na wyższą stawkę od 200 tysięcy tokenów w zapytaniu. Co ważne, wyższa stawka obejmuje wtedy wszystkie tokeny zapytania, a nie tylko te przekraczające próg.
Ile kosztuje wejście i wyjście w Groku 4.7 przy długim kontekście?
Przy kontekście powyżej 200 tysięcy tokenów wejście kosztuje 4 USD za milion, a wyjście 12 USD za milion. Poniżej progu stawki są o połowę niższe: 2 USD za wejście i 6 USD za wyjście.
Czy tokeny z pamięci podręcznej też drożeją po przekroczeniu progu 200 tysięcy tokenów?
Tak, tokeny z pamięci podręcznej rosną z 0,50 do 1,00 USD za milion. Nadal są jednak czterokrotnie tańsze od zwykłego wejścia, więc proporcja pozostaje taka sama.
Czy jest dopłata za korzystanie z amerykańskiego punktu końcowego Groka?
Tak, zapytania kierowane do punktu końcowego w USA są rozliczane ze stawką wyższą o 10 procent wobec stawek globalnych. Jeśli nie ma wymogu przetwarzania danych w USA, ta dopłata jest zbędnym kosztem.
