Przejdź do treści
Warsztat

Próg 200 tysięcy tokenów: dlaczego rachunek za Groka potrafi się podwoić

Zapytanie o 199 tysięcy tokenów kosztuje 0,40 USD, o 201 tysięcy - 0,80 USD. Próg, którego nie ma w żadnym polskim opracowaniu.

5 min czytania
Prog 200 tysiecy tokenow: dlaczego rachunek za Groka potrafi sie podwoic

👁 115 przeczytań

// w skrócie
  • Po przekroczeniu progu 200 tysięcy tokenów rachunek za Groka może się podwoić, bo wyższa stawka obejmuje wszystkie tokeny zapytania, nie tylko nadwyżkę.
  • Zapytanie o 199 tysięcy tokenów kosztuje 0,40 USD, a o 201 tysięcy - 0,80 USD, choć różnica między nimi to zaledwie około cztery strony tekstu.
  • Podział materiału liczącego 230 tysięcy tokenów na dwie części po 115 tysięcy obniża koszt wejścia z 0,92 USD do 0,46 USD, czyli o połowę.

W cenniku Groka jest próg, który potrafi podwoić rachunek w jednej chwili - i nie ma go w żadnym polskim opracowaniu, które znalazłem. Po przekroczeniu 200 tysięcy tokenów w zapytaniu wszystkie tokeny tego zapytania liczą się po wyższej stawce. Nie tylko te powyżej progu. Wszystkie.

Werdykt w jednym akapicie

Grok 4.7 kosztuje 2 USD za milion tokenów wejścia do progu 200 tysięcy tokenów i 4 USD powyżej niego. Wyjście odpowiednio 6 i 12 USD. Kluczowa jest jedna zasada z dokumentacji: gdy zapytanie przekroczy próg, stawka długiego kontekstu obejmuje cały ładunek, a nie nadwyżkę. Efekt: zapytanie o 199 tysięcy tokenów kosztuje 0,40 USD, a o 201 tysięcy - 0,80 USD. Dwa tysiące tokenów więcej, dwa razy wyższy rachunek.

Jak wygląda cennik naprawdę

PozycjaKontekst krótki
(< 200k)
Kontekst długi
(≥ 200k)
Różnica
Wejście2,00 USD / mln4,00 USD / mln
Wejście z pamięci podręcznej0,50 USD / mln1,00 USD / mln
Wyjście6,00 USD / mln12,00 USD / mln

Te same progi i mnożniki obowiązują w Groku 4.6 i 4.5. W starszych 4.3 oraz w rodzinie 4.20 stawki są niższe (1,25 i 2,50 USD), ale mechanizm identyczny.

Skok na progu w liczbach

Policzmy sam koszt wejścia, bez odpowiedzi modelu:

Wielkość zapytaniaStawkaKosztW złotych
100 tys. tokenówkrótki0,20 USD0,76 zł
199 tys. tokenówkrótki0,40 USD1,50 zł
201 tys. tokenówdługi0,80 USD3,04 zł
500 tys. tokenów, pełne oknodługi2,00 USD7,56 zł

Między trzecim a drugim wierszem jest dwa tysiące tokenów, czyli mniej więcej cztery strony tekstu. I stuprocentowy wzrost ceny. To nie jest błąd w tabeli - to sposób, w jaki producent opisał rozliczenie w dokumentacji.

Dlaczego to boli bardziej, niż wygląda

Trzy powody, dla których ten próg jest groźniejszy niż zwykła podwyżka stawki:

  1. Historia rozmowy doklejana jest do każdego zapytania. Nie musisz wrzucić 200 tysięcy tokenów naraz - wystarczy, że rozmowa do nich urośnie. Wtedy każda kolejna wiadomość, nawet jednozdaniowa, rozlicza cały kontekst po podwójnej stawce.
  2. Tokeny rozumowania też się liczą. Producent wymienia je wprost wśród rozliczanych typów tokenów, obok wejściowych, wyjściowych, obrazowych i tych z pamięci podręcznej. Wyższy tryb rozumowania to więcej tokenów, a przy długim kontekście po podwójnej cenie.
  3. Przekroczenie progu jest niewidoczne. Model nie ostrzega. Zobaczysz to dopiero na rachunku.

Cztery rzeczy, które realnie obniżają rachunek

1. Trzymaj zapytania pod progiem świadomie

Jeśli Twój materiał ma 230 tysięcy tokenów, podzielenie go na dwie części po 115 tysięcy daje 2 × 0,23 USD = 0,46 USD zamiast 0,92 USD za jedno zapytanie. Połowa ceny za tę samą treść. Podział ma sens zawsze, gdy zadanie da się wykonać na częściach.

2. Korzystaj z pamięci podręcznej promptu

Tokeny obsłużone z pamięci podręcznej kosztują 0,50 USD zamiast 2 USD - są czterokrotnie tańsze. To ma znaczenie, gdy przy każdym zapytaniu wysyłasz tę samą instrukcję systemową albo ten sam materiał referencyjny. Stała część promptu powinna być na początku i się nie zmieniać, bo to ona trafia do pamięci podręcznej.

3. Nie ustawiaj najwyższego rozumowania domyślnie

Rozumowanie w Groku 4.7 jest konfigurowalne, a jego tokeny są rozliczane jak wyjściowe - czyli po 6 USD, a przy długim kontekście po 12. To najszybszy sposób na rachunek, którego się nie spodziewasz.

4. Sprawdź, z którego punktu końcowego korzystasz

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

To jest pozycja, o której prawie nikt nie pisze: zapytania kierowane do amerykańskiego punktu końcowego rozliczane są z dziesięcioprocentową dopłatą wobec stawek globalnych. Jeśli nie masz wymogu, żeby wnioskowanie odbywało się w USA, ta dopłata jest czystą stratą.

Kiedy długi kontekst i tak się opłaca

Nie chcę zniechęcać do dużych zapytań - są zadania, w których podział materiału psuje wynik. To jest opinia poparta praktyką: zadania wymagające zestawienia całości, na przykład znalezienie sprzeczności między dwoma odległymi fragmentami dokumentu, wykonane na częściach po prostu nie zadziałają, bo model nigdy nie widzi obu fragmentów naraz.

W takich przypadkach podwójna stawka jest ceną za wynik, którego inaczej nie ma. Warto tylko wiedzieć, że się ją płaci. Więcej o tym, co realnie mieści się w oknie i gdzie leży granica użyteczności, w tekście o oknie 500 tysięcy tokenów.

Szybki test: ile kosztuje Twoja typowa rozmowa

  1. Weź swoje najdłuższe realne zapytanie i policz jego znaki. Podziel przez 4 - dostaniesz przybliżoną liczbę tokenów dla polskiego tekstu.
  2. Jeśli wynik jest powyżej 200 tysięcy, mnóż stawki przez dwa.
  3. Pomnóż przez liczbę zapytań w miesiącu.
  4. Porównaj z ceną abonamentu - 30 USD za SuperGroka. Szczegóły planów zebrałem w osobnym zestawieniu.

Przelicznik cztery znaki na token jest przybliżeniem dla polszczyzny i zawyża lub zaniża wynik zależnie od tekstu. Do decyzji budżetowej wystarcza, do fakturowania klienta - nie.

Najczęstsze pytania

Od ilu tokenów Grok liczy drożej?

Od 200 tysięcy tokenów w zapytaniu. Powyżej tego progu wszystkie tokeny zapytania rozliczane są po stawce długiego kontekstu.

Czy drożej liczona jest tylko nadwyżka ponad próg?

Nie. Dokumentacja mówi wprost, że stawka długiego kontekstu obejmuje wszystkie tokeny w zapytaniu, gdy prompt osiągnie próg.

Ile kosztuje pełne okno 500 tysięcy tokenów?

2,00 USD za samo wejście, czyli około 7,56 zł - po stawce długiego kontekstu 4 USD za milion.

Czy tokeny z pamięci podręcznej też drożeją?

Tak, z 0,50 na 1,00 USD za milion. Proporcja się nie zmienia - nadal są czterokrotnie tańsze od zwykłego wejścia.

Czy da się uniknąć podwójnej stawki?

Tak, dzieląc materiał na części poniżej progu. Nie zadziała to przy zadaniach wymagających zestawienia całego materiału naraz.

Co to za dopłata za amerykański punkt końcowy?

Zapytania kierowane do regionalnego punktu końcowego w USA rozliczane są ze stawką wyższą o 10 procent wobec globalnej.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Źródła i data sprawdzenia

Wszystkie stawki, progi i zasady rozliczenia odczytane 21 września 2026 z dokumentacji producenta docs.x.ai/docs/pricing. Przeliczenia na złote to wyliczenia redakcji przy kursie 3,78 zł za dolara, a przykładowe rachunki wynikają wprost z tych stawek. Nie mam własnych pomiarów zużycia na tym modelu - obliczenia opierają się na cenniku, nie na moich fakturach. Cennik się zmienia, przed planowaniem budżetu sprawdź stawki u źródła.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Od ilu tokenów Grok zaczyna liczyć opłaty po wyższej stawce?

Grok przechodzi na wyższą stawkę od 200 tysięcy tokenów w zapytaniu. Co ważne, wyższa stawka obejmuje wtedy wszystkie tokeny zapytania, a nie tylko te przekraczające próg.

Ile kosztuje wejście i wyjście w Groku 4.7 przy długim kontekście?

Przy kontekście powyżej 200 tysięcy tokenów wejście kosztuje 4 USD za milion, a wyjście 12 USD za milion. Poniżej progu stawki są o połowę niższe: 2 USD za wejście i 6 USD za wyjście.

Czy tokeny z pamięci podręcznej też drożeją po przekroczeniu progu 200 tysięcy tokenów?

Tak, tokeny z pamięci podręcznej rosną z 0,50 do 1,00 USD za milion. Nadal są jednak czterokrotnie tańsze od zwykłego wejścia, więc proporcja pozostaje taka sama.

Czy jest dopłata za korzystanie z amerykańskiego punktu końcowego Groka?

Tak, zapytania kierowane do punktu końcowego w USA są rozliczane ze stawką wyższą o 10 procent wobec stawek globalnych. Jeśli nie ma wymogu przetwarzania danych w USA, ta dopłata jest zbędnym kosztem.

// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok n8n Cloud Starter 320 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie