Frontier w cenie średniaka. Ta sama praca na Grok 4.6, GPT-5.6 i Claude w złotówkach
Grok 4.6 wnosi wyniki z topu benchmarków na półkę cenową średniaków. Przeliczam tę samą pracę na 7 modelach w złotówkach: artykuł, sto zapytań i godzina agenta.

👁 160 przeczytań
- Grok 4.6 kosztuje w API 2 USD za milion tokenów wejściowych i 6 USD za wyjściowe, czyli tyle samo co Qwen 3.8 Max, a osiąga 61 punktów w indeksie Artificial Analysis.
- Godzina pracy agenta kodującego przez miesiąc roboczy kosztuje na Groku 4.6 około 56 zł, na GPT-5.6 Sol 176 zł, a na Claude Fable 5 prawie 330 zł.
- Najtańszy w tabeli DeepSeek V4 Pro (1,17/2,34 USD za milion tokenów) kosztuje za godzinę agenta 1,35 zł, czyli ponad dziesięć razy mniej niż Claude Fable 5.
Wczorajsza premiera Groka 4.6 wygląda na kolejny odcinek serialu „nowy model, nowe benchmarki„, ale pod spodem dzieje się coś ważniejszego: półka cenowa, na której sprzedaje się inteligencję klasy frontier, właśnie pękła. Model, który w indeksie Artificial Analysis remisuje z najmocniejszym wariantem GPT-5.6, kosztuje w API tyle, co dotychczasowi „średniacy”. Policzyłem więc to, co liczy się naprawdę: ile kosztuje ta sama praca, wykonana przez siedem czołowych modeli, w złotówkach, na trzech zadaniach z życia. Stawki pochodzą z mojego obserwatorium kosztów AI, które codziennie zaciąga cennik z OpenRouter, kurs to średni NBP (3,73 zł za dolara), stan na 13 sierpnia 2026.
Metodologia w jednym akapicie
Trzy scenariusze, te same od miesięcy, żeby dało się porównywać: napisanie artykułu na 1500 słów (krótki brief na wejściu, tekst na wyjściu), sto zapytań w czacie (po około 700 tokenów pytania i 400 odpowiedzi) oraz godzina pracy z agentem kodującym, który czyta repozytorium i pisze poprawki (ćwierć miliona tokenów na wejściu). Liczby to czysta arytmetyka na oficjalnych stawkach API, bez rabatów za cache i batch, których każdy dostawca udziela inaczej.
Tabela dnia: ta sama robota, siedem rachunków
| Model (stawki $/mln in/out) | Artykuł 1500 słów | 100 zapytań w czacie | Godzina agenta |
|---|---|---|---|
| DeepSeek V4 Pro (1,17/2,34) | 3 gr | 0,65 zł | 1,35 zł |
| GPT-5.6 Terra (1/6) | 5 gr | 1,16 zł | 1,60 zł |
| Grok 4.6 (2/6) | 6 gr | 1,42 zł | 2,54 zł |
| Qwen 3.8 Max (2/6) | 6 gr | 1,42 zł | 2,54 zł |
| Kimi K3 (3/15) | 14 gr | 3,02 zł | 4,48 zł |
| GPT-5.6 Sol (5/30) | 27 gr | 5,78 zł | 8,02 zł |
| Claude Fable 5 (10/50) | 47 gr | 10,07 zł | 14,92 zł |
Co z tej tabeli wynika
Po pierwsze, uformowała się wyraźna „półka 2/6″: Grok 4.6 i Qwen 3.8 Max kosztują co do centa tyle samo, a GPT-5.6 Terra stoi pół kroku niżej. To nie przypadek, tylko punkt cenowy, w którym toczy się teraz wojna o programistów i agenty. Nowością Groka jest to, że wnosi na tę półkę wyniki z samego szczytu tabel: 61 punktów w indeksie Artificial Analysis, tyle co GPT-5.6 Sol Max, oraz prowadzenie w testach pracy z dokumentami. Jeszcze pół roku temu takie wyniki kosztowały pięć razy więcej.
Po drugie, skala robi się odczuwalna dopiero przy pracy agentowej. Przy pojedynczym artykule różnica między 6 a 47 groszami nikogo nie zaboli. Ale godzina agenta dziennie przez miesiąc roboczy to na Groku około 56 zł, na GPT-5.6 Sol 176 zł, a na Fable 5 prawie 330 zł. Zespół z pięcioma takimi agentami płaci już nie za model, tylko za przyzwyczajenie.
Po trzecie, tabela kosztów to nie tabela jakości i trzeba to powiedzieć uczciwie. W agentowym kodowaniu (test DeepSWE) Grok 4.6 wciąż ustępuje GPT-5.6 Sol Max o siedem punktów procentowych, a moje pojedynki AI regularnie pokazują, że na konkretnych zadaniach rankingi potrafią się odwracać. Najtańszy DeepSeek bywa świetny w kodzie, ale w polszczyźnie potrafi zgrzytać; Fable płaci się nie za benchmarki, tylko za niezawodność na najtrudniejszych zadaniach.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Jak z tego skorzystać w praktyce
Strategia, którą sam stosuję: rutynę zrzucaj na półkę 2/6 albo niżej, a drogi model trzymaj jako drugą opinię. Konkretnie: szkice, streszczenia, klasyfikacje i masówkę agentową kieruj do Groka 4.6, Qwena albo Terry, a Sol Max czy Fable wołaj tylko tam, gdzie błąd kosztuje więcej niż cała miesięczna różnica w rachunku, czyli przy architekturze kodu, umowach i tekstach, które idą do klienta. Ustawienie takiego podziału w typowym stacku agentowym to zmiana jednej linijki konfiguracji, a rachunek potrafi spaść kilkukrotnie bez widocznej straty jakości.
Wszystkie stawki z tej tabeli aktualizują się codziennie w kalkulatorze kosztów AI, gdzie przeliczysz też własne scenariusze, a szczegóły wczorajszej premiery znajdziesz w tekście o Groku 4.6. Gdy któryś z graczy ruszy cenami, pierwszy raport wpadnie w poniedziałkowych Okazjach AI.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Ile kosztuje Grok 4.6 w API w złotówkach za napisanie artykułu 1500 słów?
Za artykuł na 1500 słów Grok 4.6 kosztuje 6 groszy. Stawki to 2 USD za milion tokenów wejściowych i 6 USD za wyjściowe, a kurs przyjęty w obliczeniach to 3,73 zł za dolara według średniego NBP na 13 sierpnia 2026.
Który model frontier jest najtańszy w API według zestawienia z sierpnia 2026?
Najtańszy jest DeepSeek V4 Pro ze stawkami 1,17/2,34 USD za milion tokenów. Za sto zapytań w czacie kosztuje 0,65 zł, a za godzinę agenta kodującego 1,35 zł.
Czy Grok 4.6 jest lepszy od GPT-5.6 Sol w kodowaniu agentowym?
Nie - w teście DeepSWE Grok 4.6 ustępuje GPT-5.6 Sol Max o siedem punktów procentowych. W indeksie Artificial Analysis oba modele remisują na poziomie 61 punktów, ale w kodowaniu agentowym Sol Max wciąż prowadzi.
Jaką strategię stosować, żeby obniżyć koszty modeli AI przy pracy z agentami?
Rutynowe zadania - szkice, streszczenia, klasyfikacje i masówkę agentową - należy kierować do modeli z półki 2/6, takich jak Grok 4.6, Qwen 3.8 Max lub GPT-5.6 Terra. Droższy model, np. Sol Max lub Claude Fable 5, warto uruchamiać tylko tam, gdzie błąd kosztuje więcej niż miesięczna różnica w rachunku, czyli przy architekturze kodu, umowach i tekstach idących do klienta.
SaaSpocalypse - jak Claude Cowork wywołał największą wyprzedaż akcji oprogramowania w historiiPremium
Meta chce uczyć AI na kliknięciach pracowników. Europa pyta, czy to jeszcze praca, czy już nadzórPremium
Claude Opus 4.8 wysyła do pracy setki podagentów. Programowanie wchodzi w erę rojówPremiumPodobne tematy na Promptowym
Ile kosztuje artykuł napisany przez AI? Zapłaciłem i policzyłem. Różnica sięga 485 razy
Zbudowałem test dla jedenastu modeli AI. Na jednym zadaniu test się pomylił, a modele miały rację
Który model AI pisze najlepiej po polsku? Zmierzyłem dziesięć. Zwycięzca kosztuje 32 razy mniej niż drugi zwycięzca
