Ile kosztuje artykuł napisany przez AI? Zapłaciłem i policzyłem. Różnica sięga 485 razy
👁 114 przeczytań
- Najtańszy artykuł (DeepSeek V4 Flash) kosztował 0,00039 dolara, a najdroższy (Claude Fable 5.1) 0,18913 dolara - to 485 razy więcej za tekst tej samej długości.
- GLM 5.3 Flash zużył cały limit 8000 tokenów na wewnętrzne rozumowanie, nie napisał ani słowa, a mimo to wystawił rachunek na 0,00402 dolara.
- Przy 90 artykułach miesięcznie koszt waha się od 0,04 dolara (DeepSeek V4 Flash) do 17,02 dolara (Claude Fable 5.1), co pokazuje skalę różnic przy masowym użyciu.
Pytanie „ile kosztuje artykuł napisany przez AI” dostaje zwykle odpowiedź policzoną z cennika. Postanowiłem zapłacić i sprawdzić. Osiem modeli, to samo polecenie, artykuł o długości około dziewięciuset słów po polsku, koszt odczytany z rachunku, a nie oszacowany.
Najtańszy napisał ten tekst za 0,00039 dolara. Najdroższy za 0,18913. To czterysta osiemdziesiąt pięć razy więcej za rzecz tej samej długości. A jeden model nie napisał ani jednego słowa i też wystawił rachunek.
Wyniki
| Model | Słów | Koszt | Za 1000 słów | Czas |
|---|---|---|---|---|
| DeepSeek V4 Flash | 922 | 0,00039 USD | 0,00042 USD | 39,2 s |
| Ministral 14B | 1 192 | 0,00057 USD | 0,00048 USD | 21,4 s |
| Gemini 3.8 Flash | 1 032 | 0,01207 USD | 0,01169 USD | 24,3 s |
| Claude Haiku 4.5 | 596 | 0,00817 USD | 0,01371 USD | 16,1 s |
| Kimi K3 | 903 | 0,10990 USD | 0,12171 USD | 182,7 s |
| GPT-6 Astra | 906 | 0,11228 USD | 0,12393 USD | 51,2 s |
| Claude Fable 5.1 | 886 | 0,18913 USD | 0,21347 USD | 70,1 s |
| GLM 5.3 Flash | 0 | 0,00402 USD | nie dotyczy | 82,1 s |
Cały test kosztował 0,43653 dolara.
Model, który zapłacił za milczenie
GLM 5.3 Flash dostał limit ośmiu tysięcy tokenów na odpowiedź. Zużył wszystkie osiem tysięcy na wewnętrzne rozumowanie i nie zostawił sobie ani jednego na tekst. Wynik: zero słów, 82 sekundy czekania i rachunek na 0,00402 dolara.
To nie jest przypadek ani wpadka jednego uruchomienia. W tym modelu nie da się wyłączyć rozumowania, bo API odrzuca taką próbę błędem. Przy krótkich zadaniach to tylko podnosi rachunek. Przy dłuższych potrafi zjeść całą odpowiedź.
Jeśli budujesz cokolwiek, co pracuje bez nadzoru, to jest dokładnie ten rodzaj awarii, którego nie zobaczysz w logach: status sukcesu, niezerowy rachunek i pusty plik na wyjściu.
Najtańszy nie znaczy najgorszy, ale trzeba wiedzieć, na co patrzeć
Dwa najtańsze modele dzieli w rachunku niecały grosz, a w jakości przepaść.
DeepSeek V4 Flash napisał 922 słowa za 0,00039 dolara, bez ani jednego tokena rozumowania, i trafił w zadaną długość z dokładnością do dwóch procent. Tekst zaczyna się od zdania, które brzmi jak człowiek: „Kiedy po raz pierwszy usłyszałem o asystentach AI, pomyślałem, że to technologia zarezerwowana dla dużych korporacji”.
Ministral 14B był jeszcze o włos tańszy i najszybszy w całej stawce, ale otworzył tekst tak: „W dzisiejszym świecie, gdzie efektywność i automatyzacja są kluczowe”. Do tego wstawił dwadzieścia dziewięć długich myślników, czyli znak, który w polskim tekście natychmiast zdradza maszynę, bo prawie nikt nie używa go z klawiatury.
Oba kosztują tyle samo. Jeden wymaga korekty, drugi wymaga przepisania.
Kto trafił w zadaną długość
Poprosiłem o około dziewięćset słów. To jest test posłuszeństwa, nie kreatywności, i wypadł ciekawiej, niż zakładałem.
- Trafili z dokładnością do trzech procent: Kimi K3 (903), GPT-6 Astra (906), Claude Fable 5.1 (886), DeepSeek V4 Flash (922).
- Przestrzelili: Gemini 3.8 Flash o piętnaście procent (1 032), Ministral 14B o trzydzieści dwa procent (1 192).
- Nie dowiózł: Claude Haiku 4.5 napisał 596 słów zamiast dziewięciuset, czyli o jedną trzecią za mało.
To ma znaczenie praktyczne. Jeśli zamawiasz tekst pod konkretne miejsce w układzie strony, model, który regularnie schodzi o trzydzieści procent poniżej, oznacza dla Ciebie dopisywanie ręcznie.
Ile to kosztuje w skali miesiąca
Załóżmy trzy artykuły dziennie, czyli dziewięćdziesiąt miesięcznie.
| Model | 90 artykułów |
|---|---|
| DeepSeek V4 Flash | 0,04 USD |
| Ministral 14B | 0,05 USD |
| Gemini 3.8 Flash | 1,09 USD |
| Kimi K3 | 9,89 USD |
| GPT-6 Astra | 10,11 USD |
| Claude Fable 5.1 | 17,02 USD |
Dopiero w tej tabeli widać, o co toczy się gra. Przy jednym tekście różnica jest niewidoczna. Przy dziewięćdziesięciu to różnica między czterema centami a siedemnastoma dolarami, za rzecz o tej samej długości.
Czas też kosztuje
Kimi K3 potrzebował 182,7 sekundy, czyli ponad trzy minuty na jeden artykuł. GPT-6 Astra zrobił to samo w 51 sekundach, a Claude Haiku 4.5 w 16, choć krócej.
Przy ręcznej pracy trzy minuty to nic. Przy dziewięćdziesięciu tekstach to cztery i pół godziny samego czekania w miesiącu, wobec siedemdziesięciu sześciu minut przy Astrze.
Skąd te różnice w rachunku
Odpowiedź jest w tokenach rozumowania, czyli tekście, który model pisze sam do siebie i za który płacisz po stawce wyjścia.
- DeepSeek V4 Flash, Ministral 14B i Claude Haiku 4.5: zero tokenów rozumowania.
- GPT-6 Astra: 176. Claude Fable 5.1: 715.
- Gemini 3.8 Flash: 985.
- Kimi K3: 4 667, przy artykule o długości 903 słów.
- GLM 5.3 Flash: 8 000, czyli cały dostępny limit i nic poza nim.
Do tego dochodzi druga rzecz, o której mało kto pamięta przy liczeniu: cena z karty modelu nie musi być ceną, którą zapłacisz, bo ten sam model hostuje kilkanaście firm z własnymi stawkami, a rozrzut sięga czternastu razy.
Co z tego wynika w praktyce
Do masowego przetwarzania tekstu weź DeepSeek V4 Flash. Zero rozumowania, trafiona długość, rachunek na poziomie zaokrąglenia. Sprawdź tylko wynik, bo tanio nie znaczy bezbłędnie.
Do tekstu, który idzie do publikacji bez przeróbek, dopłać. GPT-6 Astra napisał jedyny tekst, który zaczyna się od konkretu, a nie od rozgrzewki: „Nie zaczynam od zakupu narzędzia ani od próby zautomatyzowania całej firmy”. To jest różnica, za którą płaci się dziesięć dolarów miesięcznie zamiast czterech centów.
Zawsze sprawdzaj trzy rzeczy w wyniku: długie myślniki, otwarcia w rodzaju „w dzisiejszym świecie” oraz to, czy model w ogóle coś napisał. Wszystkie trzy da się sprawdzić automatycznie i wszystkie trzy zdarzyły się w tym teście.
I rzecz najważniejsza: koszt to nie jest to samo co wartość. Ten test mierzy, ile płacisz za dziewięćset słów po polsku, a nie czy te dziewięćset słów jest komuś potrzebne. Jak sprawdzam samą jakość polszczyzny, rozpisałem w teście dziesięciu modeli na zadaniach gramatycznych, a trzymanie się instrukcji w teście jedenastu modeli na kodzie i poleceniach.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Jak to mierzyłem
Jedno polecenie, wysłane 10 września 2026, identyczne dla wszystkich ośmiu modeli, limit ośmiu tysięcy tokenów na odpowiedź. Koszt każdego zapytania odczytany z pola rozliczeniowego zwracanego przez interfejs programistyczny. Liczbę słów, znaki diakrytyczne, długie myślniki i nagłówki policzyłem maszynowo na surowej odpowiedzi.
Jedno podejście na model to za mało, żeby mówić o średniej, i tego nie twierdzę. Twierdzę, że tak wyszło przy pierwszym podejściu i że różnica czterystu osiemdziesięciu pięciu razy w cenie jest zbyt duża, żeby ją tłumaczyć wahaniem.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Który model AI jest najtańszy do pisania artykułów po polsku?
Najtańszy okazał się DeepSeek V4 Flash - jeden artykuł o długości około 900 słów kosztował 0,00039 dolara. Model nie używa tokenów rozumowania i trafił w zadaną długość z dokładnością do dwóch procent.
Dlaczego Kimi K3 jest taki drogi w porównaniu do innych modeli?
Kimi K3 wygenerował aż 4667 tokenów rozumowania przy artykule liczącym 903 słowa, a za tokeny rozumowania płaci się według stawki wyjścia. Dlatego koszt jednego tekstu wyniósł 0,10990 dolara, czyli 90 artykułów miesięcznie kosztuje niemal 10 dolarów.
Czy tańszy model AI pisze gorsze artykuły niż droższy?
Niekoniecznie - DeepSeek V4 Flash za 0,00039 dolara otworzył tekst zdaniem brzmiącym naturalnie, podczas gdy Ministral 14B za podobną cenę użył frazesy i 29 długich myślników zdradzających maszynę. Cena nie decyduje wprost o jakości, ale droższy GPT-6 Astra jako jedyny zaczął tekst od konkretu bez rozgrzewki.
Co to są tokeny rozumowania i dlaczego wpływają na koszt?
Tokeny rozumowania to tekst, który model pisze sam do siebie przed udzieleniem odpowiedzi, i płaci się za nie według stawki wyjścia. Przykładowo Gemini 3.8 Flash wygenerował 985 takich tokenów, a GLM 5.3 Flash - pełne 8000, przez co nie zostawił miejsca na właściwy artykuł i mimo to wystawił rachunek.
Podobne tematy na Promptowym
Zbudowałem test dla jedenastu modeli AI. Na jednym zadaniu test się pomylił, a modele miały rację
Który model AI pisze najlepiej po polsku? Zmierzyłem dziesięć. Zwycięzca kosztuje 32 razy mniej niż drugi zwycięzca
Dziesięć tysięcy agentów, 88 godzin, 130 miliardów tokenów. Ile kosztował dowód wart miliona dolarów
