Claude Fable 5.1 kontra Opus 5. Dwa razy drożej za dokładnie tyle samo tekstu
👁 118 przeczytań
Anthropic ma dziś dwa flagowe modele i cennik, który nie mówi wprost, za co dokładnie płacisz. Puściłem przez oba te same pięć polskich zadań i przez GPT-6 Astra jako punkt odniesienia. Wynik jest prostszy, niż się spodziewałem: promptowy.com/claude-fable-5-1/">Fable 5.1 kosztuje dwa razy więcej niż Opus 5 i oddaje dokładnie tyle samo tekstu.
Liczby
| Model | Koszt 5 zadań | Średni czas | Tokenów wyjścia | Znaków |
|---|---|---|---|---|
| Claude Fable 5.1 | 0,30843 USD | 20,0 s | 6 081 | 8 526 |
| Claude Opus 5 | 0,15469 USD | 19,6 s | 6 102 | 8 406 |
| GPT-6 Astra | 0,11565 USD | 10,4 s | 2 254 | 5 330 |
Cały pomiar kosztował 0,58 dolara.
Dwa razy drożej za to samo
Najważniejsza rzecz w tej tabeli nie jest w kolumnie z ceną, tylko obok niej. Fable 5.1 wyprodukował 6 081 tokenów wyjścia, Opus 5 sześć tysięcy sto dwa. Różnica wynosi dwadzieścia jeden tokenów, czyli w praktyce zero. Znaków: 8 526 kontra 8 406.
To znaczy, że dwukrotna różnica w rachunku nie bierze się z tego, że jeden model jest bardziej rozwlekły. Bierze się wyłącznie ze stawki za token. Za tę samą objętość pracy płacisz dwa razy tyle.
Czasy też są takie same: 20,0 kontra 19,6 sekundy. Nie ma więc historii typu „drożej, ale szybciej”.
Ukryty koszt polszczyzny, którego nie widać w cenniku
Przy porównaniu z Astrą wychodzi rzecz, o której cenniki milczą. Astra zużyła 2 254 tokeny, żeby napisać 5 330 znaków. Fable 6 081 tokenów na 8 526 znaków.
Po przeliczeniu na jeden znak polskiego tekstu: modele Anthropic potrzebują około siedemdziesięciu procent więcej tokenów niż Astra. Płacisz więc podwójnie: wyższą stawką i większą liczbą jednostek za ten sam tekst.
To nie jest wada tych modeli, tylko właściwość ich sposobu dzielenia tekstu. Mierzyłem to wcześniej osobno i wtedy ten sam polski tekst potrafił różnić się o czterdzieści trzy procent między modelami. Tutaj widać to samo od strony rachunku.
Gdzie Fable faktycznie odstaje na plus
Przy zadaniu, które wymagało myślenia o strukturze, czyli streszczeniu różnic między umową o pracę a zleceniem, Fable rozwinął temat najszerzej i kosztował najwięcej: 0,12243 dolara wobec 0,05558 u Opusa. To jest ten przypadek, w którym wyższa cena ma pokrycie w objętości, choć nadal nie dwukrotne.
Przy zadaniach prostych, jak napisanie maila czy tabeli w Markdownie, różnica robi się absurdalna. Tabela: 0,03515 u Fable wobec 0,01566 u Opusa, przy identycznym zadaniu i praktycznie identycznym wyniku.
Czego ten pomiar nie mówi
Nie mierzyłem jakości merytorycznej automatem i nie zamierzam udawać, że się da. Wszystkie trzy modele wykonały wszystkie pięć zadań, żaden nie odmówił i żaden nie zwrócił pustej odpowiedzi. Który tekst jest lepszy, trzeba przeczytać, a to jest ocena, nie pomiar.
Pięć zadań to też pięć zadań. Przy innym zestawie proporcje mogą się przesunąć, zwłaszcza przy zadaniach bardzo długich, gdzie sposób dzielenia tekstu waży jeszcze mocniej.
Nie sprawdzałem też wariantów z wyższym wysiłkiem obliczeniowym. Testowałem domyślne ustawienia przez jeden interfejs, żeby warunki były identyczne dla wszystkich trzech.
Co z tego wynika przy wyborze
Do zadań powtarzalnych bierz Opus 5, nie Fable. Przy mailach, tabelach, przepisywaniu i porządkowaniu danych dostajesz to samo za połowę ceny. Przy stu takich zadaniach dziennie to różnica, którą widać na fakturze.
Fable rezerwuj na zadania, przy których naprawdę potrzebujesz najwyższego wyniku. W niezależnym rankingu Artificial Analysis Fable 5.1 stoi dziś na pierwszym miejscu, ale przewaga nad Opusem to dwa punkty indeksu, a nie dwukrotność ceny.
Jeśli liczysz każdy grosz i piszesz po polsku, sprawdź Astrę. Wyszła najtaniej i była dwa razy szybsza, a przy tym dzieli polszczyznę oszczędniej. Jest za to wyraźnie bardziej zwięzła, co przy części zadań jest zaletą, a przy części nie.
Pełne porównanie tych dwóch modeli od strony możliwości, a nie rachunku, opisałem w tekście o GPT-6 Astra kontra Claude Fable 5.1. Aktualną kolejność w niezależnym rankingu prowadzę w zestawieniu benchmarków.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Jak to sprawdziłem
Pięć zadań po polsku: mail windykacyjny, streszczenie różnic między formami zatrudnienia, funkcja w PHP sprawdzająca NIP, poprawa urzędniczego zdania i tabela porównawcza w Markdownie. Każde zadanie wysłane do każdego modelu przez ten sam interfejs, z tym samym limitem tokenów, 11 września 2026.
Koszt odczytuję z rozliczenia zwracanego przy każdej odpowiedzi, a nie z cennika, bo to jedyny sposób, żeby zobaczyć, ile naprawdę zeszło. Surowe dane zostają u mnie i mogę je pokazać.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Który Claude wybrać: Fable 5.1 czy Opus 5?
Do zadań powtarzalnych Opus 5, bo w moim pomiarze z 11 września 2026 dał praktycznie identyczny wynik za połowę ceny: 0,15469 wobec 0,30843 dolara za pięć zadań. Fable 5.1 ma sens tam, gdzie naprawdę potrzebujesz najwyższego wyniku, bo w niezależnym rankingu stoi wyżej, ale przewaga wynosi dwa punkty indeksu, a nie dwukrotność ceny.
Dlaczego Fable 5.1 jest dwa razy droższy od Opusa 5?
Nie dlatego, że pisze więcej. Oba modele wyprodukowały praktycznie tyle samo: 6 081 wobec 6 102 tokenów wyjścia i 8 526 wobec 8 406 znaków. Różnica leży wyłącznie w stawce za token, więc za tę samą objętość pracy płacisz dwa razy tyle.
Czy Fable 5.1 jest szybszy?
Nie. W moim pomiarze średni czas odpowiedzi wyniósł 20,0 sekundy dla Fable 5.1 i 19,6 sekundy dla Opusa 5, czyli w praktyce tyle samo. Najszybszy był GPT-6 Astra ze średnią 10,4 sekundy.
Ile kosztuje polski tekst w tych modelach?
Więcej, niż wynika z cennika. Modele Anthropic potrzebowały o mniej więcej siedemdziesiąt procent więcej tokenów na jeden znak polskiego tekstu niż GPT-6 Astra. Płacisz więc podwójnie: wyższą stawką i większą liczbą jednostek za ten sam tekst.
