Dwa najdroższe modele świata kosztują dokładnie tyle samo. To nie przypadek
GPT-6 Astra i Claude Fable 5.1 wyceniono identycznie, co do dolara, w odstępie dwóch dni. Sprawdzam, co z tego wynika dla wybierającego i dlaczego cena przestała być kryterium.
👁 129 przeczytań
Trzeciego września OpenAI wyceniło swój najmocniejszy model na 10 dolarów za milion tokenów wejścia i 50 dolarów za milion wyjścia. Dwa dni wcześniej Anthropic wydał swój najmocniejszy model w cenie 10 dolarów za milion wejścia i 50 za milion wyjścia. Nie o dolara mniej, nie o dolara więcej.
Dwie największe firmy tej branży, wypuszczając flagowe produkty w odstępie 48 godzin, wyceniły je identycznie. Warto się zastanowić, co to znaczy, bo dla osoby wybierającej narzędzie zmienia to całą kalkulację.
Cena przestała być kryterium wyboru
Jeszcze rok temu porównanie modeli zaczynało się od tabeli stawek, bo różnice bywały kilkukrotne. Teraz na najwyższej półce mamy dwa produkty w tej samej cenie i pytanie brzmi już nie „co jest tańsze”, tylko „co robi lepiej to, czego akurat potrzebuję”.
Ta zbieżność nie jest zapewne zmową, tylko naturalnym skutkiem tego, że obie firmy liczą podobne koszty i celują w tego samego klienta korporacyjnego, dla którego różnica kilku dolarów za milion tokenów jest szumem przy kosztach pracy zespołu.
Gdzie każdy z nich wygrywa
Z opublikowanych wyników rysuje się dość czytelny podział. Model OpenAI prowadzi wyraźnie w matematyce najwyższego poziomu (97,6 wobec 87,8 procent), w rozumowaniu abstrakcyjnym, w automatyzacji pracy zawodowej (41,4 wobec 31,4 punktu) i w cyberbezpieczeństwie, gdzie różnica jest największa ze wszystkich.
Model Anthropica wygrywa tam, gdzie liczy się szeroka wiedza ogólna: w teście złożonym z bardzo trudnych pytań z wielu dziedzin uzyskał 65,0 procent wobec 57,2 procent u konkurenta. Wygrywa też, co ciekawe, w teście zdrowotnym w wariancie profesjonalnym starsza wersja Claude, a nie nowsza.
Trzecia opcja, o której zapomina się przy premierach
Przy okazji takich porównań warto zadać pytanie, którego producenci nie zadają: czy w ogóle potrzebujesz najwyższej półki. Claude Opus 5 kosztuje 5 i 25 dolarów, czyli połowę, a GPT-5.6 Sol 2 i 10, czyli piątą część. W zadaniach językowych, redakcyjnych i researchowych różnicy między nimi a flagowcami zwyczajnie nie widać.
Sprawdziłem to na własnym zestawie zadań z polszczyzny przy premierze modelu Anthropica. Dwukrotnie droższy flagowiec nie tylko nie wygrał z tańszym Opusem 5, ale przy jednym z zadań w ogóle nie odpowiedział. Opis metody i wyniki są w tekście o teście z dnia premiery. Ten sam test na modelu OpenAI zrobię, gdy tylko trafi do pośredników, przez których mierzę.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Jak wybrać bez zgadywania
Zamiast czytać cudze benchmarki, weź pięć zadań, które faktycznie wykonujesz, i puść je przez oba modele, mierząc trzy rzeczy: czy wynik nadaje się do użycia bez poprawek, ile to trwało i ile kosztowało. Kwadrans pracy powie ci o twoim przypadku więcej niż wszystkie tabele razem wzięte, bo mierzy dokładnie to, za co zapłacisz.
Pełne dane obu modeli zebrałem osobno: przewodnik o GPT-6 Astra i przewodnik o Claude Fable 5.1. Bieżące stawki wszystkich śledzonych modeli, przeliczone na złotówki, aktualizuję w kalkulatorze kosztów AI.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →


