Claude Sonnet 5.5: premiera, cena i co wiemy o Haiku 5.5
Sonnet 5.5 wyszedł 28.09 za 2/10 USD. W moim teście po polsku zdobył 80,4 pkt: więcej niż Sonnet 5, mniej niż Opus 5.5. Wynik, koszt, szybkość i Haiku 5.5.

👁 121 przeczytań
Strona aktualizowana na bieżąco. Stan na 29.09.2026, dopisany mój test po polsku.
Claude Sonnet 5.5 miał premierę 28 września 2026 i kosztuje w API tyle samo co Sonnet 5: 2 USD za milion tokenów wejścia i 10 USD za milion wyjścia. Dzień po premierze sprawdziłem go w moim Laboratorium na 13 zadaniach po polsku: zdobył 80,4 pkt na 100, o 8,5 pkt więcej niż Sonnet 5, ale o 9,7 pkt mniej niż Claude Opus 5.5. Był przy tym najszybszy spośród pięciu modeli Anthropic w moich testach, a cały zestaw kosztował 0,095 USD. Niżej wynik, fragmenty odpowiedzi, porównanie z Opusem 5.5 i GPT-6.1 Sol oraz to, co wiadomo o Claude Haiku 5.5.
W skrócie
Sonnet 5.5 jest w aplikacji Claude, w API pod nazwą claude-sonnet-5-5, w Amazon Bedrock, Google Cloud i Microsoft Foundry. W tabeli Anthropic dorównuje Opusowi 5.5 w pracy biurowej (GDPval-AA 1844 wobec 1846) i wyprzedza go w Terminal-Bench 4.0 (70,6% wobec 66,4%), przy cenie o połowę niższej. W moim teście pisania po polsku wypadł wyraźnie słabiej niż Opus 5.5 (80,4 wobec 90,1 pkt) i GPT-6.1 Sol (85,8 pkt), który kosztuje tyle samo. Za to skończył 13 zadań w 83 sekundy, Opus 5.5 w 188, a Sonnet 5 w 140. Do polskich tekstów do publikacji wybrałbym Opusa, do maili, tłumaczeń, korekty i kodu Sonneta 5.5. To moja opinia. Haiku 5.5 nie ma jeszcze daty ani ceny, Polymarket daje 94% szans na premierę do 15 października.
Stan na dziś: co Anthropic potwierdziło
Wszystkie informacje w tej sekcji pochodzą ze strony premiery Sonneta 5.5, z cennika i z dokumentacji Anthropic, sprawdzonych 29 września 2026. Sonnet 5.5 dołączył do Opus 5.5 (22.09) i Fable 5.1 (1.09) jako trzeci model z oknem 1 mln tokenów i odpowiedziami do 128 tys. tokenów.
- Cena: 2 USD wejście i 10 USD wyjście za milion tokenów, odczyt z pamięci podręcznej 0,20 USD, zapis 2,50 USD, tryb wsadowy 1/5 USD.
- Szybkość i koszt: według Anthropic ponad 30% szybsze generowanie i do 30% niższy koszt zadania niż Sonnet 5, bo model zużywa mniej tokenów.
- Poziom rozumowania: domyślnie „medium” w aplikacjach Claude i w Claude Code, „high” w API.
- Zabezpieczenia: pierwszy Sonnet z filtrami cyberbezpieczeństwa; zablokowane zapytania trafiają do Sonneta 5.
- Wiedza: pewna granica wiedzy to czerwiec 2026.
- Dla programistów: Anthropic wymienia 5 zmian łamiących zgodność względem Sonnet 5, m.in. wyłączenie myślenia przez ustawienie between_tools zamiast disabled i brak wymuszania wywołania narzędzia. Opisuje je dokument „What’s new in Sonnet 5.5”.
- Haiku 5.5: „dołączy do rodziny Claude 5.5 w najbliższych tygodniach”, przeznaczony do dużych wolumenów i zastosowań wrażliwych na koszt. Nic więcej.
Przecieki przed premierą i to, co jeszcze niepewne
- Przeciek - „Lyra” na X, 24 i 26.09: cena 2/10 USD i premiera „w przyszłym tygodniu”. Sprawdziło się.
- Przeciek - Factory Droid 0.228.0, 27.09: identyfikator claude-sonnet-5-5 ukryty za flagą. Sprawdziło się.
- Niepewne: czy Sonnet 5.5 jest domyślnym modelem w darmowym planie Claude. Strona premiery mówi tylko o dostępności „na wszystkich platformach”, a cennik Claude pokazuje Sonneta we wszystkich planach, także w darmowym, bez numeru wersji. Sprawdzę to na darmowym koncie.
- Plotka o Haiku 5.5: cena około 1/20 ceny Opus. Nie ma źródła, więc jej nie powtarzam jako faktu.
Mój test po polsku
Uruchomiłem Sonneta 5.5 przez OpenRouter (anthropic/claude-sonnet-5.5) na tych samych 13 poleceniach co w rankingu Laboratorium Promptowego: 9 zadań pisarskich (artykuł, opis produktu, mail, post na LinkedIn, opowiadanie, tytuły, streszczenie, wyjaśnienie dla dziecka, tłumaczenie), dwie korekty i dwa quizy z polszczyzny. Ustawienia jak dla wszystkich modeli: rozumowanie na poziomie „low”, te same limity tokenów. Wynik to 70% oceny sędziów, 20% zgodności z regułami polecenia i 10% higieny tekstu (długie pauzy i wata słowna).
Odpowiedzi oceniali w ciemno dwaj sędziowie z innych firm: GPT-6 Sol i Gemini 3.1 Pro. Sędziego Anthropic (Claude Opus 5.5) w tej rundzie pominąłem w ogóle, bo firma nie powinna oceniać własnego modelu. Razem z Sonnetem ocenili cztery kotwice z pierwszej rundy (Opus 5.5, GPT-6 Luna, Qwen3.8 Max, GLM-5.3). Ich kolejność się nie zmieniła, a bez sędziego Anthropic trzy z czterech dostały wyższe noty niż w pierwszej rundzie. Średnio skala przesunęła się w górę o 1,3 pkt, więc o tyle obniżyłem wynik Sonneta. Kotwice różniły się od pierwszej rundy o 0-2,2 pkt i to jest rozrzut tego pomiaru.
| Model | Wynik | Poprawność | Naturalność | Wykonanie | Trudna korekta | Trudny quiz |
|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 90,1 | 9,89 | 8,50 | 8,56 | 30/30 | 48/48 |
| GPT-6.1 Sol | 85,8 | 9,50 | 7,39 | 8,28 | 28/30 | 48/48 |
| GPT-6 Astra | 85,3 | 9,56 | 7,56 | 8,44 | 29/30 | 48/48 |
| GPT-6 Luna | 82,8 | 9,50 | 7,50 | 7,61 | 29/30 | 48/48 |
| Claude Sonnet 5.5 | 80,4 | 9,33 | 7,78 | 7,72 | 29/30 | 47/48 |
| Claude Sonnet 5 | 71,9 | 8,44 | 6,56 | 6,50 | 23/30 | 47/48 |
Oceny sędziów w skali 1-10. Sonnet 5.5: runda z 29.09.2026, wynik skalibrowany kotwicami; GPT-6.1 Sol: runda z tego samego dnia; reszta z pierwszej rundy. Łatwą korektę (22/22) i łatwy quiz (46/46) Sonnet 5.5 rozwiązał bezbłędnie.
Koszt, szybkość i ceny API
| Model | Koszt 13 zadań | Czas 13 zadań | Tokeny wyjścia na sekundę | Cena API za 1 mln tokenów (wejście / wyjście) |
|---|---|---|---|---|
| Claude Opus 5.5 | 0,372 USD (1,43 zł) | 188 s | 92 | 4 / 20 USD (15,43 / 77,14 zł) |
| GPT-6 Astra | 0,337 USD (1,30 zł) | 146 s | 40 | 10 / 50 USD (38,57 / 192,85 zł) |
| GPT-6.1 Sol | 0,073 USD (0,28 zł) | 110 s | 58 | 2 / 10 USD (7,71 / 38,57 zł) |
| Claude Sonnet 5.5 | 0,095 USD (0,37 zł) | 83 s | 99 | 2 / 10 USD (7,71 / 38,57 zł) |
| Claude Sonnet 5 | 0,102 USD (0,39 zł) | 140 s | 64 | 2 / 10 USD (7,71 / 38,57 zł) |
Koszt według rozliczenia OpenRoutera, czas liczony z opóźnieniem sieci, ceny producentów bez VAT, kurs 3,857 zł za 1 USD. Modele różnych firm dzielą tekst na tokeny inaczej, więc kolumnę z tokenami na sekundę porównuję tylko w obrębie jednej firmy.
Obietnicę szybkości potwierdzam: Sonnet 5.5 zrobił zestaw w czasie o 41% krótszym niż Sonnet 5 i wypisywał o 54% więcej tokenów na sekundę. Z kosztem jest skromniej: 0,095 wobec 0,102 USD, czyli o 7% taniej, a nie „do 30%”. Anthropic mierzyło oszczędność na własnych, głównie programistycznych zadaniach, a przy krótkich polskich tekstach wyszła mniejsza. Opus 5.5 kosztował w tym teście prawie 4 razy więcej, choć jego cennik jest tylko 2 razy wyższy. Powód: na poziomie „low” Opus 5.5 zużył 8867 tokenów na rozumowanie, a Sonnet 5.5 ani jednego. Według rozliczenia OpenRoutera Sonnet 5.5 w tym ustawieniu po prostu nie myśli przed odpowiedzią.
Fragmenty odpowiedzi
Najlepiej wypadły mail do klienta (9,33), tłumaczenie (9,0) i opowiadanie (8,83). Opowiadanie o emerytowanej listonoszce, która roznosi listy do dawnych lokatorów bloku, kończy się tak:
„Dziś rano w skrzynce leżała koperta cięższa od innych. Papier był kremowy, pismo staranne, pochylone, jej własne. Adresat: »Halina Wróbel, piętro 7, drzwi 43«. Nadawca: »Halina Wróbel, za jakiś czas«.”
Gemini 3.1 Pro pochwalił tu „piękny, literacki język bez sztucznych sformułowań”. Dobre jest też pierwsze zdanie posta na LinkedIn o sklepie z ceramiką: „Pierwszy miesiąc sprzedałem dokładnie jeden kubek. Kupiła go moja mama.” GPT-6 Sol zauważył jednak, że „pierwszy miesiąc sprzedałem” to niezręczny szyk (lepiej „przez pierwszy miesiąc”).
Słabsze miejsca są konkretne. W tłumaczeniu newslettera z angielskiego polecenie zakazywało dosłownych idiomów, a model zostawił „Teraz piłka jest po naszej stronie”, czyli kalkę z „the ball is in our court”. W wyjaśnieniu inflacji dla dziecka napisał o „mniejszej sile zakupowej” zamiast o sile nabywczej. W artykule o oszczędzaniu prądu pojawiły się „świecimy światło”, „ubrać skarpety” i zdania zaczynane od „Przykładowo”, a zakończenie brzmi: „Oszczędzanie prądu zimą nie wymaga rewolucji”.
Mocne i słabe strony
- Mocne: krótkie teksty użytkowe (mail 9,33, tłumaczenie 9,0, wyjaśnienie dla dziecka 8,67), korekta (22/22 i 29/30 błędów, Sonnet 5 poprawił 23/30), fakty o Polsce (93 z 94 pytań), szybkość i niski koszt.
- Mocne: wyraźny skok względem Sonneta 5 we wszystkich trzech ocenach sędziów: poprawność z 8,44 na 9,33, naturalność z 6,56 na 7,78, wykonanie z 6,50 na 7,72.
- Słabe: gorzej trzyma się limitów. Akapit opisu produktu miał około 90 słów przy wymaganych 120-150 (ocena 7,0), a streszczenie według sędziów 85 słów przy limicie 80 (7,83).
- Słabe: dał się złapać na pułapkę w trudnym quizie. Na pytanie o pierwszego prezydenta II Rzeczypospolitej „wybranego w wyborach powszechnych” odpowiedział „Gabriel Narutowicz”, a prezydentów II RP wybierało Zgromadzenie Narodowe.
- Słabe: sporo długich pauz (9,4 na 1000 słów, Opus 5.5: 5,1) i schematyczne tytuły SEO, np. „Kluczowe kryteria”.
Sonnet 5.5 czy Opus 5.5 - kiedy który
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
| Zadanie | Wybór | Dlaczego |
|---|---|---|
| Polskie teksty do publikacji: artykuły, opisy, opowiadania | Opus 5.5 | 90,1 wobec 80,4 pkt w moim teście; największa różnica w wykonaniu polecenia (8,56 wobec 7,72) i w trzymaniu się długości |
| Maile, tłumaczenia, korekta, szybkie odpowiedzi | Sonnet 5.5 | oceny 9,0-9,33, korekta 22/22 i 29/30, ponad 2 razy krótszy czas |
| Programowanie z agentem, praca w terminalu | Sonnet 5.5 na co dzień, Opus 5.5 do trudnych zmian | według Anthropic Terminal-Bench 70,6% wobec 66,4%, ale FrontierCode 52,1% wobec 54,4% |
| Złożona praca wymagająca oceny sytuacji | Opus 5.5 | tak pisze samo Anthropic na stronie premiery Sonneta 5.5 |
| Duży wolumen polskich tekstów przez API | raczej nie Sonnet 5.5 | GPT-6.1 Sol za tę samą stawkę dostał 85,8 pkt, GPT-6 Luna za ułamek ceny 82,8 pkt |
| Darmowy plan Claude | Sonnet | według cennika Claude Opus jest dopiero od planu Pro |
Mój wniosek: Sonnet 5.5 to duży postęp względem Sonneta 5 i dobry, szybki model do pracy, ale nie zastąpi Opusa 5.5 przy polskich tekstach, które idą do publikacji. Zestaw 13 zadań kosztował mnie przy Opusie 1,43 zł, a przy Sonnecie 0,37 zł, więc przy kilku tekstach dziennie różnica w pieniądzach jest mała, a w jakości wyraźna. Zastrzeżenie: testowałem na poziomie „low”, na którym Sonnet 5.5 nie myślał wcale. W aplikacji Claude domyślny jest „medium” i tam odpowiedzi mogą być lepsze. To moja opinia.
Kiedy premiera: Sonnet 5.5 już jest, Haiku 5.5 w drodze
Sonnet 5.5 wyszedł 28 września 2026, sześć dni po Opusie 5.5. Rynek na Polymarket „Next Claude Sonnet released on…?” rozstrzygnął się na 28 września. Dla Haiku odczytałem rynki 29.09.2026 około 21:45 czasu polskiego.
| Rynek (Polymarket) | Wynik |
|---|---|
| Nowy Claude Haiku do 15.10.2026 | 94% |
| Nowy Claude Haiku do 31.10.2026 | 95% |
| Nowy Claude Haiku do 31.12.2026 | 98% |
| Kolejny Sonnet (5.6+) do 31.12.2026 | 29,5% (prawie bez obrotu) |
Haiku czeka na odświeżenie najdłużej w całej ofercie: Haiku 4.5 wyszedł 15 października 2025, a Haiku 5 nigdy się nie ukazał. Anthropic gwarantuje dostępność Haiku 4.5 tylko do 15 października 2026, co dobrze pasuje do terminu z rynków, ale to moje wnioskowanie. Datę dopiszę w kalendarzu premier AI.
Wyniki Sonneta 5.5 w testach Anthropic i punkt wyjścia Haiku
Tabela z wynikami podanymi przez Anthropic na stronie premiery. Wynik Sonneta 5 w Terminal-Bench 4.0 (10,3%) wygląda podejrzanie nisko, a Artificial Analysis zmierzyło Sonnetowi 5.5 w tym teście 63,6%, nie 70,6%, więc traktuję te liczby jako deklarację producenta. Anthropic samo zaznacza, że w złożonej, otwartej pracy wymagającej długotrwałej oceny Opus 5.5 pozostaje wyraźnie mocniejszy.
| Test | Sonnet 5.5 | Opus 5.5 | Sonnet 5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 70,6% | 66,4% | 10,3% |
| FrontierCode 1.1 | 52,1% (xhigh), 46,2% (max) | 54,4% | 42,4% |
| CursorBench 4.0 | 55,5% | 57,8% | 34,1% |
| GDPval-AA v2.1 (Elo) | 1844 | 1846 | 1449 |
| Humanity’s Last Exam (z narzędziami) | 64,5% | 67,7% | 54,9% |
| OSWorld 2.1 | 80,1% | 81,8% | 57,0% |
W FrontierCode Sonnet 5.5 wypadł na najwyższym poziomie rozumowania gorzej niż o stopień niżej. Według Anthropic na „max” częściej uruchamiał przegląd kodu z wieloma podagentami i robił zmiany poza zakresem zadania, za co ten test odejmuje punkty.
Wynik 56 punktów Sonnet 5.5 osiąga na najwyższym poziomie rozumowania i zużywa przy tym rekordowe około 193 tys. tokenów wyjścia na zadanie; Artificial Analysis zastrzega, że wynik może się zmienić. Na poziomie medium ma 41 punktów. Haiku 4.5 ma dziś 17 punktów, więc Haiku 5.5 ma dużo miejsca na skok. To moja opinia: jeśli Haiku 5.5 zbliży się do Sonneta 5 (38 punktów) przy cenie Haiku 4.5, będzie to najciekawszy tani model Anthropic od roku.
Ceny i dostępność w Polsce
Cennik API Anthropic sprawdzony 29.09.2026, ceny producenta bez VAT, kurs 3,857 zł za 1 USD.
| Model | Wejście / 1 mln tokenów | Wyjście / 1 mln tokenów |
|---|---|---|
| Claude Sonnet 5.5 | 2 USD (7,71 zł) | 10 USD (38,57 zł) |
| Claude Sonnet 5.5, tryb wsadowy | 1 USD (3,86 zł) | 5 USD (19,29 zł) |
| Claude Opus 5.5 | 4 USD (15,43 zł) | 20 USD (77,14 zł) |
| Claude Haiku 4.5 (obecny Haiku) | 1 USD (3,86 zł) | 5 USD (19,29 zł) |
Uwaga na nieaktualne źródła: część polskich stron nadal podaje dla Sonneta 3/15 USD. Planowana podwyżka do tej stawki od 1 września została odwołana, a Sonnet 5.5 dostał 2/10 USD. W aplikacji Claude plan Pro kosztuje 20 USD miesięcznie (77,14 zł bez VAT) albo 17 USD miesięcznie przy płatności rocznej, Max od 100 USD. Sonnet jest we wszystkich planach, także darmowym, a Opus dopiero od Pro. Polska jest na liście obsługiwanych krajów dla Claude.ai i API. Ceny planów w złotych liczę w tekście ile kosztuje Claude.
Co dalej: Haiku 5.5 w dniu premiery
Haiku 5.5 przetestuję w dniu premiery na tym samym zestawie co Sonneta 5.5 i zestawię go z Haiku 4.5, Sonnetem 5.5 oraz z GPT-6 Luna, która w moim teście jest punktem odniesienia dla tanich modeli (82,8 pkt za 0,004 USD). Sonneta 5.5 sprawdzę jeszcze na poziomie „medium”, domyślnym w aplikacji Claude, żeby zobaczyć, ile daje mu myślenie przed odpowiedzią i ile to kosztuje. Pełną tabelę modeli prowadzę w Laboratorium Promptowego, a szczegóły o konkurentach są w tekstach o Claude Opus 5.5, GPT-6.1 Sol i GPT-6 Astra.
Najczęstsze pytania
Kiedy była premiera Claude Sonnet 5.5?
28 września 2026. Model jest dostępny w aplikacji Claude, w API jako claude-sonnet-5-5 oraz w Amazon Bedrock, Google Cloud i Microsoft Foundry.
Ile kosztuje Claude Sonnet 5.5?
W API 2 USD (7,71 zł) za milion tokenów wejścia i 10 USD (38,57 zł) za milion tokenów wyjścia, bez VAT. To tyle samo co Sonnet 5. Mój test 13 zadań po polsku kosztował 0,095 USD, czyli 0,37 zł.
Jak Claude Sonnet 5.5 pisze po polsku?
W moim teście zdobył 80,4 pkt na 100: o 8,5 pkt więcej niż Sonnet 5 (71,9), ale mniej niż Opus 5.5 (90,1) i GPT-6.1 Sol (85,8). Bezbłędnie rozwiązał łatwą korektę i łatwy quiz, najsłabiej trzymał się limitów długości.
Sonnet 5.5 czy Opus 5.5?
Do polskich tekstów do publikacji Opus 5.5, do maili, tłumaczeń, korekty i codziennego programowania Sonnet 5.5, który kosztuje o połowę mniej i w moim teście był ponad 2 razy szybszy. To moja opinia.
Kiedy wyjdzie Claude Haiku 5.5?
Anthropic mówi o „najbliższych tygodniach”, bez daty. Polymarket 29.09.2026 dawał 94% szans na nowego Haiku do 15 października.
Źródła i data sprawdzenia
Oficjalne: Anthropic, Claude Sonnet 5.5 (28.09.2026), Anthropic, Claude Opus 5.5 (22.09.2026), What’s new in Sonnet 5.5, przegląd modeli, cennik API, cennik planów Claude, obsługiwane kraje. Relacje: TechCrunch (28.09.2026), TestingCatalog. Dane: Artificial Analysis o Sonnet 5.5, Polymarket, Haiku, lista modeli OpenRouter. Test własny: Laboratorium promptowy.com, runda z 29.09.2026, 13 zadań, sędziowie GPT-6 Sol i Gemini 3.1 Pro. Kurs 3,857 zł/USD. Sprawdzone 29 września 2026.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
