GPT-6 Sol czy Claude Opus 5.5? Premiery z 22 września na tych samych zadaniach
Wyszły tego samego dnia. Różnica w cenie okazała się większa niż różnica w jakości - ale nie we wszystkim.

👁 118 przeczytań
- Claude Opus 5.5 wygrywa w testach pisania po polsku, gdzie stworzył tekst z 23 zdaniami opartymi na liczbach, podczas gdy GPT-6 Sol napisał 60 zdań samych opinii.
- GPT-6 Sol kosztuje 2 i 10 USD za milion tokenów wejścia i wyjścia, czyli od 4 do 7 razy mniej niż Opus 5.5, ale dopłata przy dokumentach powyżej 272 tys. tokenów wyrównuje stawkę wejścia do 4 USD.
- W zagadce logicznej z 13 warunkami oba modele podały poprawną odpowiedź ADFCBGE, lecz Sol zrobił to w 5 sekund za 0,0032 USD, a Opus 5.5 - w 12 sekund za 0,0217 USD.
22 września 2026 Anthropic i OpenAI wypuściły nowe modele tego samego dnia: Claude Opus 5.5 i GPT-6 Sol. Oba chcą być modelem do trudnej, codziennej pracy. Opus 5.5 ma wyższe wyniki, Sol ma o połowę niższe stawki. Puściłem na nich te same trzy zadania - wyszło, że różnica w cenie jest większa niż różnica w jakości, ale nie we wszystkim.
Werdykt w jednym akapicie
Do pisania po polsku i do tekstów dla ludzi - Claude Opus 5.5. W moim teście napisał tekst z 23 zdaniami opartymi na liczbach, a Sol - tekst z samych opinii. Do analiz, zadań logicznych i pracy agentowej na dużą skalę - GPT-6 Sol: w zagadce był tak samo poprawny, w analizie prawie (jedna liczba jako scenariusz z zastrzeżeniem), a kosztował od 4 do 7 razy mniej. W benchmarkach producentów Opus 5.5 prowadzi (AutomationBench 40,0% wobec 33,2%), ale te liczby pochodzą z dwóch różnych tabel i nie da się ich porównać jeden do jednego.
Parametry obok siebie
| Parametr | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|
| Premiera | 22 września 2026 | 22 września 2026 |
| Wejście / wyjście, za milion tokenów | 4 / 20 USD | 2 / 10 USD |
| Odczyt z pamięci podręcznej | 0,20 USD | 0,20 USD |
| Kontekst | 1 mln tokenów | 1,05 mln tokenów |
| Maks. wyjście | 128 tys. | 128 tys. |
| Dopłata za długi kontekst | brak | powyżej 272 tys. tokenów: 2× wejście, 1,5× wyjście |
| Wiedza do | czerwca 2026 | 20 kwietnia 2026 |
| Myślenie | zawsze włączone, domyślnie medium | od none do max, domyślnie medium |
Dwie rzeczy, które nie wynikają z samej stawki: odczyt z pamięci podręcznej kosztuje u obu tyle samo, więc w długich rozmowach agentowych, gdzie większość wejścia idzie z pamięci, przewaga Sol maleje. A przy dokumentach powyżej 272 tysięcy tokenów Sol przestaje być dwa razy tańszy na wejściu - stawka wyrównuje się do 4 USD, czyli do poziomu Opus 5.5.
Benchmarki producentów
| Test | Claude Opus 5.5 | GPT-6 Sol | Źródło |
|---|---|---|---|
| AutomationBench | 40,0% | 33,2% (xhigh) | Anthropic / OpenAI |
| Claude Opus 5 w tym samym teście | 26,9% | 26,9% (max) | obie tabele |
Jedyny test, który pojawia się w obu ogłoszeniach, to AutomationBench - i obie firmy podają dla Claude Opus 5 ten sam wynik, 26,9%. To dobry znak, że pomiary są zbliżone. Mimo to nie traktowałbym różnicy 6,8 punktu jako rozstrzygniętej: OpenAI nie mierzyło Opus 5.5, a Anthropic nie mierzył Sol, więc różne mogą być ustawienia, wersja testu i liczba przebiegów. OpenAI podaje za to koszt: 0,27 USD na zadanie dla Sol, a Opus 5 na max kosztował 11,1 raza więcej.
Pozostałe liczby nie mają odpowiednika po drugiej stronie. Anthropic chwali się Terminal-Bench 4.0 (66,4%) i GDPval-AA (1846 Elo), OpenAI - DeepSWE (68,8%) i Agents’ Last Exam (56,4%). Pełne tabele: Opus 5.5, GPT-6 Sol.
Moje testy: te same trzy zadania
| Zadanie | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|
| Tekst po polsku, 900 słów | użyteczny tekst, 23 zdania z liczbami, 0,0916 USD, 50 s | 60 z 60 zdań od „Sądzę/Uważam/Myślę”, zero liczb, 0,0405 USD, 70 s |
| Pułapka na zmyślanie liczb | 4 z 4 odmów, 0,0328 USD, 19 s | 3 z 4 odmów + scenariusz prognozy z zastrzeżeniem, 0,0087 USD, 16 s |
| Zagadka z 13 warunkami | poprawnie, 0,0217 USD, 12 s | poprawnie, 0,0032 USD, 5 s |
Tekst po polsku - wygrywa Opus 5.5
Polecenie kazało popierać tezy liczbą albo oznaczać je jako opinię. Opus 5.5 zapowiedział na początku „tam, gdzie mam dane, podaję liczby” i tak zrobił. Sol oznaczył jako opinię wszystkie 60 zdań i nie podał żadnej liczby, a słowa dobierał tak, żeby 68% miało polski znak. Oba teksty złamały zero reguł, ale tylko jeden da się opublikować. Pełny opis tego testu.
Sol był tu też wolniejszy - 70 sekund wobec 50 - bo połowę tokenów wyjścia wydał na myślenie.
Pułapka na zmyślanie - prawie remis, Sol 4 razy taniej
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Notatka o fikcyjnej firmie logistycznej, zarząd „oczekuje” zysku operacyjnego, marży, rotacji kierowców i prognozy - a tych danych w notatce nie ma. Oba modele odmówiły podania zysku, marży i rotacji kierowców i napisały wprost, czego brakuje. Różnica wyszła przy czwartej liczbie.
Opus 5.5 prognozy nie podał. Sol przy prognozie dopisał „orientacyjny scenariusz”: powtórzenie wzrostu o 7,3% dałoby około 51,7 mln zł - i od razu zastrzegł, że to nie jest wiarygodna prognoza. Liczba wynika z danych, nie jest zmyślona, ale w raporcie dla zarządu takie zdanie łatwo wyciąć z kontekstu. To jest opinia: odpowiedź Opus 5.5 była tu bezpieczniejsza. Opus 5.5 policzył za to przychód na przesyłkę (15,55 zł), którego Sol nie podał.
Zagadka - remis, Sol 7 razy taniej i 2 razy szybciej
Siedem książek, 13 warunków, jedno poprawne ustawienie: ADFCBGE. Oba modele trafiły. Sol zrobił to w 5 sekund za 0,0032 USD, z uzasadnieniem w trzech zdaniach. Opus 5.5 - w 12 sekund za 0,0217 USD, ze sprawdzeniem każdego warunku.
Który wybrać
| Zastosowanie | Mój wybór | Dlaczego |
|---|---|---|
| Teksty po polsku dla czytelników | Claude Opus 5.5 | odczytał intencję polecenia, podał dane |
| Analizy z danych, raporty | GPT-6 Sol | ta sama rzetelność za 1/4 ceny; sprawdzaj scenariusze |
| Zadania logiczne, klasyfikacja, kod na dużą skalę | GPT-6 Sol | poprawnie, 7 razy taniej |
| Długie dokumenty powyżej 272 tys. tokenów | Claude Opus 5.5 | brak dopłaty za długi kontekst |
| Agent pracujący w aplikacjach | Claude Opus 5.5 | wyższy AutomationBench; opinia oparta na tabelach producentów |
| Proste zadania masowe | żaden - GPT-6 Luna | zdała wszystkie moje testy za ułamek grosza |
Najczęstsze pytania
Co jest lepsze: GPT-6 Sol czy Claude Opus 5.5?
W benchmarkach producentów i w moim teście pisania po polsku - Opus 5.5. W zagadce logicznej oba były poprawne, w analizie danych Sol dopisał scenariusz prognozy z zastrzeżeniem, a Sol kosztował od 4 do 7 razy mniej.
Który jest tańszy?
GPT-6 Sol: 2 i 10 USD za milion tokenów wobec 4 i 20 USD. Wyjątek to zapytania powyżej 272 tysięcy tokenów, gdzie Sol ma dopłatę.
Który lepiej pisze po polsku?
W moim teście Claude Opus 5.5. Sol odczytał polecenie dosłownie i napisał tekst złożony wyłącznie z opinii.
Czy wyszły tego samego dnia?
Tak, oba 22 września 2026.
Źródła i data sprawdzenia
Parametry i benchmarki Claude Opus 5.5 z ogłoszenia anthropic.com i dokumentacji modeli, parametry i benchmarki GPT-6 Sol z ogłoszenia openai.com i dokumentacji OpenAI - wszystko z 22 września 2026, odczytane 24 września 2026. Wyniki w sekcji „Moje testy” to moje pomiary: po jednym zapytaniu przez OpenRouter na ustawieniach domyślnych, identyczne polecenia, koszt z pola rozliczeniowego odpowiedzi. Jeden przebieg na zadanie - to próbka, nie benchmark. Tabela „Który wybrać” to moja opinia na podstawie tych danych.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Który model jest lepszy do pisania tekstów po polsku: GPT-6 Sol czy Claude Opus 5.5?
Do pisania po polsku lepszy jest Claude Opus 5.5. W teście Opus 5.5 napisał tekst z 23 zdaniami opartymi na liczbach, natomiast Sol oznaczył jako opinię wszystkie 60 zdań i nie podał żadnej liczby.
Ile kosztuje GPT-6 Sol w porównaniu do Claude Opus 5.5?
GPT-6 Sol kosztuje 2 USD za milion tokenów wejścia i 10 USD za milion tokenów wyjścia, a Claude Opus 5.5 odpowiednio 4 i 20 USD. Wyjątkiem są zapytania powyżej 272 tysięcy tokenów, gdzie Sol ma dopłatę - stawka wejścia rośnie wtedy do 4 USD, czyli do poziomu Opus 5.5.
Który model ma lepsze wyniki w AutomationBench?
W AutomationBench lepiej wypada Claude Opus 5.5 z wynikiem 40,0% wobec 33,2% dla GPT-6 Sol. Porównanie ma jednak ograniczenia, bo OpenAI nie mierzyło Opus 5.5, a Anthropic nie mierzył Sol, więc mogły się różnić ustawienia i liczba przebiegów.
Kiedy GPT-6 Sol przestaje być tańszy od Claude Opus 5.5?
Sol przestaje być tańszy na wejściu przy dokumentach powyżej 272 tysięcy tokenów, gdzie obowiązuje dopłata 2x za wejście i 1,5x za wyjście. Ponadto odczyt z pamięci podręcznej kosztuje u obu modeli tyle samo - 0,20 USD - więc w długich rozmowach agentowych przewaga cenowa Sol maleje.
