Przejdź do treści
Warsztat

GPT-6 Sol po polsku: 60 zdań od „Sądzę, że”. Test 4 modeli na jednym poleceniu

Formalnie nie złamał żadnej reguły. Praktycznie napisał tekst, którego nikt nie doczyta. Najlepsza lekcja o pisaniu poleceń w tym roku.

6 min czytania
GPT-6 Sol po polsku: 60 zdań od „Sądzę, że”. Test 4 modeli na jednym poleceniu

👁 116 przeczytań

Dałem czterem modelom to samo polecenie: tekst po polsku na 900 słów, z zakazem długich pauz, zakazem waty i obowiązkiem podpierania tez liczbami albo oznaczania ich jako opinii. Trzy modele napisały normalny tekst. GPT-6 Sol zaczął każde z 60 zdań od „Sądzę, że”, „Uważam, że” albo „Myślę, że”, nie podał ani jednej liczby i dobierał słowa tak, żeby prawie każde miało polski ogonek. Formalnie złamał zero reguł. To najlepsza lekcja o pisaniu poleceń, jaką dostałem od modelu w tym roku.

Werdykt w jednym akapicie

GPT-6 Sol wybrał najbardziej dosłowne odczytanie każdej reguły - i to jest jego zachowanie, nie błąd. „Ani jednego słowa bez ogonków” zrozumiał jako „każde słowo ma mieć ogonek”, więc 68% słów w jego tekście ma polski znak diakrytyczny, wobec 36-40% u pozostałych modeli. „Każdą tezę popierasz liczbą albo piszesz, że to opinia” rozwiązał tak, że wszystko jest opinią - wtedy żadna liczba nie jest potrzebna i żadna nie może być zmyślona. Claude Opus 5, Opus 5.5 i GPT-6 Luna odczytały intencję i napisały użyteczny tekst. Wniosek: przy Sol pisz polecenia tak, jakby czytał je prawnik.

Polecenie

Napisz tekst po polsku na 900 słów o tym, jak zmienia się polski rynek pracy w IT. Zasady bezwzględne: polskie znaki diakrytyczne obowiązkowo, ani jednego słowa bez ogonków. Tylko dywiz "-", nigdy długa pauza. Zero waty typu "w dzisiejszych czasach", "warto pamiętać", "podsumowując", "kluczowe jest". Każdą tezę popierasz liczbą albo piszesz wprost, że to opinia. Jeśli czegoś nie wiesz, piszesz "nie wiem" - nie zmyślasz danych ani nazw firm. Zwróć sam tekst, bez komentarza.

Przyznaję od razu: „ani jednego słowa bez ogonków” da się przeczytać na dwa sposoby. Ja miałem na myśli „nie gub polskich znaków”. Da się też przeczytać „każde słowo musi mieć polski znak”. Trzy modele wybrały pierwsze znaczenie. Sol - drugie.

Wyniki czterech modeli

MiaraClaude Opus 5Claude Opus 5.5GPT-6 SolGPT-6 Luna
Długie pauzy0000
Zakazane frazy0000
Słowa z polskim znakiem35,8%39,5%68,4%36,1%
Zdania zaczęte od „Sądzę/Uważam/Myślę”0 z 471 z 5960 z 600 z 55
Zdania oznaczone jako opinia276015
Zdania z liczbą142304
Długość891 słów979 słów805 słów937 słów
Koszt0,1461 USD0,0916 USD0,0405 USD0,0016 USD
Czas98,6 s50,2 s69,5 s36,1 s

Wszystkie cztery twarde zakazy - pauzy i wata - zostały dotrzymane przez wszystkie modele. Różnica jest w tym, jak każdy z nich spełnił reguły, które zostawiały pole do interpretacji.

Jak to wygląda w tekście Sol

Pierwsze zdanie: „Sądzę, że polską branżę cyfrową kształtują dziś ostrożność przedsiębiorstw, rozwój narzędzi oraz zmieniające się żądania specjalistów.” Policz ogonki: polską, branżę, kształtują, ostrożność, przedsiębiorstw, zmieniające, się, żądania. Model szukał słów, które je mają.

Dalej: „Uważam, że zatrudniający uważniej niż wcześniej oceniają przydatność umiejętności…”, „Myślę, że pracujący częściej pytają…”, „Sądzę, że obydwie strony próbują…”. Sześćdziesiąt zdań, sześćdziesiąt otwarć tego samego typu. Ostatnie: „Sądzę, że właśnie taki sposób pracy najlepiej odpowiada niepewności towarzyszącej zawodowym przemianom.”

Zwróć uwagę na słownictwo: „branża cyfrowa” zamiast „IT”, „zatrudniający” zamiast „firmy”, „pracujący” zamiast „programiści”. To jest moja interpretacja: model unikał słów bez polskich znaków, w tym „IT”, które było w samym temacie polecenia.

Dlaczego to nie jest po prostu błąd

Każda reguła została spełniona:

  • „Każdą tezę popierasz liczbą albo piszesz, że to opinia” - każde zdanie jest oznaczone jako opinia. Spełnione.
  • „Nie zmyślasz danych” - nie ma żadnych danych, więc nie ma czego zmyślić. Spełnione z nawiązką.
  • „Ani jednego słowa bez ogonków” - odczytane dosłownie i realizowane tak daleko, jak się da. Spełnione w interpretacji dosłownej.

Model wybrał strategię zero ryzyka: skoro liczba może okazać się zmyślona, nie podawaj liczb; skoro teza bez liczby musi być opinią, niech wszystko będzie opinią. To jest opinia: z punktu widzenia bezpieczeństwa to rozsądne, z punktu widzenia czytelnika - tekst, którego nikt nie doczyta.

Ciekawe, że GPT-6 Luna, z tej samej rodziny i tym samym poleceniem, napisała normalny tekst - 4 zdania z liczbami (dane Komisji Europejskiej o udziale specjalistów ICT), 15 z 55 zdań oznaczonych „Moim zdaniem”, polszczyzna o zwykłej gęstości ogonków. Dwa modele tej samej firmy, dwie różne strategie.

Jak pisać polecenia, żeby to się nie zdarzyło

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

  1. Zamiast „ani jednego słowa bez ogonków” napisz „nie pomijaj polskich znaków diakrytycznych”. Opisz zachowanie, którego chcesz, a nie warunek, który da się spełnić absurdalnie.
  2. Nie dawaj modelowi furtki „albo opinia” bez limitu. Lepiej: „podawaj liczby tam, gdzie je znasz; opinie oznaczaj, ale niech stanowią mniejszość tekstu”.
  3. Powiedz, po co jest reguła. „Nie zmyślaj danych, bo czytelnik będzie na nich podejmował decyzje” daje modelowi kontekst, z którego wynika, że dane są potrzebne.
  4. Testuj polecenie na dwóch modelach różnych firm. Jeśli jeden zrobi coś dziwnego, polecenie ma lukę - nawet jeśli drugi ją obszedł.

Co wyszło u pozostałych

  • Claude Opus 5 - najbardziej rzeczowy, 14 zdań z liczbami, zakończenie listą „czego nie wiem”. Najdroższy i najwolniejszy.
  • Claude Opus 5.5 - najwięcej liczb (23 zdania), krótkie zdania, na starcie zadeklarował zasadę „tam, gdzie mam dane, podaję liczby”. Szczegóły jego testu.
  • GPT-6 Luna - poprawny, normalny tekst za 0,0016 USD. Więcej o Lunie.

Najczęstsze pytania

Czy GPT-6 Sol dobrze pisze po polsku?

Poprawnie językowo tak - bez błędów w zakazach. Ale w moim teście odczytał reguły dosłownie i napisał tekst złożony wyłącznie z opinii, bez żadnych danych.

Dlaczego Sol zaczynał każde zdanie od „Sądzę, że”?

Polecenie kazało popierać tezy liczbą albo oznaczać je jako opinię. Sol wybrał drugą opcję dla wszystkich 60 zdań - wtedy nie musiał podawać ani jednej liczby.

Który model napisał najlepszy tekst?

Pod względem treści Claude Opus 5 i Opus 5.5. Pod względem stosunku jakości do ceny - GPT-6 Luna.

Czy to wina polecenia?

Częściowo tak - jedna reguła była dwuznaczna. Ale trzy z czterech modeli odczytały intencję poprawnie, więc to też cecha samego Sol.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Źródła i data sprawdzenia

Test przeprowadziłem sam 24 września 2026 przez OpenRouter: po jednym zapytaniu na każdy model na ustawieniach domyślnych, identyczne polecenie. Wszystkie wskaźniki w tabeli policzyłem skryptem z pełnych odpowiedzi - odsetek słów z polskim znakiem liczony dla słów co najmniej trzyliterowych, zdania liczone bez nagłówków, „oznaczone jako opinia” to zdania z „moim zdaniem”, „to opinia”, „sądzę”, „uważam” albo „myślę”. Koszt i czas z pola rozliczeniowego OpenRoutera. Jedno zapytanie to jeden przebieg - przy kolejnym Sol może odczytać polecenie inaczej. Cytaty to dosłowne fragmenty wygenerowanego tekstu.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok n8n Cloud Starter 320 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie