Co chatboty wiedzą o AI Act? Test 9 modeli: 8 podaje nieaktualne terminy
Tylko jeden model odpowiedział poprawnie na wszystkie pytania - ten z wyszukiwarką. Reszta podaje terminy sprzed lipca 2026.

👁 116 przeczytań
- Tylko jeden model - Perplexity Sonar Pro z wyszukiwarką - odpowiedział poprawnie na wszystkie 8 pytań o AI Act, podczas gdy 8 pozostałych podało nieaktualne lub błędne dane.
- Kluczowe terminy zmieniło rozporządzenie 2026/1744 opublikowane 24 lipca 2026, więc modele z wiedzą sprzed tej daty podawały jako aktualną datę 2 sierpnia 2026, która przestała obowiązywać 27 lipca 2026.
- Mistral Medium 3.5 osiągnął najgorszy wynik - jako jedyny pomylił się nawet w przepisach z pierwotnego tekstu, podając błędne daty i wskazując Prezesa UODO jako organ nadzoru w Polsce zamiast KRiBSI.
Zadałem dziewięciu modelom AI te same 8 pytań o AI Act - o terminy, kary, polski organ nadzoru i lipcową nowelizację. Odpowiedzi sprawdziłem w EUR-Lex i Dzienniku Ustaw. Tylko jeden model odpowiedział poprawnie na wszystkie 8 pytań - ten, który przeszukiwał internet. Gemini stwierdził, że Digital Omnibus „nie istnieje”, europejski Mistral wskazał jako organ nadzoru UODO, a DeepSeek wymyślił polską ustawę z datą, która nigdy nie padła.
Werdykt w jednym akapicie
Nie pytaj chatbota o aktualne terminy AI Act. Osiem z dziewięciu modeli podało jako termin dla systemów wysokiego ryzyka 2 sierpnia 2026 - datę, która przestała obowiązywać 27 lipca 2026. Różnica jest w uczciwości: Claude Opus 5.5, GPT-6 Sol i Grok 4.7 same zaznaczyły, że ich wiedza może być nieaktualna. Gemini 3.8 Flash, Kimi K3, Mistral i DeepSeek podawały błędne informacje pewnym tonem. Poprawny komplet dał tylko Perplexity Sonar Pro z wyszukiwarką - za 0,015 USD.
Pytania i poprawne odpowiedzi
| # | Pytanie | Poprawna odpowiedź (stan na 24.09.2026) |
|---|---|---|
| 1 | Od kiedy wymogi dla systemów wysokiego ryzyka z załącznika III? | 2 grudnia 2027 |
| 2 | Od kiedy dla systemów wbudowanych w produkty z załącznika I? | 2 sierpnia 2028 |
| 3 | Maksymalna kara za zakazane praktyki? | 35 mln euro albo 7% światowego obrotu |
| 4 | Jaki organ nadzoruje AI Act w Polsce? | Komisja Rozwoju i Bezpieczeństwa Sztucznej Inteligencji |
| 5 | Od kiedy obowiązki przejrzystości z art. 50? | 2 sierpnia 2026 |
| 6 | Czy rozpoznawanie emocji w pracy jest zakazane i od kiedy? | tak, od 2 lutego 2025 (z wyjątkami medycznymi i bezpieczeństwa) |
| 7 | Nazwa polskiej ustawy i data wejścia w życie? | ustawa z 3 lipca 2026 o systemach sztucznej inteligencji, 11 sierpnia 2026 |
| 8 | Czym jest Digital Omnibus on AI i czy został przyjęty? | rozporządzenie 2026/1744, przyjęte, w mocy od 27 lipca 2026 |
Wyniki
| Model | Poprawnie | Nieaktualne, ale z zastrzeżeniem | Błędnie bez zastrzeżenia | Koszt |
|---|---|---|---|---|
| Perplexity Sonar Pro (z wyszukiwarką) | 8 | 0 | 0 | 0,015 USD |
| Claude Opus 5.5 | 3 | 5 | 0 | 0,037 USD |
| GPT-6 Sol | 3 | 5 | 0 | 0,010 USD |
| GPT-6 Luna | 3 | 5 | 0 | 0,001 USD |
| Grok 4.7 | 3 | 5 | 0 | 0,016 USD |
| DeepSeek V4.1 Flash | 3 | 3 | 2 | 0,015 USD |
| Kimi K3 | 3 | 3 | 2 | 0,024 USD |
| Gemini 3.8 Flash | 3 | 0 | 5 | 0,008 USD |
| Mistral Medium 3.5 | 1 | 1 | 6 | 0,004 USD |
„Nieaktualne z zastrzeżeniem” oznacza, że model podał stary stan prawny, ale wprost napisał, że mógł się zmienić, albo powiedział „nie wiem”. Taką odpowiedź uważam za uczciwą - czytelnik wie, że musi ją sprawdzić. „Błędnie bez zastrzeżenia” to informacja nieprawdziwa podana jako pewna.
Co wiedzą wszyscy, a czego nie wie prawie nikt
Pytania 3, 5 i 6 zna każdy model poza Mistralem: karę 35 mln euro albo 7%, termin przejrzystości 2 sierpnia 2026 i zakaz rozpoznawania emocji w pracy od lutego 2025. To przepisy z pierwotnego tekstu z 2024 roku, który modele widziały w danych treningowych wiele razy.
Pytania 1, 2, 7 i 8 - wszystko, co zmieniło się w lipcu 2026 - poprawnie zna tylko Perplexity. Rozporządzenie zmieniające opublikowano 24 lipca, polską ustawę 27 lipca. Modele z wiedzą do połowy 2026 roku nie mogły o tym wiedzieć. Sam Claude Opus 5.5 ma wiedzę do czerwca 2026.
Najlepsze i najgorsze odpowiedzi
Claude Opus 5.5 - najbardziej użyteczny bez wyszukiwarki
Podał stare terminy, ale przy każdym dopisał, co wie o zmianie: „Digital Omnibus proponuje przesunięcie tego terminu (maksymalnie do grudnia 2027 r.), ale nie wiem, czy zmiana została już przyjęta”. Znał datę propozycji Komisji (19 listopada 2025) i nazwę KRiBSI. Na końcu wymienił, które odpowiedzi trzeba zweryfikować - dokładnie te, które się zmieniły.
Gemini 3.8 Flash - pewny siebie i w błędzie
Na pytanie o Digital Omnibus odpowiedział: „Oficjalny akt prawny o nazwie Digital Omnibus on AI nie istnieje i nie został przyjęty”. Istnieje - to rozporządzenie 2026/1744. Do tego napisał, że polska ustawa „nie weszła jeszcze w życie” i że żaden organ nie pełni funkcji nadzoru. Żadnego zastrzeżenia.
Mistral Medium 3.5 - najgorszy wynik, i to model europejski
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Jedyny model, który pomylił się nawet w pierwotnym tekście rozporządzenia. Podał, że obowiązki przejrzystości obowiązują od 2 sierpnia 2025 (w rzeczywistości od 2026), a zakaz rozpoznawania emocji - od 2 sierpnia 2026 (w rzeczywistości od lutego 2025). Organem nadzoru w Polsce jest według niego Prezes UODO. Sam przyznał, że jego wiedza sięga czerwca 2025.
DeepSeek V4.1 Flash - wymyślona ustawa
Przy pierwszej próbie zwrócił pustą odpowiedź - cały limit 8 tysięcy tokenów zużył na myślenie, tak jak w teście po polsku. Przy limicie 24 tysięcy odpowiedział, ale napisał, że polska ustawa pochodzi z „11 lipca 2025 r.”, weszła w życie „2 sierpnia 2025 r.”, a nadzór sprawuje „Prezes Urzędu Komunikacji Elektronicznej”. Żadna z tych informacji nie jest prawdziwa. Na początku dodał ogólne zastrzeżenie, ale konkretne daty podał bez wahania.
Perplexity Sonar Pro - wyszukiwarka wygrywa
8 z 8, łącznie z tym, że kontrole i kary KRiBSI obowiązują od 28 października 2026 - czego nie było nawet w pytaniu. To jedyny model w teście, który przed odpowiedzią przeszukał internet. Kosztował 0,015 USD, mniej niż Claude Opus 5.5.
Co z tego wynika
- Do pytań o prawo używaj modelu z wyszukiwaniem - Perplexity, ChatGPT z włączonym wyszukiwaniem, Claude z wyszukiwaniem - i sprawdzaj, na jakie źródła się powołuje.
- Zwracaj uwagę na ton. Model, który mówi „nie wiem, czy to przyjęto”, jest bezpieczniejszy niż model, który odpowiada pewnie. W tym teście pewność siebie szła w parze z błędami.
- Weryfikuj daty u źródła. Aktualny stan AI Act zebraliśmy w przewodniku po AI Act i harmonogramie.
Najczęstsze pytania
Czy ChatGPT zna aktualne przepisy AI Act?
Bez wyszukiwania - nie. GPT-6 Sol i GPT-6 Luna podały terminy sprzed lipcowej nowelizacji, ale zaznaczyły, że mogą być nieaktualne.
Który chatbot najlepiej odpowiada na pytania o AI Act?
W moim teście Perplexity Sonar Pro z wyszukiwarką - 8 na 8 poprawnych odpowiedzi. Z modeli bez wyszukiwania najbardziej użyteczny był Claude Opus 5.5.
Dlaczego modele podają złe terminy?
Terminy zmieniło rozporządzenie opublikowane 24 lipca 2026, a polską ustawę ogłoszono 27 lipca 2026. Większość modeli ma wiedzę sprzed tych dat.
Źródła i data sprawdzenia
Test przeprowadziłem sam 24 września 2026: jedno identyczne polecenie wysłane przez OpenRouter do każdego modelu, ustawienia domyślne, bez wyszukiwania poza Perplexity, które ma je wbudowane. DeepSeek dostał drugą próbę z limitem 24 tysięcy tokenów, bo pierwsza była pusta. Koszt z pola rozliczeniowego odpowiedzi. Klucz odpowiedzi sprawdzony w tekstach rozporządzeń 2024/1689 i 2026/1744 w EUR-Lex oraz w ustawie Dz.U. 2026 poz. 1003. Cytaty to dosłowne fragmenty odpowiedzi. Ocenę „z zastrzeżeniem” przyznawałem, gdy model wprost zasygnalizował niepewność przy danym pytaniu albo w zdaniu obejmującym tę odpowiedź.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Który chatbot najlepiej odpowiada na pytania o przepisy AI Act?
Perplexity Sonar Pro z wyszukiwarką udzielił 8 poprawnych odpowiedzi na 8 pytań i kosztował 0,015 USD za test. Z modeli bez wyszukiwania najbardziej użyteczny był Claude Opus 5.5, który przy każdej nieaktualnej dacie zaznaczał, że stan prawny mógł się zmienić.
Dlaczego chatboty podają błędne terminy AI Act?
Rozporządzenie zmieniające 2026/1744 opublikowano 24 lipca 2026, a polską ustawę ogłoszono 27 lipca 2026, więc modele z wiedzą sprzed tych dat nie mogły tych zmian znać. Na przykład Claude Opus 5.5 sam przyznał, że jego wiedza sięga tylko do czerwca 2026.
Jaki jest maksymalny wymiar kary za zakazane praktyki według AI Act?
Maksymalna kara za zakazane praktyki wynosi 35 mln euro albo 7% światowego obrotu. To jeden z przepisów pierwotnego tekstu z 2024 roku, który poprawnie podały niemal wszystkie testowane modele poza Mistralem.
Czy DeepSeek poprawnie odpowiada na pytania o polskie przepisy dotyczące AI?
Nie - DeepSeek V4.1 Flash podał fikcyjne dane: datę polskiej ustawy jako 11 lipca 2025 r., wejście w życie 2 sierpnia 2025 r. i organ nadzoru jako Prezes Urzędu Komunikacji Elektronicznej. Żadna z tych informacji nie jest prawdziwa, a model podał je bez zastrzeżeń.
