AI detector i wykrywacz AI: co naprawdę oznacza wynik
Wykrywacz AI nie dowodzi autorstwa. Sprawdź obsługę polskiego, znaczenie procentów i rachunek pokazujący, skąd biorą się fałszywe alarmy.
👁 113 przeczytań
AI detector, czyli wykrywacz AI, analizuje cechy tekstu i ocenia, czy przypomina on treść wygenerowaną przez model. Nie odczytuje historii pisania, więc sam wynik nie dowodzi, że autor użył ChatGPT ani że złamał zasady.
Sprawdziłem dokumentację producentów dotyczącą języków, interpretacji wyników i błędów. Nie przeprowadziłem tu własnego porównania skuteczności detektorów na polskim korpusie. Podane dalej obliczenie jest jawnym przykładem statystycznym, a nie wynikiem testu konkretnego produktu.
Wykrywacz tekstu AI nie zastępuje dowodów
Detektor klasyfikuje tekst na podstawie wzorców poznanych podczas treningu. Może oznaczyć pracę człowieka jako wygenerowaną albo przeoczyć tekst AI. Takie pomyłki opisuje sam GPTZero w wyjaśnieniu działania detektorów. Dostawca zaleca traktowanie wyniku jako jednego z sygnałów do sprawdzenia.
Historia wersji dokumentu, notatki autora i źródła pokazują coś innego niż statystyczna klasyfikacja stylu. Pozwalają prześledzić pracę. Jeśli oceniasz tekst ucznia, pracownika albo zleceniobiorcy, najpierw ustal zasady: korekta językowa, tłumaczenie i wygenerowanie całości to różne czynności. Jeden wskaźnik nie rozstrzyga, która miała miejsce.
Detektor AI po polsku musi obsługiwać polski tekst
Polska wersja strony nie oznacza, że model detektora został przygotowany do polszczyzny. Dokumentacja Copyleaks wymienia polski z kodem pl na liście obsługiwanych języków. To potwierdzenie zakresu funkcji, nie dowód określonej skuteczności na polskich esejach, mailach czy tekstach reklamowych.
W instrukcji raportu Turnitin sprawdzonej 9 września 2026 r. wskazano angielski, hiszpański, japoński i arabski. Polski nie znajduje się na tej liście. Nie należy mylić obsługi języków przez system porównywania podobieństwa z obsługą przez jego wykrywacz AI.
| Co sprawdzasz | Jakiego dowodu szukasz | Czego to jeszcze nie dowodzi |
|---|---|---|
| Obsługa polskiego | Listy języków konkretnego detektora | Skuteczności na twoim typie tekstu |
| Wskaźnik wyniku | Definicji procentu w dokumentacji | Pewności autorstwa |
| Skuteczność | Opisu zbioru testowego i błędów | Identycznych wyników na nowych modelach |
Mały odsetek błędów może dać dużo fałszywych alarmów
Policzyłem przykład, który pokazuje wpływ proporcji tekstów. Załóżmy zbiór 1000 prac: 10 wygenerowanych i 990 napisanych przez ludzi. Wyobraźmy sobie, że detektor poprawnie oznaczył 9 prac AI, ale dodatkowo oznaczył 10 prac ludzkich. Wszystkie te liczby są założeniami ćwiczenia.
Na ekranie zobaczysz 19 alarmów. Dziesięć z nich jest błędnych, więc 10 ÷ 19 × 100 daje około 53% fałszywych alarmów wśród oznaczonych prac. Jednocześnie błędnie oznaczono tylko 10 ÷ 990, czyli około 1% wszystkich prac ludzkich. Te dwa procenty odpowiadają na różne pytania.
Wniosek z rachunku jest ograniczony, ale przydatny: niski odsetek fałszywych trafień wśród tekstów ludzkich nie oznacza, że każdy alarm jest niemal pewny. Trzeba znać także proporcje w badanej grupie. Nie przenoszę tego wyniku na szkoły ani na konkretną usługę bez danych o rzeczywistych pracach.
Procent przy wyniku trzeba najpierw zdefiniować
W Turnitin wskaźnik dotyczy części kwalifikującego się tekstu uznanej za potencjalnie wygenerowaną. Nie jest po prostu prawdopodobieństwem, że osoba oszukiwała. Dokumentacja opisuje też ograniczenia przy niskich wskazaniach i zasady wyświetlania wyniku. Inny produkt może używać innej definicji procentu.
Dlatego nie uśredniam wyników różnych detektorów. Jeżeli jedna aplikacja pokazuje udział tekstu, a druga własną ocenę klasyfikacji, średnia z tych liczb nie ma jasnego znaczenia. Zapisuję nazwę narzędzia, datę, język, długość materiału i opis wskaźnika. Bez tych informacji zrzut ekranu z czerwonym procentem niewiele wyjaśnia.
Gdzie wykrywacz AI zawodzi w ocenie autora
Nie ma dostępu do procesu, jeśli dostarczono mu wyłącznie tekst końcowy. Nie zobaczy, czy autor długo poprawiał akapit, korzystał z tłumacza albo redagował cudzy szkic. Nie wywnioskuje też zasad obowiązujących przy zadaniu. Może dostarczyć klasyfikację, ale ocenę zgodności z zasadami trzeba oprzeć na szerszym materiale.
Nie pytam samego ChatGPT „czy ty to napisałeś?” jako sposobu identyfikacji. Odpowiedź modelu na cudzy tekst nie jest dziennikiem wszystkich jego wcześniejszych rozmów. Podobnie stylistyczne cechy, takie jak regularne akapity czy ogólne wstępy, nie stanowią podpisu autora. Ocenę jakości pisania można przeprowadzić bez zgadywania jego pochodzenia.
Odróżniam też wykrywanie AI od badania zapożyczeń. Tekst wygenerowany może nie kopiować konkretnej strony, a tekst napisany przez człowieka może zawierać nieoznaczony cytat. Porównując narzędzia AI, sprawdź, jaki problem rozwiązuje dana funkcja. Sama etykieta „kontrola oryginalności” bywa zbyt szeroka.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Jak sprawdzić, czy tekst napisała AI, bez pochopnego werdyktu
Najpierw odczytaj zasady zadania i zapytaj autora o proces. Poproś o notatki, wersje robocze i źródła, jeśli taki sposób weryfikacji pasuje do sytuacji. Przeczytaj wskazane materiały, sprawdź cytaty oraz liczby. Rozmowa o konkretnym fragmencie daje więcej informacji niż ogólne oskarżenie o „styl ChatGPT”.
Jeżeli używasz detektora, sprawdź język i wymagania wejściowe, zachowaj wynik z datą i nie przesyłaj poufnego dokumentu bez sprawdzenia warunków usługi. Wątpliwości oceniaj łącznie z pozostałymi dowodami. Metodę testowania narzędzi znajdziesz w benchmarkach, a rolę polecenia dla modelu w wyjaśnieniu, czym jest prompt.
Gdy piszesz własny tekst, zachowuj szkice i wykaz źródeł. Jeśli regulamin wymaga ujawnienia użycia AI, opisz, do czego została użyta. To informacja o rzeczywistej pracy. Przepisywanie tekstu wyłącznie po to, by zmienić kolor wskaźnika, nie poprawia ani jego rzetelności, ani dokumentacji autorstwa.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Co to jest AI detector?
AI detector ocenia, czy cechy tekstu przypominają treść wygenerowaną przez model. Wynik klasyfikacji nie jest dowodem historii pisania ani tożsamości autora.
Czy wykrywacz AI jest wiarygodny?
Detektory mogą popełniać błędy w obie strony. Ich wynik trzeba rozpatrywać razem z dokumentacją narzędzia, historią pracy i innymi dowodami.
Jaki detektor AI działa po polsku?
Copyleaks wymienia język polski w dokumentacji obsługiwanych języków. Sama obsługa języka nie oznacza potwierdzonej skuteczności na każdym rodzaju polskiego tekstu.
Jak sprawdzić czy tekst napisała AI?
Sprawdź historię wersji, źródła, notatki i wyjaśnienie procesu przez autora. Detektor może dostarczyć dodatkowego sygnału, ale sam nie rozstrzyga autorstwa.
Czy Turnitin wykrywa AI po polsku?
W instrukcji raportu AI sprawdzonej 9 września 2026 r. polski nie znajduje się na liście obsługiwanych języków. Nie należy utożsamiać tej funkcji z obsługą polskiego w badaniu podobieństwa.
Czy wynik wykrywacza AI może być błędny?
Tak, ludzki tekst może zostać oznaczony jako AI, a wygenerowany może pozostać nierozpoznany. Dokumentacja detektorów opisuje fałszywie dodatnie i fałszywie ujemne wyniki.
