Deepfake polityczny w Polsce, którego wszyscy się boją i który już tu jest
Polski deepfake polityczny nie przyjdzie jako spektakularna bomba - działa już teraz, po cichu, i groźniejszy jest w formie taniej niż w perfekcyjnej.

👁 143 przeczytań
- Deepfake polityczny w Polsce już istnieje w formie sklonowanych głosów polityków w scamach i przerobionych fragmentów wywiadów, choć nie jako spektakularne nagranie zmieniające wynik wyborów.
- Skuteczna fałszywka nie musi być technicznie doskonała - wystarczy sklonować głos z 3 minut nagrań, bo syntetyczny polski głos nie budzi alarmu dzięki przyzwyczajeniu do lektorów i infolinii.
- Polski cynizm wyborczy chroni przed pojedynczym deepfake'em, ale jednocześnie otwiera drogę dla strategii erozji zaufania, w której dziesiątki tanich materiałów w zamkniętych grupach budują nastrój bez jednej dużej afery.
Wyobraźmy sobie noc przed drugą turą wyborów. Na Telegramie i w prywatnych grupach na Facebooku zaczyna krążyć nagranie: znany polityk, kiepskie światło jak z hotelowego korytarza, mówi coś, czego nigdy nie powiedział. Głos się zgadza, mimika prawie się zgadza, tło jest bez zarzutu. Do rana obejrzy to milion ludzi. Do południa sztab wyda oświadczenie, że to fałszywka. A do wieczora - i to jest cała pointa - nie będzie to już miało żadnego znaczenia, bo połowa oglądających i tak „zawsze wiedziała, że on taki jest”.
Tej sceny jeszcze w Polsce nie było w skali, która zmieniłaby wynik. Ale nie dlatego, że jest niemożliwa. Jest niemożliwa dokładnie tak, jak niemożliwy był smartfon w kieszeni każdego dziecka - czyli wcale, tylko jeszcze nie teraz. Pytanie brzmi nie „czy”, lecz „w jakiej formie” - i tu większość debaty myli się od pierwszego zdania.

Dlaczego czekamy na złego deepfake’a, a dostaniemy głupiego
W wyobraźni opinii publicznej deepfake to arcydzieło - nagranie tak doskonałe, że nikt nie odróżni go od prawdy. To wizja rodem z filmu szpiegowskiego i właśnie dlatego jest myląca. Doskonała podróbka jest droga, ryzykowna i łatwa do zdemaskowania przez ekspertów, bo im więcej pikseli, tym więcej śladów. Prawdziwa broń jest inna: tania, brzydka i wystarczająco dobra, żeby zadziałać na kogoś, kto ogląda telefon w tramwaju przez dziesięć sekund.
Nie potrzeba zsyntetyzować całej twarzy premiera w 4K. Wystarczy sklonować głos z trzech minut jego wystąpień - a tych w sieci są setki godzin - i podłożyć go pod czarny ekran, „przeciek nagrania z zamkniętego spotkania”. Wystarczy wziąć autentyczne wideo i zmienić w nim tylko jedno zdanie. Wystarczy dorobić do prawdziwego zdjęcia fałszywy podpis. To już nie jest science fiction, to jest weekendowy projekt kogoś, kto obejrzał parę poradników.
Polska ma tu swoją specyfikę, która działa na korzyść oszusta. Nasz język jest dla globalnych modeli generatywnych mniej „wygładzony” niż angielski, więc syntetyczny polski głos bywa lekko sztuczny - ale my jesteśmy do sztucznego polskiego przyzwyczajeni z lektorów, automatów i infolinii. Metaliczna intonacja nie budzi u nas takiego alarmu, jak powinna. Paradoksalnie gorsza jakość syntezy w naszym języku nie chroni nas, tylko nas usypia.
Kto miałby to zrobić i po co
Analiza zagrożenia zaczyna się od pytania o interesy, bo technologia sama z siebie nikogo nie skrzywdzi. Trzeba spytać: komu to się opłaca i co ryzykuje.
Pierwszy gracz to obcy aktor państwowy. Tu motyw jest oczywisty i dobrze udokumentowany w innych krajach: nie chodzi o to, żebyśmy uwierzyli w konkretne kłamstwo, tylko żebyśmy przestali wierzyć w cokolwiek. Deepfake jest dla takiego gracza narzędziem drugorzędnym - ważniejszy jest efekt tła, w którym każde prawdziwe nagranie da się podważyć zdaniem „przecież dziś wszystko można podrobić”. To jest znacznie groźniejsze niż jakikolwiek pojedynczy fałszywy klip.
Największym zagrożeniem nie jest to, że uwierzymy w fałszywe nagranie. Największym zagrożeniem jest to, że przestaniemy wierzyć w prawdziwe - bo skoro wszystko może być podróbką, to nic już niczego nie dowodzi.
Drugi gracz to krajowy sztab albo powiązana z nim „niezależna” grupa, której nikt oficjalnie nie zlecił niczego. Tu ryzyko jest ogromne - w polskiej polityce udowodniona fałszywka mogłaby zatopić kampanię skuteczniej niż jakiekolwiek nagranie. Dlatego poważny sztab tego nie zrobi wprost. Zrobi coś subtelniejszego: puści materiał na granicy, „satyryczny”, „przecież każdy widzi, że to żart”, a potem będzie się cieszyć, że skojarzenie już zostało zaszczepione. Prawo tego nie łapie, bo formalnie to parodia.
Trzeci gracz, najbardziej lekceważony, to zwykły oszust - ten sam, który dziś podkłada twarz celebryty pod reklamę inwestycji w krypto. Dla niego polityk to po prostu rozpoznawalna twarz o wysokim CTR. Jeżeli twarz ministra sprzeda kredyt frankowy albo cudowny suplement, to mamy deepfake polityczny bez jednej gramowej motywacji politycznej. I to jest w Polsce zjawisko, które dzieje się teraz, na masową skalę, a my traktujemy je jako drobne oszustwo reklamowe, a nie jako to, czym naprawdę jest - normalizacją podrobionego wizerunku publicznego.

Czego naprawdę trzeba, żeby to zadziałało
Tu dochodzimy do najważniejszego rozłożenia problemu na części. Deepfake polityczny nie jest problemem technologicznym. Jest problemem dystrybucji i podatności odbiorcy. Samo nagranie to może pięć procent całej operacji.
Żeby fałszywka zmieniła cokolwiek, musi spełnić trzy warunki naraz. Musi potwierdzać coś, w co ludzie już chcą wierzyć - nikt nie uwierzy w nagranie sprzeczne z jego światopoglądem, a każdy chętnie uwierzy w takie, które go utwierdza. Musi trafić w odpowiedni moment - najlepiej w ciszy wyborczej albo tuż przed nią, kiedy zdementowanie nie zdąży dogonić kłamstwa. I musi mieć kanał, który omija moderację - czyli zamknięte grupy, komunikatory, prywatne czaty rodzinne, gdzie nie dociera żaden fact-checker i żaden algorytm platformy.
Zauważcie, że dwa z tych trzech warunków nie mają nic wspólnego z jakością obrazu. Dlatego uparte szukanie artefaktów, liczenie mrugnięć oka i analiza cieni - cała ta higiena, której nas uczą - jest w praktyce bezużyteczna wobec kogoś, kto już chce w to wierzyć. On nie liczy pikseli. On dostaje potwierdzenie i idzie dalej.
To prowadzi do niewygodnego wniosku. Możemy mieć najlepsze detektory deepfake’ów na świecie, a i tak przegramy, bo detektor działa w laboratorium, a nagranie działa w emocji. Zanim ekspertyza wróci z werdyktem „fałszywka”, nagranie zdąży zrobić swoje. W polityce liczy się pierwsze wrażenie, a sprostowanie to zawsze druga liga uwagi.
Polska scena: gorzej i lepiej zarazem
Co sam z tego zbudowałem
Osiem narzędzi, które powstały z problemów opisywanych na tym blogu - razem z tym, czego nie udało się dowieźć.
Jest kilka powodów, dla których jesteśmy bardziej narażeni niż zachodnia Europa. Mamy bardzo wysoką temperaturę polityczną i głęboki podział, w którym obie strony są gotowe uwierzyć w najgorsze o przeciwniku. To idealne paliwo dla dezinformacji - grunt jest tak przygotowany, że nasiono kiełkuje samo. Mamy też ogromny ruch w zamkniętych kanałach i rozbudowaną kulturę przesyłania sobie „sensacji” w rodzinnych grupach, gdzie nikt niczego nie weryfikuje.
Ale jest i druga strona. Polski wyborca jest, wbrew stereotypom, dosyć odporny na pojedynczy szok - bo żyje w permanentnym szoku medialnym od lat. Trudno nas zaskoczyć jednym nagraniem, bo widzieliśmy już wszystko, przywykliśmy do afer i przecieków, wyrobiliśmy sobie gruby cynizm. To nas paradoksalnie chroni przed spektakularną bombą, ale zupełnie nie chroni przed powolnym zatruwaniem - bo ten sam cynizm, który mówi „nie dam się nabrać na jedno wideo”, mówi też „i tak nic nie jest prawdą”.
I tu jest polski paradoks w pełnej krasie: nasz cynizm jest jednocześnie tarczą przeciw pojedynczemu deepfake’owi i otwartą bramą dla całej strategii podważania rzeczywistości. Odbijemy jeden cios, ale przegramy wojnę na wyczerpanie zaufania.
Prawo, które biegnie kilka lat za technologią
Formalnie nie jesteśmy bezbronni. Jest zniesławienie, jest ochrona wizerunku, jest kodeks wyborczy z trybem, który pozwala szybko reagować na nieprawdziwe informacje w kampanii, są unijne regulacje wymuszające oznaczanie treści generowanych sztucznie. Na papierze wygląda to przyzwoicie.
W praktyce każdy z tych mechanizmów przegrywa z prędkością. Tryb wyborczy działa w dobę - to szybko jak na sąd, a wolno jak na internet, gdzie doba to wieczność. Obowiązek oznaczania treści AI dotyczy uczciwych, a nieuczciwy z definicji się nim nie przejmie - kto puszcza fałszywkę z zamiarem oszustwa, nie doda grzecznie znaczka „wygenerowano cyfrowo”. Prawo łapie tych, którzy i tak działają w dobrej wierze, i mija się z tymi, którzy działają w złej. To jest strukturalna słabość, nie chwilowa luka.
Nie mówię, że regulacje są bezużyteczne - są potrzebne jako ramy i jako sygnał. Ale kto myśli, że przepis nas ochroni, ten nie rozumie, że deepfake to nie jest problem, który się „zabrania”. To jest problem, z którym się żyje, jak z pogodą.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Więc kiedy i czy w ogóle
Wróćmy do pytania z tytułu, bo obiecałem wyraźny wniosek, a nie mgłę.
Czy deepfake polityczny w Polsce jest możliwy? Nie tylko możliwy - on już tu jest i działa, tyle że nie w formie, na którą patrzymy. Działa jako podrobiony głos w scamie z twarzą polityka, jako przerobiony fragment prawdziwego wywiadu, jako „satyryczny” klip na granicy prawa. Czekamy na hollywoodzką bombę i dlatego nie widzimy min, na których stoimy.
Kiedy uderzy w wielkim stylu? Moja teza jest taka: nie licząc na jedno spektakularne wydarzenie, które „zmieni wybory”. To myślenie filmowe. Realny scenariusz to nie eksplozja, tylko erozja - dziesiątki drobnych, tanich, przekonujących-akurat-wystarczająco materiałów, rozproszonych po zamkniętych kanałach w ostatnich dniach kampanii, z których żaden osobno nie jest aferą, ale które razem budują nastrój. Bomba jest efektowna, ale to erozja wygrywa wybory.
Jak? Nie przez to, że uwierzymy w kłamstwo. Przez to, że stracimy zdolność rozpoznawania prawdy - bo kiedy wszystko może być fałszywe, każdy wybiera sobie tę wersję rzeczywistości, która mu pasuje, i nazywa resztę deepfakiem. To już się dzieje i nie wymaga ani jednej podróbki. Sama świadomość, że podróbki istnieją, wystarczy, żeby politycy zaczęli nazywać niewygodne, autentyczne nagrania „wygenerowanymi przez AI”. I ludzie im uwierzą, bo tak jest wygodniej.
To jest najciemniejszy punkt całej sprawy. Deepfake nie musi być dobry, żeby wygrać. Wystarczy, że w ogóle istnieje jako pojęcie - reszta jest już tylko wymówką dla tych, którzy nie chcą wierzyć własnym oczom. Broń nie leży w nagraniu. Broń leży w zdaniu „to na pewno fałszywka”, którego już nikt nie potrafi sprawdzić na czas i którego już nikt nie chce sprawdzać.
Nie bójmy się więc jednego nagrania, które wywróci Polskę. Bójmy się dnia, w którym wzruszymy ramionami na każde n
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →Najczęstsze pytania
Czy deepfake polityczny był już używany w Polsce?
Tak, działa już w formie podrobionego głosu lub wizerunku polityka w scamach reklamowych i przerobionych fragmentach wywiadów. Nie pojawił się jeszcze jako spektakularny klip zmieniający wynik wyborów, ale te mniejsze formy są traktowane jako drobne oszustwa reklamowe, choć normalizują podrabianie wizerunku publicznego.
Jak technicznie prosty jest deepfake głosu polskiego polityka?
Sklonowanie głosu wymaga zaledwie 3 minut nagrań źródłowych, a takich materiałów polskich polityków są w sieci setki godzin. Podłożenie fałszywego głosu pod czarny ekran jako rzekomego przecieku z zamkniętego spotkania to według artykułu projekt na weekendowe popołudnie po obejrzeniu poradników.
Dlaczego polskie prawo nie chroni skutecznie przed deepfake'iem wyborczym?
Tryb wyborczy pozwalający reagować na nieprawdziwe informacje działa w ciągu doby, co jest szybkie jak na sąd, ale w internecie doba to wieczność - nagranie zdąży zrobić swoje zanim wróci ekspertyza. Obowiązek oznaczania treści AI dotyczy tylko uczciwych twórców, a ten kto puszcza fałszywkę z zamiarem oszustwa, nie doda znaczka informującego o generowaniu cyfrowym.
Dlaczego deepfake polityczny jest trudny do wykrycia nawet przy niskiej jakości nagrania?
Detekcja działa w laboratorium, a nagranie działa na emocjach - odbiorca, który chce uwierzyć, nie liczy pikseli ani nie sprawdza artefaktów. Fałszywka musi spełnić trzy warunki: potwierdzać to, w co ludzie już wierzą, trafić w odpowiedni moment przed wyborami i dotrzeć zamkniętymi kanałami omijającymi moderację - z tych trzech warunków dwa nie mają nic wspólnego z jakością obrazu.



