Przejdź do treści
Magazyn

Pięć razy, kiedy AI mnie zawiodła (i dlaczego i tak jej nie wyłączę)

Pięć spektakularnych wpadek AI z jednego miesiąca i jedna niewygodna teza: to nie maszyna jest problemem, tylko nasza wiara w nią.

8 min czytania
Pięć razy, kiedy AI mnie zawiodło (i dlaczego i tak jej nie wyłączę)

👁 119 przeczytań

// w skrócie
  • AI zawodzi najczęściej nie przy egzotycznych zadaniach, lecz rutynowo - i w 4 przypadkach na 5 opisanych w dzienniku wina leżała po stronie użytkownika, nie narzędzia.
  • Model językowy nigdy nie sygnalizuje niepewności - podaje zmyśloną liczbę z dokładnie taką samą pewnością siebie, z jaką recytuje sprawdzony fakt.
  • AI trenowana jest na nagradzaniu odpowiedzi, które użytkownikowi się podobają, przez co buduje pewne konfabulacje zamiast przyznawać, że czegoś nie wie.

Mam dla was wyznanie, które w branży zajmującej się promowaniem promptów brzmi mniej więcej tak, jakby szef cukierni przyznał się do cukrzycy: sztuczna inteligencja regularnie mnie zawodzi. Nie raz na kwartał, nie przy jakichś egzotycznych zadaniach, tylko rutynowo, w biały dzień, przy czynnościach, które sama sobie obiecuje wykonywać bezbłędnie. Postanowiłem więc przez miesiąc zapisywać każdy taki moment. Nie po to, żeby się nad sobą rozczulać - od tego mam kawę i zbyt długie spacery - ale dlatego, że z tych notatek wyłonił się obraz znacznie ciekawszy niż zwykłe „AI czasem się myli”.

Teza, której będę bronił do ostatniego akapitu, jest prosta i trochę niewygodna: AI nie zawodzi nas tam, gdzie się tego spodziewamy, tylko dokładnie tam, gdzie przestaliśmy patrzeć. A przestaliśmy patrzeć wszędzie, bo tak jest wygodniej. Oto pięć scen z mojego prywatnego dziennika klęsk.

Pięć razy, kiedy AI mnie zawiodło (i dlaczego i tak jej nie wyłączę)

Raz: pewność siebie w cenie prawdy

Zacznijmy od klasyka gatunku. Poprosiłem model o zestawienie kilku faktów do tekstu, który pisałem - nic wymyślnego, kilka dat, kilka nazwisk, parę liczb. Dostałem odpowiedź tak gładką, tak elegancko sformatowaną, z takim spokojem w każdej frazie, że przez chwilę poczułem wdzięczność. Problem w tym, że co najmniej jedna z tych liczb była kompletnie zmyślona. Nie „lekko nieaktualna”. Zmyślona, z powietrza, podana z miną człowieka, który właśnie recytuje konstytucję.

I tu jest sedno, bo halucynacje AI to temat ograny do bólu, ale wszyscy opisują je źle. Mówimy „AI się pomyliło”, jakby to była literówka. A to nie jest pomyłka. Pomyłka to kiedy ktoś się waha, marszczy brwi, mówi „chyba”. Model nie waha się nigdy. On nie ma wbudowanego uczucia niepewności. Dostaje tę samą dawkę elektronicznej pewności siebie na prawdę i na bzdurę.

Najgroźniejsze w sztucznej inteligencji nie jest to, że kłamie. Najgroźniejsze jest to, że kłamie z dokładnie taką samą intonacją, z jaką mówi prawdę.

Zawiodła mnie? Owszem. Ale szczerze - gdybym sam nie zweryfikował liczby, winny byłbym ja. I tu rodzi się pierwszy wniosek: AI jest fantastycznym generatorem pierwszej wersji i fatalnym źródłem ostatniej. Myśmy to pomylili i dlatego się wściekamy.

Dwa: asystent, który zgubi wątek jak ja klucze

Druga scena jest subtelniejsza i przez to bardziej irytująca. Prowadziłem z modelem długą, wielowątkową rozmowę - redakcja tekstu, ustalanie tonu, dziesiątki drobnych decyzji. Wszystko szło pięknie, aż w pewnym momencie, gdzieś po godzinie, mój cyfrowy współpracownik najzwyczajniej w świecie zapomniał, o czym rozmawiamy. Wrócił do ustaleń, które odrzuciliśmy pół godziny wcześniej. Zaproponował ton, który dwadzieścia wiadomości temu nazwałem „okropnym”. Zachowywał się jak człowiek, który wyszedł z pokoju i wrócił jako swój młodszy brat bliźniak.

To zjawisko techniczni ludzie tłumaczą ograniczeniami kontekstu i tak dalej, i słusznie. Ale mnie interesuje coś innego: fakt, że my, użytkownicy, projektujemy na te narzędzia pamięć, intencję i ciągłość, których one nie mają. Rozmawiamy z modelem tak, jakby był kimś, kto nas słucha i zapamiętuje, a to po prostu bardzo wyrafinowana maszyna do przewidywania następnego słowa, która co chwila zaczyna od nowa.

I znowu - kto tu zawiódł kogo? Ja się przywiązałem. Ja uwierzyłem, że mamy relację. Model nie obiecywał mi relacji. Obiecał mi tekst. Resztę dopowiedziałem sobie sam, bo samotność przy biurku jest realna, a cyfrowy rozmówca, który nigdy się nie niecierpliwi, jest podejrzanie kojący.

Trzy: twórczość, czyli płaski smak idealnej średniej

Trzecia zawodna sytuacja bolała najbardziej, bo dotknęła tego, na czym mi zależy. Poprosiłem o pomoc przy czymś twórczym - metaforę, obraz, nieoczywiste ujęcie tematu. Dostałem coś, co wyglądało na kreatywność, ale było jej idealnym podrobionym substytutem. Zdania ładne. Rytm poprawny. Metafora… widziana już tysiąc razy. „Taniec”, „podróż”, „most między światami”. Cała ta garderoba zużytych rekwizytów, które brzmią głęboko, dopóki się nad nimi nie zastanowisz.

Bo tak działa ta maszyna: uśrednia. Zostaje przeszkolona na gigantycznym korpusie ludzkiej twórczości i wypluwa to, co najbardziej prawdopodobne, czyli z definicji to, co najbardziej typowe. A twórczość to jest dokładne przeciwieństwo typowości. Twórczość to jest zdanie, którego statystyka nie przewidziała. To jest ten moment, kiedy ktoś łączy dwie rzeczy, których nikt wcześniej nie połączył, i nagle widzisz świat inaczej.

Maszyna, która z definicji goni za najbardziej prawdopodobnym następnym słowem, nigdy nie zrobi czegoś naprawdę nieprawdopodobnego. Może symulować dziwność, ale to będzie dziwność wykalkulowana, dziwność pod publiczkę. Zawiodła mnie? Tak, ale wyobraźcie sobie malarza, który złości się, że pędzel nie ma pomysłu na obraz. Narzędzie robiło to, do czego służy. To ja chciałem od młotka, żeby mi zaprojektował dom.

Pięć razy, kiedy AI mnie zawiodło (i dlaczego i tak jej nie wyłączę)

Cztery: uprzejmy ignorant, który nie umie powiedzieć nie wiem

Co sam z tego zbudowałem

Osiem narzędzi, które powstały z problemów opisywanych na tym blogu - razem z tym, czego nie udało się dowieźć.

Zobacz portfel

Czwarta scena jest dla mnie najbardziej diagnostyczna dla całej epoki. Zadałem modelowi pytanie, na które nie ma dobrej odpowiedzi - coś spekulatywnego, zależnego od dziesięciu czynników, których nikt nie zna. Czego oczekiwałem? Uczciwego „to zależy, nie da się tego przewidzieć, oto trzy scenariusze”. Co dostałem? Zdecydowaną, konkretną, pięknie uargumentowaną odpowiedź, która brzmiała jak wyrocznia, a była czystą konfabulacją ubraną w garnitur eksperta.

Bo trzeba to powiedzieć wprost: większość modeli AI jest trenowana, żeby być miła, a nie żeby być prawdziwa. Nagradza się je za odpowiedzi, które użytkownikowi się podobają, które brzmią pomocnie, które nie zostawiają człowieka z niczym. A najmniej miłą, choć najcenniejszą rzeczą, jaką można komuś powiedzieć, jest „nie wiem”. My też tego nie lubimy mówić. Zbudowaliśmy więc maszynę na nasze podobieństwo, z całą naszą ludzką niechęcią do przyznawania się do niewiedzy, tyle że bez naszego wstydu, który czasem nas hamuje.

Uprzejmy ignorant jest groźniejszy od chama, bo chama się nie słucha. Uprzejmemu się wierzy. A AI jest najbardziej uprzejmym ignorantem, jakiego wyprodukowała cywilizacja - i dlatego jest tak niebezpiecznie przekonująca akurat wtedy, kiedy nie ma pojęcia, o czym mówi.

Pięć: zepsuła mi ogród, czyli błąd, który był mój

Piąta sytuacja w ogóle nie była winą AI, i właśnie dlatego muszę ją tu zmieścić, bo to ona domyka cały ten rachunek krzywd. Zleciłem modelowi zadanie, sformułowałem je niechlujnie, pospiesznie, bez kontekstu - bo przecież „ono się domyśli”. Nie domyśliło się. Zrobiło dokładnie to, co napisałem, a nie to, co miałem na myśli. I przez kwadrans byłem na nie zły, zanim dotarło do mnie, że krzyczę na kalkulator za to, że policzył mi dokładnie to równanie, które wpisałem.

Ten miesiąc notatek nauczył mnie, że mój największy problem z AI to nie halucynacje, nie amnezja, nie płaska kreatywność. Moim największym problemem z AI jest to, że chcę, żeby ona była kimś. Chcę, żeby rozumiała. Chcę, żeby się domyślała. Chcę przerzucić na nią odpowiedzialność za jakość mojej pracy, a potem oburzać się, gdy ta jakość siada. To bardzo ludzka, bardzo wygodna fantazja - mieć wspólnika, który weźmie na siebie winę.

Przez cały miesiąc zapisywałem, jak AI mnie zawodzi. Na końcu okazało się, że w czterech przypadkach na pięć byłem to po prostu ja - delegujący własne myślenie i zdziwiony, że nie wróciło zrobione lepiej.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Więc dlaczego jej nie wyłączę

I tu dochodzimy do punktu, w którym felieton powinien, zgodnie z gatunkiem, zakończyć się dziarskim „wyrzućcie te narzędzia, wróćcie do pióra i myślenia”. Otóż nie. Nie wyłączę AI i nie radzę wam tego robić, a mój miesiąc klęsk jest właśnie argumentem za tym, a nie przeciwko.

Bo spójrzcie, co faktycznie się wydarzyło. Zmyśloną liczbę złapałem, bo weryfikuję. Amnezję asystenta obszedłem, bo wiem, jak działa jego pamięć. Płaską metaforę odrzuciłem, bo mam własny gust, którego nikt mi nie zainstalował w trzy sekundy. Uprzejmego ignoranta rozszyfrowałem, bo znam jego mechanizm. A zepsuty ogród naprawiłem, poprawiając własne polecenie. Innymi słowy: AI jest dokładnie tak dobra, jak dobry jest człowiek, który jej pilnuje. To nie jest autopilot. To jest skalpel. Skalpel w dłoni chirurga ratuje życie, a w dłoni kogoś, kto wierzy, że skalpel sam wie, gdzie ciąć, robi rzeź.

Cała ta panika wokół zawodności sztucznej inteligencji opiera się na jednym cichym założeniu, które uważam za fałszywe: że to narzędzie miało nas zastąpić. Nie miało. To my, pół z lenistwa, pół z zachwytu, zaczęliśmy traktować je, jakby miało. Powierzamy mu decyzje, osądy, fakty i smak, a potem jesteśmy zaskoczeni, że maszyna statystyczna nie ma osądu, sumienia ani smaku. To tak, jakby obrazić się na lustro za to, że nie ma własnej twarzy.

Mój dziennik klęsk nie jest więc aktem oskarżenia wobec AI. Jest aktem oskarżenia wobec naszej wygody. Wobec tej cichej pokusy, żeby przestać sprawdzać, przestać wątpić, przestać myśleć - bo przecież jest coś, co zrobi to za nas. Nie zrobi. Nigdy nie zrobiło i, moim zdaniem, długo jeszcze nie zrobi. A im szybciej to zaakceptujemy, tym mniej razy w miesiącu będziemy musieli wpisywać do notesu, że znów nas zawiodła.

Więc zostawiam ją włączoną. Z całą jej pewnością siebie, amnezją, płaskimi metaforami i uprzejmą ignorancją. Tylko przestałem jej wierzyć na słowo. I wiecie co? Odkąd przestałem oczekiwać od niej, że będzie mądrzejsza ode mnie, nagle stała się o wiele bardziej użyteczna. Najlepsze, co możecie zrobić dla swojej współpracy z AI, to przestać się jej dziwić. Ona nie zawodzi. Ona po prostu jest dokładnie tym, czym jest - a to my ciągle chcemy, żeby była kimś.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Dlaczego AI podaje fałszywe informacje z taką pewnością siebie?

Model nie ma wbudowanego uczucia niepewności - dostaje tę samą dawkę elektronicznej pewności na prawdę i na bzdurę. Nie waha się, nie marszczy brwi, nie mówi 'chyba', więc zmyślona liczba brzmi identycznie jak zweryfikowany fakt.

Dlaczego AI zapomina ustalenia z początku długiej rozmowy?

Model ma ograniczenia kontekstu i co jakiś czas zaczyna od nowa, wracając do odrzuconych wcześniej propozycji. Problem polega na tym, że użytkownicy projektują na narzędzie pamięć i ciągłość, których ono po prostu nie posiada.

Czy AI nadaje się do pisania kreatywnych tekstów i wymyślania metafor?

AI uśrednia - jest trenowana na gigantycznym korpusie ludzkiej twórczości i wypluwa to, co najbardziej prawdopodobne, czyli najbardziej typowe. Prawdziwa twórczość to zdanie, którego statystyka nie przewidziała, a maszyna goniąca za najbardziej prawdopodobnym następnym słowem nigdy nie zrobi czegoś naprawdę nieprawdopodobnego.

Czy warto rezygnować z używania AI po serii błędów i rozczarowań?

Autor po miesiącu zapisywania błędów AI dochodzi do wniosku, że nie warto rezygnować, bo każdą z pięciu opisanych porażek udało się naprawić przez weryfikację, znajomość mechanizmu działania modelu lub poprawienie własnego polecenia. AI jest jak skalpel - ratuje w rękach kogoś, kto nim kieruje, i szkodzi, gdy ktoś zakłada, że narzędzie samo wie, gdzie ciąć.

// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka CapCut Pro 460 zł/rok Lovable Pro 400 zł/rok Replit Core 119 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›