Czy modele AI rozumują poprawnie, ale z błędnych powodów?
Quanta Magazine opisuje naukowy pat wokół tzw. dużych modeli rozumowania - systemy AI zdobywają złote medale na olimpiadach matematycznych, a jednocześnie badania dokumentują ich systematyczne błędy i skróty myślowe.

👁 129 przeczytań
John Pavlus w Quanta Magazine z 31 lipca 2026 roku zestawia sprzeczne dowody na temat tego, czy tzw. duże modele rozumowania (LRM) naprawdę rozumują - czy tylko udają, że to robią.
Z jednej strony wyniki są imponujące. W maju 2026 model OpenAI rozwiązał za pierwszym podejściem znany otwarty problem matematyczny z dziedziny badań. Modele tej klasy zdobyły złote medale na Międzynarodowej Olimpiadzie Matematycznej - osiągnięcie, które, jak pisali Gary Marcus i Ernest Davis, „nawet bardzo odnoszący sukcesy matematycy mogą przez całe życie podkreślać w CV”. Google DeepMind wspólnie z matematykiem Terence’em Tao wykorzystały AI do ponownego odkrycia lub ulepszenia rozwiązań 67 problemów z analizy matematycznej, kombinatoryki, geometrii i teorii liczb.
Z drugiej strony badania z Apple pokazały „iluzję myślenia” i „całkowity zanik dokładności” w zaskakująco prostych warunkach. Naukowcy z Santa Fe Institute udowodnili z kolei, że LRM-y potrafią osiągać świetne wyniki na starannie zaprojektowanych testach rozumowania, stosując jedynie powierzchowne skróty - coś bliższego „gamingowi systemu” niż prawdziwemu rozumowaniu. Dokumentacja naukowych stanów awaryjnych tych modeli jest, jak ujmuje to Pavlus, wystarczająco długa, żeby użyć jej jako zjeżdżalni.
Branżowym terminem na opisanie tej niespójności jest „postrzępiona inteligencja” - gdy działa, to działa; gdy nie działa, trudno przewidzieć dlaczego.
Pavlus po 20 latach jako dziennikarz naukowy przyznaje, że to wahania wyjątkowo trudne do zinterpretowania nawet dla niego - i wprost pyta, czy AI może jednocześnie „rozumować” i nie rozumować.
To pytanie pozostaje otwarte, bo nauka nie zdążyła jeszcze za techniką.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →


