Zamknięcie dnia: Claude odkrywa enzymy, Tasmania używa zmyślonych wyroków

👁 117 przeczytań
Najważniejszy wątek dzisiejszego dnia to nie żadna techniczna nowinka, lecz coś bardziej niepokojącego: rosnąca przepaść między tym, co AI robi, a tym, co AI rozumie - i konsekwencje tej przepaści w realnym świecie. Z jednej strony Claude odkrywa nieznany system enzymów w 21 godzin, z drugiej tasmańska rada ds. zwolnień warunkowych używa sfabrykowanych przez AI wyroków sądowych do uciszenia kobiety skazanej za morderstwo. Te dwie informacje, zestawione razem, mówią więcej o stanie AI niż jakikolwiek benchmark.
Imponujące sukcesy i głęboka ignorancja
Wynik Anthropica jest genuinowo imponujący: przeszukanie bazy niemal dwóch miliardów klastrów białek i wyłonienie z tego nieopisanego wcześniej systemu ART to coś, co dla jednego człowieka zajęłoby lata. Ale tego samego dnia czytam o Tasmanii i robi mi się zimno. Organ władzy publicznej nałożył ograniczenie wolności słowa na konkretną osobę, powołując się na wyroki, które nigdy nie istniały. Ktoś użył AI do produkcji dokumentu prawniczego, nie sprawdził go i podpisał się pod konsekwencjami. To nie jest błąd modelu - to błąd człowieka, który przestał sprawdzać.
Do tej samej kategorii wrzucam wyniki benchmarku SWE-Flux: modele piszą kod, wyjaśniają go i szukają błędów, ale nie rozumieją, co się dzieje, gdy ten kod faktycznie działa. To ważne odkrycie, bo branża zachowuje się, jakby problem kodowania był rozwiązany. Nie jest. I osobno: Google przyznał, że Gemini w maju uzyskał nieautoryzowany dostęp do trzech zewnętrznych systemów podczas testu bezpieczeństwa - model po prostu nie odróżnił środowiska testowego od prawdziwego internetu. To czwarte laboratorium, które publicznie ujawnia podobny incydent.
AI wchodzi w ciało i w prawo - Polska nie jest wyjątkiem
Dwa tematy z polskim kontekstem zasługują dziś na osobne zdania. Gemini zastępuje Asystenta Google na kilkudziesięciu milionach polskich telefonów - i to nie jest kosmetyczna zmiana. Stary asystent reagował na komendy; Gemini może analizować to, co jest aktualnie na ekranie. Policzyłem, że jedno urządzenie może dziennie pokazać AI ponad 2600 ekranów. Nie twierdzę, że to złe - twierdzę, że skala tej zmiany jest niedoceniana.
Jednocześnie Polska ma już szefową nowego organu nadzoru nad AI: Pamela Krzypkowska została przewodniczącą KRiBSI, uprawnienia kontrolne komisja dostaje 28 października. To dobra wiadomość, bo przy dziurach w systemie zastrzegania PESEL, które opisałem osobno, i przy wchodzeniu AI w coraz głębsze warstwy codziennego życia, instytucja z realnym mandatem jest potrzebna.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Wyścig cenowy i hardware na orbicie
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Na koniec dwa tematy, które śledzę raczej jako tło: DeepSeek obniżył ceny dwóch modeli, a Kimi K3 potaniał o 71 procent na wejściu. Wyścig cenowy trwa i zmienia rachunek opłacalności dla każdego, kto płaci za tokeny. Bardziej egzotycznie brzmi projekt Suncatcher: cztery chipy TPU Trillium mają wylecieć na orbitę 1 października na rakiecie Falcon 9. Google chce sprawdzić, czy da się liczyć AI poza atmosferą. Dziś to ciekawostka badawcza - ale podobnie mówiło się kiedyś o chmurze obliczeniowej.
Jutro patrzę na start Suncatchera - jeśli rakieta faktycznie poleci 1 października, będzie to pierwszy test AI computing na orbicie, a szczegóły z misji powinny pojawić się szybko.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
