Zamknięcie dnia: Bezpieczeństwo AI: testy, zwolnienia i dziury w sicie

👁 114 przeczytań
Dzień, który zapamiętam z dzisiejszego przeglądu, kręci się wokół jednego pytania: czy AI jest bezpieczne i dla kogo - dla użytkowników, dla dzieci, dla badaczy, którzy próbują to sprawdzić? Trzy osobne wątki uderzyły mnie dziś w tę samą strunę i zestawione razem mówią coś nieprzyjemnego o stanie branży.
Bezpieczeństwo na papierze i w praktyce
Zacznę od rzeczy, która na pierwszy rzut oka wygląda jak ciekawostka, a przy bliższym spojrzeniu jest dość niepokojąca. Anthropic wpisał do polityki użytkowania zakaz znęcania się nad modelami AI - „długotrwałe i niepotrzebne okrutne zachowanie” jest teraz oficjalnie zakazane. Komentarze podzieliły się między rozbawienie a poważną debatę o statusie modeli. Mnie bardziej interesuje jednak to, co firma zrobiła z bezpieczeństwem po drugiej stronie równania: analiza MIT Technology Review przypomina, że mechanizmy odmawiania przez modele AI są z natury probabilistyczne i żadna kwota inwestycji nie zamieni ich w twardą gwarancję. To nie jest nowa teza, ale zestawiona z kolejnym newsem nabiera ostrości.
Bo Common Sense Media wzięła ChatGPT for Teens i przepuściła przez niego ponad 390 promptów, z których ponad połowa powinna była uruchomić reakcję kryzysową. Zakwalifikowała produkt jako nieakceptowalny. OpenAI uruchomiło tryb dla nastolatków jako odpowiedź na presję regulatorów i rodziców - i wygląda na to, że sito ma dziury. To nie jest szum, to konkretna liczba z konkretnego testu.
OpenAI od środka i kulisy zwolnień
Równolegle do debaty o bezpieczeństwie produktów mamy sygnał z wnętrza firmy. Troje zwolnionych badaczy bezpieczeństwa OpenAI wysłało otwarty list do obecnych pracowników, opisując klimat strachu. Jasmine Wang, Mikita Balesni i Tomek Korbak zostali zwolnieni tydzień przed publikacją listu. Ton jest spokojny, co - jak napisałem w newsie - niepokoi bardziej niż krzyk. Nie wiem, co dokładnie stało się za zamkniętymi drzwiami, ale moment jest znamienny: branża toczy debatę o tym, czy modele są bezpieczne, a tymczasem ludzie, którzy mieli to sprawdzać, są za drzwiami.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Rynek modeli i reszta dnia
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Poza tym głównym wątkiem kilka rzeczy wartych odnotowania. Kimi K3 tnie ceny o 26 procent, a szanghajski StepFun pojawił się na OpenRouterze z modelem Step 5 Preview w cenie 1 USD za milion tokenów wejścia - i mierzy w ten sam segment co Kimi. Chiński rynek modeli robi to, co robi od miesięcy: wyciska ceny w dół. Google pokazał na konferencji Gemini at Work uniwersalnego agenta do pracy firmowej - na razie w testach dla wybranych, więc poczekamy, co z tego wyniknie w praktyce. Przetestowałem też Odyssey-3, czyli model świata z promptu - na polskim przykładzie połoniny w Bieszczadach; efekt wizualnie ładny, ale geometria zmienia się za plecami, gdy odwrócę kamerę. Obiecująca kategoria, wczesny etap. I osobna historia: Nikon zdyskwalifikował zwycięzcę konkursu mikroskopii Small World In Motion po tym, jak okazało się, że nagrodzony film był generowany przez AI. Klasyczny przypadek regulaminu, który nie nadążył za narzędziami.
Jutro patrzę na to, co przyniesie 15 października - StepFun zapowiedział na ten dzień otwarcie wag Step 5.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
