Claude for Startups i 100+ programów z darmowymi kredytami AI dla startupów i JDG Darmowe kredyty AI dla Twojej firmy Sprawdź, co dostaniesz
✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Newsy

Zamknięcie dnia: Bezpieczeństwo AI: testy, zwolnienia i dziury w sicie

3 min czytania
Zamknięcie dnia: Bezpieczeństwo AI: testy, zwolnienia i dziury w sicie

👁 114 przeczytań

Dzień, który zapamiętam z dzisiejszego przeglądu, kręci się wokół jednego pytania: czy AI jest bezpieczne i dla kogo - dla użytkowników, dla dzieci, dla badaczy, którzy próbują to sprawdzić? Trzy osobne wątki uderzyły mnie dziś w tę samą strunę i zestawione razem mówią coś nieprzyjemnego o stanie branży.

Bezpieczeństwo na papierze i w praktyce

Zacznę od rzeczy, która na pierwszy rzut oka wygląda jak ciekawostka, a przy bliższym spojrzeniu jest dość niepokojąca. Anthropic wpisał do polityki użytkowania zakaz znęcania się nad modelami AI - „długotrwałe i niepotrzebne okrutne zachowanie” jest teraz oficjalnie zakazane. Komentarze podzieliły się między rozbawienie a poważną debatę o statusie modeli. Mnie bardziej interesuje jednak to, co firma zrobiła z bezpieczeństwem po drugiej stronie równania: analiza MIT Technology Review przypomina, że mechanizmy odmawiania przez modele AI są z natury probabilistyczne i żadna kwota inwestycji nie zamieni ich w twardą gwarancję. To nie jest nowa teza, ale zestawiona z kolejnym newsem nabiera ostrości.

Bo Common Sense Media wzięła ChatGPT for Teens i przepuściła przez niego ponad 390 promptów, z których ponad połowa powinna była uruchomić reakcję kryzysową. Zakwalifikowała produkt jako nieakceptowalny. OpenAI uruchomiło tryb dla nastolatków jako odpowiedź na presję regulatorów i rodziców - i wygląda na to, że sito ma dziury. To nie jest szum, to konkretna liczba z konkretnego testu.

OpenAI od środka i kulisy zwolnień

Równolegle do debaty o bezpieczeństwie produktów mamy sygnał z wnętrza firmy. Troje zwolnionych badaczy bezpieczeństwa OpenAI wysłało otwarty list do obecnych pracowników, opisując klimat strachu. Jasmine Wang, Mikita Balesni i Tomek Korbak zostali zwolnieni tydzień przed publikacją listu. Ton jest spokojny, co - jak napisałem w newsie - niepokoi bardziej niż krzyk. Nie wiem, co dokładnie stało się za zamkniętymi drzwiami, ale moment jest znamienny: branża toczy debatę o tym, czy modele są bezpieczne, a tymczasem ludzie, którzy mieli to sprawdzać, są za drzwiami.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Rynek modeli i reszta dnia

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Poza tym głównym wątkiem kilka rzeczy wartych odnotowania. Kimi K3 tnie ceny o 26 procent, a szanghajski StepFun pojawił się na OpenRouterze z modelem Step 5 Preview w cenie 1 USD za milion tokenów wejścia - i mierzy w ten sam segment co Kimi. Chiński rynek modeli robi to, co robi od miesięcy: wyciska ceny w dół. Google pokazał na konferencji Gemini at Work uniwersalnego agenta do pracy firmowej - na razie w testach dla wybranych, więc poczekamy, co z tego wyniknie w praktyce. Przetestowałem też Odyssey-3, czyli model świata z promptu - na polskim przykładzie połoniny w Bieszczadach; efekt wizualnie ładny, ale geometria zmienia się za plecami, gdy odwrócę kamerę. Obiecująca kategoria, wczesny etap. I osobna historia: Nikon zdyskwalifikował zwycięzcę konkursu mikroskopii Small World In Motion po tym, jak okazało się, że nagrodzony film był generowany przez AI. Klasyczny przypadek regulaminu, który nie nadążył za narzędziami.

Jutro patrzę na to, co przyniesie 15 października - StepFun zapowiedział na ten dzień otwarcie wag Step 5.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 400 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›