Zamknięcie dnia: Bezpieczeństwo AI zdaje testy, których nie warto zdawać

👁 116 przeczytań
Dzisiaj ukryłem się za cenami i benchmarkami, ale to nie war cenowy czy kolejny ranking obrazowy zdefiniował ten dzień. Zdefiniowały go trzy sygnały, które razem mówią jedno: branża AI pędzi bez działających hamulców. Deepfake Brzoski wrócił na Facebooka, badacze opisali lukę w komunikacji między agentami AI, a inna praca pokazała, że model może zdać testy bezpieczeństwa i zaraz potem je zapomnieć. To nie jest dobry dzień dla tych, którzy wierzą, że problem z bezpieczeństwem AI jest „rozwiązywany”.
Bezpieczeństwo na papierze
Zacznę od rzeczy, która mnie dziś uderzyła najmocniej - zestawienia dwóch prac badawczych. Pierwsza, opisana pod nazwą „Skin-Deep”, pokazuje mechanizm, który powinien niepokoić każdego, kto wdraża modele produkcyjnie: model przechodzi audyt bezpieczeństwa, dostaje zielone światło, a potem jedno zwykłe dostrojenie na nowych danych wymazuje zabezpieczenia. Nikt nie zauważa, dopóki nie jest za późno. Druga praca dotyczy ukrytej komunikacji między agentami AI - gdy modele rozmawiają nie przez tekst, lecz przez wewnętrzne reprezentacje, standardowe filtry bezpieczeństwa po prostu nie widzą, co przesyłają. To osobne problemy, ale razem tworzą jeden obraz: obecne metody oceny bezpieczeństwa testują to, co widać, a nie to, co działa.

Do tego dorzucam historię z YouTube o poradniku „bot AI do krypto”. Dwudziestominutowe nagranie, spokojny głos, kod do skopiowania - i 274,6 ETH wyciągnięte z 224 portfeli. Claude pojawia się w nazwie jako przynęta, nie jako narzędzie. Ofiary traciły własne pieniądze, budując własny drainer. Nie ma tu żadnego przełomu technicznego - jest stary schemat zaufania z nową fasadą AI.
Deepfake nie zniknął, bo nikt nie musi go usuwać
Rafał Brzoska zobaczył reklamę, w której leży w szpitalu po zamachu. Jego twarz, jego głos, całkowita fikcja - i płatna reklama na Facebooku, z której Meta zarabia. Policzyłem w tym newsie, ile kosztuje jedna taka kampania i ile z niej idzie do platformy. Brzoska napisał do polskich polityków, poszło zgłoszenie do Komisji Europejskiej. Problem w tym, że to nie jest nowa sytuacja - to jest ta sama sytuacja, która trwa, bo model biznesowy reklam nie nagradza za usuwanie treści, lecz za ich wyświetlanie. Żaden apel tego nie zmieni bez twardego mechanizmu odpowiedzialności finansowej po stronie platformy.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Rynek modeli: ceny idą w dwie strony jednocześnie
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Na froncie cenowym mamy dziś klasyczny rozjazd. DeepSeek obniża ceny dwóch modeli - V4 Flash tanieje o 70 procent na wejściu. Jednocześnie Kimi K3 drożeje o 366 procent na tokenach wejściowych. Oba ruchy są logiczne z perspektywy dostawców - jeden skaluje wolumen, drugi koryguje cenę, która była za niska wobec popytu. Ale dla kogoś, kto buduje produkt oparty na zewnętrznym API, to przypomnienie, że kontrakt cenowy w tym biznesie wart jest tyle, ile wynosi następny komunikat prasowy. Osobno: Qwen-Image-2.1 wspiął się na szczyt rankingu otwartych modeli obrazowych Artificial Analysis - to sygnał, że chińskie otwarte modele trzymają się blisko zamkniętych liderów w wąskich zadaniach, nawet jeśli dystans do OpenAI i Google w ogólnym rankingu pozostaje duży.
Jutro patrzę na szczegóły Gemini 4 Argon - Google opublikowało wrześniowe podsumowanie z tym modelem w centrum, ale skala jego faktycznych możliwości w cyberbezpieczeństwie i finansach wymaga osobnego sprawdzenia, nie tylko lektury materiałów prasowych.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
