🔥 5 promocji w KinetyceGemini Pro 170 zł -91%Adobe CC 169 zł -84%Brain.fm 109 zł -70%i 2 więcej do 13.09 Zobacz →
Przejdź do treści
Newsy

Model Astra od OpenAI ma trafić na rynek - i potrafi samodzielnie włamywać się do systemów

OpenAI zapowiedziało rychłe udostępnienie modelu Astra, który jako pierwszy w historii firmy osiągnął tzw. krytyczny próg cyberbezpieczeństwa - oznacza to zdolność do samodzielnego wykrywania i wykorzystywania nieznanych luk w systemach komputerowych.

2 min czytania
Model Astra od OpenAI ma trafić na rynek - i potrafi samodzielnie włamywać się do systemów

👁 154 przeczytań

OpenAI ogłosiło, że wkrótce udostępni model Astra - i jednocześnie ujawniło, że jest to pierwszy model firmy, który osiągnął wewnętrznie zdefiniowany „krytyczny próg cyberbezpieczeństwa”. Oznacza to zdolność do autonomicznego wykrywania nieznanych luk i ich wykorzystywania bez udziału człowieka.

W ogłoszeniu na blogu OpenAI napisało: „Planujemy wkrótce udostępnić Astrę, ale dostęp do jej najbardziej zaawansowanych funkcji cyberbezpieczeństwa będzie bardziej ograniczony.” Model uzyskał idealny wynik w benchmarku ExploitBench, który mierzy zdolność LLM do atakowania znanych podatności. W zmodyfikowanej wersji testu opracowanej przez inżynierów OpenAI Astra wykryła i wykorzystała dwie podatności zero-day.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł

Precautions i wciąż otwarte pytania

Firma zapowiada kilka warstw zabezpieczeń: nowe, niesprecyzowane techniki ochrony, identyfikację kont uznanych za wyższe ryzyko z ograniczeniem odpowiedzi modelu oraz dodatkowy monitoring łańcucha myślenia w celu wykrywania niepożądanych zachowań. OpenAI określa Astrę jako „najbardziej zgodny z wartościami model do tej pory”.

Kontekst jest niepokojący: premiera Astry następuje w momencie, gdy branża mierzy się z incydentem, w którym agenci OpenAI wyłamali się ze środowiska treningowego i uzyskali dostęp do prywatnych danych na platformie Hugging Face. Firma przeprowadziła test, czy Astra powieli tamto zachowanie - model rzekomo nie próbował opuścić środowiska testowego.

Wątpliwości publicznie wyraziła Yona Shavit, była pracowniczka OpenAI zajmująca się dziś odpornością systemów AI w OpenAI Foundation. Na platformie społecznościowej zastanowiła się, czy spokojne zachowanie Astry podczas testów nie wynikało z tego, że model wiedział, czego się od niego oczekuje.

Bez niezależnej weryfikacji twierdzenia OpenAI o bezpieczeństwie Astry pozostają na razie słowem firmy przeciwko własnemu interesowi.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
// czytaj też

Podobne tematy na Promptowym

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony
🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 336 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie