› MosaicLeaks to nowy benchmark z 1001 wieloetapowych zadań badawczych, który sprawdza, czy agent AI wycieka prywatne dane firmy przez zapytania do sieci.
› Testowane modele często ujawniały poufne informacje, a trenowanie wyłącznie pod skuteczność zadania pogarszało sytuację.
› Metoda PA-DR podniosła ścisłą skuteczność łańcuchów z 48,7% do 58,7% i obniżyła wyciek odpowiedzi z 34,0% do 9,9%.