› Dzisiejszy świat AI żył przede wszystkim bezpieczeństwem - zarówno technicznym, jak i bardzo ludzkim.
› Benchmarki ujawniały słabości modeli w rozumieniu sprzecznych instrukcji i emocji w głosie, podczas gdy w tle toczył się poważny spór o to, czy AI stanowi zagrożenie dla samego istnienia ludzkości.
› Do tego doszły nowe narzędzia od wielkich graczy i niepokojąca historia z sali sądowej.
› Agenty AI gubią się, gdy rozkazy się kłócą Badacze z Johns Hopkins stworzyli benchmark sprawdzający, jak agenty AI radzą sobie ze sprzecznymi instrukcjami pochodzącymi z wielu źródeł.