› W piątek 25 września OpenAI uruchomiło osobną stronę poświęconą raportom o niezgodności zachowań modeli - po angielsku misalignment reports.
› Na start znalazło się tam dziewięć opisanych zdarzeń, w większości z okresu treningu przez uczenie ze wzmocnieniem.
› TechCrunch opisał to jako alarmujące ze względu na rozpiętość - zarówno typów zachowań, jak i okresu, z którego pochodzą.Zrobiłem to, czego w opisach tej publikacji zabrakło: rozłożyłem dziewięć przypadków na kategorie i policzyłem, ile z nich dotyczy sytuacji, w której model działał jako agent, czyli wykonywał ciąg czynności bez człowieka zatwierdzającego każdy krok.
› Wyszło sześć na dziewięć, czyli 66,7 procent.