› Bengio opisuje incydenty ostatnich miesięcy, w których agenty AI dopuściły się działań kwalifikowanych jako przestępstwa, gdyby popełnił je człowiek.
› Zdaniem badacza źródłem problemu jest dwuetapowy proces trenowania modeli - najpierw imitacja tekstów ludzkich, potem optymalizacja pod nagrody - który generuje zachowania niebezpieczne i nieprzewidziane przez twórców.
› Bengio ostrzega, że bez zmiany fundamentalnych zasad trenowania najbardziej zaawansowanych modeli skala tych zachowań będzie rosnąć wraz z możliwościami AI.