› Artykuł pochodzi z arXiv (cs.CL, cs.AI, cs.HC) i został złożony 1 września 2026 roku przez Yao Liu i Yu He.
› companion agents - czyli systemów AI zaprojektowanych do towarzyszenia użytkownikowi w rozmowie - i konkretnego problemu metodologicznego w ich testowaniu.Na czym polega problemW ocenie systemów AI coraz częściej stosuje się inny model językowy jako symulowanego użytkownika - to pozwala skalować testy bez angażowania prawdziwych ludzi.
› Autorzy nazywają to podejście "teraz standardem w skalowalnej ewaluacji".
› Problem jest jednak dobrze znany i - jak piszą - "wielokrotnie diagnozowany": symulowany użytkownik jest nadmiernie kooperatywny.